Illimité IA API : Guide de prise en main
Obtenez votre clé API et commencez à envoyer des requêtes de texte en quelques minutes. Ce guide couvre l'URL de base, l'authentification et les endpoints compatibles OpenAI standards pour notre LLM sans censure.
URL de base et authentification
Notre API est entièrement compatible avec le format du SDK OpenAI. Vous devez définir l'URL de base sur https://api.unlimitedaiapi.com/v1. Cela garantit que toutes les requêtes sont acheminées vers notre modèle sans censure dédié, et non vers un proxy ou un agrégateur. L'authentification utilise un token Bearer dans l'en-tête Authorization. Vous pouvez générer votre clé immédiatement après vous être connecté avec simplement un e-mail et un mot de passe. La clé n'est affichée qu'une seule fois après la connexion, mais vous pouvez la régénérer à tout moment, ce qui invalide l'ancienne. Nous ne demandons ni numéro de téléphone ni carte bancaire pour le niveau d'essai.
Première requête
Commencez par envoyer une requête simple de complétion de chat. Cela confirme que votre clé API fonctionne et vous donne une idée de la vitesse de réponse. L'ID du modèle est toujours uncensored. Vous pouvez envoyer plusieurs messages dans une seule requête pour maintenir le contexte. Le modèle accepte les formats de messages standard OpenAI. Il n'y a pas de règles de routage complexes ni de particularités spécifiques au fournisseur à gérer.
curl https://api.unlimitedaiapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Vérifiez la réponse pour le tableau choices contenant le texte généré. Si vous obtenez une erreur 401, vérifiez votre clé API. Une erreur 402 signifie que votre crédit prépayé est épuisé.
Intégration SDK Python
L'utilisation de la bibliothèque Python officielle openai rend l'intégration triviale. Définissez base_url et api_key lors de l'initialisation de votre client. Cette approche fonctionne pour les appels synchrones, qui sont le mode standard pour la plupart des scripts. Nous supportons les entrées et sorties de texte standard. Nous ne proposons pas d'embeddings ni de génération d'images, donc concentrez votre payload sur le texte. Le SDK gère automatiquement la tokenisation, vous n'avez donc pas besoin de compter les tokens manuellement pour une utilisation de base.
from openai import OpenAI
client = OpenAI(base_url="https://api.unlimitedaiapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Assurez-vous d'utiliser une version récente du SDK pour prendre correctement en charge le paramètre base_url. Cette configuration se connecte directement à notre infrastructure sans couches de routage tierces.
Utilisation SDK Node.js
Pour les environnements Node.js, le package officiel openai fonctionne avec une configuration minimale. Transmettez votre clé API et l'URL de base correcte lors de l'initialisation. Cela vous permet de tirer parti de l'infrastructure Node.js existante tout en conservant un contrôle total sur vos appels API. Nous supportons les modèles de requête-réponse standard. Le streaming est géré séparément via les événements envoyés par le serveur. Le modèle est un modèle à poids ouverts ajusté pour réduire les refus, ce qui le rend adapté aux sujets créatifs ou controversés dans les limites légales.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.unlimitedaiapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);N'oubliez pas que nous facturons par token, surveillez donc votre utilisation via les en-têtes de réponse ou votre tableau de bord. Il n'y a pas de frais cachés ni d'abonnements mensuels.
Réponses en streaming
Vous pouvez activer le streaming en définissant le paramètre stream sur true dans votre requête. L'API renvoie des événements envoyés par le serveur (SSE) au lieu d'un seul objet JSON. Cela réduit la latence perçue pour les sorties longues. Chaque chunk contient un delta partiel de la réponse. Vous devez accumuler ces deltas pour reconstituer le texte complet. La facturation reste basée sur le nombre total de tokens d'entrée et de sortie traités, quel que soit le streaming. C'est idéal pour les interfaces utilisateur qui souhaitent afficher le texte au fur et à mesure de sa génération.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Gérez soigneusement l'analyse des événements envoyés par le serveur pour éviter les fuites de mémoire en cas de déconnexion inattendue. La fenêtre de contexte de 100 000 tokens s'applique à l'historique complet de la conversation, et non seulement au tour actuel.
Limites, erreurs et contexte
Votre clé API est limitée à 300 requêtes par minute. Si vous dépassez ce seuil, vous recevrez une erreur de limite de débit 429. La taille maximale du corps de la requête est de 8 Mo. Le modèle dispose d'une fenêtre de contexte de 100 000 tokens, combinant les tokens de prompt et de complétion. Cela suffit pour la plupart des tâches de documents longs. Nous ne proposons pas d'ajustement fin ni de routage de modèles. Si vous avez besoin d'embeddings, vous devez utiliser un service séparé. La limite stricte de contenu bloque le contenu sexuel impliquant des mineurs, mais autorise sinon les sujets adultes et controversés légaux. Les erreurs comme 401 indiquent une clé invalide, tandis que 402 indique un crédit prépayé insuffisant.
Fiche technique de l'API
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| Base URL | https://api.unlimitedaiapi.com/v1 |
| Authentification | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| ID du modèle | uncensored |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Mode JSON | response_format: {"type": "json_object"} |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Limite de débit | 300 requêtes par minute et par clé |
| Concurrence | 8 requêtes simultanées par clé |
| Taille | jusqu'à 8 Mo par requête |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Connexion | Google ou e-mail et mot de passe |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
Codes d'erreur
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions et réponses
Le modèle sans censure fonctionne-t-il avec les outils OpenAI standards ?
Oui, notre API est entièrement compatible avec OpenAI. Vous pouvez utiliser l'endpoint standard chat-completions avec n'importe quel SDK ou client OpenAI prenant en charge la configuration <code>base_url</code>. Nous prenons en charge l'appel de fonctions et le streaming via SSE.
Comment fonctionne la facturation pour les réponses en streaming ?
La facturation est basée sur le nombre total de tokens d'entrée et de sortie traités, que vous utilisiez le streaming ou des réponses standard. Le streaming affecte uniquement la latence, pas le coût par token. Vous payez 0,25 $ par 1M de tokens d'entrée et 1,00 $ par 1M de tokens de sortie.
Puis-je utiliser cette API pour la génération d'images ou d'audio ?
Non, nous proposons uniquement la génération de texte via l'endpoint <code>chat-completions</code>. Nous ne prenons pas en charge les embeddings, la génération d'images, d'audio ou de vidéo. Si vous avez besoin de ces fonctionnalités, vous devrez intégrer un service différent pour ces étapes spécifiques.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.