NL ▾
API-sleutel aanvragen

Unlimited AI API: Snelstart Gids

Haal je API-sleutel op en begin binnen enkele minuten met het versturen van tekstverzoeken. Deze gids behandelt de basis-URL, authenticatie en standaard OpenAI-compatibele endpoints voor onze ongecensureerde LLM.

Basis-URL en authenticatie

Onze API is volledig compatibel met het OpenAI SDK-formaat. Je moet de base URL instellen op https://api.unlimitedaiapi.com/v1. Dit zorgt ervoor dat alle verzoeken naar ons dedicated ongecensureerde model gaan, niet via een proxy of aggregator. Authenticatie gebeurt met een Bearer-token in de Authorization header. Je kunt je sleutel direct genereren na het inloggen met alleen een e-mailadres en wachtwoord. De sleutel wordt één keer getoond na het inloggen, maar je kunt hem op elk moment opnieuw genereren, waardoor de oude ongeldig wordt. We vereisen geen telefoonnummer of creditcard voor de trial tier.

Eerste verzoek

Begin met het sturen van een eenvoudige chat completion request. Dit bevestigt dat je API-sleutel werkt en geeft je een idee van de responsnelheid. De model ID is altijd uncensored. Je kunt meerdere berichten in één verzoek sturen om de context te behouden. Het model accepteert standaard OpenAI berichtformaten. Er zijn geen complexe routingregels of vendor-specific quirks om te beheren.

curl https://api.unlimitedaiapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Controleer de respons op de choices-array met de gegenereerde tekst. Als je een 401-fout krijgt, controleer dan je API-sleutel. Een 402-fout betekent dat je prepaid tegoed op is.

Python SDK-integratie

Het gebruik van de officiële openai Python-bibliotheek maakt integratie triviaal. Stel de base_url en api_key in tijdens de client-initialisatie. Deze aanpak werkt voor synchronische calls, wat de standaard mode is voor de meeste scripts. We ondersteunen standaard tekstinput en -output. We bieden geen embeddings of image generation, dus houd je payload gericht op tekst. De SDK doet de tokenization automatisch, dus je hoeft geen tokens handmatig te tellen voor basisgebruik.

from openai import OpenAI

client = OpenAI(base_url="https://api.unlimitedaiapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Zorg dat je een recente versie van de SDK gebruikt om de base_url parameter correct te ondersteunen. Deze setup verbindt direct met onze infrastructuur zonder third-party routing layers.

Node SDK-gebruik

Voor Node.js-omgevingen werkt het officiële openai pakket met minimale configuratie. Geef je API-sleutel en de juiste base URL door tijdens de initialisatie. Dit stelt je in bestaande Node.js-infrastructuur te gebruiken terwijl je volledige controle houdt over je API-calls. We ondersteunen standaard request-response patronen. Streaming wordt afzonderlijk afgehandeld via Server-Sent Events. Het model is een open-weight model dat is afgestemd op minder refusals, wat het geschikt maakt voor creatieve of controversiële onderwerpen binnen legal bounds.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.unlimitedaiapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Onthoud dat we per token rekenen, dus houd je gebruik bij via de responsheaders of je dashboard. Er zijn geen verborgen kosten of maandelijkse abonnementen.

Streaming-antwoorden

Je kunt streaming inschakelen door de stream parameter in te stellen op true in je verzoek. De API retourneert Server-Sent Events (SSE) in plaats van een enkel JSON-object. Dit vermindert de perceived latency voor lange outputs. Elke chunk bevat een partial delta van de respons. Je moet deze deltas accumuleren om de volledige tekst te reconstrueren. De prijzen blijven gebaseerd op de totale input- en output tokens die zijn verwerkt, ongeacht streaming. Dit is ideaal voor UI's die tekst willen weergeven terwijl deze wordt gegenereerd.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Verwerk SSE parsing zorgvuldig om memory leaks te voorkomen als een connection onverwacht droppt. Het contextvenster van 100,000 tokens geldt voor de volledige conversation history, niet alleen voor de huidige turn.

Limieten, fouten en context

Je API-sleutel is beperkt tot 300 verzoeken per minuut. Als je dit overschrijdt, ontvang je een 429 rate limit error. De maximum request body size is 8 MB. Het model heeft een contextvenster van 100,000 tokens, waarbij zowel prompt als completion tokens worden meegerekend. Dit is voldoende voor de meeste long-document tasks. We bieden geen fine-tuning of model routing. Als je embeddings nodig hebt, moet je een aparte service gebruiken. De harde content limit blokkeert sexual content involving minors, maar staat anders lawful adult en controversiële onderwerpen toe. Fouten zoals 401 duiden op een ongeldige sleutel, terwijl 402 duidt op onvoldoende prepaid credit.

API-specificaties

Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.

OnderdeelWaarde
API-formaatOpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel
Base URLhttps://api.unlimitedaiapi.com/v1
AuthenticatieAuthorization: Bearer YOUR_KEY
EndpointsPOST /v1/chat/completions · GET /v1/models
Model-IDuncensored
Streamingja — server-sent events; het laatste deel bevat het tokenverbruik
Parameterstemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Max. uitvoertot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet)
JSON-modusresponse_format: {"type": "json_object"}
Contextvenster100.000 tokens (invoer + uitvoer)
Function callingja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool
Rate limit300 verzoeken per minuut per sleutel
Gelijktijdige verzoekentot 8 tegelijk per sleutel
Verzoekgroottetot 8 MB
ResponsheadersX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Geldigheidbetaald tegoed verloopt niet, geen abonnement
Gratis proeftegoed$0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering
Prijs$0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens
Bonus+5% vanaf $50, +10% vanaf $100
OpwaarderenUSDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500
Afrekeningprepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis
InloggenGoogle of e-mail en wachtwoord
Inhoudinhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd
Sleutelséén actieve sleutel per account; een nieuwe vervangt de oude

Foutcodes

Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.

CodeTypeBetekenis
400bad_requestongeldige JSON, lege berichten, verkeerde parameter of context te lang
401missing_key · invalid_key · key_revokedsleutel ontbreekt, is onjuist of is vervangen
402no_creditgeen tegoed — waardeer op en ga direct verder
403content_blockedseksuele inhoud met minderjarigen — geweigerd, niet gerekend
404not_foundonbekend endpoint
413request_too_largebody groter dan 8 MB
429rate_limited · concurrencymeer dan 300/min of 8 tegelijk — wacht en probeer opnieuw
503upstream_busymodel bezet — probeer het over enkele seconden opnieuw

Vragen en antwoorden

Werkt het ongecensureerde model met standaard OpenAI-tools?

Ja, onze API is volledig compatibel met OpenAI. Je kunt het standaard chat-completions-endpoint gebruiken met elke OpenAI SDK of client die de <code>base_url</code>-configuratie ondersteunt. We ondersteunen tool/function calling en streaming via SSE.

Hoe werkt de prijsstelling voor streaming-antwoorden?

De prijs is gebaseerd op het totale aantal verwerkte input- en outputtokens, ongeacht of je streaming of standaardantwoorden gebruikt. Streaming beïnvloedt alleen de latentie, niet de kosten per token. Je betaalt $0,25 per 1M inputtokens en $1,00 per 1M outputtokens.

Kan ik deze API gebruiken voor afbeeldings- of audiogeneratie?

Nee, we bieden alleen tekstgeneratie via het <code>chat-completions</code>-endpoint. We ondersteunen geen embeddings, afbeeldings-, audio- of videogeneratie. Als je die functionaliteiten nodig hebt, moet je een andere service integreren voor die specifieke stappen.

Je sleutel is nog maar één formulier verwijderd

Maak een account aan, kopieer de sleutel, pas de basis-URL aan. Dat is de hele setup.

API-sleutel aanvragen