Illimitato AI API: Avvio rapido Guida
Ottieni la tua chiave API e inizia a inviare richieste di testo in pochi minuti. Questa guida copre l'URL di base, l'autenticazione e gli endpoint standard compatibili con OpenAI per il nostro LLM senza censura.
URL di base e autenticazione
La nostra API è completamente compatibile con il formato SDK OpenAI. Devi impostare l'URL di base su https://api.unlimitedaiapi.com/v1. Questo garantisce che tutte le richieste vengano instradate al nostro modello senza censura dedicato, non a un proxy o aggregatore. L'autenticazione utilizza un token Bearer nell'intestazione Authorization. Puoi generare la tua chiave immediatamente dopo la registrazione con solo email e password. La chiave viene mostrata una sola volta dopo la registrazione, ma puoi rigenerarla in qualsiasi momento, invalidando quella precedente. Non richiediamo un numero di telefono o una carta di credito per il livello di prova.
Prima richiesta
Inizia inviando una semplice richiesta di completamento chat. Questo conferma che la tua chiave API funziona e ti dà un'idea della velocità di risposta. L'ID del modello è sempre uncensored. Puoi inviare più messaggi in una singola richiesta per mantenere il contesto. Il modello accetta formati di messaggio standard OpenAI. Non ci sono regole di instradamento complesse o peculiarità specifiche del fornitore da gestire.
curl https://api.unlimitedaiapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Controlla la risposta per l'array choices contenente il testo generato. Se ricevi un errore 401, verifica la tua chiave API. Un errore 402 significa che il tuo credito prepagato è esaurito.
Integrazione SDK Python
L'utilizzo della libreria Python ufficiale openai rende l'integrazione banale. Imposta base_url e api_key nell'inizializzazione del client. Questo approccio funziona per le chiamate sincrone, che sono la modalità standard per la maggior parte degli script. Supportiamo input e output di testo standard. Non offriamo embeddings o generazione di immagini, quindi mantieni il payload focalizzato sul testo. L'SDK gestisce la tokenizzazione automaticamente, quindi non devi contare i token manualmente per l'uso di base.
from openai import OpenAI
client = OpenAI(base_url="https://api.unlimitedaiapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Assicurati di utilizzare una versione recente dell'SDK per supportare correttamente il parametro base_url. Questa configurazione si connette direttamente alla nostra infrastruttura senza livelli di instradamento di terze parti.
Utilizzo SDK Node.js
Per gli ambienti Node.js, il pacchetto ufficiale openai funziona con configurazione minima. Inserisci la tua chiave API e l'URL di base corretto durante l'inizializzazione. Questo ti permette di sfruttare l'infrastruttura Node.js esistente mantenendo il controllo completo sulle tue chiamate API. Supportiamo i pattern standard di richiesta-risposta. Lo streaming viene gestito separatamente tramite Server-Sent Events. Il modello è un modello a pesi aperti ottimizzato per ridurre i rifiuti, rendendolo adatto per argomenti creativi o controversi entro i limiti legali.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.unlimitedaiapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Ricorda che addebitiamo per token, quindi monitora il tuo utilizzo tramite le intestazioni di risposta o il tuo dashboard. Non ci sono costi nascosti o abbonamenti mensili.
Risposte in streaming
Puoi abilitare lo streaming impostando il parametro stream su true nella tua richiesta. L'API restituisce Server-Sent Events (SSE) invece di un singolo oggetto JSON. Questo riduce la latenza percepita per output lunghi. Ogni chunk contiene un delta parziale della risposta. Devi accumulare questi delta per ricostruire il testo completo. Il prezzo rimane basato sul totale dei token di input e output elaborati, indipendentemente dallo streaming. Questo è ideale per le interfacce utente che vogliono visualizzare il testo man mano che viene generato.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Gestisci attentamente il parsing SSE per evitare perdite di memoria se una connessione viene interrotta inaspettatamente. La finestra di contesto di 100.000 token si applica all'intera cronologia delle conversazioni, non solo al turno corrente.
Limiti, errori e contesto
La tua chiave API è limitata a 300 richieste al minuto. Se superi questo limite, riceverai un errore del limite di richieste 429. La dimensione massima del corpo della richiesta è 8 MB. Il modello ha una finestra di contesto di 100.000 token, che combina sia i token di prompt che quelli di completamento. Questo è sufficiente per la maggior parte dei compiti di documenti lunghi. Non offriamo il fine-tuning o il routing del modello. Se hai bisogno di embedding, devi usare un servizio separato. Il limite rigido sui contenuti blocca i contenuti sessuali che coinvolgono minori, ma altrimenti consente argomenti legali per adulti e controversi. Errori come 401 indicano una chiave non valida, mentre 402 indica credito prepagato insufficiente.
Scheda tecnica dell'API
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| Base URL | https://api.unlimitedaiapi.com/v1 |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| ID modello | uncensored |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Output massimo | fino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato) |
| Modalità JSON | response_format: {"type": "json_object"} |
| Finestra di contesto | 100.000 token (input + output) |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Concorrenza | 8 richieste contemporanee per chiave |
| Dimensione | fino a 8 MB per richiesta |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Bonus | +5% da $50, +10% da $100 |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Accesso | Google oppure e-mail e password |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |
Domande e risposte
Il modello senza censura funziona con gli strumenti standard di OpenAI?
Sì, la nostra API è completamente compatibile con OpenAI. Puoi utilizzare l'endpoint standard chat-completions con qualsiasi SDK o client OpenAI che supporti la configurazione <code>base_url</code>. Supportiamo la chiamata di funzioni e lo streaming tramite SSE.
Come funziona il prezzo per le risposte in streaming?
Il prezzo si basa sul numero totale di token di input e output elaborati, indipendentemente dal fatto che si utilizzi lo streaming o risposte standard. Lo streaming influisce solo sulla latenza, non sul costo per token. Paghi $0,25 per 1M di token di input e $1,00 per 1M di token di output.
Posso usare questa API per la generazione di immagini o audio?
No, offriamo solo generazione di testo tramite l'endpoint <code>chat-completions</code>. Non supportiamo embeddings, generazione di immagini, audio o video. Se hai bisogno di queste funzionalità, dovrai integrare un servizio diverso per quelle specifiche operazioni.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, cambia l'URL di base. È tutta qui la configurazione.