Unlimited AI API: Início rápido Guia
Obtenha sua chave de API e comece a enviar solicitações de texto em minutos. Este guia cobre a URL base, autenticação e endpoints padrão compatíveis com OpenAI para nosso LLM sem censura.
URL base e autenticação
Nossa API é totalmente compatível com o formato do SDK OpenAI. Você deve definir a URL base para https://api.unlimitedaiapi.com/v1. Isso garante que todas as requisições sejam roteadas para nosso modelo sem censura dedicado, e não um proxy ou agregador. A autenticação usa um token Bearer no cabeçalho Authorization. Você pode gerar sua chave imediatamente após entrar com apenas e-mail e senha. A chave é exibida uma vez após o login, mas você pode regenerá-la a qualquer momento, o que invalida a chave anterior. Não exigimos número de telefone ou cartão de crédito para o nível de teste.
Primeira solicitação
Comece enviando uma solicitação simples de conclusão de chat. Isso confirma que sua chave de API funciona e dá uma ideia da velocidade da resposta. O ID do modelo é sempre uncensored. Você pode enviar várias mensagens em uma única solicitação para manter o contexto. O modelo aceita formatos de mensagem padrão do OpenAI. Não há regras complexas de roteamento ou peculiaridades específicas de fornecedor para gerenciar.
curl https://api.unlimitedaiapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Verifique a resposta para a matriz choices contendo o texto gerado. Se você receber um erro 401, verifique sua chave de API. Um erro 402 significa que seu crédito pré-pago está esgotado.
Integração com SDK Python
Usar a biblioteca Python oficial openai torna a integração trivial. Defina base_url e api_key na inicialização do seu cliente. Esta abordagem funciona para chamadas síncronas, que é o modo padrão para a maioria dos scripts. Suportamos entrada e saída de texto padrão. Não oferecemos embeddings ou geração de imagem, então mantenha o corpo da requisição focado em texto. O SDK lida com a tokenização automaticamente, então você não precisa contar tokens manualmente para uso básico.
from openai import OpenAI
client = OpenAI(base_url="https://api.unlimitedaiapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Certifique-se de estar usando uma versão recente do SDK para suportar o parâmetro base_url corretamente. Esta configuração conecta-se diretamente à nossa infraestrutura sem camadas de roteamento de terceiros.
Uso do SDK Node.js
Para ambientes Node.js, o pacote oficial openai funciona com configuração mínima. Passe sua chave de API e a URL base correta durante a inicialização. Isso permite que você aproveite a infraestrutura existente do Node.js enquanto mantém controle total sobre suas chamadas de API. Suportamos padrões de solicitação-resposta padrão. O streaming é tratado separadamente via Server-Sent Events. O modelo é um modelo de pesos abertos ajustado para menos recusas, tornando-o adequado para tópicos criativos ou controversos dentro dos limites legais.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.unlimitedaiapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Lembre-se de que cobramos por token, então monitore seu uso por meio dos cabeçalhos de resposta ou do seu painel. Não há taxas ocultas ou assinaturas mensais.
Respostas em streaming
Você pode habilitar o streaming definindo o parâmetro stream como true em sua solicitação. A API retorna Server-Sent Events (SSE) em vez de um único objeto JSON. Isso reduz a latência percebida para saídas longas. Cada chunk contém um delta parcial da resposta. Você deve acumular esses deltas para reconstruir o texto completo. A precificação continua baseada no total de tokens de entrada e saída processados, independentemente do streaming. Isso é ideal para interfaces que desejam exibir texto conforme é gerado.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Trate o parseamento de SSE com cuidado para evitar vazamentos de memória caso a conexão seja encerrada inesperadamente. A janela de contexto de 100.000 tokens aplica-se a todo o histórico de conversas, não apenas à mensagem atual.
Limites, erros e contexto
Sua chave de API está limitada a 300 requisições por minuto. Se você exceder isso, receberá um erro de limite de requisições 429. O tamanho máximo do corpo da solicitação é 8 MB. O modelo tem uma janela de contexto de 100.000 tokens, combinando tokens de prompt e conclusão. Isso é suficiente para a maioria das tarefas de documentos longos. Não oferecemos fine-tuning ou roteamento de modelos. Se precisar de embeddings, deve usar um serviço separado. O limite rígido de conteúdo bloqueia conteúdo sexual envolvendo menores, mas permite outros tópicos adultos e controversos legais. Erros como 401 indicam uma chave inválida, enquanto 402 indica crédito pré-pago insuficiente.
Ficha técnica da API
Uma tabela com cada limite, recurso e preço.
| Item | Valor |
|---|---|
| Formato | compatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave |
| Base URL | https://api.unlimitedaiapi.com/v1 |
| Autenticação | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| ID do modelo | uncensored |
| Streaming | sim — server-sent events; o último bloco traz o uso de tokens |
| Parâmetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Saída máxima | até o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado) |
| Modo JSON | response_format: {"type": "json_object"} |
| Janela de contexto | 100.000 tokens (entrada + saída) |
| Chamada de funções | sim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool |
| Limite de taxa | 300 requisições por minuto por chave |
| Concorrência | 8 requisições ao mesmo tempo por chave |
| Tamanho | até 8 MB por requisição |
| Cabeçalhos | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Validade | crédito pago não expira, sem assinatura |
| Teste grátis | $0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga |
| Preço | $0,25 por 1M tokens de entrada · $1,00 por 1M de saída |
| Bônus | +5% a partir de $50, +10% a partir de $100 |
| Recarga | USDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500 |
| Cobrança | crédito pré-pago pelo uso real; erros e recusas são grátis |
| Login | Google ou e-mail e senha |
| Conteúdo | conteúdo adulto permitido; conteúdo sexual com menores é recusado |
| Chaves | uma chave ativa por conta; uma nova substitui a anterior |
Códigos de erro
Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais |
401 | missing_key · invalid_key · key_revoked | chave ausente, errada ou substituída |
402 | no_credit | sem crédito — recarregue e continue na hora |
403 | content_blocked | conteúdo sexual com menores — recusado, sem cobrança |
404 | not_found | endpoint desconhecido |
413 | request_too_large | corpo acima de 8 MB |
429 | rate_limited · concurrency | acima de 300/min ou 8 em paralelo — aguarde e tente de novo |
503 | upstream_busy | modelo ocupado — tente em alguns segundos |
Perguntas e respostas
O modelo sem censura funciona com as ferramentas padrão do OpenAI?
Sim, nossa API é totalmente compatível com OpenAI. Você pode usar o endpoint padrão de chat-completions com qualquer SDK ou cliente do OpenAI que suporte a configuração <code>base_url</code>. Suportamos chamada de funções e streaming via SSE.
Como funciona o preço para respostas em streaming?
A precificação é baseada no número total de tokens de entrada e saída processados, independentemente de usar streaming ou respostas padrão. O streaming afeta apenas a latência, não o custo por token. Você paga $0,25 por 1M de tokens de entrada e $1,00 por 1M de tokens de saída.
Posso usar esta API para geração de imagens ou áudio?
Não, oferecemos apenas geração de texto via o endpoint <code>chat-completions</code>. Não suportamos embeddings, geração de imagens, áudio ou vídeo. Se precisar dessas capacidades, você precisará integrar um serviço diferente para essas etapas específicas.
Sua chave está a um formulário de distância
Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.