PT ▾
Obter chave de API

Unlimited AI API: Início rápido Guia

Obtenha sua chave de API e comece a enviar solicitações de texto em minutos. Este guia cobre a URL base, autenticação e endpoints padrão compatíveis com OpenAI para nosso LLM sem censura.

URL base e autenticação

Nossa API é totalmente compatível com o formato do SDK OpenAI. Você deve definir a URL base para https://api.unlimitedaiapi.com/v1. Isso garante que todas as requisições sejam roteadas para nosso modelo sem censura dedicado, e não um proxy ou agregador. A autenticação usa um token Bearer no cabeçalho Authorization. Você pode gerar sua chave imediatamente após entrar com apenas e-mail e senha. A chave é exibida uma vez após o login, mas você pode regenerá-la a qualquer momento, o que invalida a chave anterior. Não exigimos número de telefone ou cartão de crédito para o nível de teste.

Primeira solicitação

Comece enviando uma solicitação simples de conclusão de chat. Isso confirma que sua chave de API funciona e dá uma ideia da velocidade da resposta. O ID do modelo é sempre uncensored. Você pode enviar várias mensagens em uma única solicitação para manter o contexto. O modelo aceita formatos de mensagem padrão do OpenAI. Não há regras complexas de roteamento ou peculiaridades específicas de fornecedor para gerenciar.

curl https://api.unlimitedaiapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Verifique a resposta para a matriz choices contendo o texto gerado. Se você receber um erro 401, verifique sua chave de API. Um erro 402 significa que seu crédito pré-pago está esgotado.

Integração com SDK Python

Usar a biblioteca Python oficial openai torna a integração trivial. Defina base_url e api_key na inicialização do seu cliente. Esta abordagem funciona para chamadas síncronas, que é o modo padrão para a maioria dos scripts. Suportamos entrada e saída de texto padrão. Não oferecemos embeddings ou geração de imagem, então mantenha o corpo da requisição focado em texto. O SDK lida com a tokenização automaticamente, então você não precisa contar tokens manualmente para uso básico.

from openai import OpenAI

client = OpenAI(base_url="https://api.unlimitedaiapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Certifique-se de estar usando uma versão recente do SDK para suportar o parâmetro base_url corretamente. Esta configuração conecta-se diretamente à nossa infraestrutura sem camadas de roteamento de terceiros.

Uso do SDK Node.js

Para ambientes Node.js, o pacote oficial openai funciona com configuração mínima. Passe sua chave de API e a URL base correta durante a inicialização. Isso permite que você aproveite a infraestrutura existente do Node.js enquanto mantém controle total sobre suas chamadas de API. Suportamos padrões de solicitação-resposta padrão. O streaming é tratado separadamente via Server-Sent Events. O modelo é um modelo de pesos abertos ajustado para menos recusas, tornando-o adequado para tópicos criativos ou controversos dentro dos limites legais.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.unlimitedaiapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Lembre-se de que cobramos por token, então monitore seu uso por meio dos cabeçalhos de resposta ou do seu painel. Não há taxas ocultas ou assinaturas mensais.

Respostas em streaming

Você pode habilitar o streaming definindo o parâmetro stream como true em sua solicitação. A API retorna Server-Sent Events (SSE) em vez de um único objeto JSON. Isso reduz a latência percebida para saídas longas. Cada chunk contém um delta parcial da resposta. Você deve acumular esses deltas para reconstruir o texto completo. A precificação continua baseada no total de tokens de entrada e saída processados, independentemente do streaming. Isso é ideal para interfaces que desejam exibir texto conforme é gerado.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Trate o parseamento de SSE com cuidado para evitar vazamentos de memória caso a conexão seja encerrada inesperadamente. A janela de contexto de 100.000 tokens aplica-se a todo o histórico de conversas, não apenas à mensagem atual.

Limites, erros e contexto

Sua chave de API está limitada a 300 requisições por minuto. Se você exceder isso, receberá um erro de limite de requisições 429. O tamanho máximo do corpo da solicitação é 8 MB. O modelo tem uma janela de contexto de 100.000 tokens, combinando tokens de prompt e conclusão. Isso é suficiente para a maioria das tarefas de documentos longos. Não oferecemos fine-tuning ou roteamento de modelos. Se precisar de embeddings, deve usar um serviço separado. O limite rígido de conteúdo bloqueia conteúdo sexual envolvendo menores, mas permite outros tópicos adultos e controversos legais. Erros como 401 indicam uma chave inválida, enquanto 402 indica crédito pré-pago insuficiente.

Ficha técnica da API

Uma tabela com cada limite, recurso e preço.

ItemValor
Formatocompatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave
Base URLhttps://api.unlimitedaiapi.com/v1
AutenticaçãoAuthorization: Bearer YOUR_KEY
EndpointsPOST /v1/chat/completions · GET /v1/models
ID do modelouncensored
Streamingsim — server-sent events; o último bloco traz o uso de tokens
Parâmetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Saída máximaaté o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado)
Modo JSONresponse_format: {"type": "json_object"}
Janela de contexto100.000 tokens (entrada + saída)
Chamada de funçõessim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool
Limite de taxa300 requisições por minuto por chave
Concorrência8 requisições ao mesmo tempo por chave
Tamanhoaté 8 MB por requisição
CabeçalhosX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Validadecrédito pago não expira, sem assinatura
Teste grátis$0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga
Preço$0,25 por 1M tokens de entrada · $1,00 por 1M de saída
Bônus+5% a partir de $50, +10% a partir de $100
RecargaUSDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500
Cobrançacrédito pré-pago pelo uso real; erros e recusas são grátis
LoginGoogle ou e-mail e senha
Conteúdoconteúdo adulto permitido; conteúdo sexual com menores é recusado
Chavesuma chave ativa por conta; uma nova substitui a anterior

Códigos de erro

Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.

CódigoTipoSignificado
400bad_requestJSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais
401missing_key · invalid_key · key_revokedchave ausente, errada ou substituída
402no_creditsem crédito — recarregue e continue na hora
403content_blockedconteúdo sexual com menores — recusado, sem cobrança
404not_foundendpoint desconhecido
413request_too_largecorpo acima de 8 MB
429rate_limited · concurrencyacima de 300/min ou 8 em paralelo — aguarde e tente de novo
503upstream_busymodelo ocupado — tente em alguns segundos

Perguntas e respostas

O modelo sem censura funciona com as ferramentas padrão do OpenAI?

Sim, nossa API é totalmente compatível com OpenAI. Você pode usar o endpoint padrão de chat-completions com qualquer SDK ou cliente do OpenAI que suporte a configuração <code>base_url</code>. Suportamos chamada de funções e streaming via SSE.

Como funciona o preço para respostas em streaming?

A precificação é baseada no número total de tokens de entrada e saída processados, independentemente de usar streaming ou respostas padrão. O streaming afeta apenas a latência, não o custo por token. Você paga $0,25 por 1M de tokens de entrada e $1,00 por 1M de tokens de saída.

Posso usar esta API para geração de imagens ou áudio?

Não, oferecemos apenas geração de texto via o endpoint <code>chat-completions</code>. Não suportamos embeddings, geração de imagens, áudio ou vídeo. Se precisar dessas capacidades, você precisará integrar um serviço diferente para essas etapas específicas.

Sua chave está a um formulário de distância

Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.

Obter chave de API