Unlimited AI API: Inicio rápido Guía
Obtén tu clave de API y comienza a enviar peticiones de texto en minutos. Esta guía cubre la URL base, la autenticación y los endpoints estándar compatibles con OpenAI para nuestro LLM sin censura.
URL base y autenticación
Nuestra API es totalmente compatible con el formato del SDK de OpenAI. Debes configurar la URL base en https://api.unlimitedaiapi.com/v1. Esto asegura que todas las peticiones se enruten a nuestro modelo sin censura dedicado, no a un proxy o agregador. La autenticación usa un token Bearer en el encabezado Authorization. Puedes generar tu clave inmediatamente después de registrarte con solo un correo electrónico y una contraseña. La clave se muestra una sola vez después del registro, pero puedes regenerarla en cualquier momento, lo que invalida la anterior. No requerimos número de teléfono ni tarjeta de crédito para la capa de prueba.
Primera petición
Empieza enviando una petición de chat completion simple. Esto confirma que tu clave de API funciona y te da una idea de la velocidad de respuesta. El ID del modelo es siempre uncensored. Puedes enviar varios mensajes en una sola petición para mantener el contexto. El modelo acepta formatos de mensaje estándar de OpenAI. No hay reglas de enrutamiento complejas ni particularidades específicas del proveedor que debas gestionar.
curl https://api.unlimitedaiapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Verifica la respuesta para ver la matriz choices que contiene el texto generado. Si obtienes un error 401, verifica tu clave de API. Un error 402 significa que tu crédito prepago se ha agotado.
Integración con SDK de Python
Usar la biblioteca oficial de Python openai hace que la integración sea trivial. Configura base_url y api_key en la inicialización de tu cliente. Este enfoque funciona para llamadas sincrónicas, que es el modo estándar para la mayoría de los scripts. Admitimos entrada y salida de texto estándar. No ofrecemos embeddings ni generación de imágenes, así que mantén tu carga útil centrada en el texto. El SDK maneja la tokenización automáticamente, así que no necesitas contar tokens manualmente para el uso básico.
from openai import OpenAI
client = OpenAI(base_url="https://api.unlimitedaiapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Asegúrate de usar una versión reciente del SDK para admitir correctamente el parámetro base_url. Esta configuración se conecta directamente a nuestra infraestructura sin capas de enrutamiento de terceros.
Uso del SDK de Node.js
Para entornos Node.js, el paquete oficial openai funciona con configuración mínima. Pasa tu clave de API y la URL base correcta durante la inicialización. Esto te permite aprovechar la infraestructura existente de Node.js mientras mantienes el control total sobre tus llamadas a la API. Admitimos patrones estándar de petición-respuesta. El streaming se maneja por separado mediante eventos enviados por el servidor. El modelo es un modelo de pesos abiertos ajustado para tener menos rechazos, lo que lo hace adecuado para temas creativos o controvertidos dentro de los límites legales.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.unlimitedaiapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Recuerda que cobramos por token, así que monitorea tu uso a través de los encabezados de respuesta o tu panel. No hay tarifas ocultas ni suscripciones mensuales.
Respuestas en streaming
Puedes habilitar el streaming estableciendo el parámetro stream en true en tu petición. La API devuelve Server-Sent Events (SSE) en lugar de un único objeto JSON. Esto reduce la latencia percibida para salidas largas. Cada fragmento contiene un delta parcial de la respuesta. Debes acumular estos deltas para reconstruir el texto completo. La facturación sigue basándose en el total de tokens de entrada y salida procesados, independientemente del streaming. Esto es ideal para interfaces de usuario que desean mostrar el texto a medida que se genera.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Maneja el análisis de SSE cuidadosamente para evitar fugas de memoria si una conexión se cae inesperadamente. La ventana de contexto de 100.000 tokens se aplica a todo el historial de la conversación, no solo al turno actual.
Límites, errores y contexto
Tu clave de API está limitada a 300 peticiones por minuto. Si excedes este límite, recibirás un error de límite de peticiones 429. El tamaño máximo del cuerpo de la petición es de 8 MB. El modelo tiene una ventana de contexto de 100.000 tokens, que combina tanto tokens de prompt como tokens de completion. Esto es suficiente para la mayoría de tareas con documentos largos. No ofrecemos ajuste fino ni enrutamiento de modelos. Si necesitas embeddings, debes usar un servicio separado. El límite estricto de contenido bloquea el contenido sexual que involucra a menores, pero de lo contrario permite temas adultos lícitos y controversiales. Errores como 401 indican una clave no válida, mientras que 402 indica crédito prepago insuficiente.
Ficha técnica de la API
Una tabla con cada límite, función y precio.
| Elemento | Valor |
|---|---|
| Formato | compatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave |
| Base URL | https://api.unlimitedaiapi.com/v1 |
| Autenticación | Authorization: Bearer YOUR_KEY |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| ID del modelo | uncensored |
| Streaming | sí: server-sent events; el último fragmento incluye el uso de tokens |
| Parámetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Salida máxima | hasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte) |
| Modo JSON | response_format: {"type": "json_object"} |
| Ventana de contexto | 100.000 tokens (entrada + salida) |
| Llamadas a funciones | sí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool |
| Límite de peticiones | 300 por minuto por clave |
| Concurrencia | 8 peticiones a la vez por clave |
| Tamaño de petición | hasta 8 MB |
| Cabeceras | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Caducidad | el crédito pagado no caduca, sin suscripción |
| Prueba gratis | $0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga |
| Precio | $0,25 por 1M tokens de entrada · $1,00 por 1M de salida |
| Bono | +5 % desde $50, +10 % desde $100 |
| Recarga | USDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500 |
| Facturación | crédito prepago por uso real; errores y rechazos no se cobran |
| Acceso | Google o correo y contraseña |
| Contenido | contenido adulto permitido; se rechaza el contenido sexual con menores |
| Claves | una clave activa por cuenta; una nueva reemplaza a la anterior |
Códigos de error
Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo |
401 | missing_key · invalid_key · key_revoked | falta la clave, es incorrecta o fue reemplazada |
402 | no_credit | sin crédito: recarga y sigue al instante |
403 | content_blocked | contenido sexual con menores: rechazado, no se cobra |
404 | not_found | endpoint desconocido |
413 | request_too_large | cuerpo mayor de 8 MB |
429 | rate_limited · concurrency | más de 300/min o 8 en paralelo: espera y reintenta |
503 | upstream_busy | modelo ocupado: reintenta en unos segundos |
Preguntas y respuestas
¿El modelo sin censura funciona con las herramientas estándar de OpenAI?
Sí, nuestra API es totalmente compatible con OpenAI. Puedes usar el endpoint estándar de chat-completions con cualquier SDK o cliente de OpenAI que admita la configuración de <code>base_url</code>. Admitimos llamadas a funciones y streaming mediante SSE.
¿Cómo funciona la facturación para las respuestas en streaming?
La facturación se basa en el número total de tokens de entrada y salida procesados, independientemente de si usas streaming o respuestas estándar. El streaming solo afecta a la latencia, no al costo por token. Pagas $0,25 por cada 1M de tokens de entrada y $1,00 por cada 1M de tokens de salida.
¿Puedo usar esta API para generación de imágenes o audio?
No, solo ofrecemos generación de texto a través del endpoint <code>chat-completions</code>. No admitimos embeddings, generación de imágenes, audio ni video. Si necesitas esas capacidades, deberás integrar un servicio diferente para esos pasos específicos.
Tu clave está a un formulario de distancia
Crea una cuenta, copia la clave, cambia la URL base. Eso es toda la configuración.