ES ▾
Obtener clave de API

Unlimited AI API: Inicio rápido Guía

Obtén tu clave de API y comienza a enviar peticiones de texto en minutos. Esta guía cubre la URL base, la autenticación y los endpoints estándar compatibles con OpenAI para nuestro LLM sin censura.

URL base y autenticación

Nuestra API es totalmente compatible con el formato del SDK de OpenAI. Debes configurar la URL base en https://api.unlimitedaiapi.com/v1. Esto asegura que todas las peticiones se enruten a nuestro modelo sin censura dedicado, no a un proxy o agregador. La autenticación usa un token Bearer en el encabezado Authorization. Puedes generar tu clave inmediatamente después de registrarte con solo un correo electrónico y una contraseña. La clave se muestra una sola vez después del registro, pero puedes regenerarla en cualquier momento, lo que invalida la anterior. No requerimos número de teléfono ni tarjeta de crédito para la capa de prueba.

Primera petición

Empieza enviando una petición de chat completion simple. Esto confirma que tu clave de API funciona y te da una idea de la velocidad de respuesta. El ID del modelo es siempre uncensored. Puedes enviar varios mensajes en una sola petición para mantener el contexto. El modelo acepta formatos de mensaje estándar de OpenAI. No hay reglas de enrutamiento complejas ni particularidades específicas del proveedor que debas gestionar.

curl https://api.unlimitedaiapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Verifica la respuesta para ver la matriz choices que contiene el texto generado. Si obtienes un error 401, verifica tu clave de API. Un error 402 significa que tu crédito prepago se ha agotado.

Integración con SDK de Python

Usar la biblioteca oficial de Python openai hace que la integración sea trivial. Configura base_url y api_key en la inicialización de tu cliente. Este enfoque funciona para llamadas sincrónicas, que es el modo estándar para la mayoría de los scripts. Admitimos entrada y salida de texto estándar. No ofrecemos embeddings ni generación de imágenes, así que mantén tu carga útil centrada en el texto. El SDK maneja la tokenización automáticamente, así que no necesitas contar tokens manualmente para el uso básico.

from openai import OpenAI

client = OpenAI(base_url="https://api.unlimitedaiapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Asegúrate de usar una versión reciente del SDK para admitir correctamente el parámetro base_url. Esta configuración se conecta directamente a nuestra infraestructura sin capas de enrutamiento de terceros.

Uso del SDK de Node.js

Para entornos Node.js, el paquete oficial openai funciona con configuración mínima. Pasa tu clave de API y la URL base correcta durante la inicialización. Esto te permite aprovechar la infraestructura existente de Node.js mientras mantienes el control total sobre tus llamadas a la API. Admitimos patrones estándar de petición-respuesta. El streaming se maneja por separado mediante eventos enviados por el servidor. El modelo es un modelo de pesos abiertos ajustado para tener menos rechazos, lo que lo hace adecuado para temas creativos o controvertidos dentro de los límites legales.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.unlimitedaiapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Recuerda que cobramos por token, así que monitorea tu uso a través de los encabezados de respuesta o tu panel. No hay tarifas ocultas ni suscripciones mensuales.

Respuestas en streaming

Puedes habilitar el streaming estableciendo el parámetro stream en true en tu petición. La API devuelve Server-Sent Events (SSE) en lugar de un único objeto JSON. Esto reduce la latencia percibida para salidas largas. Cada fragmento contiene un delta parcial de la respuesta. Debes acumular estos deltas para reconstruir el texto completo. La facturación sigue basándose en el total de tokens de entrada y salida procesados, independientemente del streaming. Esto es ideal para interfaces de usuario que desean mostrar el texto a medida que se genera.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Maneja el análisis de SSE cuidadosamente para evitar fugas de memoria si una conexión se cae inesperadamente. La ventana de contexto de 100.000 tokens se aplica a todo el historial de la conversación, no solo al turno actual.

Límites, errores y contexto

Tu clave de API está limitada a 300 peticiones por minuto. Si excedes este límite, recibirás un error de límite de peticiones 429. El tamaño máximo del cuerpo de la petición es de 8 MB. El modelo tiene una ventana de contexto de 100.000 tokens, que combina tanto tokens de prompt como tokens de completion. Esto es suficiente para la mayoría de tareas con documentos largos. No ofrecemos ajuste fino ni enrutamiento de modelos. Si necesitas embeddings, debes usar un servicio separado. El límite estricto de contenido bloquea el contenido sexual que involucra a menores, pero de lo contrario permite temas adultos lícitos y controversiales. Errores como 401 indican una clave no válida, mientras que 402 indica crédito prepago insuficiente.

Ficha técnica de la API

Una tabla con cada límite, función y precio.

ElementoValor
Formatocompatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave
Base URLhttps://api.unlimitedaiapi.com/v1
AutenticaciónAuthorization: Bearer YOUR_KEY
EndpointsPOST /v1/chat/completions · GET /v1/models
ID del modelouncensored
Streamingsí: server-sent events; el último fragmento incluye el uso de tokens
Parámetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Salida máximahasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte)
Modo JSONresponse_format: {"type": "json_object"}
Ventana de contexto100.000 tokens (entrada + salida)
Llamadas a funcionessí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool
Límite de peticiones300 por minuto por clave
Concurrencia8 peticiones a la vez por clave
Tamaño de peticiónhasta 8 MB
CabecerasX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Caducidadel crédito pagado no caduca, sin suscripción
Prueba gratis$0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga
Precio$0,25 por 1M tokens de entrada · $1,00 por 1M de salida
Bono+5 % desde $50, +10 % desde $100
RecargaUSDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500
Facturacióncrédito prepago por uso real; errores y rechazos no se cobran
AccesoGoogle o correo y contraseña
Contenidocontenido adulto permitido; se rechaza el contenido sexual con menores
Clavesuna clave activa por cuenta; una nueva reemplaza a la anterior

Códigos de error

Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.

CódigoTipoSignificado
400bad_requestJSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo
401missing_key · invalid_key · key_revokedfalta la clave, es incorrecta o fue reemplazada
402no_creditsin crédito: recarga y sigue al instante
403content_blockedcontenido sexual con menores: rechazado, no se cobra
404not_foundendpoint desconocido
413request_too_largecuerpo mayor de 8 MB
429rate_limited · concurrencymás de 300/min o 8 en paralelo: espera y reintenta
503upstream_busymodelo ocupado: reintenta en unos segundos

Preguntas y respuestas

¿El modelo sin censura funciona con las herramientas estándar de OpenAI?

Sí, nuestra API es totalmente compatible con OpenAI. Puedes usar el endpoint estándar de chat-completions con cualquier SDK o cliente de OpenAI que admita la configuración de <code>base_url</code>. Admitimos llamadas a funciones y streaming mediante SSE.

¿Cómo funciona la facturación para las respuestas en streaming?

La facturación se basa en el número total de tokens de entrada y salida procesados, independientemente de si usas streaming o respuestas estándar. El streaming solo afecta a la latencia, no al costo por token. Pagas $0,25 por cada 1M de tokens de entrada y $1,00 por cada 1M de tokens de salida.

¿Puedo usar esta API para generación de imágenes o audio?

No, solo ofrecemos generación de texto a través del endpoint <code>chat-completions</code>. No admitimos embeddings, generación de imágenes, audio ni video. Si necesitas esas capacidades, deberás integrar un servicio diferente para esos pasos específicos.

Tu clave está a un formulario de distancia

Crea una cuenta, copia la clave, cambia la URL base. Eso es toda la configuración.

Obtener clave de API