Unlimited AI API: Szybki start Przewodnik
Pobierz swój klucz API i zacznij wysyłać zapytania tekstowe w kilka minut. Przewodnik obejmuje Base URL, uwierzytelnianie i standardowe endpointy kompatybilne z OpenAI dla naszego modelu LLM bez cenzury.
Base URL i uwierzytelnianie
Nasze API jest w pełni kompatybilne z formatem SDK OpenAI. Musisz ustawić base URL na https://api.unlimitedaiapi.com/v1. Zapewnia to kierowanie wszystkich zapytań do naszego dedykowanego modelu bez cenzury, a nie proxy ani agregatora. Autoryzacja używa tokena Bearer w nagłówku Authorization. Możesz wygenerować klucz natychmiast po zalogowaniu się za pomocą samego adresu e-mail i hasła. Klucz jest wyświetlany raz po rejestracji, ale możesz go wygenerować ponownie w dowolnym momencie, co unieważnia poprzedni. Nie wymagamy numeru telefonu ani karty kredytowej dla warstwy próbnej.
Pierwsze zapytanie
Wyślij najpierw proste zapytanie do endpointu uzupełnienia rozmowy. To potwierdzi, że Twój klucz API działa, i pokaże prędkość odpowiedzi. ID modelu to zawsze uncensored. Możesz wysłać wiele wiadomości w jednym zapytaniu, aby zachować kontekst. Model obsługuje standardowe formaty wiadomości OpenAI. Nie ma skomplikowanych reguł routingu ani specyficznych dla dostawcy niuansów, które trzeba konfigurować.
curl https://api.unlimitedaiapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Sprawdź odpowiedź pod kątem tablicy choices zawierającej wygenerowany tekst. Jeśli otrzymasz błąd 401, zweryfikuj swój klucz API. Błąd 402 oznacza, że Twój przedpłacony kredyt został wyczerpany.
Integracja z Python SDK
Użycie oficjalnej biblioteki Pythona openai sprawia, że integracja jest trywialna. Ustaw base_url i api_key podczas inicjalizacji klienta. To podejście działa dla wywołań synchronicznych, co jest standardowym trybem dla większości skryptów. Obsługujemy standardowe wejście i wyjście tekstowe. Nie oferujemy osadzania ani generowania obrazów, więc skup swój ładunek na tekście. SDK automatycznie zarządza tokenizacją, więc nie musisz ręcznie liczyć tokenów przy podstawowym użyciu.
from openai import OpenAI
client = OpenAI(base_url="https://api.unlimitedaiapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Upewnij się, że używasz najnowszej wersji SDK, aby poprawnie obsługiwać parametr base_url. To ustawienie łączy się bezpośrednio z naszą infrastrukturą bez warstw routingu stron trzecich.
Użycie Node SDK
W środowiskach Node.js oficjalny pakiet openai działa przy minimalnej konfiguracji. Przekaż swój klucz API i poprawny base URL podczas inicjalizacji. Pozwala to wykorzystać istniejącą infrastrukturę Node.js przy zachowaniu pełnej kontroli nad wywołaniami API. Obsługujemy standardowe wzorce żądanie-odpowiedź. Strumieniowanie jest obsługiwane osobno za pomocą zdarzeń wysyłanych serwerowo. Model jest modelem o otwartych wagach dostrojonym do mniejszej liczby odmów, co czyni go odpowiednim do tematów kreatywnych lub kontrowersyjnych w granicach prawa.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.unlimitedaiapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Pamiętaj, że rozliczamy się za tokeny, więc monitoruj swoje zużycie za pomocą nagłówków odpowiedzi lub swojego panelu. Nie ma ukrytych opłat ani subskrypcji miesięcznych.
Odpowiedzi strumieniowe
Możesz włączyć strumieniowanie, ustawiając parametr stream na true w swoim zapytaniu. API zwraca zdarzenia wysyłane przez serwer (SSE) zamiast pojedynczego obiektu JSON. Zmniejsza to postrzegane opóźnienie przy długich wynikach. Każdy chunk zawiera cząstkową deltę odpowiedzi. Musisz zsumować te delty, aby odtworzyć pełny tekst. Ceny są nadal oparte na całkowitej liczbie tokenów wejściowych i wyjściowych przetworzonych niezależnie od strumieniowania. Jest to idealne dla interfejsów użytkownika, które chcą wyświetlać tekst w miarę jego generowania.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Obsługuj parsowanie SSE ostrożnie, aby uniknąć wycieków pamięci w przypadku nieoczekiwanego zerwania połączenia. Okno kontekstu 100 000 tokenów dotyczy całej historii rozmowy, a nie tylko bieżącej tury.
Limity, błędy i kontekst
Twój klucz API jest ograniczony do 300 zapytań na minutę. Jeśli przekroczysz ten limit, otrzymasz błąd limitu zapytań 429. Maksymalny rozmiar ciała zapytania to 8 MB. Model ma okno kontekstu 100 000 tokenów, obejmujące zarówno tokeny promptu, jak i uzupełnienia rozmowy. To wystarczy do większości zadań z długimi dokumentami. Nie oferujemy dostrajania ani routingu modeli. Jeśli potrzebujesz embeddingów, musisz użyć osobnej usługi. Ścisły limit treści blokuje treści seksualne z udziałem małoletnich, ale w pozostałym zakresie pozwala na legalne treści dla dorosłych i kontrowersyjne tematy. Błędy takie jak 401 oznaczają nieprawidłowy klucz, podczas gdy 402 oznacza niewystarczający przedpłacony kredyt.
Parametry API
Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.
| Element | Wartość |
|---|---|
| Format API | zgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz |
| Base URL | https://api.unlimitedaiapi.com/v1 |
| Uwierzytelnianie | Authorization: Bearer YOUR_KEY |
| Endpointy | POST /v1/chat/completions · GET /v1/models |
| ID modelu | uncensored |
| Strumieniowanie | tak — server-sent events; ostatni fragment zawiera zużycie tokenów |
| Parametry | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Maks. odpowiedź | do reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu) |
| Tryb JSON | response_format: {"type": "json_object"} |
| Okno kontekstu | 100 000 tokenów (wejście + odpowiedź) |
| Wywoływanie funkcji | tak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool |
| Limit zapytań | 300 zapytań na minutę na klucz |
| Równoległe zapytania | do 8 jednocześnie na klucz |
| Rozmiar zapytania | do 8 MB |
| Nagłówki odpowiedzi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Ważność | opłacony kredyt nie wygasa, bez subskrypcji |
| Darmowy kredyt | $0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu |
| Cena | $0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia |
| Bonus | +5% od $50, +10% od $100 |
| Doładowanie | USDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500 |
| Rozliczenie | przedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe |
| Logowanie | Google albo e-mail i hasło |
| Treści | treści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane |
| Klucze | jeden aktywny klucz na konto; nowy zastępuje stary |
Kody błędów
Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.
| Kod | Typ | Znaczenie |
|---|---|---|
400 | bad_request | błędny JSON, puste wiadomości, zły parametr lub za długi kontekst |
401 | missing_key · invalid_key · key_revoked | brak klucza, zły klucz lub klucz zastąpiony nowym |
402 | no_credit | brak kredytu — doładuj, działa od razu |
403 | content_blocked | treści seksualne z nieletnimi — odmowa, bez opłaty |
404 | not_found | nieznany endpoint |
413 | request_too_large | treść większa niż 8 MB |
429 | rate_limited · concurrency | ponad 300/min lub 8 równolegle — odczekaj i ponów |
503 | upstream_busy | model zajęty — ponów za kilka sekund |
Pytania i odpowiedzi
Czy model bez cenzury działa ze standardowymi narzędziami OpenAI?
Tak, nasz API jest w pełni kompatybilny z OpenAI. Możesz użyć standardowego endpointu chat-completions z dowolnym SDK lub klientem OpenAI obsługującym konfigurację <code>base_url</code>. Wspieramy wywoływanie funkcji i strumieniowanie przez SSE.
Jak działa rozliczenie za odpowiedzi strumieniowe?
Ceny opierają się na całkowitej liczbie przetworzonych tokenów wejściowych i wyjściowych, niezależnie od tego, czy używasz strumieniowania, czy standardowych odpowiedzi. Strumieniowanie wpływa tylko na opóźnienie, nie na koszt za token. Płacisz $0,25 za 1 mln tokenów wejściowych i $1,00 za 1 mln tokenów wyjściowych.
Czy mogę użyć tego API do generowania obrazów lub audio?
Nie, oferujemy tylko generowanie tekstu przez endpoint <code>chat-completions</code>. Nie obsługujemy embeddingów, generowania obrazu, audio ani wideo. Jeśli potrzebujesz tych możliwości, musisz zintegrować inną usługę dla tych konkretnych kroków.
Twój klucz jest o jeden formularz stąd
Stwórz konto, skopiuj klucz, zmień Base URL. To cały proces konfiguracji.