Unlimited AI API: Bắt đầu nhanh Hướng dẫn
Lấy khóa API của bạn và bắt đầu gửi yêu cầu văn bản trong vài phút. Hướng dẫn này bao gồm base URL, xác thực và các endpoint tương thích OpenAI tiêu chuẩn cho LLM không kiểm duyệt của chúng tôi.
Base URL và Xác thực
API của chúng tôi tương thích hoàn toàn với định dạng SDK OpenAI. Bạn phải đặt base URL là https://api.unlimitedaiapi.com/v1. Điều này đảm bảo tất cả yêu cầu được định tuyến đến mô hình không kiểm duyệt chuyên dụng của chúng tôi, không phải proxy hoặc bộ tổng hợp. Xác thực sử dụng token Bearer trong tiêu đề Authorization. Bạn có thể tạo khóa ngay lập tức sau khi đăng ký chỉ với email và mật khẩu. Khóa được hiển thị một lần sau khi đăng ký, nhưng bạn có thể tạo lại bất cứ lúc nào, điều này sẽ làm vô hiệu hóa khóa cũ. Chúng tôi không yêu cầu số điện thoại hoặc thẻ tín dụng cho gói dùng thử.
Yêu cầu đầu tiên
Bắt đầu bằng cách gửi một yêu cầu hoàn thành trò chuyện đơn giản. Điều này xác nhận khóa API của bạn hoạt động và cho bạn ý tưởng về tốc độ phản hồi. ID mô hình luôn là uncensored. Bạn có thể gửi nhiều tin nhắn trong một yêu cầu để duy trì ngữ cảnh. Mô hình chấp nhận định dạng tin nhắn OpenAI tiêu chuẩn. Không có quy tắc định tuyến phức tạp hoặc điểm khác biệt cụ thể của nhà cung cấp cần quản lý.
curl https://api.unlimitedaiapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Kiểm tra phản hồi cho mảng choices chứa văn bản được tạo. Nếu bạn nhận được lỗi 401, hãy xác minh khóa API của bạn. Lỗi 402 có nghĩa là tín dụng trả trước của bạn đã hết.
Tích hợp SDK Python
Sử dụng thư viện Python openai chính thức giúp việc tích hợp trở nên dễ dàng. Đặt base_url và api_key trong khởi tạo client của bạn. Cách tiếp cận này hoạt động cho các cuộc gọi đồng bộ, đây là chế độ tiêu chuẩn cho hầu hết các kịch bản. Chúng tôi hỗ trợ đầu vào và đầu ra văn bản tiêu chuẩn. Chúng tôi không cung cấp embedding hoặc tạo ảnh, vì vậy hãy giữ trọng tâm tải trọng của bạn vào văn bản. SDK tự động xử lý tokenization, vì vậy bạn không cần phải đếm token thủ công cho việc sử dụng cơ bản.
from openai import OpenAI
client = OpenAI(base_url="https://api.unlimitedaiapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Đảm bảo bạn đang sử dụng phiên bản SDK mới nhất để hỗ trợ tham số base_url chính xác. Cấu hình này kết nối trực tiếp với cơ sở hạ tầng của chúng tôi mà không có lớp định tuyến bên thứ ba.
Sử dụng SDK Node.js
Đối với môi trường Node.js, gói openai chính thức hoạt động với cấu hình tối thiểu. Truyền khóa API và base URL chính xác trong quá trình khởi tạo. Điều này cho phép bạn tận dụng cơ sở hạ tầng Node.js hiện có trong khi vẫn duy trì quyền kiểm soát đầy đủ đối với các cuộc gọi API của bạn. Chúng tôi hỗ trợ các mẫu yêu cầu-phản hồi tiêu chuẩn. Truyền phát được xử lý riêng biệt qua Server-Sent Events. Mô hình là một mô hình trọng số mở được tinh chỉnh để ít từ chối hơn, phù hợp cho các chủ đề sáng tạo hoặc gây tranh cãi trong phạm vi pháp lý.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.unlimitedaiapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Hãy nhớ rằng chúng tôi tính phí theo token, vì vậy hãy theo dõi việc sử dụng của bạn qua các tiêu đề phản hồi hoặc bảng điều khiển của bạn. Không có phí ẩn hoặc đăng ký hàng tháng.
Phản hồi truyền phát (Streaming)
Bạn có thể kích hoạt truyền phát bằng cách đặt tham số stream thành true trong yêu cầu của bạn. API trả về Server-Sent Events (SSE) thay vì một đối tượng JSON duy nhất. Điều này giảm độ trễ cảm nhận được cho các đầu ra dài. Mỗi chunk chứa một phần delta của phản hồi. Bạn phải tích lũy các delta này để tái tạo lại văn bản đầy đủ. Giá vẫn dựa trên tổng số token đầu vào và đầu ra được xử lý, bất kể truyền phát. Điều này lý tưởng cho các giao diện người dùng muốn hiển thị văn bản khi nó được tạo.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Xử lý phân tích cú pháp SSE cẩn thận để tránh rò rỉ bộ nhớ nếu kết nối bị ngắt đột ngột. Cửa sổ ngữ cảnh 100.000 token áp dụng cho toàn bộ lịch sử hội thoại, không chỉ lượt hiện tại.
Giới hạn, Lỗi và Ngữ cảnh
Khóa API của bạn bị giới hạn ở 300 yêu cầu mỗi phút. Nếu vượt quá giới hạn này, bạn sẽ nhận được lỗi giới hạn tốc độ 429. Kích thước tối đa của thân yêu cầu là 8 MB. Mô hình có cửa sổ ngữ cảnh 100,000 token, bao gồm cả token prompt và token hoàn thành. Điều này đủ cho hầu hết các tác vụ xử lý tài liệu dài. Chúng tôi không cung cấp tùy chỉnh mô hình hay định tuyến mô hình. Nếu bạn cần embedding, bạn phải sử dụng một dịch vụ riêng biệt. Giới hạn nội dung cứng chặn nội dung tình dục liên quan đến trẻ em dưới 18 tuổi, nhưng vẫn cho phép các chủ đề hợp pháp dành cho người trưởng thành và các chủ đề gây tranh cãi. Các lỗi như 401 cho biết khóa không hợp lệ, trong khi 402 cho biết tín dụng trả trước không đủ.
Thông số API
Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.
| Mục | Giá trị |
|---|---|
| Định dạng | tương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa |
| Base URL | https://api.unlimitedaiapi.com/v1 |
| Xác thực | Authorization: Bearer YOUR_KEY |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| ID mô hình | uncensored |
| Streaming | có — server-sent events; phần cuối chứa lượng token đã dùng |
| Tham số | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Đầu ra tối đa | tối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng) |
| Chế độ JSON | response_format: {"type": "json_object"} |
| Cửa sổ ngữ cảnh | 100.000 token (đầu vào + đầu ra) |
| Gọi hàm | có — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool |
| Giới hạn tốc độ | 300 yêu cầu mỗi phút cho mỗi khóa |
| Yêu cầu đồng thời | tối đa 8 cùng lúc cho mỗi khóa |
| Kích thước yêu cầu | tối đa 8 MB |
| Header phản hồi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Thời hạn | tín dụng đã trả không hết hạn, không đăng ký định kỳ |
| Dùng thử miễn phí | $0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu |
| Giá | $0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra |
| Thưởng | +5% từ $50, +10% từ $100 |
| Nạp tiền | USDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500 |
| Tính phí | tín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí |
| Đăng nhập | Google hoặc email và mật khẩu |
| Nội dung | cho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên |
| Khóa | mỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ |
Mã lỗi
Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.
| Mã | Loại | Ý nghĩa |
|---|---|---|
400 | bad_request | JSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh |
401 | missing_key · invalid_key · key_revoked | thiếu khóa, sai khóa hoặc khóa đã bị thay |
402 | no_credit | hết tín dụng — nạp tiền là dùng tiếp ngay |
403 | content_blocked | nội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí |
404 | not_found | endpoint không tồn tại |
413 | request_too_large | nội dung lớn hơn 8 MB |
429 | rate_limited · concurrency | vượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại |
503 | upstream_busy | mô hình đang bận — thử lại sau vài giây |
Hỏi đáp
Mô hình không kiểm duyệt có hoạt động với các công cụ OpenAI tiêu chuẩn không?
Có, API của chúng tôi tương thích hoàn toàn với OpenAI. Bạn có thể sử dụng endpoint chat-completions tiêu chuẩn với bất kỳ SDK hoặc client OpenAI nào hỗ trợ cấu hình <code>base_url</code>. Chúng tôi hỗ trợ gọi hàm (tool/function calling) và truyền phát (streaming) qua SSE.
Cách tính giá cho các phản hồi truyền phát (streaming)?
Giá dựa trên tổng số token đầu vào và đầu ra được xử lý, bất kể bạn sử dụng truyền phát (streaming) hay phản hồi tiêu chuẩn. Truyền phát chỉ ảnh hưởng đến độ trễ, không ảnh hưởng đến chi phí trên mỗi token. Bạn trả $0.25 cho mỗi 1M token đầu vào và $1.00 cho mỗi 1M token đầu ra.
Tôi có thể sử dụng API này cho tạo ảnh hoặc âm thanh không?
Không, chúng tôi chỉ cung cấp tạo văn bản qua endpoint <code>chat-completions</code>. Chúng tôi không hỗ trợ embedding, tạo ảnh, âm thanh hoặc video. Nếu bạn cần những khả năng đó, bạn sẽ cần tích hợp một dịch vụ khác cho các bước cụ thể đó.
Khóa của bạn chỉ cách một biểu mẫu
Tạo tài khoản, sao chép khóa, thay đổi base URL. Đó là toàn bộ thiết lập.