VI ▾
Lấy khóa API

Unlimited AI API: Bắt đầu nhanh Hướng dẫn

Lấy khóa API của bạn và bắt đầu gửi yêu cầu văn bản trong vài phút. Hướng dẫn này bao gồm base URL, xác thực và các endpoint tương thích OpenAI tiêu chuẩn cho LLM không kiểm duyệt của chúng tôi.

Base URL và Xác thực

API của chúng tôi tương thích hoàn toàn với định dạng SDK OpenAI. Bạn phải đặt base URL là https://api.unlimitedaiapi.com/v1. Điều này đảm bảo tất cả yêu cầu được định tuyến đến mô hình không kiểm duyệt chuyên dụng của chúng tôi, không phải proxy hoặc bộ tổng hợp. Xác thực sử dụng token Bearer trong tiêu đề Authorization. Bạn có thể tạo khóa ngay lập tức sau khi đăng ký chỉ với email và mật khẩu. Khóa được hiển thị một lần sau khi đăng ký, nhưng bạn có thể tạo lại bất cứ lúc nào, điều này sẽ làm vô hiệu hóa khóa cũ. Chúng tôi không yêu cầu số điện thoại hoặc thẻ tín dụng cho gói dùng thử.

Yêu cầu đầu tiên

Bắt đầu bằng cách gửi một yêu cầu hoàn thành trò chuyện đơn giản. Điều này xác nhận khóa API của bạn hoạt động và cho bạn ý tưởng về tốc độ phản hồi. ID mô hình luôn là uncensored. Bạn có thể gửi nhiều tin nhắn trong một yêu cầu để duy trì ngữ cảnh. Mô hình chấp nhận định dạng tin nhắn OpenAI tiêu chuẩn. Không có quy tắc định tuyến phức tạp hoặc điểm khác biệt cụ thể của nhà cung cấp cần quản lý.

curl https://api.unlimitedaiapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Kiểm tra phản hồi cho mảng choices chứa văn bản được tạo. Nếu bạn nhận được lỗi 401, hãy xác minh khóa API của bạn. Lỗi 402 có nghĩa là tín dụng trả trước của bạn đã hết.

Tích hợp SDK Python

Sử dụng thư viện Python openai chính thức giúp việc tích hợp trở nên dễ dàng. Đặt base_url và api_key trong khởi tạo client của bạn. Cách tiếp cận này hoạt động cho các cuộc gọi đồng bộ, đây là chế độ tiêu chuẩn cho hầu hết các kịch bản. Chúng tôi hỗ trợ đầu vào và đầu ra văn bản tiêu chuẩn. Chúng tôi không cung cấp embedding hoặc tạo ảnh, vì vậy hãy giữ trọng tâm tải trọng của bạn vào văn bản. SDK tự động xử lý tokenization, vì vậy bạn không cần phải đếm token thủ công cho việc sử dụng cơ bản.

from openai import OpenAI

client = OpenAI(base_url="https://api.unlimitedaiapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Đảm bảo bạn đang sử dụng phiên bản SDK mới nhất để hỗ trợ tham số base_url chính xác. Cấu hình này kết nối trực tiếp với cơ sở hạ tầng của chúng tôi mà không có lớp định tuyến bên thứ ba.

Sử dụng SDK Node.js

Đối với môi trường Node.js, gói openai chính thức hoạt động với cấu hình tối thiểu. Truyền khóa API và base URL chính xác trong quá trình khởi tạo. Điều này cho phép bạn tận dụng cơ sở hạ tầng Node.js hiện có trong khi vẫn duy trì quyền kiểm soát đầy đủ đối với các cuộc gọi API của bạn. Chúng tôi hỗ trợ các mẫu yêu cầu-phản hồi tiêu chuẩn. Truyền phát được xử lý riêng biệt qua Server-Sent Events. Mô hình là một mô hình trọng số mở được tinh chỉnh để ít từ chối hơn, phù hợp cho các chủ đề sáng tạo hoặc gây tranh cãi trong phạm vi pháp lý.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.unlimitedaiapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Hãy nhớ rằng chúng tôi tính phí theo token, vì vậy hãy theo dõi việc sử dụng của bạn qua các tiêu đề phản hồi hoặc bảng điều khiển của bạn. Không có phí ẩn hoặc đăng ký hàng tháng.

Phản hồi truyền phát (Streaming)

Bạn có thể kích hoạt truyền phát bằng cách đặt tham số stream thành true trong yêu cầu của bạn. API trả về Server-Sent Events (SSE) thay vì một đối tượng JSON duy nhất. Điều này giảm độ trễ cảm nhận được cho các đầu ra dài. Mỗi chunk chứa một phần delta của phản hồi. Bạn phải tích lũy các delta này để tái tạo lại văn bản đầy đủ. Giá vẫn dựa trên tổng số token đầu vào và đầu ra được xử lý, bất kể truyền phát. Điều này lý tưởng cho các giao diện người dùng muốn hiển thị văn bản khi nó được tạo.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Xử lý phân tích cú pháp SSE cẩn thận để tránh rò rỉ bộ nhớ nếu kết nối bị ngắt đột ngột. Cửa sổ ngữ cảnh 100.000 token áp dụng cho toàn bộ lịch sử hội thoại, không chỉ lượt hiện tại.

Giới hạn, Lỗi và Ngữ cảnh

Khóa API của bạn bị giới hạn ở 300 yêu cầu mỗi phút. Nếu vượt quá giới hạn này, bạn sẽ nhận được lỗi giới hạn tốc độ 429. Kích thước tối đa của thân yêu cầu là 8 MB. Mô hình có cửa sổ ngữ cảnh 100,000 token, bao gồm cả token prompt và token hoàn thành. Điều này đủ cho hầu hết các tác vụ xử lý tài liệu dài. Chúng tôi không cung cấp tùy chỉnh mô hình hay định tuyến mô hình. Nếu bạn cần embedding, bạn phải sử dụng một dịch vụ riêng biệt. Giới hạn nội dung cứng chặn nội dung tình dục liên quan đến trẻ em dưới 18 tuổi, nhưng vẫn cho phép các chủ đề hợp pháp dành cho người trưởng thành và các chủ đề gây tranh cãi. Các lỗi như 401 cho biết khóa không hợp lệ, trong khi 402 cho biết tín dụng trả trước không đủ.

Thông số API

Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.

MụcGiá trị
Định dạngtương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa
Base URLhttps://api.unlimitedaiapi.com/v1
Xác thựcAuthorization: Bearer YOUR_KEY
EndpointPOST /v1/chat/completions · GET /v1/models
ID mô hìnhuncensored
Streamingcó — server-sent events; phần cuối chứa lượng token đã dùng
Tham sốtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Đầu ra tối đatối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng)
Chế độ JSONresponse_format: {"type": "json_object"}
Cửa sổ ngữ cảnh100.000 token (đầu vào + đầu ra)
Gọi hàmcó — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool
Giới hạn tốc độ300 yêu cầu mỗi phút cho mỗi khóa
Yêu cầu đồng thờitối đa 8 cùng lúc cho mỗi khóa
Kích thước yêu cầutối đa 8 MB
Header phản hồiX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Thời hạntín dụng đã trả không hết hạn, không đăng ký định kỳ
Dùng thử miễn phí$0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu
Giá$0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra
Thưởng+5% từ $50, +10% từ $100
Nạp tiềnUSDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500
Tính phítín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí
Đăng nhậpGoogle hoặc email và mật khẩu
Nội dungcho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên
Khóamỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ

Mã lỗi

Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.

MãLoạiÝ nghĩa
400bad_requestJSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh
401missing_key · invalid_key · key_revokedthiếu khóa, sai khóa hoặc khóa đã bị thay
402no_credithết tín dụng — nạp tiền là dùng tiếp ngay
403content_blockednội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí
404not_foundendpoint không tồn tại
413request_too_largenội dung lớn hơn 8 MB
429rate_limited · concurrencyvượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại
503upstream_busymô hình đang bận — thử lại sau vài giây

Hỏi đáp

Mô hình không kiểm duyệt có hoạt động với các công cụ OpenAI tiêu chuẩn không?

Có, API của chúng tôi tương thích hoàn toàn với OpenAI. Bạn có thể sử dụng endpoint chat-completions tiêu chuẩn với bất kỳ SDK hoặc client OpenAI nào hỗ trợ cấu hình <code>base_url</code>. Chúng tôi hỗ trợ gọi hàm (tool/function calling) và truyền phát (streaming) qua SSE.

Cách tính giá cho các phản hồi truyền phát (streaming)?

Giá dựa trên tổng số token đầu vào và đầu ra được xử lý, bất kể bạn sử dụng truyền phát (streaming) hay phản hồi tiêu chuẩn. Truyền phát chỉ ảnh hưởng đến độ trễ, không ảnh hưởng đến chi phí trên mỗi token. Bạn trả $0.25 cho mỗi 1M token đầu vào và $1.00 cho mỗi 1M token đầu ra.

Tôi có thể sử dụng API này cho tạo ảnh hoặc âm thanh không?

Không, chúng tôi chỉ cung cấp tạo văn bản qua endpoint <code>chat-completions</code>. Chúng tôi không hỗ trợ embedding, tạo ảnh, âm thanh hoặc video. Nếu bạn cần những khả năng đó, bạn sẽ cần tích hợp một dịch vụ khác cho các bước cụ thể đó.

Khóa của bạn chỉ cách một biểu mẫu

Tạo tài khoản, sao chép khóa, thay đổi base URL. Đó là toàn bộ thiết lập.

Lấy khóa API