Tài liệu API Chat Completions không kiểm duyệt
Tài liệu này hướng dẫn bạn tích hợp LLM không kiểm duyệt của chúng tôi thông qua endpoint chat completions tương thích tiêu chuẩn với OpenAI. Bạn có thể bắt đầu tạo văn bản ngay lập tức bằng cách định cấu hình máy khách của mình với URL cơ sở của chúng tôi và một khóa API vừa được tạo.
Trên trang này
Xác thực & Cài đặt
Yêu cầu truy cập phải có một khóa API hợp lệ liên kết với tài khoản của bạn. Bạn tạo khóa này trên trang Get API Key sau khi đăng ký bằng email và mật khẩu. Khóa được hiển thị ngay lập tức khi tạo. Để chuyển từ một nhà cung cấp như OpenAI, hãy cập nhật cấu hình máy khách của bạn để trỏ đến URL cơ sở của chúng tôi: https://api.unfilteredaimodels.com/v1 và cung cấp khóa API độc nhất của bạn. Chúng tôi hỗ trợ định dạng tiêu chuẩn của tiêu đề Authorization.
Endpoint Chat Completions
Giao diện chính là endpoint POST /v1/chat/completions. Nó chấp nhận các đối tượng tin nhắn tiêu chuẩn và trả về phản hồi văn bản. ID mô hình cần chỉ định là uncensored. Endpoint này xử lý việc tạo văn bản thô mà không có các giới hạn doanh nghiệp điển hình, cho phép nội dung người lớn, gây tranh cãi hoặc sáng tạo trong các giới hạn pháp lý. Bạn có thể gửi yêu cầu đầu tiên bằng ví dụ sau:
curl https://api.unfilteredaimodels.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Yêu cầu này minh họa việc gửi một prompt hệ thống đơn giản và truy vấn của người dùng để tạo phản hồi.
Tích hợp SDK Python
Sử dụng gói Python openai chính thức. Khởi tạo máy khách với URL cơ sở của chúng tôi và khóa API của bạn. Sau đó gọi chat.completions.create với ID mô hình uncensored. Cách tiếp cận này yêu cầu không thay đổi mã nào nếu bạn đang sử dụng SDK OpenAI cho các dịch vụ khác. Đoạn mã sau đây cho thấy cách khởi tạo máy khách và gửi yêu cầu:
from openai import OpenAI
client = OpenAI(base_url="https://api.unfilteredaimodels.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
SDK xử lý tự động việc tuần tự hóa JSON và phân tích phản hồi.
Tích hợp SDK Node.js
Đối với môi trường JavaScript, hãy sử dụng gói Node openai. Cấu hình basePath thành endpoint của chúng tôi và cung cấp khóa API của bạn. Gọi phương thức chat.completions.create với ID mô hình uncensored. Điều này đảm bảo tương thích với các ứng dụng Node.js hiện có yêu cầu phản hồi chuẩn OpenAI. Đây là cách thiết lập máy khách:
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.unfilteredaimodels.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Cài đặt này đảm bảo ứng dụng Node của bạn có thể giao tiếp với mô hình không kiểm duyệt của chúng tôi bằng các mẫu quen thuộc.
Phản hồi truyền phát
Đặt tham số stream thành true để nhận các sự kiện do máy chủ gửi (SSE). Điều này cho phép bạn xử lý các token khi chúng được tạo, giảm độ trễ cảm nhận được cho các phản hồi dài. API trả về một luồng các chunk, mỗi chunk chứa các delta một phần của phản hồi. Sử dụng ví dụ sau để triển khai truyền phát:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Truyền phát rất lý tưởng cho các giao diện trò chuyện nơi người dùng mong đợi thấy văn bản xuất hiện theo thời gian thực.
Giới hạn tốc độ & Hạn mức
Khóa API của bạn bị giới hạn ở 300 yêu cầu mỗi phút. Nếu vượt quá giới hạn này, bạn sẽ nhận được lỗi 429 Too Many Requests. Bạn có thể tạo lại khóa bất cứ lúc nào từ bảng điều khiển của mình, điều này sẽ thu hồi khóa cũ và cung cấp một khóa mới với bộ đếm giới hạn tốc độ mới. Các lỗi khác bao gồm 401 cho khóa không hợp lệ và 402 nếu tín dụng trả trước của bạn đã hết. Cửa sổ ngữ cảnh hỗ trợ tối đa 100.000 token cho prompt và phần hoàn thành kết hợp. Thân yêu cầu được giới hạn ở 8 MB.
Thông số kỹ thuật
Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.
| Mục | Giá trị |
|---|---|
| Định dạng | tương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa |
| Xác thực | Authorization: Bearer YOUR_KEY |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.unfilteredaimodels.com/v1 |
| ID mô hình | uncensored |
| Chế độ JSON | response_format: {"type": "json_object"} |
| Đầu ra tối đa | tối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng) |
| Gọi hàm | có — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool |
| Streaming | có — server-sent events; phần cuối chứa lượng token đã dùng |
| Tham số | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Cửa sổ ngữ cảnh | 100.000 token (đầu vào + đầu ra) |
| Giới hạn tốc độ | 300 yêu cầu mỗi phút cho mỗi khóa |
| Yêu cầu đồng thời | tối đa 8 cùng lúc cho mỗi khóa |
| Kích thước yêu cầu | tối đa 8 MB |
| Header phản hồi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Tính phí | tín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí |
| Giá | $0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra |
| Dùng thử miễn phí | $0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu |
| Nạp tiền | USDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500 |
| Thời hạn | tín dụng đã trả không hết hạn, không đăng ký định kỳ |
| Thưởng | +5% từ $50, +10% từ $100 |
| Nội dung | cho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên |
| Đăng nhập | Google hoặc email và mật khẩu |
| Khóa | mỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ |
Mã lỗi
Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.
| Mã | Loại | Ý nghĩa |
|---|---|---|
400 | bad_request | JSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh |
401 | missing_key · invalid_key · key_revoked | thiếu khóa, sai khóa hoặc khóa đã bị thay |
402 | no_credit | hết tín dụng — nạp tiền là dùng tiếp ngay |
403 | content_blocked | nội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí |
404 | not_found | endpoint không tồn tại |
413 | request_too_large | nội dung lớn hơn 8 MB |
429 | rate_limited · concurrency | vượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại |
503 | upstream_busy | mô hình đang bận — thử lại sau vài giây |
Hỏi đáp
Việc tạo lại khóa API có đặt lại giới hạn tốc độ của tôi không?
Có. Việc tạo lại khóa của bạn sẽ thu hồi khóa cũ và cấp một khóa mới với bộ đếm giới hạn tốc độ mới. Giới hạn 300 yêu cầu mỗi phút áp dụng cho khóa cụ thể đang được sử dụng.
Nội dung nào bị hạn chế?
Mô hình không từ chối hầu hết các chủ đề người lớn, hư cấu hoặc gây tranh cãi. Tuy nhiên, luôn có một giới hạn cứng: nội dung tình dục liên quan đến trẻ vị thành niên sẽ bị chặn.
Mô hình có được tinh chỉnh (fine-tuned) hay là GPT tiêu chuẩn không?
Đây là một mô hình trọng số mở chạy trên máy chủ GPU của chúng tôi, được tinh chỉnh cho đầu ra không kiểm duyệt. Nó không phải là GPT, Claude hay bất kỳ mô hình của nhà cung cấp nào khác.
Khóa của bạn chỉ cách một biểu mẫu
Tạo tài khoản, sao chép khóa, thay đổi URL cơ sở. Đó là toàn bộ quá trình cài đặt.