Xác thực & URL cơ sở
API của chúng tôi được thiết kế để thay thế trực tiếp cho các máy khách OpenAI hiện có. Bạn chỉ cần thay đổi hai thứ trong cấu hình của mình: URL cơ sở và khóa API. URL cơ sở cho dịch vụ này là https://api.uncensoredgpt.top/v1. Bạn có thể tạo khóa API ngay lập tức sau khi đăng nhập qua Google hoặc email trên bảng điều khiển. Không cần số điện thoại và khóa chỉ được hiển thị một lần khi tạo.
Hãy đảm bảo lưu trữ khóa của bạn một cách bảo mật. Nếu bạn mất nó, bạn có thể tạo một khóa mới từ bảng điều khiển, khóa cũ sẽ bị vô hiệu hóa. Thiết lập đơn giản này cho phép bạn kết nối với API AI không kiểm duyệt của chúng tôi bằng các thư viện tiêu chuẩn mà không cần bộ điều chỉnh tùy chỉnh.
Endpoint Chat Completions
Chức năng cốt lõi được cung cấp thông qua endpoint POST /v1/chat/completions tiêu chuẩn. Endpoint này chấp nhận đầu vào văn bản và trả về đầu ra văn bản, hỗ trợ cả yêu cầu đồng bộ và không đồng bộ. Bạn không cần lo lắng về việc định tuyến mô hình hoặc tổng hợp; chúng tôi cung cấp một mô hình ngôn ngữ lớn không kiểm duyệt hiệu suất cao được tinh chỉnh cho nội dung không giới hạn.
Khi thực hiện yêu cầu, bạn phải chỉ định ID mô hình là uncensored. Mô hình này là mô hình trọng số mở và được lưu trữ trên máy chủ của chính chúng tôi, khác biệt với GPT, Claude hoặc các mô hình của nhà cung cấp khác. Nó được thiết kế để trả lời mà không từ chối nội dung cho mục đích người trưởng thành hợp pháp, rất lý tưởng cho các chủ đề NSFW hoặc gây tranh cãi.
Để bắt đầu, bạn có thể kiểm tra endpoint bằng một lệnh cURL đơn giản. Thay YOUR_API_KEY bằng khóa thực tế của bạn.
curl https://api.uncensoredgpt.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Phản hồi truyền phát (SSE)
Đối với các ứng dụng thời gian thực, API hỗ trợ Sự kiện gửi bởi máy chủ (SSE). Truyền phát cho phép bạn nhận token khi chúng được tạo, cung cấp trải nghiệm người dùng tốt hơn cho các giao diện trò chuyện. Khi bạn đặt stream: true trong yêu cầu của mình, API sẽ trả về một luồng các chunk thay vì một phản hồi hoàn chỉnh duy nhất.
Mỗi chunk chứa văn bản một phần và chunk cuối cùng bao gồm thống kê sử dụng token để tính phí. Tính năng này đặc biệt hữu ích cho các ứng dụng yêu cầu phản hồi ngay lập tức. Bạn có thể xử lý luồng bằng ngôn ngữ ưa thích của mình bằng SDK phù hợp.
Dưới đây là ví dụ về cách khởi tạo yêu cầu truyền phát bằng cURL:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Gọi hàm & Công cụ
API hỗ trợ gọi hàm, cho phép ứng dụng của bạn tương tác với các công cụ và dịch vụ bên ngoài. Bạn có thể xác định một danh sách các hàm trong tham số tools và mô hình sẽ trả về một lệnh gọi hàm nếu phù hợp. Điều này hữu ích để xây dựng các tác nhân hoặc ứng dụng cần thực hiện các hành động cụ thể.
Bạn có thể kiểm soát hành vi của mô hình bằng tool_choice, có thể được đặt thành auto, none hoặc một ID hàm cụ thể. Mô hình sẽ trả về tên hàm và các đối số trong phản hồi, sau đó bạn có thể thực thi chúng trong ứng dụng của mình.
Dưới đây là ví dụ Python minh họa cách sử dụng tính năng gọi hàm với SDK tương thích OpenAI:
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredgpt.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Cấu hình chế độ JSON
Nếu bạn cần đầu ra có cấu trúc, bạn có thể bật chế độ JSON bằng cách đặt tham số response_format thành {"type": "json_object"}. Điều này hướng dẫn mô hình tạo đầu ra tuân thủ cú pháp JSON hợp lệ. Điều này đặc biệt hữu ích cho các ứng dụng yêu cầu phân tích cú pháp phản hồi theo cách lập trình.
Khi sử dụng chế độ JSON, mô hình sẽ tránh thêm các hàng rào markdown hoặc văn bản bổ sung xung quanh đối tượng JSON. Điều này đảm bảo trình phân tích cú pháp của bạn có thể tiêu thụ trực tiếp phản hồi mà không cần các bước dọn dẹp bổ sung. Đây là một cách đáng tin cậy để lấy dữ liệu có cấu trúc từ LLM.
Dưới đây là ví dụ Node.js cho thấy cách cấu hình khách hàng cho chế độ JSON:
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredgpt.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Tham số: Nhiệt độ & Top P
Bạn có thể kiểm soát độ ngẫu nhiên và sáng tạo trong các phản hồi của mô hình bằng các tham số như temperature và top_p. Tham số temperature điều chỉnh nhiệt độ lấy mẫu, với các giá trị thấp hơn làm cho đầu ra xác định hơn và các giá trị cao hơn làm cho nó sáng tạo hơn. Tham số top_p kiểm soát lấy mẫu hạt nhân, giới hạn mô hình chỉ xem xét khối xác suất top p của các token.
Các tham số được hỗ trợ khác bao gồm chuỗi stop, seed để tái lập lại, và các hình phạt cho presence_penalty và frequency_penalty. Các tham số này cho phép bạn tinh chỉnh hành vi của mô hình để phù hợp với trường hợp sử dụng cụ thể của bạn.
Hiểu các tham số này là rất quan trọng để tối ưu hóa chất lượng văn bản được tạo của bạn. Hãy thử nghiệm với các giá trị khác nhau để tìm sự cân bằng phù hợp cho ứng dụng của bạn.
Thông số API
Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.
| Mục | Giá trị |
|---|---|
| Định dạng | tương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.uncensoredgpt.top/v1 |
| Xác thực | Authorization: Bearer YOUR_KEY |
| ID mô hình | uncensored |
| Streaming | có — server-sent events; phần cuối chứa lượng token đã dùng |
| Tham số | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Gọi hàm | có — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool |
| Chế độ JSON | response_format: {"type": "json_object"} |
| Đầu ra tối đa | tối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng) |
| Cửa sổ ngữ cảnh | 100.000 token (đầu vào + đầu ra) |
| Kích thước yêu cầu | tối đa 8 MB |
| Giới hạn tốc độ | 300 yêu cầu mỗi phút cho mỗi khóa |
| Yêu cầu đồng thời | tối đa 8 cùng lúc cho mỗi khóa |
| Header phản hồi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Giá | $0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra |
| Dùng thử miễn phí | $0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu |
| Tính phí | tín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí |
| Nạp tiền | USDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500 |
| Thưởng | +5% từ $50, +10% từ $100 |
| Thời hạn | tín dụng đã trả không hết hạn, không đăng ký định kỳ |
| Khóa | mỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ |
| Nội dung | cho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên |
| Đăng nhập | Google hoặc email và mật khẩu |
Mã lỗi
Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.
| Mã | Loại | Ý nghĩa |
|---|---|---|
400 | bad_request | JSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh |
401 | missing_key · invalid_key · key_revoked | thiếu khóa, sai khóa hoặc khóa đã bị thay |
402 | no_credit | hết tín dụng — nạp tiền là dùng tiếp ngay |
403 | content_blocked | nội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí |
404 | not_found | endpoint không tồn tại |
413 | request_too_large | nội dung lớn hơn 8 MB |
429 | rate_limited · concurrency | vượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại |
503 | upstream_busy | mô hình đang bận — thử lại sau vài giây |
Hỏi đáp
Điều gì xảy ra nếu tôi vượt quá giới hạn tốc độ?
Nếu bạn vượt quá giới hạn 300 yêu cầu mỗi phút hoặc 8 yêu cầu đồng thời, bạn sẽ nhận được lỗi 429 Too Many Requests. Khóa API của bạn được giới hạn ở 8 kết nối đồng thời, vì vậy hãy đảm bảo ứng dụng của bạn xử lý các yêu cầu đồng thời một cách phù hợp để tránh chạm vào giới hạn này.
Tại sao tôi nhận được lỗi 402?
Lỗi 402 cho biết tín dụng trả trước của bạn đã hết. Vì chúng tôi sử dụng mô hình token trả trước, bạn cần nạp tiền vào tài khoản để tiếp tục sử dụng API. Lỗi và từ chối không tiêu tốn tín dụng, vì vậy bạn chỉ trả tiền cho việc sử dụng token thành công.
Giới hạn cửa sổ ngữ cảnh là gì?
Mô hình hỗ trợ cửa sổ ngữ cảnh 100.000 token, bao gồm cả prompt và phần hoàn thành. Đầu ra tối đa cho mỗi yêu cầu là 32.000 token, hoặc 2.048 token nếu bạn không chỉ định giá trị max_tokens. Điều này cho phép tạo nội dung dài và các tác vụ suy luận phức tạp.
Khóa của bạn chỉ cách một biểu mẫu
Tạo tài khoản, sao chép khóa, thay đổi URL cơ sở. Đó là toàn bộ thiết lập.