認証とベースURL
当APIは既存のOpenAIクライアントへのそのまま置き換え可能として設計されています。設定で変更する必要があるのは2つのことだけです:ベースURLとAPI キー。このサービスのベースURLはhttps://api.uncensoredgpt.top/v1です。ダッシュボードでGoogleまたはメールでサインインすると、すぐにAPI キーを生成できます。電話番号は不要で、API キーは作成時に1回表示されます。
キーを安全に保管してください。紛失した場合はダッシュボードから新しいキーを生成でき、以前のキーは無効になります。この簡単なセットアップにより、カスタムアダプターなしで標準ライブラリを使用して当社の無検閲ai apiに接続できます。
チャット補完エンドポイント
コア機能は標準のPOST /v1/chat/completionsエンドポイントを通じて提供されます。このエンドポイントはテキスト入力を受け取り、テキスト出力を返します。同期リクエストと非同期リクエストの両方に対応しています。モデルのルーティングや集約を気にする必要はありません。私たちは制限のないコンテンツ向けにチューニングされた単一の高性能無検閲大規模言語モデルを提供しています。
リクエストを行う際は、モデルIDをuncensoredとして指定する必要があります。このモデルはオープンウェイトモデルであり、GPT、Claude、またはその他のベンダーモデルとは異なる当社のサーバーでホストされています。法的な成人向け用途においてコンテンツ拒否なしで回答するように設計されており、NSFWや論争的なトピックに最適です。
始めるには、簡単なcURLコマンドでエンドポイントをテストできます。YOUR_API_KEYを実際のキーに置き換えてください。
curl https://api.uncensoredgpt.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
ストリーミングレスポンス(SSE)
リアルタイムアプリケーション向けに、APIはServer-Sent Events (SSE)をサポートしています。ストリーミングにより、トークンが生成されるたびにそれを受け取ることができ、チャットインターフェースにより良いユーザー体験を提供します。リクエストでstream: trueを設定すると、APIは単一の完全なレスポンスではなく、チャンクのストリームを返します。
各チャンクには部分的なテキストが含まれており、最終的なチャンクには課金目的のトークン使用統計情報が含まれます。この機能は、即時フィードバックを必要とするアプリケーションに特に役立ちます。適切なSDKを使用して、お好みの言語でストリームを処理できます。
cURLを使用してストリーミングリクエストを開始する方法の例を以下に示します。
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
関数呼び出しとツール
APIは関数呼び出しをサポートしており、アプリケーションが外部ツールやサービスと連携できます。toolsパラメータに関数のリストを定義し、適切な場合はモデルが関数呼び出しで応答します。これはエージェントや特定のアクションを実行する必要があるアプリケーションの構築に役立ちます。
tool_choiceを使用してモデルの動作を制御できます。これはauto、none、または特定の関数IDに設定できます。モデルはレスポンスに関数名と引数を返すため、それらをアプリケーションで実行できます。
OpenAI互換SDKを使用して関数呼び出し機能を使用する方法を示すPythonの例を以下に示します。
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredgpt.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
JSON モード設定
構造化出力が必要な場合は、response_formatパラメータを{"type": "json_object"}に設定してJSON モードを有効にできます。これはモデルに有効なJSON構文に準拠した出力を生成するよう指示します。これはレスポンスをプログラムで解析する必要があるアプリケーションに特に有用です。
JSON モードを使用すると、モデルはJSONオブジェクトの周りにマークダウンフェンスや余分なテキストを追加しません。これにより、パサーが追加のクリーンアップ手順なしでレスポンスを直接消費できるようになります。これはLLMから構造化データを取得する信頼性の高い方法です。
JSON モード用にクライアントを設定する方法を示すNode.jsの例を以下に示します。
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredgpt.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
パラメータ:温度とTop P
temperatureやtop_pなどのパラメータを使用して、モデルのレスポンスのランダム性と創造性を制御できます。temperatureパラメータはサンプリング温度を調整し、低い値は出力をより決定論的に、高い値はより創造的にします。top_pパラメータは核サンプリングを制御し、モデルがトークンの上位pの確率質量のみを考慮するように制限します。
その他のサポートされているパラメータには、stopシーケンス、再現性のためのseed、およびpresence_penaltyとfrequency_penaltyのペナルティが含まれます。これらのパラメータにより、特定のユースケースに合わせてモデルの動作を微調整できます。
これらのパラメータを理解することは、生成テキストの品質を最適化する上で重要です。アプリケーションに適したバランスを見つけるために、異なる値で実験してください。
API 仕様
購入前に確認できるよう、API の実際の制限と機能をすべてまとめました。
| 項目 | 内容 |
|---|---|
| 形式 | OpenAI 互換:どの OpenAI SDK でも base URL とキーを変えるだけで動作 |
| エンドポイント | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.uncensoredgpt.top/v1 |
| 認証 | Authorization: Bearer YOUR_KEY |
| モデル ID | uncensored |
| ストリーミング | 対応 — SSE、最後のチャンクにトークン使用量 |
| パラメータ | temperature、top_p、stop、seed、presence_penalty、frequency_penalty |
| 関数呼び出し | 対応 — tools、tool_choice。応答に tool_calls(ストリーミングでも)、結果は role: tool で返送 |
| JSON モード | response_format: {"type": "json_object"} |
| 最大出力 | 100,000 トークンのウィンドウの残りまで。max_tokens は任意(個別の上限なし) |
| コンテキスト長 | 100,000 トークン(入力+出力) |
| リクエストサイズ | 最大 8 MB |
| レート制限 | キーごとに毎分 300 リクエスト |
| 同時実行 | キーごとに同時 8 リクエストまで |
| レスポンスヘッダー | X-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency |
| 料金 | 入力 100 万トークン $0.25 · 出力 100 万トークン $1.00 |
| 無料トライアル | $0.50、7 日間、カード不要 · トライアルキー: 同時2件、毎分60件。初回チャージ後に上限が8件・300件へ拡大 |
| 課金 | 前払いクレジットから実使用量で課金。エラーと拒否は無料 |
| チャージ | USDT(TRC20)または USDC(Base)、$10〜$500 の任意の整数額 |
| ボーナス | $50 以上で +5%、$100 以上で +10% |
| 有効期限 | 購入クレジットは失効なし、サブスクなし |
| キー | アカウントごとに有効なキーは 1 つ。新しいキーで旧キーは無効 |
| コンテンツ | 成人向けコンテンツ可。未成年者を含む性的コンテンツは拒否 |
| ログイン | Google またはメール+パスワード |
エラーコード
エラーは固定の type を持つ JSON で返ります。失敗・拒否されたリクエストは課金されません。
| コード | タイプ | 意味 |
|---|---|---|
400 | bad_request | JSON 不正、メッセージ空、パラメータ誤り、またはコンテキスト超過 |
401 | missing_key · invalid_key · key_revoked | キーなし・誤り・新しいキーに置換済み |
402 | no_credit | 残高ゼロ — チャージすれば即再開 |
403 | content_blocked | 未成年者を含む性的コンテンツ — 拒否、課金なし |
404 | not_found | 不明なエンドポイント |
413 | request_too_large | 本文が 8 MB 超 |
429 | rate_limited · concurrency | 毎分 300 回または同時 8 件を超過 — 待って再試行 |
503 | upstream_busy | モデル混雑 — 数秒後に再試行 |
質問と回答
レート制限を超えた場合どうなりますか?
1分あたり300リクエストまたは8つの同時リクエストの制限を超えると、429 Too Many Requestsエラーが発生します。API キーは8つの同時接続に制限されているため、この制限に達しないようアプリケーションで同時リクエストを適切に処理してください。
402エラーが発生するのはなぜですか?
402エラーは、前払いクレジットが枯渇したことを示します。前払いトークンモデルを採用しているため、APIを引き続き使用するにはアカウントにチャージする必要があります。エラーや拒否はクレジットを消費しないため、成功したトークン使用に対してのみ課金されます。
コンテキストウィンドウの制限は何ですか?
モデルは100,000トークンのコンテキストウィンドウをサポートしており、これにはプロンプトと補完の両方が含まれます。1リクエストあたりの最大出力は32,000トークン、またはmax_tokens値を指定しない場合は2,048トークンです。これにより、長文のコンテンツ生成や複雑な推論タスクが可能になります。
キーはフォーム 1 つで手に入ります
アカウントを作成し、キーをコピーし、ベースURLを変更します。これですべてのセットアップが完了です。