Authentification et URL de base
Notre API est conçue pour être un remplacement prêt à l’emploi pour les clients OpenAI existants. Vous devez modifier deux éléments dans votre configuration : l’URL de base et la clé API. L’URL de base pour ce service est https://api.uncensoredgpt.top/v1. Vous pouvez générer votre clé API immédiatement après vous être connecté via Google ou e-mail sur le tableau de bord. Aucun numéro de téléphone n’est requis et la clé est affichée une seule fois lors de sa création.
Assurez-vous de stocker votre clé en toute sécurité. Si vous la perdez, vous pouvez en générer une nouvelle depuis le tableau de bord, ce qui invalidera la clé précédente. Cette configuration simple vous permet de vous connecter à notre api ia sans censure à l'aide de bibliothèques standard sans adaptateurs personnalisés.
Endpoint Chat Completions
Les fonctionnalités principales sont servies via l’endpoint standard POST /v1/chat/completions. Cet endpoint accepte une entrée textuelle et retourne une sortie textuelle, prenant en charge les requêtes synchrones et asynchrones. Vous n’avez pas à vous soucier du routage ou de l’agrégation des modèles ; nous servons un seul grand modèle de langage sans censure haute performance, ajusté pour le contenu non restreint.
Lors de la réalisation d’une requête, vous devez spécifier l’ID du modèle comme uncensored. Ce modèle est à poids ouverts et hébergé sur nos propres serveurs, distinct de GPT, Claude ou d’autres modèles de fournisseurs. Il est conçu pour répondre sans refus de contenu pour une utilisation adulte légale, ce qui le rend idéal pour les sujets NSFW ou controversés.
Pour commencer, vous pouvez tester l'endpoint avec une simple commande cURL. Remplacez YOUR_API_KEY par votre clé réelle.
curl https://api.uncensoredgpt.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Réponses en streaming (SSE)
Pour les applications en temps réel, l'API prend en charge les Server-Sent Events (SSE). Le streaming vous permet de recevoir des tokens au fur et à mesure de leur génération, offrant une meilleure expérience utilisateur pour les interfaces de chat. Lorsque vous définissez stream: true dans votre requête, l'API retourne un flux de chunks plutôt qu'une réponse complète unique.
Chaque chunk contient du texte partiel, et le dernier chunk inclut les statistiques d'utilisation des tokens à des fins de facturation. Cette fonctionnalité est particulièrement utile pour les applications nécessitant une rétroaction immédiate. Vous pouvez gérer le flux dans votre langage préféré à l'aide du SDK approprié.
Voici un exemple de la manière d'initier une requête en streaming à l'aide de cURL :
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Appel de fonctions et outils
L’API prend en charge l’appel de fonctions, permettant à votre application d’interagir avec des outils et services externes. Vous pouvez définir une liste de fonctions dans le paramètre tools, et le modèle répondra par un appel de fonction si cela est approprié. Cela est utile pour créer des agents ou des applications nécessitant d’effectuer des actions spécifiques.
Vous pouvez contrôler le comportement du modèle à l'aide de tool_choice, qui peut être défini sur auto, none, ou un ID de fonction spécifique. Le modèle retournera le nom de la fonction et les arguments dans la réponse, que vous pourrez ensuite exécuter dans votre application.
Voici un exemple Python démontrant comment utiliser la fonction d'appel de fonctions avec le SDK compatible OpenAI :
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredgpt.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Configuration du mode JSON
Si vous avez besoin d’une sortie structurée, vous pouvez activer le mode JSON en définissant le paramètre response_format sur {"type": "json_object"}. Cela indique au modèle de générer une sortie conforme à une syntaxe JSON valide. Cela est particulièrement utile pour les applications nécessitant d’analyser la réponse de manière programmatique.
Lors de l'utilisation du mode JSON, le modèle évitera d'ajouter des balises markdown ou du texte supplémentaire autour de l'objet JSON. Cela garantit que votre analyseur peut consommer directement la réponse sans étapes de nettoyage supplémentaires. C'est un moyen fiable d'obtenir des données structurées à partir d'un LLM.
Voici un exemple Node.js montrant comment configurer le client pour le mode JSON :
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredgpt.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Paramètres : Température et Top P
Vous pouvez contrôler l’aléatoire et la créativité des réponses du modèle à l’aide de paramètres comme temperature et top_p. Le paramètre temperature ajuste la température d’échantillonnage, des valeurs plus basses rendant la sortie plus déterministe et des valeurs plus élevées la rendant plus créative. Le paramètre top_p contrôle l’échantillonnage du noyau, limitant le modèle à ne considérer que la masse de probabilité des tokens top p.
Les autres paramètres pris en charge incluent les séquences stop, seed pour la reproductibilité, et les pénalités pour presence_penalty et frequency_penalty. Ces paramètres vous permettent d'affiner le comportement du modèle pour répondre à votre cas d'utilisation spécifique.
Comprendre ces paramètres est crucial pour optimiser la qualité de votre texte généré. Expérimentez avec différentes valeurs pour trouver le bon équilibre pour votre application.
Fonctions et limites
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.uncensoredgpt.top/v1 |
| Authentification | Authorization: Bearer YOUR_KEY |
| ID du modèle | uncensored |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Mode JSON | response_format: {"type": "json_object"} |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Taille | jusqu'à 8 Mo par requête |
| Limite de débit | 300 requêtes par minute et par clé |
| Concurrence | 8 requêtes simultanées par clé |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
| Connexion | Google ou e-mail et mot de passe |
Erreurs et solutions
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions et réponses
Que se passe-t-il si je dépasse la limite de débit ?
Si vous dépassez la limite de 300 requêtes par minute ou 8 requêtes simultanées, vous recevrez une erreur 429 Too Many Requests. Votre clé API est limitée à 8 connexions simultanées, alors assurez-vous que votre application gère correctement les requêtes simultanées pour éviter d'atteindre cette limite.
Pourquoi obtiens-je une erreur 402 ?
Une erreur 402 indique que votre crédit prépayé est épuisé. Comme nous utilisons un modèle de tokens prépayés, vous devez recharger votre compte pour continuer à utiliser l'API. Les erreurs et les refus ne consomment pas de crédit, vous ne payez donc que pour l'utilisation réussie des tokens.
Quelle est la limite de la fenêtre de contexte ?
Le modèle prend en charge une fenêtre de contexte de 100 000 tokens, qui inclut à la fois le prompt et la complétion. La sortie maximale par requête est de 32 000 tokens, ou 2 048 tokens si vous ne spécifiez pas de valeur max_tokens. Cela permet la génération de contenu long et des tâches de raisonnement complexes.
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.