Autenticazione e URL di base
La nostra API è progettata per essere un'alternativa pronta all’uso per i client OpenAI esistenti. Devi solo modificare due cose nella tua configurazione: l'URL di base e la chiave API. L'URL di base per questo servizio è https://api.uncensoredgpt.top/v1. Puoi generare la tua chiave API immediatamente dopo esserti registrato tramite Google o email nella dashboard. Non è richiesto il numero di telefono e la chiave viene visualizzata una sola volta alla creazione.
Assicurati di memorizzare la tua chiave in modo sicuro. Se la perdi, puoi generarne una nuova dalla dashboard, che invaliderà la chiave precedente. Questa configurazione semplice ti consente di connetterti alla nostra api ai senza censura utilizzando librerie standard senza adattatori personalizzati.
Endpoint Chat Completions
La funzionalità principale è servita attraverso l'endpoint standard POST /v1/chat/completions. Questo endpoint accetta input testuale e restituisce output testuale, supportando sia richieste sincrone che asincrone. Non devi preoccuparti del routing o dell'aggregazione dei modelli; serviamo un singolo modello di linguaggio grande senza censura ad alte prestazioni, ottimizzato per contenuti non filtrati.
Quando effettui una richiesta, devi specificare l'ID del modello come uncensored. Questo modello è un modello a pesi aperti e ospitato sui nostri server, distinto da GPT, Claude o altri modelli di fornitori. È progettato per rispondere senza rifiuti di contenuti per l'uso adulto legale, rendendolo ideale per argomenti NSFW o controversi.
Per iniziare, puoi testare l'endpoint con un semplice comando cURL. Sostituisci YOUR_API_KEY con la tua chiave effettiva.
curl https://api.uncensoredgpt.top/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Risposte in streaming (SSE)
Per le applicazioni in tempo reale, l'API supporta Server-Sent Events (SSE). Lo streaming ti permette di ricevere i token man mano che vengono generati, offrendo un'esperienza utente migliore per le interfacce chat. Quando imposti stream: true nella tua richiesta, l'API restituisce uno stream di chunk anziché una singola risposta completa.
Ogni chunk contiene testo parziale e l'ultimo chunk include le statistiche sull'utilizzo dei token per le finalità di fatturazione. Questa funzione è particolarmente utile per le applicazioni che richiedono feedback immediato. Puoi gestire lo stream nel tuo linguaggio preferito utilizzando l'SDK appropriato.
Ecco un esempio di come avviare una richiesta in streaming utilizzando cURL:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Chiamata di funzioni e strumenti
L'API supporta la chiamata di funzioni, consentendo alla tua applicazione di interagire con strumenti e servizi esterni. Puoi definire un elenco di funzioni nel parametro tools e il modello risponderà con una chiamata di funzione se appropriato. Questo è utile per costruire agenti o applicazioni che devono eseguire azioni specifiche.
Puoi controllare il comportamento del modello utilizzando tool_choice, che può essere impostato su auto, none o un ID di funzione specifico. Il modello restituirà il nome della funzione e gli argomenti nella risposta, che potrai poi eseguire nella tua applicazione.
Ecco un esempio Python che dimostra come utilizzare la funzione di chiamata di funzioni con l'SDK compatibile con OpenAI:
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredgpt.top/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Configurazione modalità JSON
Se hai bisogno di un output strutturato, puoi abilitare la modalità JSON impostando il parametro response_format su {"type": "json_object"}. Questo istruisce il modello a generare un output conforme alla sintassi JSON valida. Questo è particolarmente utile per le applicazioni che richiedono l'analisi della risposta a livello di codice.
Quando utilizzi la modalità JSON, il modello eviterà di aggiungere marcatori markdown o testo aggiuntivo intorno all'oggetto JSON. Questo garantisce che il tuo parser possa consumare direttamente la risposta senza passaggi di pulizia aggiuntivi. È un modo affidabile per ottenere dati strutturati da un LLM.
Ecco un esempio Node.js che mostra come configurare il client per la modalità JSON:
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredgpt.top/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Parametri: Temperatura e Top P
Puoi controllare la casualità e la creatività delle risposte del modello utilizzando parametri come temperature e top_p. Il parametro temperature regola la temperatura di campionamento, con valori più bassi che rendono l'output più deterministico e valori più alti che lo rendono più creativo. Il parametro top_p controlla il campionamento del nucleo, limitando il modello a considerare solo la massa di probabilità dei token superiori a p.
Altri parametri supportati includono le sequenze stop, seed per la riproducibilità e le penalità per presence_penalty e frequency_penalty. Questi parametri ti consentono di perfezionare il comportamento del modello per adattarlo al tuo caso d'uso specifico.
Comprendere questi parametri è fondamentale per ottimizzare la qualità del testo generato. Sperimenta con valori diversi per trovare il giusto equilibrio per la tua applicazione.
Scheda tecnica dell'API
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.uncensoredgpt.top/v1 |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| ID modello | uncensored |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Modalità JSON | response_format: {"type": "json_object"} |
| Output massimo | fino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato) |
| Finestra di contesto | 100.000 token (input + output) |
| Dimensione | fino a 8 MB per richiesta |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Concorrenza | 8 richieste contemporanee per chiave |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Bonus | +5% da $50, +10% da $100 |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
| Accesso | Google oppure e-mail e password |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |
Domande e risposte
Cosa succede se superi il limite di richieste?
Se superi il limite di 300 richieste al minuto o 8 richieste concorrenti, riceverai un errore 429 Too Many Requests. La tua chiave API è limitata a 8 connessioni simultanee, quindi assicurati che la tua applicazione gestisca le richieste concorrenti in modo appropriato per evitare di raggiungere questo limite.
Perché ricevo un errore 402?
Un errore 402 indica che il tuo credito prepagato è stato esaurito. Poiché utilizziamo un modello a token prepagati, devi ricaricare il tuo account per continuare a utilizzare l'API. Errori e rifiuti non consumano credito, quindi paghi solo per l'utilizzo riuscito dei token.
Qual è il limite della finestra di contesto?
Il modello supporta una finestra di contesto di 100.000 token, che include sia il prompt che il completamento. L'output massimo per richiesta è di 32.000 token, o 2.048 token se non specifichi un valore max_tokens. Ciò consente la generazione di contenuti lunghi e attività di ragionamento complesso.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, cambia l'URL di base. È tutta la configurazione.