Guida rapida all'API LLM senza censura
Questa guida rapida ti aiuta a integrare la nostra API chat-completions senza censura utilizzando client compatibili con OpenAI standard. Troverai l'URL di base, i passaggi di autenticazione, esempi di codice e i limiti necessari per iniziare a inviare richieste immediatamente.
Autenticazione e Intestazioni
La nostra API utilizza l'autenticazione tramite chiave API standard. Devi includere la tua chiave nell'intestazione Authorization per ogni richiesta. I nuovi account ricevono una chiave immediatamente dopo la registrazione nella pagina Ottieni chiave API. Se perdi la chiave, puoi rigenerarla in qualsiasi momento, il che revoca quella vecchia. È consentita una sola chiave attiva per account.
L'URL di base per tutte le richieste è https://api.llmapistatus.com/v1. Funziona con gli SDK ufficiali OpenAI e qualsiasi client compatibile con OpenAI semplicemente aggiornando la configurazione base_url. Non sono necessarie intestazioni speciali oltre all'autenticazione.
Endpoint Completamenti Chat
Invia testo e ottieni testo in risposta utilizzando l'endpoint POST /v1/chat/completions. L'ID del modello è sempre uncensored. Questo è un modello a pesi aperti eseguito sui nostri server GPU, ottimizzato per rispondere senza rifiuti di contenuti per l'uso adulto legale. Non è GPT, Claude o il modello di nessun altro fornitore.
L'API supporta la chiamata di funzioni e strumenti. Non devi gestire l'instradamento tra diversi fornitori; serviamo un singolo endpoint dedicato senza censura. Per confronti generali tra altri provider, consulta la nostra Classifica LLM.
curl https://api.llmapistatus.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Risposte in Streaming
Per una latenza inferiore, puoi abilitare lo streaming impostando stream: true nel corpo della richiesta. L'API restituisce uno stream di Server-Sent Events (SSE). Questo è ideale per le interfacce chat dove vuoi visualizzare i token man mano che vengono generati.
Lo streaming funziona sia con gli SDK ufficiali OpenAI che con client HTTP generici. Lo streaming continua fino a quando il modello non termina o si verifica un errore. Questo metodo riduce il tempo di attesa percepito dagli utenti, rendendo il modello senza censura più reattivo nelle applicazioni di produzione.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Supporto Chiamata di Funzioni
L'API supporta l'output strutturato tramite chiamata di funzioni. Puoi definire gli strumenti nella tua richiesta e il modello restituirà un JSON strutturato che corrisponde al tuo schema. Questo è utile per costruire agenti o applicazioni che devono interagire con altri sistemi.
Usa il parametro tools nella tua richiesta di completamento chat. Il modello risponderà con chiamate di funzioni quando appropriato, permettendoti di eseguire funzioni e inviare i risultati di nuovo alla conversazione. Questa funzione è disponibile su tutte le richieste senza costi aggiuntivi.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmapistatus.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Elenco Modelli e Finestra di Contesto
Puoi elencare i modelli disponibili utilizzando l'endpoint GET /v1/models. Questo restituirà metadati tra cui l'ID del modello, che è uncensored. Il modello supporta una finestra di contesto di 100.000 token per prompt e completamento combinati.
Questa grande finestra di contesto ti permette di passare istruzioni di sistema estese, cronologia delle conversazioni o contenuti di documenti in una singola richiesta. È adatta per la generazione di testi lunghi o l'elaborazione di grandi documenti. Mantieni il conteggio totale dei token entro il limite di 100k per evitare errori.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmapistatus.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Limiti di Richiesta e Quote
Ogni chiave API è limitata a 300 richieste al minuto. La dimensione massima del corpo della richiesta è 8 MB. Se superi il limite di richieste, riceverai un codice di stato 429. Se la tua chiave API non è valida, riceverai un errore 401. Se non hai credito prepagato, riceverai un errore 402.
I prezzi sono trasparenti: $0,25 per 1M token di input e $1,00 per 1M token di output. Il credito è prepagato e non scade mai. Puoi ricaricare da $10 con criptovalute (USDT o USDC). Vedi la pagina Prezzi API LLM per i dettagli sui crediti bonus.
Specifiche tecniche
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| ID modello | uncensored |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.llmapistatus.com/v1 |
| Modalità JSON | response_format: {"type": "json_object"} |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Output massimo | fino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato) |
| Finestra di contesto | 100.000 token (input + output) |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Concorrenza | 8 richieste contemporanee per chiave |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Dimensione | fino a 8 MB per richiesta |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Bonus | +5% da $50, +10% da $100 |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
| Accesso | Google oppure e-mail e password |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |
Domande e risposte
Questo modello è uguale a GPT-4 o Claude?
No. L'ID del modello è "uncensored" ed è un modello a pesi aperti eseguito sui nostri server GPU. È ottimizzato per l'uso adulto legale senza rifiuti di contenuti, ma è un modello distinto da GPT, Claude, Gemini o altri fornitori.
Come iniziare con il credito di prova?
Registrati nella pagina Ottieni chiave API con solo email e password. Riceverai $0,50 di credito di prova valido per 7 giorni. Non è necessaria una carta di credito o un numero di telefono per iniziare.
Cosa succede se superi il limite di richieste?
Se superi 300 richieste al minuto, l'API restituisce un codice di stato 429. Dovresti implementare un backoff esponenziale nel tuo client. Puoi rigenerare la tua chiave se necessario, ma il limite di richieste si applica per chiave.
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, cambia l'URL di base. È tutta qui la configurazione.