IT ▾
Ottieni chiave API

Guida rapida all'API LLM senza censura

Questa guida rapida ti aiuta a integrare la nostra API chat-completions senza censura utilizzando client compatibili con OpenAI standard. Troverai l'URL di base, i passaggi di autenticazione, esempi di codice e i limiti necessari per iniziare a inviare richieste immediatamente.

Autenticazione e Intestazioni

La nostra API utilizza l'autenticazione tramite chiave API standard. Devi includere la tua chiave nell'intestazione Authorization per ogni richiesta. I nuovi account ricevono una chiave immediatamente dopo la registrazione nella pagina Ottieni chiave API. Se perdi la chiave, puoi rigenerarla in qualsiasi momento, il che revoca quella vecchia. È consentita una sola chiave attiva per account.

L'URL di base per tutte le richieste è https://api.llmapistatus.com/v1. Funziona con gli SDK ufficiali OpenAI e qualsiasi client compatibile con OpenAI semplicemente aggiornando la configurazione base_url. Non sono necessarie intestazioni speciali oltre all'autenticazione.

Endpoint Completamenti Chat

Invia testo e ottieni testo in risposta utilizzando l'endpoint POST /v1/chat/completions. L'ID del modello è sempre uncensored. Questo è un modello a pesi aperti eseguito sui nostri server GPU, ottimizzato per rispondere senza rifiuti di contenuti per l'uso adulto legale. Non è GPT, Claude o il modello di nessun altro fornitore.

L'API supporta la chiamata di funzioni e strumenti. Non devi gestire l'instradamento tra diversi fornitori; serviamo un singolo endpoint dedicato senza censura. Per confronti generali tra altri provider, consulta la nostra Classifica LLM.

curl https://api.llmapistatus.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Risposte in Streaming

Per una latenza inferiore, puoi abilitare lo streaming impostando stream: true nel corpo della richiesta. L'API restituisce uno stream di Server-Sent Events (SSE). Questo è ideale per le interfacce chat dove vuoi visualizzare i token man mano che vengono generati.

Lo streaming funziona sia con gli SDK ufficiali OpenAI che con client HTTP generici. Lo streaming continua fino a quando il modello non termina o si verifica un errore. Questo metodo riduce il tempo di attesa percepito dagli utenti, rendendo il modello senza censura più reattivo nelle applicazioni di produzione.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Supporto Chiamata di Funzioni

L'API supporta l'output strutturato tramite chiamata di funzioni. Puoi definire gli strumenti nella tua richiesta e il modello restituirà un JSON strutturato che corrisponde al tuo schema. Questo è utile per costruire agenti o applicazioni che devono interagire con altri sistemi.

Usa il parametro tools nella tua richiesta di completamento chat. Il modello risponderà con chiamate di funzioni quando appropriato, permettendoti di eseguire funzioni e inviare i risultati di nuovo alla conversazione. Questa funzione è disponibile su tutte le richieste senza costi aggiuntivi.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmapistatus.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Elenco Modelli e Finestra di Contesto

Puoi elencare i modelli disponibili utilizzando l'endpoint GET /v1/models. Questo restituirà metadati tra cui l'ID del modello, che è uncensored. Il modello supporta una finestra di contesto di 100.000 token per prompt e completamento combinati.

Questa grande finestra di contesto ti permette di passare istruzioni di sistema estese, cronologia delle conversazioni o contenuti di documenti in una singola richiesta. È adatta per la generazione di testi lunghi o l'elaborazione di grandi documenti. Mantieni il conteggio totale dei token entro il limite di 100k per evitare errori.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmapistatus.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Limiti di Richiesta e Quote

Ogni chiave API è limitata a 300 richieste al minuto. La dimensione massima del corpo della richiesta è 8 MB. Se superi il limite di richieste, riceverai un codice di stato 429. Se la tua chiave API non è valida, riceverai un errore 401. Se non hai credito prepagato, riceverai un errore 402.

I prezzi sono trasparenti: $0,25 per 1M token di input e $1,00 per 1M token di output. Il credito è prepagato e non scade mai. Puoi ricaricare da $10 con criptovalute (USDT o USDC). Vedi la pagina Prezzi API LLM per i dettagli sui crediti bonus.

Specifiche tecniche

Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.

VoceValore
Formatocompatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave
ID modellouncensored
EndpointPOST /v1/chat/completions · GET /v1/models
AutenticazioneAuthorization: Bearer YOUR_KEY
Base URLhttps://api.llmapistatus.com/v1
Modalità JSONresponse_format: {"type": "json_object"}
Parametritemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Output massimofino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato)
Finestra di contesto100.000 token (input + output)
Function callingsì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool
Streamingsì — server-sent events; l'ultimo blocco riporta l'uso dei token
Concorrenza8 richieste contemporanee per chiave
Limite di frequenza300 richieste al minuto per chiave
Dimensionefino a 8 MB per richiesta
HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Prezzo$0,25 per 1M token in input · $1,00 per 1M in output
Prova gratuita$0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica
Bonus+5% da $50, +10% da $100
RicaricaUSDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500
Scadenzail credito pagato non scade, nessun abbonamento
Fatturazionecredito prepagato in base all'uso reale; errori e rifiuti gratuiti
Contenuticontenuti per adulti consentiti; rifiutati i contenuti sessuali con minori
AccessoGoogle oppure e-mail e password
Chiaviuna chiave attiva per account; una nuova sostituisce la precedente

Codici di errore

Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.

CodiceTipoSignificato
400bad_requestJSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo
401missing_key · invalid_key · key_revokedchiave mancante, errata o sostituita
402no_creditcredito esaurito — ricarica e riparti subito
403content_blockedcontenuti sessuali con minori — rifiutato, non addebitato
404not_foundendpoint sconosciuto
413request_too_largecorpo oltre 8 MB
429rate_limited · concurrencyoltre 300/min o 8 in parallelo — attendi e riprova
503upstream_busymodello occupato — riprova tra pochi secondi

Domande e risposte

Questo modello è uguale a GPT-4 o Claude?

No. L'ID del modello è "uncensored" ed è un modello a pesi aperti eseguito sui nostri server GPU. È ottimizzato per l'uso adulto legale senza rifiuti di contenuti, ma è un modello distinto da GPT, Claude, Gemini o altri fornitori.

Come iniziare con il credito di prova?

Registrati nella pagina Ottieni chiave API con solo email e password. Riceverai $0,50 di credito di prova valido per 7 giorni. Non è necessaria una carta di credito o un numero di telefono per iniziare.

Cosa succede se superi il limite di richieste?

Se superi 300 richieste al minuto, l'API restituisce un codice di stato 429. Dovresti implementare un backoff esponenziale nel tuo client. Puoi rigenerare la tua chiave se necessario, ma il limite di richieste si applica per chiave.

La tua chiave è a un modulo di distanza

Crea un account, copia la chiave, cambia l'URL di base. È tutta qui la configurazione.

Ottieni la chiave API