Snelstartgids voor de ongecensureerde LLM-API
Deze snelstartgids helpt je onze chat-completions-API te integreren met standaard OpenAI-compatibele clients. Je vindt de basis-URL, authenticatiestappen, codevoorbeelden en limieten die nodig zijn om direct verzoeken te versturen.
Authenticatie & Headers
Onze API gebruikt standaard authenticatie met een API-sleutel. Je moet je sleutel opnemen in de Authorization-header voor elk verzoek. Nieuwe accounts krijgen direct na het aanmaken op de pagina API-sleutel ophalen een sleutel. Als je je sleutel kwijtraakt, kun je deze op elk moment opnieuw genereren, waardoor de oude ongeldig wordt. Per account is slechts één actieve sleutel toegestaan.
De basis-URL voor alle verzoeken is https://api.llmapistatus.com/v1. Dit werkt met officiële OpenAI-SDK's en elke OpenAI-compatibele client door eenvoudig de base_url-configuratie aan te passen. Er zijn geen speciale headers nodig naast authenticatie.
Chat Completions Endpoint
Stuur tekst in en krijg tekst terug via het POST /v1/chat/completions endpoint. De model-ID is altijd uncensored. Dit is een open-weight model dat op onze eigen GPU-servers draait, afgestemd om te antwoorden zonder inhoudsfiltering voor wettelijk volwassen gebruik. Het is geen GPT, Claude of een model van een andere aanbieder.
De API ondersteunt tool- en function calling. Je hoeft geen routing tussen verschillende leveranciers te beheren; wij bieden een enkel, toegewijd ongecensureerd endpoint. Voor algemene vergelijkingen van andere providers, zie onze LLM Leaderboard.
curl https://api.llmapistatus.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Streaming Responses
Voor lagere latentie kun je streaming inschakelen door stream: true in je request body in te stellen. De API retourneert een Server-Sent Events (SSE)-stream. Dit is ideaal voor chatinterfaces waar je tokens wilt weergeven zodra ze gegenereerd worden.
Streaming werkt met zowel de officiële OpenAI-SDK's als generieke HTTP-clients. De stream gaat door tot het model klaar is of er een fout optreedt. Deze methode vermindert de waargenomen wachttijd voor gebruikers, waardoor het ongecensureerde model in productieapplicaties responsiever aanvoelt.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Function Calling Support
De API ondersteunt gestructureerde output via function calling. Je kunt tools definiëren in je request en het model retourneert gestructureerde JSON die overeenkomt met je schema. Dit is nuttig voor het bouwen van agents of applicaties die met andere systemen moeten communiceren.
Gebruik de parameter tools in je chat completion request. Het model reageert met tool calls wanneer passend, waardoor je functies kunt uitvoeren en de resultaten terug kunt voeren in het gesprek. Deze functie is beschikbaar op alle requests zonder extra kosten.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmapistatus.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Modeloverzicht en contextvenster
Je kunt beschikbare modellen opvragen via het GET /v1/models-endpoint. Dit retourneert metadata inclusief de model-ID, namelijk uncensored. Het model ondersteunt een contextvenster van 100.000 tokens voor zowel prompt als completion samen.
Dit grote contextvenster stelt je in staat uitgebreide systeem-instructies, gespreks geschiedenis of documentinhoud in één verzoek te versturen. Het is geschikt voor langdurige generatie of het verwerken van grote documenten. Houd je totale tokenaantal binnen de limiet van 100k om fouten te vermijden.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmapistatus.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Rate Limits & Quotas
Elke API-sleutel is beperkt tot 300 verzoeken per minuut. De maximale grootte van de request body is 8 MB. Als je de rate limit overschrijdt, ontvang je een 429-statuscode. Als je API-sleutel ongeldig is, ontvang je een 401-fout. Als je geen prepaid tegoed hebt, ontvang je een 402-fout.
Prijzen zijn transparant: $0,25 per 1M input tokens en $1,00 per 1M output tokens. Tegoed is prepaid en verloopt nooit. Je kunt opwaarderen vanaf $10 met crypto (USDT of USDC). Zie de LLM API Pricing-pagina voor details over bonuscredits.
Technische specificaties
Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.
| Onderdeel | Waarde |
|---|---|
| API-formaat | OpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel |
| Model-ID | uncensored |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Authenticatie | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.llmapistatus.com/v1 |
| JSON-modus | response_format: {"type": "json_object"} |
| Parameters | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Max. uitvoer | tot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet) |
| Contextvenster | 100.000 tokens (invoer + uitvoer) |
| Function calling | ja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool |
| Streaming | ja — server-sent events; het laatste deel bevat het tokenverbruik |
| Gelijktijdige verzoeken | tot 8 tegelijk per sleutel |
| Rate limit | 300 verzoeken per minuut per sleutel |
| Verzoekgrootte | tot 8 MB |
| Responsheaders | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Prijs | $0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens |
| Gratis proeftegoed | $0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering |
| Bonus | +5% vanaf $50, +10% vanaf $100 |
| Opwaarderen | USDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500 |
| Geldigheid | betaald tegoed verloopt niet, geen abonnement |
| Afrekening | prepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis |
| Inhoud | inhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd |
| Inloggen | Google of e-mail en wachtwoord |
| Sleutels | één actieve sleutel per account; een nieuwe vervangt de oude |
Foutcodes
Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.
| Code | Type | Betekenis |
|---|---|---|
400 | bad_request | ongeldige JSON, lege berichten, verkeerde parameter of context te lang |
401 | missing_key · invalid_key · key_revoked | sleutel ontbreekt, is onjuist of is vervangen |
402 | no_credit | geen tegoed — waardeer op en ga direct verder |
403 | content_blocked | seksuele inhoud met minderjarigen — geweigerd, niet gerekend |
404 | not_found | onbekend endpoint |
413 | request_too_large | body groter dan 8 MB |
429 | rate_limited · concurrency | meer dan 300/min of 8 tegelijk — wacht en probeer opnieuw |
503 | upstream_busy | model bezet — probeer het over enkele seconden opnieuw |
Vragen en antwoorden
Is dit model hetzelfde als GPT-4 of Claude?
Nee. De model-ID is "uncensored" en het is een open-weight model dat op onze eigen GPU-servers draait. Het is afgestemd op wettelijk volwassen gebruik zonder inhoudsrefusies, maar is een apart model van GPT, Claude, Gemini of andere leveranciers.
Hoe begin ik met gratis proeftegoed?
Meld je aan op de pagina API-sleutel ophalen met alleen een e-mailadres en wachtwoord. Je ontvangt $0,50 aan gratis proeftegoed dat 7 dagen geldig is. Er is geen creditcard of telefoonnummer nodig om te beginnen.
Wat gebeurt er als ik de rate limit raak?
Als je meer dan 300 verzoeken per minuut overschrijdt, retourneert de API een 429-statuscode. Je zou exponentiële backoff in je client moeten implementeren. Je kunt je sleutel opnieuw genereren indien nodig, maar de rate limit geldt per sleutel.
Je sleutel is nog maar één formulier verwijderd
Maak een account aan, kopieer de sleutel, pas de basis-URL aan. Dat is de hele setup.