NL ▾
API-sleutel ophalen

Snelstartgids voor de ongecensureerde LLM-API

Deze snelstartgids helpt je onze chat-completions-API te integreren met standaard OpenAI-compatibele clients. Je vindt de basis-URL, authenticatiestappen, codevoorbeelden en limieten die nodig zijn om direct verzoeken te versturen.

Authenticatie & Headers

Onze API gebruikt standaard authenticatie met een API-sleutel. Je moet je sleutel opnemen in de Authorization-header voor elk verzoek. Nieuwe accounts krijgen direct na het aanmaken op de pagina API-sleutel ophalen een sleutel. Als je je sleutel kwijtraakt, kun je deze op elk moment opnieuw genereren, waardoor de oude ongeldig wordt. Per account is slechts één actieve sleutel toegestaan.

De basis-URL voor alle verzoeken is https://api.llmapistatus.com/v1. Dit werkt met officiële OpenAI-SDK's en elke OpenAI-compatibele client door eenvoudig de base_url-configuratie aan te passen. Er zijn geen speciale headers nodig naast authenticatie.

Chat Completions Endpoint

Stuur tekst in en krijg tekst terug via het POST /v1/chat/completions endpoint. De model-ID is altijd uncensored. Dit is een open-weight model dat op onze eigen GPU-servers draait, afgestemd om te antwoorden zonder inhoudsfiltering voor wettelijk volwassen gebruik. Het is geen GPT, Claude of een model van een andere aanbieder.

De API ondersteunt tool- en function calling. Je hoeft geen routing tussen verschillende leveranciers te beheren; wij bieden een enkel, toegewijd ongecensureerd endpoint. Voor algemene vergelijkingen van andere providers, zie onze LLM Leaderboard.

curl https://api.llmapistatus.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Streaming Responses

Voor lagere latentie kun je streaming inschakelen door stream: true in je request body in te stellen. De API retourneert een Server-Sent Events (SSE)-stream. Dit is ideaal voor chatinterfaces waar je tokens wilt weergeven zodra ze gegenereerd worden.

Streaming werkt met zowel de officiële OpenAI-SDK's als generieke HTTP-clients. De stream gaat door tot het model klaar is of er een fout optreedt. Deze methode vermindert de waargenomen wachttijd voor gebruikers, waardoor het ongecensureerde model in productieapplicaties responsiever aanvoelt.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Function Calling Support

De API ondersteunt gestructureerde output via function calling. Je kunt tools definiëren in je request en het model retourneert gestructureerde JSON die overeenkomt met je schema. Dit is nuttig voor het bouwen van agents of applicaties die met andere systemen moeten communiceren.

Gebruik de parameter tools in je chat completion request. Het model reageert met tool calls wanneer passend, waardoor je functies kunt uitvoeren en de resultaten terug kunt voeren in het gesprek. Deze functie is beschikbaar op alle requests zonder extra kosten.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmapistatus.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Modeloverzicht en contextvenster

Je kunt beschikbare modellen opvragen via het GET /v1/models-endpoint. Dit retourneert metadata inclusief de model-ID, namelijk uncensored. Het model ondersteunt een contextvenster van 100.000 tokens voor zowel prompt als completion samen.

Dit grote contextvenster stelt je in staat uitgebreide systeem-instructies, gespreks geschiedenis of documentinhoud in één verzoek te versturen. Het is geschikt voor langdurige generatie of het verwerken van grote documenten. Houd je totale tokenaantal binnen de limiet van 100k om fouten te vermijden.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmapistatus.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Rate Limits & Quotas

Elke API-sleutel is beperkt tot 300 verzoeken per minuut. De maximale grootte van de request body is 8 MB. Als je de rate limit overschrijdt, ontvang je een 429-statuscode. Als je API-sleutel ongeldig is, ontvang je een 401-fout. Als je geen prepaid tegoed hebt, ontvang je een 402-fout.

Prijzen zijn transparant: $0,25 per 1M input tokens en $1,00 per 1M output tokens. Tegoed is prepaid en verloopt nooit. Je kunt opwaarderen vanaf $10 met crypto (USDT of USDC). Zie de LLM API Pricing-pagina voor details over bonuscredits.

Technische specificaties

Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.

OnderdeelWaarde
API-formaatOpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel
Model-IDuncensored
EndpointsPOST /v1/chat/completions · GET /v1/models
AuthenticatieAuthorization: Bearer YOUR_KEY
Base URLhttps://api.llmapistatus.com/v1
JSON-modusresponse_format: {"type": "json_object"}
Parameterstemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Max. uitvoertot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet)
Contextvenster100.000 tokens (invoer + uitvoer)
Function callingja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool
Streamingja — server-sent events; het laatste deel bevat het tokenverbruik
Gelijktijdige verzoekentot 8 tegelijk per sleutel
Rate limit300 verzoeken per minuut per sleutel
Verzoekgroottetot 8 MB
ResponsheadersX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Prijs$0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens
Gratis proeftegoed$0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering
Bonus+5% vanaf $50, +10% vanaf $100
OpwaarderenUSDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500
Geldigheidbetaald tegoed verloopt niet, geen abonnement
Afrekeningprepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis
Inhoudinhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd
InloggenGoogle of e-mail en wachtwoord
Sleutelséén actieve sleutel per account; een nieuwe vervangt de oude

Foutcodes

Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.

CodeTypeBetekenis
400bad_requestongeldige JSON, lege berichten, verkeerde parameter of context te lang
401missing_key · invalid_key · key_revokedsleutel ontbreekt, is onjuist of is vervangen
402no_creditgeen tegoed — waardeer op en ga direct verder
403content_blockedseksuele inhoud met minderjarigen — geweigerd, niet gerekend
404not_foundonbekend endpoint
413request_too_largebody groter dan 8 MB
429rate_limited · concurrencymeer dan 300/min of 8 tegelijk — wacht en probeer opnieuw
503upstream_busymodel bezet — probeer het over enkele seconden opnieuw

Vragen en antwoorden

Is dit model hetzelfde als GPT-4 of Claude?

Nee. De model-ID is "uncensored" en het is een open-weight model dat op onze eigen GPU-servers draait. Het is afgestemd op wettelijk volwassen gebruik zonder inhoudsrefusies, maar is een apart model van GPT, Claude, Gemini of andere leveranciers.

Hoe begin ik met gratis proeftegoed?

Meld je aan op de pagina API-sleutel ophalen met alleen een e-mailadres en wachtwoord. Je ontvangt $0,50 aan gratis proeftegoed dat 7 dagen geldig is. Er is geen creditcard of telefoonnummer nodig om te beginnen.

Wat gebeurt er als ik de rate limit raak?

Als je meer dan 300 verzoeken per minuut overschrijdt, retourneert de API een 429-statuscode. Je zou exponentiële backoff in je client moeten implementeren. Je kunt je sleutel opnieuw genereren indien nodig, maar de rate limit geldt per sleutel.

Je sleutel is nog maar één formulier verwijderd

Maak een account aan, kopieer de sleutel, pas de basis-URL aan. Dat is de hele setup.

API-sleutel aanvragen