PT ▾
Obter chave de API

Guia de início rápido para API LLM sem censura

Este guia de início rápido ajuda você a integrar nossa API de chat-completions sem censura usando clientes padrão compatíveis com OpenAI. Você encontrará a URL base, etapas de autenticação, exemplos de código e limites necessários para começar a enviar requisições imediatamente.

Autenticação e Cabeçalhos

Nossa API usa autenticação padrão com chave de API. Você deve incluir sua chave no cabeçalho Authorization para cada requisição. Contas novas recebem uma chave imediatamente após o cadastro na página Obter chave de API. Se você perder sua chave, poderá regenerá-la a qualquer momento, o que revoga a anterior. Apenas uma chave ativa é permitida por conta.

A URL base para todas as requisições é https://api.llmapistatus.com/v1. Isso funciona com SDKs oficiais da OpenAI e qualquer cliente compatível com OpenAI, basta atualizar a configuração base_url. Não são necessários cabeçalhos especiais além da autenticação.

Endpoint de Completions de Chat

Envie texto e receba texto usando o endpoint POST /v1/chat/completions. O ID do modelo é sempre uncensored. Este é um modelo de pesos abertos executado em nossos próprios servidores GPU, ajustado para responder sem recusas de conteúdo para uso adulto legal. Não é GPT, Claude ou modelo de nenhum outro fornecedor.

A API suporta chamada de ferramentas e funções. Você não precisa gerenciar o roteamento entre diferentes fornecedores; oferecemos um único endpoint dedicado sem censura. Para comparações gerais de outros provedores, consulte nosso LLM Leaderboard.

curl https://api.llmapistatus.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Respostas em Streaming

Para menor latência, você pode habilitar o streaming definindo stream: true no corpo da sua requisição. A API retorna um stream de Server-Sent Events (SSE). Isso é ideal para interfaces de chat onde você deseja exibir tokens conforme são gerados.

O streaming funciona tanto com os SDKs oficiais da OpenAI quanto com clientes HTTP genéricos. O stream continua até que o modelo termine ou ocorra um erro. Este método reduz o tempo de espera percebido pelos usuários, tornando o modelo sem censura mais responsivo em aplicações de produção.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Suporte a Chamada de Funções

A API suporta saída estruturada via chamada de funções. Você pode definir ferramentas na sua requisição e o modelo retornará JSON estruturado que corresponde ao seu esquema. Isso é útil para construir agentes ou aplicações que precisam interagir com outros sistemas.

Use o parâmetro tools na sua requisição de completions de chat. O modelo responderá com chamadas de ferramentas quando apropriado, permitindo que você execute funções e alimente os resultados de volta na conversa. Este recurso está disponível em todas as requisições sem custo adicional.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmapistatus.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Listagem de Modelos e Janela de Contexto

Você pode listar modelos disponíveis usando o endpoint GET /v1/models. Isso retornará metadados incluindo o ID do modelo, que é uncensored. O modelo suporta uma janela de contexto de 100.000 tokens para prompt e conclusão combinados.

Esta grande janela de contexto permite que você passe instruções de sistema extensas, histórico de conversas ou conteúdo de documentos em uma única requisição. É adequado para geração de texto longo ou processamento de documentos grandes. Mantenha sua contagem total de tokens dentro do limite de 100k para evitar erros.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmapistatus.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Limites de Taxa e Cotas

Cada chave de API é limitada a 300 requisições por minuto. O tamanho máximo do corpo da requisição é 8 MB. Se você exceder o limite de taxa, receberá o código de status 429. Se sua chave de API for inválida, você receberá o erro 401. Se você não tiver crédito pré-pago, receberá o erro 402.

A precificação é transparente: $0,25 por 1M de tokens de entrada e $1,00 por 1M de tokens de saída. O crédito é pré-pago e nunca expira. Você pode recarregar a partir de $10 por criptomoeda (USDT ou USDC). Consulte a página de Preços da API LLM para detalhes sobre créditos bônus.

Especificações técnicas

Uma tabela com cada limite, recurso e preço.

ItemValor
Formatocompatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave
ID do modelouncensored
EndpointsPOST /v1/chat/completions · GET /v1/models
AutenticaçãoAuthorization: Bearer YOUR_KEY
Base URLhttps://api.llmapistatus.com/v1
Modo JSONresponse_format: {"type": "json_object"}
Parâmetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Saída máximaaté o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado)
Janela de contexto100.000 tokens (entrada + saída)
Chamada de funçõessim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool
Streamingsim — server-sent events; o último bloco traz o uso de tokens
Concorrência8 requisições ao mesmo tempo por chave
Limite de taxa300 requisições por minuto por chave
Tamanhoaté 8 MB por requisição
CabeçalhosX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Preço$0,25 por 1M tokens de entrada · $1,00 por 1M de saída
Teste grátis$0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga
Bônus+5% a partir de $50, +10% a partir de $100
RecargaUSDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500
Validadecrédito pago não expira, sem assinatura
Cobrançacrédito pré-pago pelo uso real; erros e recusas são grátis
Conteúdoconteúdo adulto permitido; conteúdo sexual com menores é recusado
LoginGoogle ou e-mail e senha
Chavesuma chave ativa por conta; uma nova substitui a anterior

Erros e o que fazer

Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.

CódigoTipoSignificado
400bad_requestJSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais
401missing_key · invalid_key · key_revokedchave ausente, errada ou substituída
402no_creditsem crédito — recarregue e continue na hora
403content_blockedconteúdo sexual com menores — recusado, sem cobrança
404not_foundendpoint desconhecido
413request_too_largecorpo acima de 8 MB
429rate_limited · concurrencyacima de 300/min ou 8 em paralelo — aguarde e tente de novo
503upstream_busymodelo ocupado — tente em alguns segundos

Perguntas e respostas

Este modelo é igual ao GPT-4 ou Claude?

Não. O ID do modelo é "uncensored" e é um modelo de pesos abertos executado em nossos próprios servidores GPU. É ajustado para uso adulto legal sem recusas de conteúdo, mas é um modelo distinto do GPT, Claude, Gemini ou de outros fornecedores.

Como começar com o crédito de teste?

Cadastre-se na página Obter chave de API usando apenas e-mail e senha. Você receberá $0,50 de crédito de teste válido por 7 dias. Não é necessário cartão de crédito ou número de telefone para começar.

O que acontece se eu atingir o limite de requisições?

Se você exceder 300 requisições por minuto, a API retorna um código de status 429. Você deve implementar backoff exponencial no seu cliente. Você pode regenerar sua chave se necessário, mas o limite de requisições aplica-se por chave.

Sua chave está a um formulário de distância

Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.

Obter chave de API