ES ▾
Obtener clave de API

Guía de inicio rápido para la API de LLM sin censura

Esta guía de inicio rápido te ayuda a integrar nuestra API de chat-completions sin censura usando clientes compatibles con OpenAI estándar. Encontrarás la URL base, los pasos de autenticación, ejemplos de código y los límites necesarios para empezar a enviar peticiones de inmediato.

Autenticación y Cabeceras

Nuestra API utiliza autenticación estándar con clave de API. Debes incluir tu clave en la cabecera Authorization para cada petición. Las cuentas nuevas reciben una clave inmediatamente después del registro en la página Obtener clave de API. Si pierdes tu clave, puedes regenerarla en cualquier momento, lo que invalida la anterior. Solo se permite una clave activa por cuenta.

La URL base para todas las peticiones es https://api.llmapistatus.com/v1. Funciona con los SDKs oficiales de OpenAI y cualquier cliente compatible con OpenAI simplemente actualizando la configuración de base_url. No se requieren cabeceras especiales más allá de la autenticación.

Endpoint de Completado de Chat

Envía texto y obtén texto de salida usando el endpoint POST /v1/chat/completions. El ID del modelo es siempre uncensored. Es un modelo de pesos abiertos ejecutado en nuestros propios servidores GPU, ajustado para responder sin rechazos de contenido para uso adulto lícito. No es GPT, Claude ni el modelo de ningún otro proveedor.

La API admite llamadas a funciones y herramientas. No necesitas gestionar el enrutamiento entre diferentes proveedores; servimos un único endpoint dedicado sin censura. Para comparaciones generales de otros proveedores, consulta nuestro LLM Leaderboard.

curl https://api.llmapistatus.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Respuestas en Streaming

Para reducir la latencia, puedes activar el streaming estableciendo stream: true en el cuerpo de tu petición. La API devuelve un flujo de Server-Sent Events (SSE). Esto es ideal para interfaces de chat donde deseas mostrar los tokens a medida que se generan.

El streaming funciona tanto con los SDK oficiales de OpenAI como con clientes HTTP genéricos. El flujo continúa hasta que el modelo termina o ocurre un error. Este método reduce el tiempo de espera percibido por los usuarios, haciendo que el modelo sin censura se sienta más receptivo en aplicaciones de producción.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Soporte para Llamadas a Funciones

La API admite salida estructurada mediante llamadas a funciones. Puedes definir herramientas en tu petición y el modelo devolverá JSON estructurado que coincida con tu esquema. Esto es útil para construir agentes o aplicaciones que necesiten interactuar con otros sistemas.

Usa el parámetro tools en tu petición de completado de chat. El modelo responderá con llamadas a herramientas cuando sea apropiado, permitiéndote ejecutar funciones y devolver los resultados a la conversación. Esta función está disponible en todas las peticiones sin costo adicional.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmapistatus.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Listado de Modelos y Ventana de Contexto

Puedes listar los modelos disponibles usando el endpoint GET /v1/models. Esto devolverá metadatos que incluyen el ID del modelo, que es uncensored. El modelo admite una ventana de contexto de 100.000 tokens para prompt y finalización combinados.

Esta gran ventana de contexto te permite pasar instrucciones de sistema extensas, historial de conversaciones o contenido de documentos en una sola petición. Es adecuada para generación de texto largo o procesamiento de documentos grandes. Mantén tu conteo total de tokens dentro del límite de 100k para evitar errores.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmapistatus.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Límites de Velocidad y Cuotas

Cada clave de API está limitada a 300 peticiones por minuto. El tamaño máximo del cuerpo de la petición es 8 MB. Si excedes el límite de velocidad, recibirás un código de estado 429. Si tu clave de API no es válida, recibirás un error 401. Si no tienes crédito prepago, recibirás un error 402.

Los precios son transparentes: $0,25 por 1M de tokens de entrada y $1,00 por 1M de tokens de salida. El crédito es prepago y no caduca. Puedes recargar desde $10 con criptomonedas (USDT o USDC). Consulta la página de Precios de la API de LLM para detalles sobre créditos bonus.

Especificaciones técnicas

Una tabla con cada límite, función y precio.

ElementoValor
Formatocompatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave
ID del modelouncensored
EndpointsPOST /v1/chat/completions · GET /v1/models
AutenticaciónAuthorization: Bearer YOUR_KEY
Base URLhttps://api.llmapistatus.com/v1
Modo JSONresponse_format: {"type": "json_object"}
Parámetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Salida máximahasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte)
Ventana de contexto100.000 tokens (entrada + salida)
Llamadas a funcionessí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool
Streamingsí: server-sent events; el último fragmento incluye el uso de tokens
Concurrencia8 peticiones a la vez por clave
Límite de peticiones300 por minuto por clave
Tamaño de peticiónhasta 8 MB
CabecerasX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Precio$0,25 por 1M tokens de entrada · $1,00 por 1M de salida
Prueba gratis$0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga
Bono+5 % desde $50, +10 % desde $100
RecargaUSDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500
Caducidadel crédito pagado no caduca, sin suscripción
Facturacióncrédito prepago por uso real; errores y rechazos no se cobran
Contenidocontenido adulto permitido; se rechaza el contenido sexual con menores
AccesoGoogle o correo y contraseña
Clavesuna clave activa por cuenta; una nueva reemplaza a la anterior

Errores y qué hacer

Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.

CódigoTipoSignificado
400bad_requestJSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo
401missing_key · invalid_key · key_revokedfalta la clave, es incorrecta o fue reemplazada
402no_creditsin crédito: recarga y sigue al instante
403content_blockedcontenido sexual con menores: rechazado, no se cobra
404not_foundendpoint desconocido
413request_too_largecuerpo mayor de 8 MB
429rate_limited · concurrencymás de 300/min o 8 en paralelo: espera y reintenta
503upstream_busymodelo ocupado: reintenta en unos segundos

Preguntas y respuestas

¿Es este modelo el mismo que GPT-4 o Claude?

No. El ID del modelo es "uncensored" y es un modelo de pesos abiertos ejecutado en nuestros propios servidores GPU. Está ajustado para uso adulto lícito sin rechazos de contenido, pero es un modelo distinto de GPT, Claude, Gemini u otros proveedores.

¿Cómo empiezo con el crédito de prueba?

Regístrate en la página Obtener clave de API con solo un correo electrónico y una contraseña. Recibirás $0,50 de crédito de prueba válido por 7 días. No se requiere tarjeta de crédito ni número de teléfono para empezar.

¿Qué pasa si supero el límite de peticiones?

Si excedes 300 peticiones por minuto, la API devuelve un código de estado 429. Deberías implementar retroceso exponencial en tu cliente. Puedes regenerar tu clave si es necesario, pero el límite de peticiones se aplica por clave.

Tu clave está a un formulario de distancia

Crea una cuenta, copia la clave, cambia la URL base. Eso es toda la configuración.

Obtener clave de API