Guía de inicio rápido para la API de LLM sin censura
Esta guía de inicio rápido te ayuda a integrar nuestra API de chat-completions sin censura usando clientes compatibles con OpenAI estándar. Encontrarás la URL base, los pasos de autenticación, ejemplos de código y los límites necesarios para empezar a enviar peticiones de inmediato.
Autenticación y Cabeceras
Nuestra API utiliza autenticación estándar con clave de API. Debes incluir tu clave en la cabecera Authorization para cada petición. Las cuentas nuevas reciben una clave inmediatamente después del registro en la página Obtener clave de API. Si pierdes tu clave, puedes regenerarla en cualquier momento, lo que invalida la anterior. Solo se permite una clave activa por cuenta.
La URL base para todas las peticiones es https://api.llmapistatus.com/v1. Funciona con los SDKs oficiales de OpenAI y cualquier cliente compatible con OpenAI simplemente actualizando la configuración de base_url. No se requieren cabeceras especiales más allá de la autenticación.
Endpoint de Completado de Chat
Envía texto y obtén texto de salida usando el endpoint POST /v1/chat/completions. El ID del modelo es siempre uncensored. Es un modelo de pesos abiertos ejecutado en nuestros propios servidores GPU, ajustado para responder sin rechazos de contenido para uso adulto lícito. No es GPT, Claude ni el modelo de ningún otro proveedor.
La API admite llamadas a funciones y herramientas. No necesitas gestionar el enrutamiento entre diferentes proveedores; servimos un único endpoint dedicado sin censura. Para comparaciones generales de otros proveedores, consulta nuestro LLM Leaderboard.
curl https://api.llmapistatus.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Respuestas en Streaming
Para reducir la latencia, puedes activar el streaming estableciendo stream: true en el cuerpo de tu petición. La API devuelve un flujo de Server-Sent Events (SSE). Esto es ideal para interfaces de chat donde deseas mostrar los tokens a medida que se generan.
El streaming funciona tanto con los SDK oficiales de OpenAI como con clientes HTTP genéricos. El flujo continúa hasta que el modelo termina o ocurre un error. Este método reduce el tiempo de espera percibido por los usuarios, haciendo que el modelo sin censura se sienta más receptivo en aplicaciones de producción.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Soporte para Llamadas a Funciones
La API admite salida estructurada mediante llamadas a funciones. Puedes definir herramientas en tu petición y el modelo devolverá JSON estructurado que coincida con tu esquema. Esto es útil para construir agentes o aplicaciones que necesiten interactuar con otros sistemas.
Usa el parámetro tools en tu petición de completado de chat. El modelo responderá con llamadas a herramientas cuando sea apropiado, permitiéndote ejecutar funciones y devolver los resultados a la conversación. Esta función está disponible en todas las peticiones sin costo adicional.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmapistatus.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Listado de Modelos y Ventana de Contexto
Puedes listar los modelos disponibles usando el endpoint GET /v1/models. Esto devolverá metadatos que incluyen el ID del modelo, que es uncensored. El modelo admite una ventana de contexto de 100.000 tokens para prompt y finalización combinados.
Esta gran ventana de contexto te permite pasar instrucciones de sistema extensas, historial de conversaciones o contenido de documentos en una sola petición. Es adecuada para generación de texto largo o procesamiento de documentos grandes. Mantén tu conteo total de tokens dentro del límite de 100k para evitar errores.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmapistatus.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Límites de Velocidad y Cuotas
Cada clave de API está limitada a 300 peticiones por minuto. El tamaño máximo del cuerpo de la petición es 8 MB. Si excedes el límite de velocidad, recibirás un código de estado 429. Si tu clave de API no es válida, recibirás un error 401. Si no tienes crédito prepago, recibirás un error 402.
Los precios son transparentes: $0,25 por 1M de tokens de entrada y $1,00 por 1M de tokens de salida. El crédito es prepago y no caduca. Puedes recargar desde $10 con criptomonedas (USDT o USDC). Consulta la página de Precios de la API de LLM para detalles sobre créditos bonus.
Especificaciones técnicas
Una tabla con cada límite, función y precio.
| Elemento | Valor |
|---|---|
| Formato | compatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave |
| ID del modelo | uncensored |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Autenticación | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.llmapistatus.com/v1 |
| Modo JSON | response_format: {"type": "json_object"} |
| Parámetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Salida máxima | hasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte) |
| Ventana de contexto | 100.000 tokens (entrada + salida) |
| Llamadas a funciones | sí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool |
| Streaming | sí: server-sent events; el último fragmento incluye el uso de tokens |
| Concurrencia | 8 peticiones a la vez por clave |
| Límite de peticiones | 300 por minuto por clave |
| Tamaño de petición | hasta 8 MB |
| Cabeceras | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Precio | $0,25 por 1M tokens de entrada · $1,00 por 1M de salida |
| Prueba gratis | $0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga |
| Bono | +5 % desde $50, +10 % desde $100 |
| Recarga | USDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500 |
| Caducidad | el crédito pagado no caduca, sin suscripción |
| Facturación | crédito prepago por uso real; errores y rechazos no se cobran |
| Contenido | contenido adulto permitido; se rechaza el contenido sexual con menores |
| Acceso | Google o correo y contraseña |
| Claves | una clave activa por cuenta; una nueva reemplaza a la anterior |
Errores y qué hacer
Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo |
401 | missing_key · invalid_key · key_revoked | falta la clave, es incorrecta o fue reemplazada |
402 | no_credit | sin crédito: recarga y sigue al instante |
403 | content_blocked | contenido sexual con menores: rechazado, no se cobra |
404 | not_found | endpoint desconocido |
413 | request_too_large | cuerpo mayor de 8 MB |
429 | rate_limited · concurrency | más de 300/min o 8 en paralelo: espera y reintenta |
503 | upstream_busy | modelo ocupado: reintenta en unos segundos |
Preguntas y respuestas
¿Es este modelo el mismo que GPT-4 o Claude?
No. El ID del modelo es "uncensored" y es un modelo de pesos abiertos ejecutado en nuestros propios servidores GPU. Está ajustado para uso adulto lícito sin rechazos de contenido, pero es un modelo distinto de GPT, Claude, Gemini u otros proveedores.
¿Cómo empiezo con el crédito de prueba?
Regístrate en la página Obtener clave de API con solo un correo electrónico y una contraseña. Recibirás $0,50 de crédito de prueba válido por 7 días. No se requiere tarjeta de crédito ni número de teléfono para empezar.
¿Qué pasa si supero el límite de peticiones?
Si excedes 300 peticiones por minuto, la API devuelve un código de estado 429. Deberías implementar retroceso exponencial en tu cliente. Puedes regenerar tu clave si es necesario, pero el límite de peticiones se aplica por clave.
Tu clave está a un formulario de distancia
Crea una cuenta, copia la clave, cambia la URL base. Eso es toda la configuración.