Руководство по быстрому старту для API LLM без цензуры
Это руководство поможет вам интегрировать наш API чат-завершений без цензуры, используя стандартные клиенты, совместимые с OpenAI. Вы найдете базовый URL, шаги аутентификации, примеры кода и ограничения, необходимые для немедленного начала отправки запросов.
Аутентификация и заголовки
Наш API использует стандартную аутентификацию по API-ключу. Вы должны включить свой ключ в заголовок Authorization для каждого запроса. Новые аккаунты получают ключ сразу после регистрации на странице получения API-ключа. Если вы потеряете ключ, вы можете сгенерировать новый в любое время, что аннулирует старый. На один аккаунт допускается только один активный ключ.
Базовый адрес для всех запросов — https://api.llmapistatus.com/v1. Он работает со стандартными SDK OpenAI и любым клиентом, совместимым с OpenAI, путём простого обновления конфигурации base_url. Специальные заголовки не требуются, кроме аутентификации.
Эндпоинт чат-завершений
Отправляйте текст и получайте текст через эндпоинт POST /v1/chat/completions. Идентификатор модели всегда uncensored. Это модель с открытыми весами, работающая на наших собственных GPU-серверах, настроенная на ответы без отказов по контенту для законного использования взрослыми. Это не GPT, Claude или модель другого поставщика.
API поддерживает вызов инструментов и функций. Вам не нужно управлять маршрутизацией между разными поставщиками; мы предоставляем один выделенный эндпоинт без цензуры. Для общих сравнений других провайдеров см. наш рейтинг LLM.
curl https://api.llmapistatus.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Потоковые ответы
Для снижения задержки вы можете включить потоковую передачу, установив stream: true в теле запроса. API возвращает поток событий, отправляемых сервером (SSE). Это идеально подходит для интерфейсов чата, где вы хотите отображать токены по мере их генерации.
Потоковая передача работает как с официальными SDK OpenAI, так и с общими HTTP-клиентами. Поток продолжается до завершения модели или возникновения ошибки. Этот метод снижает воспринимаемое время ожидания для пользователей, делая модель без цензуры более отзывчивой в производственных приложениях.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Поддержка вызова функций
API поддерживает структурированный вывод через вызов функций. Вы можете определить инструменты в своем запросе, и модель вернет структурированный JSON, соответствующий вашей схеме. Это полезно для создания агентов или приложений, которым необходимо взаимодействовать с другими системами.
Используйте параметр tools в запросе завершения чата. Модель будет отвечать вызовами функций, когда это уместно, позволяя вам выполнять функции и возвращать результаты в разговор. Эта функция доступна во всех запросах без дополнительной платы.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmapistatus.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Список моделей и контекстное окно
Вы можете получить список доступных моделей, используя эндпоинт GET /v1/models. Это вернет метаданные, включая идентификатор модели, который равен uncensored. Модель поддерживает контекстное окно на 100 000 токенов для промпта и завершения вместе.
Это большое контекстное окно позволяет передавать обширные системные инструкции, историю разговора или содержимое документа в одном запросе. Оно подходит для генерации длинных текстов или обработки больших документов. Держите общее количество токенов в пределах лимита 100k, чтобы избежать ошибок.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmapistatus.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Лимиты запросов и квоты
Каждый API-ключ ограничен 300 запросами в минуту. Максимальный размер тела запроса — 8 МБ. Если вы превысите лимит запросов, вы получите статус 429. Если ваш API-ключ недействителен, вы получите ошибку 401. Если у вас нет предоплаченного баланса, вы получите ошибку 402.
Ценообразование прозрачно: $0,25 за 1M входных токенов и $1,00 за 1M выходных токенов. Баланс предоплачен и не сгорает. Вы можете пополнить его от $10 криптовалютой (USDT или USDC). Подробности о бонусных кредитах см. на странице Тарифов LLM API.
Технические характеристики
Все реальные лимиты и возможности API в одном месте — сверьте их до пополнения.
| Параметр | Значение |
|---|---|
| Формат API | совместим с OpenAI: любой OpenAI SDK работает — замените base URL и ключ |
| ID модели | uncensored |
| Эндпоинты | POST /v1/chat/completions · GET /v1/models |
| Авторизация | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.llmapistatus.com/v1 |
| JSON-режим | response_format: {"type": "json_object"} |
| Параметры | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Максимум ответа | до остатка окна в 100 000 токенов; max_tokens необязателен (отдельного лимита нет) |
| Контекстное окно | 100 000 токенов (вход и ответ вместе) |
| Вызов функций | да — tools, tool_choice; ответ содержит tool_calls, в том числе в потоке; результат — сообщением role: tool |
| Потоковая передача | да — server-sent events, последний фрагмент содержит расход токенов |
| Параллельные запросы | до 8 одновременно на ключ |
| Лимит запросов | 300 запросов в минуту на ключ |
| Размер запроса | до 8 МБ |
| Заголовки ответа | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Цена | $0,25 за 1 млн входных токенов · $1,00 за 1 млн выходных |
| Пробный баланс | $0,50 на 7 дней, без карты · Пробный ключ: 2 параллельных запроса, 60 в минуту; полные лимиты (8 и 300) после первого пополнения |
| Бонус | +5% от $50, +10% от $100 |
| Пополнение | USDT (TRC20) или USDC (Base), любая целая сумма от $10 до $500 |
| Срок действия | оплаченный баланс не сгорает, без подписки |
| Оплата | предоплаченный баланс по фактическому расходу; ошибки и отказы бесплатны |
| Контент | контент для взрослых разрешён; сексуальный контент с несовершеннолетними запрещён |
| Вход | Google или e-mail и пароль |
| Ключи | один активный ключ на аккаунт; новый заменяет старый |
Коды ошибок
Ошибки приходят в JSON с постоянным type; неудачные и отклонённые запросы не оплачиваются.
| Код | Тип | Что значит |
|---|---|---|
400 | bad_request | неверный JSON, пустые сообщения, неверный параметр или превышено окно контекста |
401 | missing_key · invalid_key · key_revoked | нет ключа, ключ неверный или заменён новым |
402 | no_credit | баланс пуст — пополните, работа продолжится сразу |
403 | content_blocked | сексуальный контент с несовершеннолетними — отказ, без оплаты |
404 | not_found | неизвестный эндпоинт |
413 | request_too_large | тело запроса больше 8 МБ |
429 | rate_limited · concurrency | больше 300/мин или 8 параллельно — подождите и повторите |
503 | upstream_busy | модель занята — повторите через несколько секунд |
Вопросы и ответы
Эта модель такая же, как GPT-4 или Claude?
Нет. Идентификатор модели — «uncensored», это модель с открытыми весами, работающая на наших собственных GPU-серверах. Она настроена на законное взрослое использование без отказов по контенту, но является отдельной моделью от GPT, Claude, Gemini или других поставщиков.
Как начать работу с бесплатным пробным балансом?
Зарегистрируйтесь на странице получения API-ключа, указав только email и пароль. Вы получите $0,50 бесплатного пробного баланса, действительного в течение 7 дней. Для начала не требуется банковская карта или номер телефона.
Что произойдет, если я превышу лимит запросов?
Если вы превысите 300 запросов в минуту, API вернет код статуса 429. Вам следует реализовать экспоненциальное замедление в вашем клиенте. Вы можете создать новый ключ, если это необходимо, но лимит запросов применяется для каждого ключа отдельно.
Ваш ключ — в одной форме от вас
Создайте аккаунт, скопируйте ключ, измените базовый URL. Вот и вся настройка.