無検閲LLM API用クイックスタートガイド
このクイックスタートガイドでは、標準のOpenAI互換クライアントを使用して無検閲チャット完了APIを統合する方法を紹介します。ベースURL、認証手順、コード例、すぐにリクエストを送信するために必要な制限について確認できます。
認証とヘッダー
当APIは標準のAPIキー認証を使用します。すべてのリクエストでAuthorizationヘッダーにキーを含める必要があります。新しいアカウントは、APIキー取得ページでサインアップするとすぐにキーを受け取ります。キーを紛失した場合はいつでも再生成でき、古いキーは無効になります。アカウントごとにアクティブなキーは1つまでです。
すべてのリクエストのベースURLはhttps://api.llmapistatus.com/v1です。これは公式のOpenAI SDKやOpenAI互換のクライアントで、base_url設定を更新するだけで動作します。認証以外に特別なヘッダーは必要ありません。
チャット完了エンドポイント
POST /v1/chat/completionsエンドポイントを使用して、テキストを入力しテキストを取得します。モデルIDは常にuncensoredです。これは独自のGPUサーバーで動作するオープンウェイトモデルで、法的な成人利用向けにコンテンツ拒否なしで回答するように調整されています。GPT、Claude、その他のベンダーのモデルではありません。
APIはツールと関数の呼び出しをサポートしています。異なるベンダー間のルーティングを管理する必要はありません。当社は単一の専用無検閲エンドポイントを提供します。他のプロバイダーの一般的な比較については、LLMリーダーボードをご覧ください。
curl https://api.llmapistatus.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
ストリーミングレスポンス
レイテンシを低減するには、リクエストボディにstream: trueを設定してストリーミングを有効にできます。APIはServer-Sent Events (SSE)ストリームを返します。これは、トークンが生成されるたびにチャットインターフェースに表示したい場合に最適です。
ストリーミングは公式のOpenAI SDKと汎用HTTPクライアントの両方で動作します。ストリームはモデルが完了するかエラーが発生するまで続きます。この方法はユーザーの体感待機時間を短縮し、本番環境での無検閲モデルのレスポンス性を向上させます。
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
関数呼び出しサポート
APIは関数呼び出しを通じて構造化出力をサポートします。リクエストでツールを定義すると、モデルはスキーマに一致する構造化JSONを返します。これは、他のシステムと連携するエージェントやアプリケーションの構築に役立ちます。
チャット完了リクエストでtoolsパラメータを使用してください。モデルは適切な場合にツール呼び出しを返し、関数を実行してその結果を会話にフィードバックできます。この機能は追加料金なしですべてのリクエストで利用可能です。
from openai import OpenAI
client = OpenAI(base_url="https://api.llmapistatus.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
モデル一覧とコンテキストウィンドウ
GET /v1/modelsエンドポイントで利用可能なモデルを一覧表示できます。これにはモデルIDなどのメタデータが含まれ、モデルIDはuncensoredです。このモデルはプロンプトと補完を合わせて100,000トークンのコンテキストウィンドウをサポートします。
この大きなコンテキストウィンドウにより、単一のリクエストで広範なシステム指示、会話履歴、またはドキュメントの内容を渡すことができます。長文の生成や大規模なドキュメントの処理に適しています。エラーを避けるため、トークンの合計数を100kの制限内に保ってください。
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmapistatus.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
レート制限とクォータ
各APIキーは1分あたり300リクエストに制限されます。最大リクエストボディサイズは8 MBです。レート制限を超えると、429ステータスコードが返されます。APIキーが無効な場合は401エラーが、前払いクレジットがない場合は402エラーが発生します。
料金は透明です:入力トークン100万トークンあたり$0.25、出力トークン100万トークンあたり$1.00。クレジットは前払いで、期限切れになりません。暗号通貨(USDTまたはUSDC)で$10からチャージできます。ボーナスクレジットの詳細についてはLLM API価格ページをご覧ください。
技術仕様
購入前に確認できるよう、API の実際の制限と機能をすべてまとめました。
| 項目 | 内容 |
|---|---|
| 形式 | OpenAI 互換:どの OpenAI SDK でも base URL とキーを変えるだけで動作 |
| モデル ID | uncensored |
| エンドポイント | POST /v1/chat/completions · GET /v1/models |
| 認証 | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.llmapistatus.com/v1 |
| JSON モード | response_format: {"type": "json_object"} |
| パラメータ | temperature、top_p、stop、seed、presence_penalty、frequency_penalty |
| 最大出力 | 100,000 トークンのウィンドウの残りまで。max_tokens は任意(個別の上限なし) |
| コンテキスト長 | 100,000 トークン(入力+出力) |
| 関数呼び出し | 対応 — tools、tool_choice。応答に tool_calls(ストリーミングでも)、結果は role: tool で返送 |
| ストリーミング | 対応 — SSE、最後のチャンクにトークン使用量 |
| 同時実行 | キーごとに同時 8 リクエストまで |
| レート制限 | キーごとに毎分 300 リクエスト |
| リクエストサイズ | 最大 8 MB |
| レスポンスヘッダー | X-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency |
| 料金 | 入力 100 万トークン $0.25 · 出力 100 万トークン $1.00 |
| 無料トライアル | $0.50、7 日間、カード不要 · トライアルキー: 同時2件、毎分60件。初回チャージ後に上限が8件・300件へ拡大 |
| ボーナス | $50 以上で +5%、$100 以上で +10% |
| チャージ | USDT(TRC20)または USDC(Base)、$10〜$500 の任意の整数額 |
| 有効期限 | 購入クレジットは失効なし、サブスクなし |
| 課金 | 前払いクレジットから実使用量で課金。エラーと拒否は無料 |
| コンテンツ | 成人向けコンテンツ可。未成年者を含む性的コンテンツは拒否 |
| ログイン | Google またはメール+パスワード |
| キー | アカウントごとに有効なキーは 1 つ。新しいキーで旧キーは無効 |
エラーコード
エラーは固定の type を持つ JSON で返ります。失敗・拒否されたリクエストは課金されません。
| コード | タイプ | 意味 |
|---|---|---|
400 | bad_request | JSON 不正、メッセージ空、パラメータ誤り、またはコンテキスト超過 |
401 | missing_key · invalid_key · key_revoked | キーなし・誤り・新しいキーに置換済み |
402 | no_credit | 残高ゼロ — チャージすれば即再開 |
403 | content_blocked | 未成年者を含む性的コンテンツ — 拒否、課金なし |
404 | not_found | 不明なエンドポイント |
413 | request_too_large | 本文が 8 MB 超 |
429 | rate_limited · concurrency | 毎分 300 回または同時 8 件を超過 — 待って再試行 |
503 | upstream_busy | モデル混雑 — 数秒後に再試行 |
質問と回答
このモデルはGPT-4やClaudeと同じですか?
いいえ。モデルIDは「uncensored」で、独自のGPUサーバーで動作するオープンウェイトモデルです。法的な成人利用向けにコンテンツ拒否なしに調整されていますが、GPT、Claude、Gemini、その他のベンダーとは異なるモデルです。
トライアルクレジットの始め方は?
APIキー取得ページでメールアドレスとパスワードのみでサインアップしてください。7日間有効な$0.50の無料トライアルクレジットが付与されます。開始にクレジットカードや電話番号は不要です。
レート制限に達するとどうなりますか?
1分間に300リクエストを超えると、APIは429ステータスコードを返します。クライアント側で指数バックオフを実装してください。必要に応じてキーを再生成できますが、レート制限はキーごとに適用されます。
キーはフォーム 1 つで手に入ります
アカウントを作成し、キーをコピーし、ベースURLを変更するだけです。セットアップはこれだけです。