無審查 LLM API 快速上手指南
此快速上手指南協助您使用標準 OpenAI 相容客戶端整合我們的無審查聊天完成 API。您將找到基礎 URL、驗證步驟、程式碼範例及立即開始發送請求所需的限制。
驗證與標頭
我們的 API 使用標準 API 金鑰驗證。您必須在每個請求的 Authorization 標頭中包含您的金鑰。新帳戶在取得 API 金鑰頁面註冊後會立即獲得金鑰。如果您遺失金鑰,您可以隨時重新產生它,這將使舊金鑰失效。每個帳戶只允許一個有效金鑰。
所有請求的基礎 URL 為 https://api.llmapistatus.com/v1。透過僅更新 base_url 設定,即可與官方 OpenAI SDK 及任何 OpenAI 相容客戶端配合使用。除了驗證之外,不需要其他特殊標頭。
聊天完成端點
使用 POST /v1/chat/completions 端點輸入文字並獲取文字輸出。模型 ID 始終為 uncensored。這是一個運行於我們自有 GPU 伺服器上的開放權重模型,針對合法成人用途進行微調,可無內容審查地回答問題。它不是 GPT、Claude 或其他廠商的模型。
API 支援工具和函式呼叫。您無需管理不同廠商之間的路由;我們提供單一專屬的無審查端點。如需比較其他供應商,請參閱我們的 LLM 排行榜。
curl https://api.llmapistatus.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
串流回應
為了降低延遲,您可以在請求主體中設定 stream: true 以啟用串流。API 會返回伺服器發送事件 (SSE) 串流。這非常適合希望即時顯示生成 token 的聊天介面。
串流功能適用於官方 OpenAI SDK 和通用 HTTP 客戶端。串流會持續直到模型完成或發生錯誤。此方法可減少使用者的感知等待時間,使無審查模型在生產應用中感覺更具回應性。
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
函式呼叫支援
API 支援透過函式呼叫實現結構化輸出。您可以在請求中定義工具,模型將返回符合您架構的結構化 JSON。這對於需要與其他系統互動的代理程式或應用程式很有用。
在聊天完成請求中使用 tools 參數。模型會在適當時回應工具呼叫,允許您執行函式並將結果回饋至對話中。此功能在所有請求中均可用,且無額外費用。
from openai import OpenAI
client = OpenAI(base_url="https://api.llmapistatus.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
模型列表與上下文視窗
您可以使用 GET /v1/models 端點列出可用模型。這將返回包含模型 ID 的元數據,即 uncensored。該模型支援 100,000 個 token 的上下文視窗,適用於提示詞和完成內容的總和。
此大型上下文視窗允許您在單一請求中傳遞廣泛的系統指令、對話歷史或文件內容。它適合長篇生成或處理大型文件。請將您的總 token 計數保持在 100k 限制以內,以避免錯誤。
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmapistatus.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
速率限制與配額
每個 API 金鑰限制為每分鐘 300 個請求。最大請求主體大小為 8 MB。如果您超過速率限制,您將收到 429 狀態碼。如果您的 API 金鑰無效,您將收到 401 錯誤。如果您沒有預付額度,您將收到 402 錯誤。
定價透明:每 100 萬個輸入 token 為 $0.25,每 100 萬個輸出 token 為 $1.00。額度為預付制且永不過期。你可以透過加密貨幣(USDT 或 USDC)進行儲值,最低金額為 $10。有關額外額度的詳細資訊,請參閱 LLM API 定價頁面。
技術規格
購買額度前,請先確認介面是否符合你的需求——以下是全部真實參數。
| 項目 | 說明 |
|---|---|
| 介面格式 | 相容 OpenAI:任何 OpenAI SDK 只需更換 base URL 和金鑰 |
| 模型 ID | uncensored |
| 端點 | POST /v1/chat/completions · GET /v1/models |
| 驗證 | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.llmapistatus.com/v1 |
| JSON 模式 | response_format: {"type": "json_object"} |
| 取樣參數 | temperature、top_p、stop、seed、presence_penalty、frequency_penalty |
| 最大輸出 | 不另設輸出上限;提示+回覆共 100,000 個 token 視窗內,max_tokens 可選 |
| 上下文視窗 | 100,000 tokens(輸入與輸出合計) |
| 函式呼叫 | 支援 tools、tool_choice;回覆包含 tool_calls(串流同樣支援),結果以 role: tool 訊息回傳 |
| 串流輸出 | 支援 SSE,最後一段包含 token 用量 |
| 並行請求 | 每把金鑰同時最多 8 個請求 |
| 速率限制 | 每把金鑰每分鐘 300 次請求 |
| 請求大小 | 每次請求不超過 8 MB |
| 回應標頭 | X-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency |
| 價格 | 輸入 $0.25 / 百萬 tokens · 輸出 $1.00 / 百萬 tokens |
| 免費試用 | $0.50,有效期 7 天,不需信用卡 · 試用金鑰:2 個並行請求,每分鐘 60 次;首次儲值後恢復完整限額(8 和 300) |
| 贈送額度 | 滿 $50 送 5%,滿 $100 送 10% |
| 儲值 | USDT(TRC20)或 USDC(Base),$10–$500 任意整數金額 |
| 額度效期 | 付費額度永不過期,無訂閱 |
| 計費 | 預付額度,按實際 token 用量扣費;錯誤和拒絕不收費 |
| 內容政策 | 允許成人內容;涉及未成年人的性內容一律拒絕 |
| 登入 | Google 或電子郵件 + 密碼 |
| 金鑰 | 每個帳戶一把有效金鑰;產生新金鑰後舊金鑰失效 |
錯誤代碼
錯誤以 JSON 回傳,type 欄位固定;失敗或被拒絕的請求不計費。
| 狀態碼 | 類型 | 含義 |
|---|---|---|
400 | bad_request | JSON 無效、訊息為空、參數錯誤或超出上下文視窗 |
401 | missing_key · invalid_key · key_revoked | 缺少金鑰、金鑰錯誤或已被新金鑰取代 |
402 | no_credit | 餘額不足——儲值後立即恢復 |
403 | content_blocked | 涉及未成年人的性內容——拒絕且不計費 |
404 | not_found | 未知端點 |
413 | request_too_large | 請求內容超過 8 MB |
429 | rate_limited · concurrency | 超過每分鐘 300 次或 8 個並行——稍後重試 |
503 | upstream_busy | 模型忙碌——幾秒後重試 |
問答
此模型與 GPT-4 或 Claude 相同嗎?
不相同。模型 ID 為「uncensored」,是運行於我們自有 GPU 伺服器上的開放權重模型。它針對合法成人用途進行微調,無內容審查,但與 GPT、Claude、Gemini 或其他廠商的模型不同。
如何開始使用試用額度?
在取得 API 金鑰頁面僅使用電子郵件和密碼註冊。您將獲得 $0.50 的免費試用額度,有效期為 7 天。開始使用無需信用卡或手機號碼。
如果我達到速率限制會怎樣?
如果您每分鐘超過 300 個請求,API 會返回 429 狀態碼。您應在客戶端實作指數退避。如有需要可重新產生金鑰,但速率限制是針對每個金鑰計算的。
只差一張表單,即可取得金鑰
建立帳戶、複製金鑰、更改基礎 URL。這就是整個設定。