คู่มือเริ่มต้นใช้งาน API LLM แบบไม่เซ็นเซอร์
คู่มือเริ่มต้นใช้งานนี้ช่วยคุณบูรณาการ API chat-completions LLM ไม่เซ็นเซอร์ของเราโดยใช้ไคลเอนต์ที่เข้ากันได้กับ OpenAI มาตรฐาน คุณจะพบ URL พื้นฐาน ขั้นตอนการตรวจสอบสิทธิ์ ตัวอย่างโค้ด และขีดจำกัดที่จำเป็นเพื่อเริ่มส่งคำขอได้ทันที
การตรวจสอบสิทธิ์และส่วนหัว
API ของเราใช้การตรวจสอบสิทธิ์ด้วยคีย์ API มาตรฐาน คุณต้องรวมคีย์ของคุณในส่วนหัว Authorization สำหรับทุกคำขอ บัญชีใหม่จะได้รับคีย์ทันทีหลังจากสมัครสมาชิกที่หน้ารับคีย์ API หากคุณทำหาย คุณสามารถสร้างคีย์ใหม่ได้ทุกเมื่อ ซึ่งจะทำให้คีย์เก่ายกเลิกทันที อนุญาตให้มีคีย์ที่ใช้งานได้อย่างเดียวต่อบัญชี
URL พื้นฐานสำหรับคำขอทั้งหมดคือ https://api.llmapistatus.com/v1 สิ่งนี้ทำงานกับ SDK อย่างเป็นทางการของ OpenAI และไคลเอนต์ที่เข้ากันได้กับ OpenAI ใดๆ โดยการอัปเดตการกำหนดค่า base_url อย่างง่าย ไม่ต้องใช้ส่วนหัวพิเศษนอกเหนือจากการตรวจสอบสิทธิ์
เอนด์พอยต์ Chat Completions
ส่งข้อความเข้าและรับข้อความออกโดยใช้เอนด์พอยต์ POST /v1/chat/completions รหัสโมเดลคือ uncensored เสมอ นี่คือโมเดลแบบเปิดน้ำหนักที่รันบนเซิร์ฟเวอร์ GPU ของเรา ปรับแต่งเพื่อตอบโดยไม่มีการปฏิเสธเนื้อหาสำหรับการใช้งานผู้ใหญ่ที่ถูกต้องตามกฎหมาย ไม่ใช่โมเดลของ GPT, Claude หรือผู้จัดจำหน่ายรายอื่น
API รองรับเครื่องมือและการเรียกใช้ฟังก์ชัน คุณไม่จำเป็นต้องจัดการการเปลี่ยนเส้นทางระหว่างผู้จัดจำหน่ายรายต่างๆ เราให้บริการเอนด์พอยต์แบบไม่เซ็นเซอร์เฉพาะทางเดียว สำหรับการเปรียบเทียบทั่วไปของผู้จัดจำหน่ายรายอื่น โปรดดูตารางผู้นำ LLM ของเรา
curl https://api.llmapistatus.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
การตอบสนองแบบสตรีมมิง
เพื่อลดเวลาแฝง คุณสามารถเปิดใช้งานสตรีมมิงโดยการตั้งค่า stream: true ในร่างกายคำขอของคุณ API จะส่งสตรีมเหตุการณ์ที่ส่งโดยเซิร์ฟเวอร์ (SSE) สิ่งนี้เหมาะสำหรับอินเทอร์เฟซแชทที่คุณต้องการแสดงโทเคนเมื่อสร้างเสร็จ
สตรีมมิงใช้งานได้ทั้งกับ SDK อย่างเป็นทางการของ OpenAI และไคลเอนต์ HTTP ทั่วไป สตรีมจะดำเนินต่อไปจนกว่าโมเดลจะเสร็จสิ้นหรือเกิดข้อผิดพลาด วิธีการนี้ลดเวลาการรอที่ผู้ใช้รู้สึก ทำให้โมเดลแบบไม่เซ็นเซอร์รู้สึกตอบสนองมากขึ้นในแอปพลิเคชันการผลิต
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
การรองรับการเรียกใช้ฟังก์ชัน
API รองรับเอาต์พุตที่มีโครงสร้างผ่านการเรียกใช้ฟังก์ชัน คุณสามารถกำหนดเครื่องมือในคำขอของคุณและโมเดลจะส่งคืน JSON ที่มีโครงสร้างที่ตรงกับสคีมาของคุณ สิ่งนี้มีประโยชน์สำหรับการสร้างเอเจนต์หรือแอปพลิเคชันที่ต้องโต้ตอบกับระบบอื่น
ใช้พารามิเตอร์ tools ในคำขอเสร็จสิ้นแชทของคุณ โมเดลจะตอบสนองด้วยการเรียกใช้ฟังก์ชันเมื่อเหมาะสม ทำให้คุณสามารถเรียกใช้ฟังก์ชันและส่งผลลัพธ์กลับเข้าสู่การสนทนาได้ คุณสมบัตินี้มีในทุกคำขอโดยไม่เสียค่าใช้จ่ายเพิ่มเติม
from openai import OpenAI
client = OpenAI(base_url="https://api.llmapistatus.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
การระบุโมเดลและหน้าต่างบริบท
คุณสามารถระบุโมเดลที่มีอยู่โดยใช้เอนด์พอยต์ GET /v1/models สิ่งนี้จะส่งข้อมูลเมตาซึ่งรวมถึงรหัสโมเดล ซึ่งคือ uncensored โมเดลรองรับหน้าต่างบริบท 100,000 โทเคนสำหรับพรอมต์และการเสร็จสิ้นรวมกัน
หน้าต่างบริบทขนาดใหญ่ nàyช่วยให้คุณส่งคำแนะนำระบบ คำอธิบายประวัติการสนทนา หรือเนื้อหาเอกสารจำนวนมากในคำขอเดียว เหมาะสำหรับข้อความยาวหรือประมวลผลเอกสารขนาดใหญ่ รักษาจำนวนโทเคนรวมของคุณภายในขีดจำกัด 100k เพื่อหลีกเลี่ยงข้อผิดพลาด
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmapistatus.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
ขีดจำกัดอัตราและโควตา
คีย์ API แต่ละอันจำกัดอยู่ที่ 300 คำขอต่อนาที ขนาดร่างกายคำขอสูงสุดคือ 8 MB หากคุณเกินขีดจำกัดอัตรา คุณจะรับสถานะ 429 หากคุณมีคีย์ API ไม่ถูกต้อง คุณจะรับข้อผิดพลาด 401 หากคุณไม่มีเครดิตแบบเติมเงินล่วงหน้า คุณจะรับข้อผิดพลาด 402
ราคาโปร่งใส: $0.25 ต่อ 1M โทเคนอินพุต และ $1.00 ต่อ 1M โทเคนเอาต์พุต เครดิตเป็นแบบเติมเงินล่วงหน้าและไม่หมดอายุ คุณสามารถเติมเงินตั้งแต่ $10 ด้วยคริปโต (USDT หรือ USDC) ดูหน้าราคา API LLM สำหรับรายละเอียดเกี่ยวกับเครดิตโบนัส
ข้อมูลจำเพาะทางเทคนิค
ขีดจำกัดและความสามารถจริงทั้งหมดของ API ในที่เดียว ตรวจสอบก่อนเติมเงิน
| รายการ | ค่า |
|---|---|
| รูปแบบ API | รองรับ OpenAI: ใช้ OpenAI SDK ใดก็ได้ แค่เปลี่ยน base URL และคีย์ |
| ID โมเดล | uncensored |
| เอนด์พอยต์ | POST /v1/chat/completions · GET /v1/models |
| การยืนยันตัวตน | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.llmapistatus.com/v1 |
| โหมด JSON | response_format: {"type": "json_object"} |
| พารามิเตอร์ | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| เอาต์พุตสูงสุด | ได้ถึงส่วนที่เหลือของหน้าต่าง 100,000 โทเคน; max_tokens ไม่บังคับ (ไม่มีเพดานแยก) |
| หน้าต่างบริบท | 100,000 โทเคน (อินพุตรวมเอาต์พุต) |
| การเรียกใช้ฟังก์ชัน | รองรับ — tools, tool_choice คำตอบมี tool_calls รวมถึงตอนสตรีม ส่งผลลัพธ์กลับด้วย role: tool |
| สตรีมมิง | รองรับ — server-sent events ชิ้นสุดท้ายมีจำนวนโทเคนที่ใช้ |
| คำขอพร้อมกัน | สูงสุด 8 คำขอพร้อมกันต่อคีย์ |
| ขีดจำกัดอัตรา | 300 คำขอต่อนาทีต่อคีย์ |
| ขนาดคำขอ | ไม่เกิน 8 MB |
| เฮดเดอร์ของคำตอบ | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| ราคา | $0.25 ต่อ 1 ล้านโทเคนอินพุต · $1.00 ต่อ 1 ล้านโทเคนเอาต์พุต |
| เครดิตทดลองใช้ฟรี | $0.50 ใช้ได้ 7 วัน ไม่ต้องใช้บัตร · คีย์ทดลอง: 2 คำขอพร้อมกัน, 60 ครั้งต่อนาที; ขีดจำกัดเต็ม (8 และ 300) หลังเติมเงินครั้งแรก |
| โบนัส | +5% เมื่อเติมตั้งแต่ $50, +10% ตั้งแต่ $100 |
| เติมเงิน | USDT (TRC20) หรือ USDC (Base) จำนวนเต็มใดก็ได้ตั้งแต่ $10 ถึง $500 |
| อายุเครดิต | เครดิตที่ซื้อไม่มีวันหมดอายุ ไม่มีการสมัครรายเดือน |
| การคิดเงิน | เครดิตแบบเติมเงินล่วงหน้าตามการใช้งานจริง ข้อผิดพลาดและการปฏิเสธไม่คิดเงิน |
| เนื้อหา | อนุญาตเนื้อหาสำหรับผู้ใหญ่ ปฏิเสธเนื้อหาทางเพศที่เกี่ยวข้องกับผู้เยาว์ |
| เข้าสู่ระบบ | Google หรืออีเมลและรหัสผ่าน |
| คีย์ | หนึ่งบัญชีมีคีย์ที่ใช้งานได้หนึ่งคีย์ คีย์ใหม่จะแทนคีย์เดิม |
รหัสข้อผิดพลาด
ข้อผิดพลาดส่งกลับเป็น JSON พร้อม type ที่คงที่ คำขอที่ล้มเหลวหรือถูกปฏิเสธไม่คิดเงิน
| รหัส | ประเภท | ความหมาย |
|---|---|---|
400 | bad_request | JSON ไม่ถูกต้อง ข้อความว่าง พารามิเตอร์ผิด หรือเกินหน้าต่างบริบท |
401 | missing_key · invalid_key · key_revoked | ไม่มีคีย์ คีย์ผิด หรือคีย์ถูกแทนที่แล้ว |
402 | no_credit | เครดิตหมด เติมเงินแล้วใช้งานต่อได้ทันที |
403 | content_blocked | เนื้อหาทางเพศเกี่ยวกับผู้เยาว์ ถูกปฏิเสธ ไม่คิดเงิน |
404 | not_found | ไม่รู้จักเอนด์พอยต์ |
413 | request_too_large | ขนาดเกิน 8 MB |
429 | rate_limited · concurrency | เกิน 300/นาที หรือ 8 พร้อมกัน รอแล้วลองใหม่ |
503 | upstream_busy | โมเดลไม่ว่าง ลองใหม่ในไม่กี่วินาที |
ถาม-ตอบ
โมเดลนี้เหมือนกับ GPT-4 หรือ Claude หรือไม่
ไม่ รหัสโมเดลคือ "uncensored" และเป็นโมเดลแบบเปิดน้ำหนักที่รันบนเซิร์ฟเวอร์ GPU ของเราเอง ปรับแต่งสำหรับการใช้งานผู้ใหญ่ที่ถูกต้องตามกฎหมายโดยไม่มีการปฏิเสธเนื้อหา แต่เป็นโมเดลที่แตกต่างจาก GPT, Claude, Gemini หรือผู้จัดจำหน่ายรายอื่น
ฉันจะเริ่มใช้งานเครดิตทดลองใช้ได้อย่างไร
สมัครสมาชิกที่หน้ารับคีย์ API โดยใช้เพียงอีเมลและรหัสผ่าน คุณจะได้รับเครดิตทดลองใช้ฟรี $0.50 ที่ใช้งานได้ 7 วัน ไม่ต้องใช้บัตรเครดิตหรือหมายเลขโทรศัพท์เพื่อเริ่มต้น
เกิดอะไรขึ้นเมื่อฉันถึงขีดจำกัดอัตรา
หากคุณเกิน 300 คำขอต่อนาที API จะส่งสถานะ 429 กลับมา คุณควรใช้การถอยหลังแบบเอกซ์โพเนนเชียลในไคลเอนต์ของคุณ คุณสามารถสร้างคีย์ใหม่ได้หากจำเป็น แต่ขีดจำกัดอัตรานี้ใช้ต่อคีย์
คีย์ของคุณอยู่ห่างแค่แบบฟอร์มเดียว
สร้างบัญชี คัดลอกคีย์ เปลี่ยน URL พื้นฐาน นั่นคือการตั้งค่าทั้งหมด