VI ▾
Lấy khóa API

Hướng dẫn nhanh tích hợp API LLM không kiểm duyệt

Hướng dẫn nhanh này giúp bạn tích hợp API chat-completions không kiểm duyệt của chúng tôi bằng các máy khách tương thích tiêu chuẩn với OpenAI. Bạn sẽ tìm thấy URL cơ bản, các bước xác thực, ví dụ mã và các giới hạn cần thiết để bắt đầu gửi yêu cầu ngay lập tức.

Xác thực & Tiêu đề

API của chúng tôi sử dụng xác thực khóa API tiêu chuẩn. Bạn phải bao gồm khóa của mình trong tiêu đề Authorization cho mọi yêu cầu. Tài khoản mới nhận được khóa ngay sau khi đăng ký trên trang Lấy khóa API. Nếu bạn mất khóa, bạn có thể tạo lại bất cứ lúc nào, điều này sẽ thu hồi khóa cũ. Chỉ một khóa hoạt động được phép cho mỗi tài khoản.

URL cơ bản cho tất cả các yêu cầu là https://api.llmapistatus.com/v1. Điều này hoạt động với các SDK OpenAI chính thức và bất kỳ máy khách tương thích OpenAI nào chỉ bằng cách cập nhật cấu hình base_url. Không cần tiêu đề đặc biệt nào ngoài xác thực.

Endpoint Chat Completions

Gửi văn bản vào và nhận văn bản ra bằng cách sử dụng endpoint POST /v1/chat/completions. ID mô hình luôn là uncensored. Đây là một mô hình trọng số mở chạy trên máy chủ GPU của chúng tôi, được tinh chỉnh để trả lời mà không từ chối nội dung cho người dùng trưởng thành hợp pháp. Nó không phải là GPT, Claude hoặc mô hình của nhà cung cấp khác.

API hỗ trợ gọi công cụ và hàm. Bạn không cần quản lý việc định tuyến giữa các nhà cung cấp khác nhau; chúng tôi cung cấp một endpoint không kiểm duyệt chuyên dụng. Để so sánh chung với các nhà cung cấp khác, hãy xem Bảng xếp hạng LLM của chúng tôi.

curl https://api.llmapistatus.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Phản hồi truyền phát

Để giảm độ trễ, bạn có thể bật truyền phát bằng cách đặt stream: true trong thân yêu cầu của bạn. API trả về luồng Sự kiện được máy chủ gửi (SSE). Điều này rất lý tưởng cho các giao diện trò chuyện nơi bạn muốn hiển thị token khi chúng được tạo ra.

Truyền phát hoạt động với cả các SDK OpenAI chính thức và các máy khách HTTP chung. Luồng tiếp tục cho đến khi mô hình hoàn thành hoặc xảy ra lỗi. Phương pháp này giảm thời gian chờ cảm nhận được của người dùng, khiến mô hình không kiểm duyệt cảm thấy phản hồi hơn trong các ứng dụng sản xuất.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Hỗ trợ gọi hàm

API hỗ trợ đầu ra có cấu trúc thông qua gọi hàm. Bạn có thể xác định các công cụ trong yêu cầu của mình và mô hình sẽ trả về JSON có cấu trúc khớp với lược đồ của bạn. Điều này hữu ích để xây dựng các tác nhân hoặc ứng dụng cần tương tác với các hệ thống khác.

Sử dụng tham số tools trong yêu cầu hoàn thành trò chuyện của bạn. Mô hình sẽ phản hồi bằng các cuộc gọi công cụ khi thích hợp, cho phép bạn thực thi các hàm và đưa kết quả trở lại cuộc trò chuyện. Tính năng này có sẵn trên tất cả các yêu cầu mà không tốn thêm chi phí.

from openai import OpenAI

client = OpenAI(base_url="https://api.llmapistatus.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Danh sách mô hình & Cửa sổ ngữ cảnh

Bạn có thể liệt kê các mô hình khả dụng bằng cách sử dụng endpoint GET /v1/models. Điều này sẽ trả về siêu dữ liệu bao gồm ID mô hình, là uncensored. Mô hình hỗ trợ cửa sổ ngữ cảnh 100.000 token cho cả prompt và completion kết hợp.

Cửa sổ ngữ cảnh lớn này cho phép bạn chuyển các hướng dẫn hệ thống rộng rãi, lịch sử trò chuyện hoặc nội dung tài liệu trong một yêu cầu duy nhất. Nó phù hợp cho việc tạo văn bản dài hoặc xử lý các tài liệu lớn. Hãy giữ tổng số token của bạn trong giới hạn 100k để tránh lỗi.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmapistatus.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Giới hạn tốc độ & Hạn mức

Mỗi khóa API bị giới hạn ở 300 yêu cầu mỗi phút. Kích thước thân yêu cầu tối đa là 8 MB. Nếu bạn vượt quá giới hạn tốc độ, bạn sẽ nhận được mã trạng thái 429. Nếu khóa API của bạn không hợp lệ, bạn sẽ nhận được lỗi 401. Nếu bạn không có tín dụng trả trước, bạn sẽ nhận được lỗi 402.

Giá cả minh bạch: $0.25 cho mỗi 1 triệu token đầu vào và $1.00 cho mỗi 1 triệu token đầu ra. Tín dụng được trả trước và không bao giờ hết hạn. Bạn có thể nạp tiền từ $10 bằng tiền điện tử (USDT hoặc USDC). Xem trang Bảng giá API LLM để biết chi tiết về tín dụng thưởng.

Thông số kỹ thuật

Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.

MụcGiá trị
Định dạngtương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa
ID mô hìnhuncensored
EndpointPOST /v1/chat/completions · GET /v1/models
Xác thựcAuthorization: Bearer YOUR_KEY
Base URLhttps://api.llmapistatus.com/v1
Chế độ JSONresponse_format: {"type": "json_object"}
Tham sốtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Đầu ra tối đatối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng)
Cửa sổ ngữ cảnh100.000 token (đầu vào + đầu ra)
Gọi hàmcó — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool
Streamingcó — server-sent events; phần cuối chứa lượng token đã dùng
Yêu cầu đồng thờitối đa 8 cùng lúc cho mỗi khóa
Giới hạn tốc độ300 yêu cầu mỗi phút cho mỗi khóa
Kích thước yêu cầutối đa 8 MB
Header phản hồiX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Giá$0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra
Dùng thử miễn phí$0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu
Thưởng+5% từ $50, +10% từ $100
Nạp tiềnUSDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500
Thời hạntín dụng đã trả không hết hạn, không đăng ký định kỳ
Tính phítín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí
Nội dungcho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên
Đăng nhậpGoogle hoặc email và mật khẩu
Khóamỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ

Mã lỗi

Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.

MãLoạiÝ nghĩa
400bad_requestJSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh
401missing_key · invalid_key · key_revokedthiếu khóa, sai khóa hoặc khóa đã bị thay
402no_credithết tín dụng — nạp tiền là dùng tiếp ngay
403content_blockednội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí
404not_foundendpoint không tồn tại
413request_too_largenội dung lớn hơn 8 MB
429rate_limited · concurrencyvượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại
503upstream_busymô hình đang bận — thử lại sau vài giây

Hỏi đáp

Mô hình này có giống GPT-4 hay Claude không?

Không. ID mô hình là "uncensored" và đây là mô hình trọng số mở chạy trên máy chủ GPU của chúng tôi. Nó được tinh chỉnh cho người dùng trưởng thành hợp pháp mà không từ chối nội dung, nhưng là một mô hình khác biệt với GPT, Claude, Gemini hoặc các nhà cung cấp khác.

Làm thế nào để bắt đầu với tín dụng dùng thử?

Đăng ký trên trang Lấy khóa API chỉ bằng email và mật khẩu. Bạn sẽ nhận được $0.50 tín dụng dùng thử có hiệu lực trong 7 ngày. Không cần thẻ tín dụng hoặc số điện thoại để bắt đầu.

Điều gì xảy ra nếu tôi vượt quá giới hạn tốc độ?

Nếu bạn vượt quá 300 yêu cầu mỗi phút, API sẽ trả về mã trạng thái 429. Bạn nên triển khai cơ chế backoff theo cấp số nhân trong ứng dụng của mình. Bạn có thể tạo lại khóa nếu cần, nhưng giới hạn tốc độ áp dụng cho mỗi khóa.

Khóa của bạn chỉ cách một biểu mẫu

Tạo tài khoản, sao chép khóa, thay đổi URL cơ bản. Đó là toàn bộ quá trình thiết lập.

Lấy khóa API