무검열 LLM API 빠른 시작 가이드
이 빠른 시작 가이드는 표준 OpenAI 호환 클라이언트를 사용하여 무검열 채팅-완성 API를 연동하는 방법을 안내합니다. 즉시 요청을 시작하는 데 필요한 기본 URL, 인증 단계, 코드 예제 및 제한 사항을 확인하세요.
인증 및 헤더
당사의 API는 표준 API 키 인증을 사용합니다. 모든 요청 시 Authorization 헤더에 키를 포함해야 합니다. 새 계정은 Get API key 페이지에서 가입한 직후 키를 받습니다. 키를 분실한 경우 언제든지 재생성할 수 있으며, 이 경우 기존 키가 무효화됩니다. 계정당 활성 키는 하나만 허용됩니다.
모든 요청의 기본 URL은 https://api.llmapistatus.com/v1입니다. 이는 base_url 구성을 업데이트하기만 하면 공식 OpenAI SDK 및 모든 OpenAI 호환 클라이언트에서 작동합니다. 인증 외에 특별한 헤더는 필요하지 않습니다.
채팅 완성 엔드포인트
POST /v1/chat/completions 엔드포인트를 사용하여 텍스트를 입력하고 텍스트를 얻으세요. 모델 ID는 항상 uncensored입니다. 이는 자체 GPU 서버에서 실행되는 오픈 웨이트 모델로, 합법적인 성인용으로 콘텐츠 거부 없이 답변하도록 튜닝되었습니다. GPT, Claude 또는 기타 벤더의 모델이 아닙니다.
API는 도구 및 함수 호출을 지원합니다. 다른 벤더 간 라우팅을 관리할 필요가 없습니다. 우리는 단일 전용 무검열 엔드포인트를 제공합니다. 기타 제공업체의 일반적인 비교는 LLM 리더보드를 참조하세요.
curl https://api.llmapistatus.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
스트리밍 응답
낮은 지연 시간을 위해 요청 본문에 stream: true을 설정하여 스트리밍을 활성화할 수 있습니다. API는 서버 전송 이벤트(SSE) 스트림을 반환합니다. 이는 생성되는 토큰을 표시하려는 채팅 인터페이스에 이상적입니다.
스트리밍은 공식 OpenAI SDK 및 일반 HTTP 클라이언트 모두에서 작동합니다. 스트림은 모델이 완료되거나 오류가 발생할 때까지 계속됩니다. 이 방법은 사용자의 체감 대기 시간을 줄여 프로덕션 애플리케이션에서 무검열 모델이 더 반응이 빠르도록 만듭니다.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
함수 호출 지원
API는 함수 호출을 통해 구조화된 출력을 지원합니다. 요청에서 도구를 정의하면 모델이 스키마와 일치하는 구조화된 JSON을 반환합니다. 이는 다른 시스템과 상호 작용해야 하는 에이전트나 애플리케이션을 구축하는 데 유용합니다.
채팅 완성 요청에 tools 매개변수를 사용하세요. 모델은 적절한 경우 도구 호출로 응답하여 함수를 실행하고 결과를 대화에 다시 피드백할 수 있게 합니다. 이 기능은 추가 비용 없이 모든 요청에서 사용할 수 있습니다.
from openai import OpenAI
client = OpenAI(base_url="https://api.llmapistatus.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
모델 목록 및 컨텍스트 창
GET /v1/models 엔드포인트를 사용하여 사용 가능한 모델을 나열할 수 있습니다. 여기에는 모델 ID(uncensored)를 포함한 메타데이터가 반환됩니다. 이 모델은 프롬프트와 완성을 합쳐 100,000개의 토큰 컨텍스트 창을 지원합니다.
이 큰 컨텍스트 창을 사용하면 단일 요청에 광범위한 시스템 지시문, 대화 기록 또는 문서 내용을 전달할 수 있습니다. 장문 생성이나 대규모 문서 처리에 적합합니다. 오류를 피하려면 전체 토큰 수를 100k 제한 내에 유지하세요.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.llmapistatus.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
속도 제한 및 할당량
각 API 키는 분당 300개의 요청으로 제한됩니다. 최대 요청 본문 크기는 8 MB입니다. 속도 제한을 초과하면 429 상태 코드를 받게 됩니다. API 키가 유효하지 않으면 401 오류가 발생합니다. 선불 크레딧이 없으면 402 오류가 발생합니다.
가격은 투명합니다: 입력 토큰 1M당 $0.25, 출력 토큰 1M당 $1.00. 크레딧은 선불이며 만료되지 않습니다. USDT 또는 USDC로 $10부터 크레딧을 충전할 수 있습니다. 보너스 크레딧에 대한 자세한 내용은 LLM API 가격 페이지를 참조하세요.
기술 사양
크레딧을 구매하기 전에 확인할 수 있도록 API의 실제 한도와 기능을 한곳에 정리했습니다.
| 항목 | 내용 |
|---|---|
| 형식 | OpenAI 호환: 어떤 OpenAI SDK든 base URL과 키만 바꾸면 동작 |
| 모델 ID | uncensored |
| 엔드포인트 | POST /v1/chat/completions · GET /v1/models |
| 인증 | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.llmapistatus.com/v1 |
| JSON 모드 | response_format: {"type": "json_object"} |
| 파라미터 | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| 최대 출력 | 100,000 토큰 윈도우의 남은 만큼; max_tokens는 선택 사항(별도 상한 없음) |
| 컨텍스트 창 | 100,000 토큰 (입력 + 출력) |
| 함수 호출 | 지원 — tools, tool_choice; 응답에 tool_calls (스트리밍 포함), 결과는 role: tool로 전송 |
| 스트리밍 | 지원 — SSE, 마지막 청크에 토큰 사용량 포함 |
| 동시 요청 | 키당 동시 8개 |
| 속도 제한 | 키당 분당 300회 |
| 요청 크기 | 최대 8 MB |
| 응답 헤더 | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| 가격 | 입력 100만 토큰당 $0.25 · 출력 100만 토큰당 $1.00 |
| 무료 체험 | $0.50, 7일, 카드 불필요 · 체험 키: 동시 요청 2건, 분당 60건. 첫 충전 후 전체 한도(8건, 300건) 적용 |
| 보너스 | $50 이상 +5%, $100 이상 +10% |
| 충전 | USDT (TRC20) 또는 USDC (Base), $10~$500 사이 원하는 정수 금액 |
| 유효기간 | 유료 크레딧은 만료되지 않으며 구독 없음 |
| 과금 | 선불 크레딧에서 실제 사용량만큼 차감, 오류·거부는 무료 |
| 콘텐츠 | 성인 콘텐츠 허용, 미성년자가 관련된 성적 콘텐츠는 거부 |
| 로그인 | Google 또는 이메일과 비밀번호 |
| 키 | 계정당 활성 키 1개, 새 키를 만들면 이전 키는 무효 |
오류 코드
오류는 고정된 type을 가진 JSON으로 반환되며, 실패하거나 거부된 요청은 과금되지 않습니다.
| 코드 | 유형 | 의미 |
|---|---|---|
400 | bad_request | 잘못된 JSON, 빈 메시지, 잘못된 파라미터 또는 컨텍스트 초과 |
401 | missing_key · invalid_key · key_revoked | 키 없음·잘못됨·새 키로 교체됨 |
402 | no_credit | 잔액 없음 — 충전하면 즉시 재개 |
403 | content_blocked | 미성년자 관련 성적 콘텐츠 — 거부, 과금 없음 |
404 | not_found | 알 수 없는 엔드포인트 |
413 | request_too_large | 본문 8 MB 초과 |
429 | rate_limited · concurrency | 분당 300회 또는 동시 8개 초과 — 잠시 후 재시도 |
503 | upstream_busy | 모델 혼잡 — 몇 초 후 재시도 |
질문과 답변
이 모델은 GPT-4나 Claude와 동일한가요?
아니요. 모델 ID는 "uncensored"이며 자체 GPU 서버에서 실행되는 오픈 웨이트 모델입니다. 합법적인 성인용으로 콘텐츠 거부 없이 튜닝되었지만 GPT, Claude, Gemini 또는 기타 벤더의 모델과는 별개입니다.
무료 체험 크레딧으로 시작하려면 어떻게 하나요?
API 키 받기 페이지에서 이메일과 비밀번호만으로 가입하세요. 7일 유효한 $0.50의 무료 체험 크레딧을 받게 됩니다. 시작하기 위해 신용카드나 전화번호가 필요하지 않습니다.
속도 제한에 도달하면 어떻게 되나요?
분당 300개 요청을 초과하면 API가 429 상태 코드를 반환합니다. 클라이언트에서 지수 백오프를 구현해야 합니다. 필요시 키를 재생성할 수 있지만 속도 제한은 키별로 적용됩니다.
키는 양식 하나만 작성하면 받을 수 있습니다
계정을 생성하고 키를 복사한 후 기본 URL을 변경하세요. 설정은 이것뿐입니다.