HI ▾
Get API key

अनसेंसर्ड LLM API के लिए क्विकस्टार्ट गाइड

यह क्विकस्टार्ट गाइड आपको मानक OpenAI-संगत क्लाइंट्स का उपयोग करके हमारे बिना सेंसर चैट पूर्ता API को इंटीग्रेट करने में मदद करता है। आपको बेस URL, प्रमाणीकरण चरण, कोड उदाहरण और तुरंत अनुरोध भेजने के लिए आवश्यक सीमाएँ मिलेंगी।

प्रमाणीकरण और हेडर्स

हमारा API मानक API कुंजी प्रमाणीकरण का उपयोग करता है। आपको हर अनुरोध में अपनी कुंजी Authorization हेडर में शामिल करनी होगी। नए खातों को Get API key पेज पर साइन अप करने के तुरंत बाद एक कुंजी मिलती है। यदि आप अपनी कुंजी खो देते हैं, तो आप इसे किसी भी समय पुनः जनरेट कर सकते हैं, जिससे पुरानी कुंजी रद्द हो जाती है। प्रति खाता केवल एक सक्रिय कुंजी की अनुमति है।

सभी अनुरोधों के लिए बेस URL https://api.llmapistatus.com/v1 है। यह आधिकारिक OpenAI SDKs और किसी भी OpenAI-संगत क्लाइंट के साथ काम करता है, बस base_url कॉन्फ़िगरेशन को अपडेट करने से। प्रमाणीकरण के अलावा कोई विशेष हेडर की आवश्यकता नहीं है।

चैट कम्प्लीशंस एंडपॉइंट

POST /v1/chat/completions एंडपॉइंट पर टेक्स्ट भेजें और टेक्स्ट प्राप्त करें। मॉडल ID हमेशा uncensored है। यह हमारे अपने GPU सर्वरों पर चलने वाला एक ओपन-वेट मॉडल है, जिसे कानूनी वयस्क उपयोग के लिए बिना सामग्री अस्वीकृति के उत्तर देने के लिए ट्यून्ड किया गया है। यह GPT, क्लॉड या किसी अन्य विक्रेता का मॉडल नहीं है।

API टूल और फ़ंक्शन कॉलिंग का समर्थन करता है। आपको अलग-अलग वेंडर्स के बीच रूटिंग प्रबंधित करने की आवश्यकता नहीं है; हम एक एकल, समर्पित अनसेंसर्ड एंडपॉइंट प्रदान करते हैं। अन्य प्रदाताओं की सामान्य तुलना के लिए, हमारे LLM लीडरबोर्ड को देखें।

curl https://api.llmapistatus.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

स्ट्रीमिंग प्रतिक्रियाएं

कम लेटेंसी के लिए, आप अपने अनुरोध बॉडी में stream: true सेट करके स्ट्रीमिंग सक्षम कर सकते हैं। API एक सर्वर-सेंट इवेंट्स (SSE) स्ट्रीम लौटाता है। यह उन चैट इंटरफेस के लिए आदर्श है जहां आप टोकन को जनरेट होते ही प्रदर्शित करना चाहते हैं।

स्ट्रीमिंग आधिकारिक OpenAI SDKs और सामान्य HTTP क्लाइंट्स दोनों के साथ काम करती है। स्ट्रीम तब तक चलती रहती है जब तक कि मॉडल समाप्त नहीं हो जाता या कोई त्रुटि नहीं होती। यह विधि उपयोगकर्ताओं के लिए प्रतीक्षा समय को कम करती है, जिससे उत्पादन अनुप्रयोगों में अनसेंसर्ड मॉडल अधिक प्रतिक्रियाशील लगता है।

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

फ़ंक्शन कॉलिंग समर्थन

API फ़ंक्शन कॉलिंग के माध्यम से संरचित आउटपुट का समर्थन करता है। आप अपने अनुरोध में टूल्स परिभाषित कर सकते हैं और मॉडल आपके स्कीमा से मेल खाने वाला संरचित JSON लौटाएगा। यह एजेंट्स या अन्य सिस्टम के साथ इंटरैक्ट करने वाले अनुप्रयोगों को बनाने के लिए उपयोगी है।

अपने चैट कम्प्लीशंस अनुरोध में tools पैरामीटर का उपयोग करें। मॉडल उचित होने पर टूल कॉल्स के साथ प्रतिक्रिया देगा, जिससे आपको फ़ंक्शन निष्पादित करने और परिणामों को बातचीत में वापस फ़ीड करने की अनुमति मिलती है। यह सुविधा बिना अतिरिक्त लागत के सभी अनुरोधों पर उपलब्ध है।

from openai import OpenAI

client = OpenAI(base_url="https://api.llmapistatus.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

मॉडल सूची और कॉन्टेक्स्ट विंडो

आप GET /v1/models एंडपॉइंट का उपयोग करके उपलब्ध मॉडल की सूची देख सकते हैं। इससे मॉडल ID सहित मेटाडेटा लौटेगा, जो uncensored है। मॉडल प्रॉम्प्ट और पूर्ति के संयुक्त उपयोग के लिए 100,000 टोकन की कॉन्टेक्स्ट विंडो का समर्थन करता है।

यह बड़ी कॉन्टेक्स्ट विंडो आपको एक ही अनुरोध में विस्तृत सिस्टम निर्देश, बातचीत का इतिहास या दस्तावेज़ सामग्री भेजने की अनुमति देती है। यह लंबी सामग्री निर्माण या बड़े दस्तावेज़ों के प्रसंस्करण के लिए उपयुक्त है। त्रुटियों से बचने के लिए अपने कुल टोकन गणना को 100k सीमा के भीतर रखें।

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.llmapistatus.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

रेट लिमिट और कोटा

प्रत्येक API कुंजी 300 अनुरोध प्रति मिनट तक सीमित है। अधिकतम अनुरोध बॉडी आकार 8 MB है। यदि आप रेट लिमिट से अधिक जाते हैं, तो आपको 429 स्टेटस कोड मिलेगा। यदि आपकी API कुंजी अमान्य है, तो आपको 401 त्रुटि मिलेगी। यदि आपके पास कोई प्रीपेड क्रेडिट नहीं है, तो आपको 402 त्रुटि मिलेगी।

मूल्य स्पष्ट हैं: 1M इनपुट टोकन के लिए $0.25 और 1M आउटपुट टोकन के लिए $1.00। क्रेडिट प्रीपेड है और कभी समाप्त नहीं होता। आप क्रिप्टो (USDT या USDC) से $10 से टॉप-अप कर सकते हैं। बोनस क्रेडिट के विवरण के लिए LLM API Pricing पेज देखें।

तकनीकी विवरण

API की सभी असली सीमाएँ और सुविधाएँ एक जगह — क्रेडिट जोड़ने से पहले इन्हें देख लें।

मदमान
API फ़ॉर्मेटOpenAI के अनुकूल: कोई भी OpenAI SDK चलेगा — बस base URL और कुंजी बदलें
मॉडल IDuncensored
एंडपॉइंटPOST /v1/chat/completions · GET /v1/models
प्रमाणीकरणAuthorization: Bearer YOUR_KEY
Base URLhttps://api.llmapistatus.com/v1
JSON मोडresponse_format: {"type": "json_object"}
पैरामीटरtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
अधिकतम आउटपुट100,000-टोकन विंडो के शेष हिस्से तक; max_tokens वैकल्पिक (अलग सीमा नहीं)
कॉन्टेक्स्ट विंडो100,000 टोकन (इनपुट + आउटपुट मिलाकर)
फ़ंक्शन कॉलिंगहाँ — tools, tool_choice; जवाब में tool_calls, स्ट्रीमिंग में भी; नतीजे role: tool संदेश से भेजें
स्ट्रीमिंगहाँ — server-sent events; आख़िरी हिस्से में टोकन उपयोग
समानांतर अनुरोधप्रति कुंजी एक साथ 8 तक
रेट लिमिटप्रति कुंजी प्रति मिनट 300 अनुरोध
अनुरोध का आकार8 MB तक
रिस्पॉन्स हेडरX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
कीमतप्रति 10 लाख इनपुट टोकन $0.25 · प्रति 10 लाख आउटपुट टोकन $1.00
मुफ़्त ट्रायल क्रेडिट$0.50, 7 दिन, कार्ड की ज़रूरत नहीं · ट्रायल कुंजी: 2 समानांतर अनुरोध, 60 प्रति मिनट; पहले टॉप-अप के बाद पूरी सीमाएँ (8 और 300)
बोनस$50 से +5%, $100 से +10%
टॉप-अपUSDT (TRC20) या USDC (Base), $10 से $500 तक कोई भी पूरी राशि
वैधताभुगतान किया क्रेडिट कभी समाप्त नहीं होता, कोई सदस्यता नहीं
बिलिंगप्रीपेड क्रेडिट, असली उपयोग के अनुसार; त्रुटियाँ और अस्वीकृतियाँ मुफ़्त
सामग्रीवयस्क सामग्री की अनुमति; नाबालिगों से जुड़ी यौन सामग्री अस्वीकार
साइन इनGoogle या ईमेल और पासवर्ड
कुंजियाँहर खाते में एक सक्रिय कुंजी; नई कुंजी पुरानी की जगह लेती है

त्रुटि कोड

त्रुटियाँ JSON में स्थिर type के साथ आती हैं; विफल या अस्वीकृत अनुरोधों का शुल्क नहीं लगता।

कोडप्रकारअर्थ
400bad_requestअमान्य JSON, खाली संदेश, गलत पैरामीटर या कॉन्टेक्स्ट विंडो से अधिक
401missing_key · invalid_key · key_revokedकुंजी नहीं, गलत कुंजी या नई कुंजी से बदली गई
402no_creditक्रेडिट ख़त्म — टॉप-अप करें, तुरंत चालू
403content_blockedनाबालिगों से जुड़ी यौन सामग्री — अस्वीकार, कोई शुल्क नहीं
404not_foundअज्ञात एंडपॉइंट
413request_too_largeबॉडी 8 MB से बड़ी
429rate_limited · concurrency300/मिनट या 8 समानांतर से अधिक — रुककर फिर कोशिश करें
503upstream_busyमॉडल व्यस्त — कुछ सेकंड बाद फिर कोशिश करें

प्रश्न और उत्तर

क्या यह मॉडल GPT-4 या क्लॉड जैसा ही है?

नहीं। मॉडल ID "uncensored" है और यह एक ओपन-वेट मॉडल है जो हमारे अपने GPU सर्वरों पर चलता है। यह कानूनी वयस्कों के उपयोग के लिए बिना सेंसर के उत्तर देने के लिए ट्यून्ड है, लेकिन यह GPT, क्लॉड, जेमिनी या अन्य वेंडर्स से एक अलग मॉडल है।

मैं ट्रायल क्रेडिट के साथ कैसे शुरुआत करूं?

Get API key पेज पर केवल ईमेल और पासवर्ड से साइन अप करें। आपको $0.50 का मुफ़्त ट्रायल क्रेडिट मिलेगा जो 7 दिनों के लिए मान्य है। शुरू करने के लिए क्रेडिट कार्ड या फ़ोन नंबर की आवश्यकता नहीं है।

अगर मैं रेट लिमिट पर पहुंच जाता हूं तो क्या होता है?

यदि आप 300 अनुरोध प्रति मिनट से अधिक भेजते हैं, तो API 429 स्टेटस कोड लौटाता है। आपको अपने क्लाइंट में एक्सपोनेंशियल बैकऑफ लागू करना चाहिए। आप अपनी API कुंजी को पुनः जनरेट कर सकते हैं, लेकिन रेट लिमिट प्रति कुंजी लागू होता है।

आपकी कुंजी बस एक फ़ॉर्म दूर है

एक खाता बनाएं, कुंजी कॉपी करें, बेस URL बदलें। सेटअप यही है।

API कुंजी पाएँ