अनसेंसर्ड चैट कंप्लीशंस API दस्तावेज़
यह दस्तावेज़ आपको मानक OpenAI-कम्पैटिबल चैट कंप्लीशंस एंडपॉइंट के माध्यम से हमारे अनसेंसर्ड LLM को इंटीग्रेट करने में मार्गदर्शन करता है। हमारे बेस URL और एक ताज़ा API कुंजी के साथ अपने क्लाइंट को कॉन्फ़िगर करके आप तुरंत टेक्स्ट जनरेट करना शुरू कर सकते हैं।
इस पेज पर
प्रमाणीकरण और सेटअप
प्रवेश के लिए आपके खाते से जुड़ी एक मान्य API कुंजी की आवश्यकता होती है। ईमेल और पासवर्ड से साइन अप करने के बाद, आप API कुंजी प्राप्त करें पृष्ठ पर इस कुंजी को जनरेट करते हैं। कुंली तुरंत बनाने पर प्रदर्शित होती है। OpenAI जैसे किसी वेंडर से स्विच करने के लिए, अपनी क्लाइंट कॉन्फ़िगरेशन को हमारे बेस URL https://api.unfilteredaimodels.com/v1 की ओर इशारा करने के लिए अपडेट करें और अपनी अद्वितीय API कुंजी प्रदान करें। हम मानक Authorization हेडर फॉर्मेट का समर्थन करते हैं।
चैट कंप्लीशंस एंडपॉइंट
प्राथमिक इंटरफ़ेस POST /v1/chat/completions एंडपॉइंट है। यह मानक संदेश ऑब्जेक्ट स्वीकार करता है और टेक्स्ट प्रतिक्रियाएँ लौटाता है। निर्दिष्ट करने के लिए मॉडल ID uncensored है। यह एंडपॉइंट आमतौर पर कॉर्पोरेट गार्डरेल्स के बिना कच्चे टेक्स्ट जनरेशन संभालता है, जिससे कानूनी सीमाओं के भीतर वयस्क, विवादास्पद या रचनात्मक सामग्री की अनुमति मिलती है। आप निम्नलिखित उदाहरण का उपयोग करके अपना पहला अनुरोध भेज सकते हैं:
curl https://api.unfilteredaimodels.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
यह अनुरोध एक सरल सिस्टम प्रॉम्प्ट और एक उपयोगकर्ता क्वेरी भेजकर प्रतिक्रिया जनरेट करने का प्रदर्शन करता है।
Python SDK इंटीग्रेशन
औपचारिक openai Python पैकेज का उपयोग करें। हमारे बेस URL और अपनी API कुंजी के साथ क्लाइंट को इनिशियलाइज़ करें। फिर मॉडल ID uncensored के साथ chat.completions.create को कॉल करें। इस दृष्टिकोण के लिए यदि आप पहले से ही अन्य सेवाओं के लिए OpenAI SDK का उपयोग कर रहे हैं तो शून्य कोड परिवर्तन की आवश्यकता होती है। निम्नलिखित स्निपेट क्लाइंट को इनिशियलाइज़ करने और अनुरोध भेजने का तरीका दिखाता है:
from openai import OpenAI
client = OpenAI(base_url="https://api.unfilteredaimodels.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
SDK JSON सीरियलाइज़ेशन और प्रतिक्रिया पार्सिंग को स्वचालित रूप से संभालता है।
Node.js SDK इंटीग्रेशन
JavaScript वातावरण के लिए, openai Node पैकेज का उपयोग करें। अपने एंडपॉइंट के लिए basePath कॉन्फ़िगर करें और अपनी API कुंजी प्रदान करें। uncensored मॉडल ID के साथ chat.completions.create विधि को कॉल करें। यह मौजूदा Node.js एप्लिकेशन के साथ संगतता सुनिश्चित करता है जो OpenAI-मानक प्रतिक्रियाओं की उम्मीद करते हैं। क्लाइंट को सेटअप करने का तरीका यहाँ दिया गया है:
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.unfilteredaimodels.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
यह सेटअप सुनिश्चित करता है कि आपका Node एप्लिकेशन परिचित पैटर्न का उपयोग करके हमारे अनसेंसर्ड मॉडल से संचार कर सके।
स्ट्रीमिंग प्रतिक्रियाएं
सर्वर-सेंट इवेंट्स (SSE) प्राप्त करने के लिए stream पैरामीटर को true पर सेट करें। यह आपको टोकन को जनरेट होते हुए प्रोसेस करने की अनुमति देता है, जिससे लंबी प्रतिक्रियाओं के लिए अनुभव की गई विलंबता कम होती है। API टुकड़ों का एक स्ट्रीम लौटाता है, प्रत्येक में प्रतिक्रिया के आंशिक डेल्टा होते हैं। स्ट्रीमिंग को लागू करने के लिए निम्नलिखित उदाहरण का उपयोग करें:
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
स्ट्रीमिंग उन चैट इंटरफ़ेस के लिए आदर्श है जहाँ उपयोगकर्ता रीयल-टाइम में टेक्स्ट दिखाई देने की उम्मीद करते हैं।
रेट लिमिट और कोटा
आपकी API कुंजी प्रति मिनट 300 अनुरोधों तक सीमित है। यदि आप इससे अधिक भेजते हैं, तो आपको 429 Too Many Requests त्रुटि मिलती है। आप किसी भी समय अपने डैशबोर्ड से अपनी कुंजी को पुनः जनरेट कर सकते हैं, जिससे पुरानी कुंजी रद्द हो जाती है और एक नई रेट लिमिट काउंटर के साथ एक नई कुंजी प्रदान की जाती है। अन्य त्रुटियों में 401 अमान्य कुंजियों के लिए और 402 यदि आपका प्रीपेड क्रेडिट खत्म हो गया है, शामिल हैं। कॉन्टेक्स्ट विंडो प्रॉम्प्ट और कंप्लीशन के संयोजन के लिए 100,000 टोकन तक समर्थित है। अनुरोध बॉडी 8 MB तक सीमित हैं।
तकनीकी विवरण
API की सभी असली सीमाएँ और सुविधाएँ एक जगह — क्रेडिट जोड़ने से पहले इन्हें देख लें।
| मद | मान |
|---|---|
| API फ़ॉर्मेट | OpenAI के अनुकूल: कोई भी OpenAI SDK चलेगा — बस base URL और कुंजी बदलें |
| प्रमाणीकरण | Authorization: Bearer YOUR_KEY |
| एंडपॉइंट | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.unfilteredaimodels.com/v1 |
| मॉडल ID | uncensored |
| JSON मोड | response_format: {"type": "json_object"} |
| अधिकतम आउटपुट | 100,000-टोकन विंडो के शेष हिस्से तक; max_tokens वैकल्पिक (अलग सीमा नहीं) |
| फ़ंक्शन कॉलिंग | हाँ — tools, tool_choice; जवाब में tool_calls, स्ट्रीमिंग में भी; नतीजे role: tool संदेश से भेजें |
| स्ट्रीमिंग | हाँ — server-sent events; आख़िरी हिस्से में टोकन उपयोग |
| पैरामीटर | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| कॉन्टेक्स्ट विंडो | 100,000 टोकन (इनपुट + आउटपुट मिलाकर) |
| रेट लिमिट | प्रति कुंजी प्रति मिनट 300 अनुरोध |
| समानांतर अनुरोध | प्रति कुंजी एक साथ 8 तक |
| अनुरोध का आकार | 8 MB तक |
| रिस्पॉन्स हेडर | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| बिलिंग | प्रीपेड क्रेडिट, असली उपयोग के अनुसार; त्रुटियाँ और अस्वीकृतियाँ मुफ़्त |
| कीमत | प्रति 10 लाख इनपुट टोकन $0.25 · प्रति 10 लाख आउटपुट टोकन $1.00 |
| मुफ़्त ट्रायल क्रेडिट | $0.50, 7 दिन, कार्ड की ज़रूरत नहीं · ट्रायल कुंजी: 2 समानांतर अनुरोध, 60 प्रति मिनट; पहले टॉप-अप के बाद पूरी सीमाएँ (8 और 300) |
| टॉप-अप | USDT (TRC20) या USDC (Base), $10 से $500 तक कोई भी पूरी राशि |
| वैधता | भुगतान किया क्रेडिट कभी समाप्त नहीं होता, कोई सदस्यता नहीं |
| बोनस | $50 से +5%, $100 से +10% |
| सामग्री | वयस्क सामग्री की अनुमति; नाबालिगों से जुड़ी यौन सामग्री अस्वीकार |
| साइन इन | Google या ईमेल और पासवर्ड |
| कुंजियाँ | हर खाते में एक सक्रिय कुंजी; नई कुंजी पुरानी की जगह लेती है |
त्रुटि कोड
त्रुटियाँ JSON में स्थिर type के साथ आती हैं; विफल या अस्वीकृत अनुरोधों का शुल्क नहीं लगता।
| कोड | प्रकार | अर्थ |
|---|---|---|
400 | bad_request | अमान्य JSON, खाली संदेश, गलत पैरामीटर या कॉन्टेक्स्ट विंडो से अधिक |
401 | missing_key · invalid_key · key_revoked | कुंजी नहीं, गलत कुंजी या नई कुंजी से बदली गई |
402 | no_credit | क्रेडिट ख़त्म — टॉप-अप करें, तुरंत चालू |
403 | content_blocked | नाबालिगों से जुड़ी यौन सामग्री — अस्वीकार, कोई शुल्क नहीं |
404 | not_found | अज्ञात एंडपॉइंट |
413 | request_too_large | बॉडी 8 MB से बड़ी |
429 | rate_limited · concurrency | 300/मिनट या 8 समानांतर से अधिक — रुककर फिर कोशिश करें |
503 | upstream_busy | मॉडल व्यस्त — कुछ सेकंड बाद फिर कोशिश करें |
प्रश्न और उत्तर
क्या अपनी API कुंजी को रीजनरेट करने से मेरा रेट लिमिट रीसेट हो जाता है?
हाँ। अपनी कुंजी को रीजनरेट करने से पुरानी कुंजी रद्द हो जाती है और एक नई कुंजी जारी की जाती है जिसका रेट लिमिट काउंटर ताज़ा होता है। प्रति मिनट 300 अनुरोध की सीमा उपयोग में आ रही विशिष्ट कुंजी पर लागू होती है।
किस सामग्री पर प्रतिबंध है?
मॉडल अधिकांश वयस्क, काल्पनिक या विवादास्पद विषयों को अस्वीकार नहीं करता है। हालाँकि, एक कठोर सीमा हमेशा लागू होती है: किशोरों से संबंधित यौन सामग्री ब्लॉक कर दी जाती है।
क्या मॉडल फाइन-ट्यूंड है या एक मानक GPT है?
यह एक ओपन-वेट मॉडल है जो हमारे अपने GPU सर्वरों पर चलाया जाता है और बिना सेंसर आउटपुट के लिए ट्यून्ड किया गया है। यह GPT, क्लॉड या किसी अन्य वेंडर का मॉडल नहीं है।
आपकी कुंजी बस एक फ़ॉर्म दूर है
एक खाता बनाएं, कुंजी कॉपी करें, बेस URL बदलें। यही पूरा सेटअप है।