HI ▾
API कुंजी पाएँ

अनसेंसरड LLM को होस्ट करें: OpenAI-कम्पैटिबल API के साथ

अनसेंसरड LLM होस्ट करने से एक सीधा, रिफ्यूज़-फ्री इन्फरेंस एंडपॉइंट मिलता है जो वयस्क, रचनात्मक या असीमित कंटेंट जनरेशन के लिए अनुकूलित है। OpenAI-कम्पैटिबल आर्किटेक्चर का उपयोग करने से आपको मॉडल रूटिंग या जटिल वेंडर लॉक-इन की ओवरहेड के बिना तुरंत SDK इंटीग्रेशन मिलता है।

अपडेटेड

मुख्य बिंदु

  • रूटिंग जटिलता को खत्म करने और सुसंगत बिना सेंसर व्यवहार को सुनिश्चित करने के लिए सिंगल-मॉडल आर्किटेक्चर का उपयोग करें।
  • एक OpenAI-संगत एंडपॉइंट आपको अपनी API कुंजी और बेस URL बदलने की अनुमति देता है ताकि तुरंत एकीकरण किया जा सके।
  • प्रीपेड क्रिप्टो क्रेडिट के साथ पारदर्शी प्रति-टोकन बिलिंग सुनिश्चित करती है कि आप केवल वास्तविक उपयोग के लिए भुगतान करें, त्रुटियों और रिफ्यूज़ को मुफ्त गिना जाता है।
  • प्रॉम्प्ट को ट्रेनिंग डेटा से बाहर रखकर गोपनीयता बनाए रखी जाती है, जिसमें मॉडल की सामान्य सहिष्णुता के बावजूद किशोरों से संबंधित यौन सामग्री पर एक कठोर ब्लॉक लगा होता है।

अनसेंसरड LLM क्यों होस्ट करें?

मानक LLM APIs अक्सर कठोर सामग्री फ़िल्टर लागू करते हैं जो कानूनी वयस्क विषयों, सूक्ष्म रचनात्मक लेखन या विवादास्पद विषयों को अस्वीकार कर सकते हैं। एक बिना सेंसर LLM होस्ट करने का अर्थ है कि आप इन्फरेंस परत पर नियंत्रण रखते हैं, यह सुनिश्चित करते हुए कि मॉडल आपके प्रॉम्प्ट का जवाब बिना किसी मनमाने अस्वीकृति के देता है। यह उन एप्लिकेशन के लिए महत्वपूर्ण है जिन्हें कच्ची, बिना फ़िल्टर वाली टेक्स्ट जनरेशन की आवश्यकता होती है, जैसे कि रोलप्ले इंजन, रचनात्मक लेखन सहायक, या संवेदनशील डेटा का विश्लेषण करने वाले रिसर्च टूल।

ऐसे एग्रीगेटर्स के विपरीत जो अनुरोधों को कई मॉडल्स के माध्यम से रूट करते हैं, एक होस्टेड बिना सेंसर LLM API आमतौर पर एक अकेले, ट्यून्ड मॉडल को सर्व करता है। इससे डिबगिंग आसान हो जाती है और आपके एप्लिकेशन में व्यवहार स्थिर रहता है। आप मॉडल वर्जन या बड़े प्रदाताओं से अचानक नीति परिवर्तनों की अनिश्चितता से बचते हैं। परिणाम एक भरोसेमंद, निर्धारक टेक्स्ट-इन/टेक्स्ट-आउट सेवा है जो आपके इनपुट पैरामीटर का सम्मान करती है।

सही आर्किटेक्चर चुनना

बिना सेंसर इन्फरेंस के लिए सबसे कुशल आर्किटेक्चर एकल-मॉडल सेटअप है। एग्रीगेटर्स अक्सर विभिन्न मॉडल्स के लिए अनुरोधों को रूट करके विलंबता और जटिलता पेश करते हैं, जिससे आपके प्राथमिक मॉडल की बिना सेंसर विशेषताएं कमजोर हो सकती हैं। एकल बड़े भाषा मॉडल होस्ट करके, आप इन्फरेंस पाइपलाइन पर पूर्ण नियंत्रण बनाए रखते हैं और सुनिश्चित करते हैं कि सामग्री सहिष्णुता के लिए मॉडल की ट्यूनिंग लगातार लागू होती है।

एक ऐसे API को चुनें जो केवल आवश्यक एंडपॉइंट एक्सपोज़ करता है: POST /v1/chat/completions जनरेशन के लिए और GET /v1/models मेटाडेटा के लिए। उन सेवाओं से बचें जो एम्बेडिंग, इमेज जनरेशन या फाइन-ट्यूनिंग पेश करती हैं, जब तक कि आपको उनकी आवश्यकता न हो, क्योंकि ये अनावश्यक ओवरहेड जोड़ती हैं। एक फोकस्ड API विलंबता और लागत को कम करता है, मौजूदा OpenAI-संगत क्लाइंट्स के साथ सहज एकीकरण प्रदान करता है।

API एंडपॉइंट संरचना

एक OpenAI-संगत API एक मानक RESTful संरचना का पालन करता है। टेक्स्ट जनरेट करने के लिए, आप अपने संदेशों और पैरामीटर के साथ POST अनुरोध /v1/chat/completions पर भेजते हैं। बेस URL आमतौर पर https://api.uncensoredgpt.cc/v1 जैसा कुछ होता है। आपको Authorization हेडर में अपनी API कुंजी शामिल करनी होगी।

GET /v1/models एंडपॉइंट उपलब्ध मॉडल्स की एक सूची लौटाता है, जो एक एकल-मॉडल सेटअप में आमतौर पर केवल एक प्रविष्टि सूचीबद्ध करेगा। यह पुष्टि करता है कि सेवा सक्रिय है और अनुरोध स्वीकार करने के लिए तैयार है। कोई जटिल रूटिंग टेबल या फॉलबैक मैकेनिज्म नहीं हैं; API को प्रत्यक्ष, पूर्वानुमेय इंटरैक्शन के लिए डिज़ाइन किया गया है।

  • POST /v1/chat/completions: टेक्स्ट जनरेशन के लिए मुख्य एंडपॉइंट।
  • GET /v1/models: मॉडल उपलब्धता सत्यापित करने के लिए एंडपॉइंट।
  • Authorization: सभी अनुरोधों के लिए Bearer टोकन आवश्यक है।

कॉन्टेक्स्ट विंडो हैंडल करना

100,000 टोकन की कॉन्टेक्स्ट विंडो एक ही अनुरोध में महत्वपूर्ण इनपुट और आउटपुट की अनुमति देती है। यह क्षमता लंबी सामग्री जनरेशन, जटिल तर्क कार्यों या बड़े दस्तावेजों को प्रोसेस करने के लिए आवश्यक है। कॉन्टेक्स्ट विंडो में प्रॉम्प्ट (इनपुट) और कंप्लीशन (आउटपुट) दोनों शामिल हैं। आपको यह सुनिश्चित करना होगा कि कुल टोकन गणना इस सीमा से अधिक न हो।

अधिकतम आउटपुट लंबाई के प्रति सचेत रहें। हालांकि कॉन्टेक्स्ट विंडो 100,000 टोकन की है, प्रति अनुरोध अधिकतम आउटपुट 32,000 टोकन पर सीमित हो सकता है। यदि आप max_tokens पैरामीटर निर्दिष्ट नहीं करते हैं, तो डिफ़ॉल्ट आउटपुट लंबाई 2,048 टोकन तक सीमित हो सकती है। उपलब्ध कॉन्टेक्स्ट का अधिकतम लाभ उठाने के लिए अपने प्रॉम्प्ट की योजना बनाएं, बिना कठोर सीमाओं को पार किए।

स्ट्रीमिंग और रियल-टाइम आउटपुट

स्ट्रीमिंग Server-Sent Events (SSE) के माध्यम से समर्थित है। यह आपको रियल-टाइम में टोकन प्राप्त करने की अनुमति देता है जैसे ही वे जनरेट होते हैं, इंटरैक्टिव एप्लिकेशन के लिए उपयोगकर्ता अनुभव को बेहतर बनाता है। API स्ट्रीमिंग सत्रों के दौरान सटीक बिलिंग डेटा प्रदान करते हुए अंतिम चंक में टोकन उपयोग जानकारी स्ट्रीम करता है।

स्ट्रीमिंग सक्षम करने के लिए, अपने अनुरोध में stream पैरामीटर को true पर सेट करें। प्रतिक्रिया घटनाओं की एक श्रृंखला होगी, प्रत्येक में एक आंशिक आउटपुट होता है। यह चेट इंटरफेस, लाइव कोड जनरेशन और किसी भी परिदृश्य के लिए आदर्श है जहां विलंबता मायने रखती है। आप इन घटनाओं को मानक HTTP क्लाइंट लाइब्रेरी का उपयोग करके पार्स कर सकते हैं।

टूल उपयोग और फ़ंक्शन कॉलिंग

API फ़ंक्शन कॉलिंग का समर्थन करता है, जिससे मॉडल संरचित डेटा जनरेट कर सकता है या बाहरी टूल्स को इंकॉक कर सकता है। आप tools पैरामीटर में फ़ंक्शन स्कीमा परिभाषित कर सकते हैं और tool_choice निर्दिष्ट कर सकते हैं कि मॉडल उनका उपयोग कैसे करता है। इससे जटिल वर्कफ़्लो संभव होते हैं जहाँ LLM उपयोगकर्ता इनपुट के आधार पर डेटा प्राप्त कर सकता है, गणना कर सकता है या एक्शन ट्रिगर कर सकता है।

JSON मोड भी response_format पैरामीटर को {"type": "json_object"} पर सेट करके उपलब्ध है। यह सुनिश्चित करता है कि मॉडल वैध JSON आउटपुट देता है, जो प्रोग्रामेटिक इंटीग्रेशन के लिए महत्वपूर्ण है। आप रचनात्मकता और पुनरुत्पादकता को नियंत्रित करने के लिए temperature, top_p, और seed जैसे पैरामीटर समायोजित कर सकते हैं। ये सुविधाएं API को परिष्कृत AI-चालित एप्लिकेशन बनाने के लिए उपयुक्त बनाती हैं।

टोकन प्रबंधन और बिलिंग

बिलिंग पारदर्शी है और वास्तविक टोकन उपयोग पर आधारित है। कीमत $0.25 प्रति 1M इनपुट टोकन और $1.00 प्रति 1M आउटपुट टोकन है। त्रुटियां और रिफ्यूज़ मुफ्त हैं, जिसका अर्थ है कि आप केवल सफल कम्पलीशन के लिए भुगतान करते हैं। कोई मासिक शुल्क या सदस्यता नहीं है; आप क्रेडिट प्रीलोड करते हैं, जो कभी समाप्त नहीं होता।

टॉप-अप क्रिप्टोकरेंसी के माध्यम से स्वीकार किए जाते हैं, विशेष रूप से USDT (TRC20) या USDC (Base)। न्यूनतम टॉप-अप राशि $10 से $500 तक होती है, बड़ी राशि के लिए बोनस क्रेडिट। टॉप-अप के लिए कोई क्रेडिट कार्ड या पेपैल स्वीकार नहीं किया जाता है। एक नए खाते को 7 दिनों के लिए वैध $0.50 का मुफ़्त ट्रायल क्रेडिट प्राप्त होता है, कार्ड की आवश्यकता नहीं है। सीमाओं में प्रति मिनट 300 अनुरोध और प्रति कुंजी 8 समानांतर अनुरोध शामिल हैं।

गोपनीयता और डेटा हैंडलिंग

गोपनीयता कई उपयोगकर्ताओं के लिए एक प्रमुख विचार है। API आपके प्रॉम्प्ट को ट्रेनिंग डेटा के लिए उपयोग नहीं करता है, यह सुनिश्चित करते हुए कि आपका इनपुट निजी रहता है। खाता बनाने के लिए केवल ईमेल पता की आवश्यकता होती है, फोन नंबर की आवश्यकता नहीं होती है। यह पूर्ण API एक्सेस प्रदान करते हुए व्यक्तिगत डेटा संग्रह को न्यूनतम करता है।

सामग्री प्रतिबंध न्यूनतम लेकिन विशिष्ट हैं। मॉडल कानूनी वयस्क, काल्पनिक या विवादास्पद विषयों को अस्वीकार नहीं करता है। हालांकि, एक कठोर सीमा लागू होती है: किशोरों से संबंधित यौन सामग्री हमेशा ब्लॉक की जाती है। यह अन्य सामग्री प्रकारों के लिए एक उच्चतम सहिष्णु वातावरण बनाए रखते हुए मौलिक कानूनी मानकों के अनुपालन को सुनिश्चित करता है।

अपनी कुंजी के साथ शुरुआत

साइन अप करना सरल है। आप "Google के साथ जारी रखें" का उपयोग कर सकते हैं या एक ईमेल और पासवर्ड के साथ एक खाता बना सकते हैं। पंजीकरण के बाद, आपकी API कुंजी तुरंत प्रदर्शित होती है, जिससे आप बिना किसी विलंबता के अनुरोध करना शुरू कर सकते हैं। फोन नंबर सत्यापन की आवश्यकता नहीं है, और प्रक्रिया गति के लिए डिज़ाइन की गई है।

एकीकृत करने के लिए, अपने क्लाइंट का बेस URL https://api.uncensoredgpt.cc/v1 पर अपडेट करें और API कुंजी सेट करें। सभी अनुरोधों के लिए "uncensored" मॉडल ID का उपयोग करें। यह एकल-मॉडल दृष्टिकोण स्थिरता सुनिश्चित करता है और रूटिंग की जटिलता को समाप्त करता है। आप तुरंत स्ट्रीमिंग शुरू कर सकते हैं, फ़ंक्शन कॉल कर सकते हैं, या लंबे टेक्स्ट जनरेट कर सकते हैं।

प्रश्न और उत्तर

क्या यह API NSFW कंटेंट के लिए उपयुक्त है?

हाँ, मॉडल बिना सेंसर है और कानूनी वयस्क, काल्पनिक या विवादास्पद विषयों को अस्वीकार नहीं करता है। यह किसी भी मनमाने प्रतिबंध के बिना NSFW सामग्री को संभालने के लिए डिज़ाइन किया गया है, सिवाय किशोरों से संबंधित यौन सामग्री पर एक कठोर ब्लॉक के।

मैं API के लिए कैसे भुगतान करूं?

भुगतान केवल क्रिप्टोकरेंसी के माध्यम से स्वीकार किए जाते हैं: USDT (TRC20) या USDC (Base)। कोई क्रेडिट कार्ड, पेपैल या बैंक ट्रांसफर विकल्प नहीं हैं। टॉप-अप $10 से $500 तक होते हैं, और क्रेडिट कभी समाप्त नहीं होते।

कॉन्टेक्स्ट विंडो का आकार क्या है?

कॉन्टेक्स्ट विंडो 100,000 टोकन की है, जिसमें प्रॉम्प्ट और कम्प्लीशन दोनों शामिल हैं। प्रति अनुरोध अधिकतम आउटपुट 32,000 टोकन है, या 2,048 यदि <code>max_tokens</code> निर्दिष्ट नहीं किया गया है।

क्या API मेरे डेटा का उपयोग ट्रेनिंग के लिए करता है?

नहीं, प्रॉम्प्ट्स ट्रेनिंग के लिए उपयोग नहीं किए जाते हैं। सेवा निजी होने के लिए डिज़ाइन की गई है, जिसमें केवल खाता बनाने के लिए ईमेल की आवश्यकता होती है और यह सुनिश्चित किया जाता है कि आपका इनपुट डेटा आपका ही रहे।

आपकी कुंजी बस एक फ़ॉर्म दूर है

एक खाता बनाएं, कुंजी कॉपी करें, बेस URL बदलें। सेटअप यही है।

API कुंजी पाएँ