Uncensored Local LLM API को एकीकृत करें
अपने OpenAI-कम्पैटिबल क्लाइंट को हमारे होस्टेड एंडपॉइंट की ओर इशारा करके Uncensored Local LLM API को इंटीग्रेट करें। आपको 100k कॉन्टेक्स्ट विंडो, स्ट्रीमिंग सपोर्ट और स्थानीय GPU इंफ्रास्ट्रक्चर मैनेज किए बिना रॉ मॉडल आउटपुट मिलते हैं।
- बेस URL
- https://api.uncensoredlocalllm.com/v1
- मॉडल
- बिना सेंसर
बेस यूआरएल और प्रमाणीकरण
हमारा API OpenAI SDKs के साथ पूरी तरह से संगत है। आपको केवल base_url अपडेट करने और अपनी API कुंजी प्रदान करने की आवश्यकता है। तुरंत अपनी कुंजी प्राप्त करने के लिए Get API key पेज पर साइन इन करें। ट्रायल क्रेडिट के साथ शुरू करने के लिए फ़ोन नंबर या क्रेडिट कार्ड की आवश्यकता नहीं है। बेस URL https://api.uncensoredlocalllm.com/v1 है। अपनी कुंजी को सुरक्षित रखें; आप इसे किसी भी समय पुनः उत्पन्न कर सकते हैं, जिससे पुरानी कुंजी तुरंत रद्द हो जाती है। इससे आपके एप्लिकेशन के लिए स्थिर एंडपॉइंट बना रहता है, बिना स्थानीय इन्फरेंस मैनेजमेंट की जटिलता के।
पहला अनुरोध
अपने पसंदीदा HTTP क्लाइंट का उपयोग करके अपना पहला API कॉल करें। एंडपॉइंट मानक chat-completions फॉर्मेट का समर्थन करता है। नीचे एक बुनियादी अनुरोध प्रदर्शित करने वाला cURL उदाहरण दिया गया है। YOUR_API_KEY को अपनी वास्तविक कुंजी से बदलें। यह अनुरोध एक प्रॉम्प्ट भेजता है और एक पाठ प्रतिक्रिया की अपेक्षा करता है। मॉडल आईडी uncensored है। यह ओपन-वेट मॉडल कानूनी वयस्क उपयोग के लिए सामग्री अस्वीकृतियों के बिना उत्तर देने के लिए ट्यून्ड है, आपके उपयोग मामले के लिए प्रत्यक्ष आउटपुट प्रदान करता है।
curl https://api.uncensoredlocalllm.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
प्रतिक्रिया में choices सरणी में उत्पन्न पाठ होगा। यदि आपको 401 त्रुटि मिलती है, तो आपकी API कुंजी अमान्य या अनुपस्थित है। सुनिश्चित करें कि आप सही बेस यूआरएल का उपयोग कर रहे हैं और कि आपकी कुंजी पुनर्जनन के बाद रद्द नहीं की गई है।
Python SDK इंटीग्रेशन
तेज़ इंटिग्रेशन के लिए आधिकारिक OpenAI Python SDK का उपयोग करें। अपने क्लाइंट इनिशियलाइज़ेशन में base_url और api_key सेट करें। इस दृष्टिकोण से आप chat.completions.create() जैसे परिचित विधियों का उपयोग कर सकते हैं। SDK JSON सीरियलाइज़ेशन और HTTP अनुरोधों को स्वचालित रूप से संभालता है। यह उन बैकएंड सेवाओं या स्क्रिप्ट्स के लिए आदर्श है जिन्हें बड़ी मात्रा में पाठ प्रोसेस करने की आवश्यकता होती है। याद रखें कि मॉडल आईडी हमेशा uncensored ही रहती है, चाहे आप जो भी SDK वर्जन उपयोग करें।
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredlocalllm.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
यह विधि बैच प्रसंस्करण के लिए या जब आपको पायथन में प्रतिक्रिया तर्क संभालने की आवश्यकता हो, तो कुशल है। सुनिश्चित करें कि आपके वातावरण में openai पैकेज इंस्टॉल है। SDK सिंक्रोनस और असिंक्रोनस दोनों संचालन का समर्थन करता है, विभिन्न वास्तुकला आवश्यकताओं के अनुकूल है।
Node SDK इंटीग्रेशन
JavaScript या TypeScript वातावरण के लिए, OpenAI Node SDK एक समान अनुभव प्रदान करता है। अपने बेस यूआरएल और API कुंजी के साथ क्लाइंट को इनिशियलाइज करें। यह वेब एप्लिकेशन या सर्वरलेस फंक्शंस के लिए विशेष रूप से उपयोगी है। SDK HTTP विवरणों को अमूर्त करता है, जिससे आप एप्लिकेशन लॉजिक पर ध्यान केंद्रित कर सकते हैं। आप अन्य OpenAI-कम्पैटिबल सेवाओं की तरह ही कंप्लीशंस एंडपॉइंट को उसी संरचना के साथ कॉल कर सकते हैं।
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredlocalllm.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
रियल-टाइम वेब इंटरफेस या Node.js माइक्रोसर्विसेज के लिए इस इंटीग्रेशन का उपयोग करें। SDK प्रॉमिसेज और async/await पैटर्न का समर्थन करता है, जिससे एरर हैंडलिंग सरल हो जाती है। विशेष रूप से वितरित सिस्टम में संभावित नेटवर्क त्रुटियों को सहजता से हैंडल करें।
स्ट्रीमिंग प्रतिक्रियाएं
अपने अनुरोध में stream: true सेट करके स्ट्रीमिंग सक्षम करें। इससे आपको आंशिक प्रतिक्रियाएँ प्राप्त होती हैं जैसे ही वे जनरेट होती हैं, जिससे उपयोगकर्ताओं के लिए अनुभवी विलंबता में सुधार होता है। API स्ट्रीमिंग के लिए Server-Sent Events (SSE) का समर्थन करता है। यह उन चैट इंटरफ़ेसों के लिए महत्वपूर्ण है जहाँ तत्काल प्रतिक्रिया की उम्मीद की जाती है। स्ट्रीमिंग मॉडल के आउटपुट गुणवत्ता या कॉन्टेक्स्ट विंडो को प्रभावित नहीं करती।
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
अपने क्लाइंट कोड में स्ट्रीम इवेंट्स हैंडल करें। प्रत्येक चंक अंतिम प्रतिक्रिया का एक हिस्सा होता है। पूर्ण संदेश को पुनर्निर्मित करने के लिए इन चंक्स को एग्रीगेट करें। यह दृष्टिकोण Python और Node.js दोनों में OpenAI SDKs के साथ सहजता से काम करता है।
रेट लिमिट, त्रुटियां और कॉन्टेक्स्ट विंडो
API प्रति कुंजी प्रति मिनट 300 अनुरोध की सीमा लागू करता है। अधिकतम अनुरोध बॉडी आकार 8 MB है। यदि आप रेट लिमिट से अधिक हो जाते हैं, तो आपको 429 त्रुटि मिलेगी। 402 त्रुटि का अर्थ है कि प्रीपेड क्रेडिट अपर्याप्त है। सुनिश्चित करें कि आप अपनी उपयोगिता की निगरानी करें और डैशबोर्ड के माध्यम से अपने खाते में टॉप-अप करें। क्रेडिट कभी समाप्त नहीं होता, और आप क्रिप्टो (USDT या USDC) का उपयोग करके भुगतान कर सकते हैं।
कॉन्टेक्स्ट विंडो 100,000 टोकन का है, जिसमें प्रॉम्प्ट और पूर्णता दोनों शामिल हैं। यह विस्तृत संवादों या बड़े दस्तावेज़ प्रोसेसिंग की अनुमति देता है। यदि आप सीमा से अधिक हो जाते हैं, तो API अनुरोध को अस्वीकार कर देगा। मॉडल की पहचान uncensored है, और यह विस्तृत क्षमताओं के लिए टूल/फ़ंक्शन कॉलिंग का समर्थन करता है।
API विवरण
API की सभी असली सीमाएँ और सुविधाएँ एक जगह — क्रेडिट जोड़ने से पहले इन्हें देख लें।
| मद | मान |
|---|---|
| API फ़ॉर्मेट | OpenAI के अनुकूल: कोई भी OpenAI SDK चलेगा — बस base URL और कुंजी बदलें |
| मॉडल ID | uncensored |
| एंडपॉइंट | POST /v1/chat/completions · GET /v1/models |
| प्रमाणीकरण | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.uncensoredlocalllm.com/v1 |
| फ़ंक्शन कॉलिंग | हाँ — tools, tool_choice; जवाब में tool_calls, स्ट्रीमिंग में भी; नतीजे role: tool संदेश से भेजें |
| पैरामीटर | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| कॉन्टेक्स्ट विंडो | 100,000 टोकन (इनपुट + आउटपुट मिलाकर) |
| अधिकतम आउटपुट | 100,000-टोकन विंडो के शेष हिस्से तक; max_tokens वैकल्पिक (अलग सीमा नहीं) |
| JSON मोड | response_format: {"type": "json_object"} |
| स्ट्रीमिंग | हाँ — server-sent events; आख़िरी हिस्से में टोकन उपयोग |
| अनुरोध का आकार | 8 MB तक |
| रिस्पॉन्स हेडर | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| समानांतर अनुरोध | प्रति कुंजी एक साथ 8 तक |
| रेट लिमिट | प्रति कुंजी प्रति मिनट 300 अनुरोध |
| बोनस | $50 से +5%, $100 से +10% |
| टॉप-अप | USDT (TRC20) या USDC (Base), $10 से $500 तक कोई भी पूरी राशि |
| कीमत | प्रति 10 लाख इनपुट टोकन $0.25 · प्रति 10 लाख आउटपुट टोकन $1.00 |
| मुफ़्त ट्रायल क्रेडिट | $0.50, 7 दिन, कार्ड की ज़रूरत नहीं · ट्रायल कुंजी: 2 समानांतर अनुरोध, 60 प्रति मिनट; पहले टॉप-अप के बाद पूरी सीमाएँ (8 और 300) |
| बिलिंग | प्रीपेड क्रेडिट, असली उपयोग के अनुसार; त्रुटियाँ और अस्वीकृतियाँ मुफ़्त |
| वैधता | भुगतान किया क्रेडिट कभी समाप्त नहीं होता, कोई सदस्यता नहीं |
| साइन इन | Google या ईमेल और पासवर्ड |
| कुंजियाँ | हर खाते में एक सक्रिय कुंजी; नई कुंजी पुरानी की जगह लेती है |
| सामग्री | वयस्क सामग्री की अनुमति; नाबालिगों से जुड़ी यौन सामग्री अस्वीकार |
त्रुटि कोड
त्रुटियाँ JSON में स्थिर type के साथ आती हैं; विफल या अस्वीकृत अनुरोधों का शुल्क नहीं लगता।
| कोड | प्रकार | अर्थ |
|---|---|---|
400 | bad_request | अमान्य JSON, खाली संदेश, गलत पैरामीटर या कॉन्टेक्स्ट विंडो से अधिक |
401 | missing_key · invalid_key · key_revoked | कुंजी नहीं, गलत कुंजी या नई कुंजी से बदली गई |
402 | no_credit | क्रेडिट ख़त्म — टॉप-अप करें, तुरंत चालू |
403 | content_blocked | नाबालिगों से जुड़ी यौन सामग्री — अस्वीकार, कोई शुल्क नहीं |
404 | not_found | अज्ञात एंडपॉइंट |
413 | request_too_large | बॉडी 8 MB से बड़ी |
429 | rate_limited · concurrency | 300/मिनट या 8 समानांतर से अधिक — रुककर फिर कोशिश करें |
503 | upstream_busy | मॉडल व्यस्त — कुछ सेकंड बाद फिर कोशिश करें |
प्रश्न और उत्तर
कॉन्टेक्स्ट विंडो का आकार क्या है?
API 100,000 टोकन की कॉन्टेक्स्ट विंडो का समर्थन करता है, जिसमें इनपुट प्रॉम्प्ट और आउटपुट कंप्लीशन दोनों शामिल हैं। इससे एक ही अनुरोध में विस्तृत बातचीत या बड़े दस्तावेज़ों को प्रोसेस करने की सुविधा मिलती है।
स्ट्रीमिंग प्रतिक्रियाओं को कैसे हैंडल करें?
सर्वर-सेंट इवेंट्स (SSE) प्राप्त करने के लिए अपने अनुरोध में <code>stream: true</code> सेट करें। Python और Node.js में OpenAI SDKs इस फ्लैग सक्षम होने पर स्ट्रीमिंग को स्वचालित रूप से हैंडल करते हैं। फिर आप प्रत्येक चंक को आने पर प्रोसेस कर सकते हैं।
यदि क्रेडिट खत्म हो जाए तो क्या होता है?
आपको <code>402</code> त्रुटि मिलेगी जिसका संकेत है कि कोई क्रेडिट उपलब्ध नहीं है। आप क्रिप्टो (USDT या USDC) का उपयोग करके न्यूनतम $10 के साथ अपने खाते में टॉप-अप कर सकते हैं। क्रेडिट कभी एक्सपायर नहीं होते हैं, और बड़े टॉप-अप के लिए बोनस लागू होते हैं।
uncensoredlocalllm.com
आपकी कुंजी बस एक फ़ॉर्म दूर है
एक खाता बनाएं, कुंजी कॉपी करें, बेस यूआरएल बदलें। सेटअप यही है।