HI ▾
API कुंजी पाएँ

uncensoredlocalllm.comDocs

Uncensored Local LLM API को एकीकृत करें

अपने OpenAI-कम्पैटिबल क्लाइंट को हमारे होस्टेड एंडपॉइंट की ओर इशारा करके Uncensored Local LLM API को इंटीग्रेट करें। आपको 100k कॉन्टेक्स्ट विंडो, स्ट्रीमिंग सपोर्ट और स्थानीय GPU इंफ्रास्ट्रक्चर मैनेज किए बिना रॉ मॉडल आउटपुट मिलते हैं।

बेस URL
https://api.uncensoredlocalllm.com/v1
मॉडल
बिना सेंसर

बेस यूआरएल और प्रमाणीकरण

हमारा API OpenAI SDKs के साथ पूरी तरह से संगत है। आपको केवल base_url अपडेट करने और अपनी API कुंजी प्रदान करने की आवश्यकता है। तुरंत अपनी कुंजी प्राप्त करने के लिए Get API key पेज पर साइन इन करें। ट्रायल क्रेडिट के साथ शुरू करने के लिए फ़ोन नंबर या क्रेडिट कार्ड की आवश्यकता नहीं है। बेस URL https://api.uncensoredlocalllm.com/v1 है। अपनी कुंजी को सुरक्षित रखें; आप इसे किसी भी समय पुनः उत्पन्न कर सकते हैं, जिससे पुरानी कुंजी तुरंत रद्द हो जाती है। इससे आपके एप्लिकेशन के लिए स्थिर एंडपॉइंट बना रहता है, बिना स्थानीय इन्फरेंस मैनेजमेंट की जटिलता के।

पहला अनुरोध

अपने पसंदीदा HTTP क्लाइंट का उपयोग करके अपना पहला API कॉल करें। एंडपॉइंट मानक chat-completions फॉर्मेट का समर्थन करता है। नीचे एक बुनियादी अनुरोध प्रदर्शित करने वाला cURL उदाहरण दिया गया है। YOUR_API_KEY को अपनी वास्तविक कुंजी से बदलें। यह अनुरोध एक प्रॉम्प्ट भेजता है और एक पाठ प्रतिक्रिया की अपेक्षा करता है। मॉडल आईडी uncensored है। यह ओपन-वेट मॉडल कानूनी वयस्क उपयोग के लिए सामग्री अस्वीकृतियों के बिना उत्तर देने के लिए ट्यून्ड है, आपके उपयोग मामले के लिए प्रत्यक्ष आउटपुट प्रदान करता है।

curl https://api.uncensoredlocalllm.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

प्रतिक्रिया में choices सरणी में उत्पन्न पाठ होगा। यदि आपको 401 त्रुटि मिलती है, तो आपकी API कुंजी अमान्य या अनुपस्थित है। सुनिश्चित करें कि आप सही बेस यूआरएल का उपयोग कर रहे हैं और कि आपकी कुंजी पुनर्जनन के बाद रद्द नहीं की गई है।

Python SDK इंटीग्रेशन

तेज़ इंटिग्रेशन के लिए आधिकारिक OpenAI Python SDK का उपयोग करें। अपने क्लाइंट इनिशियलाइज़ेशन में base_url और api_key सेट करें। इस दृष्टिकोण से आप chat.completions.create() जैसे परिचित विधियों का उपयोग कर सकते हैं। SDK JSON सीरियलाइज़ेशन और HTTP अनुरोधों को स्वचालित रूप से संभालता है। यह उन बैकएंड सेवाओं या स्क्रिप्ट्स के लिए आदर्श है जिन्हें बड़ी मात्रा में पाठ प्रोसेस करने की आवश्यकता होती है। याद रखें कि मॉडल आईडी हमेशा uncensored ही रहती है, चाहे आप जो भी SDK वर्जन उपयोग करें।

from openai import OpenAI

client = OpenAI(base_url="https://api.uncensoredlocalllm.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

यह विधि बैच प्रसंस्करण के लिए या जब आपको पायथन में प्रतिक्रिया तर्क संभालने की आवश्यकता हो, तो कुशल है। सुनिश्चित करें कि आपके वातावरण में openai पैकेज इंस्टॉल है। SDK सिंक्रोनस और असिंक्रोनस दोनों संचालन का समर्थन करता है, विभिन्न वास्तुकला आवश्यकताओं के अनुकूल है।

Node SDK इंटीग्रेशन

JavaScript या TypeScript वातावरण के लिए, OpenAI Node SDK एक समान अनुभव प्रदान करता है। अपने बेस यूआरएल और API कुंजी के साथ क्लाइंट को इनिशियलाइज करें। यह वेब एप्लिकेशन या सर्वरलेस फंक्शंस के लिए विशेष रूप से उपयोगी है। SDK HTTP विवरणों को अमूर्त करता है, जिससे आप एप्लिकेशन लॉजिक पर ध्यान केंद्रित कर सकते हैं। आप अन्य OpenAI-कम्पैटिबल सेवाओं की तरह ही कंप्लीशंस एंडपॉइंट को उसी संरचना के साथ कॉल कर सकते हैं।

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.uncensoredlocalllm.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

रियल-टाइम वेब इंटरफेस या Node.js माइक्रोसर्विसेज के लिए इस इंटीग्रेशन का उपयोग करें। SDK प्रॉमिसेज और async/await पैटर्न का समर्थन करता है, जिससे एरर हैंडलिंग सरल हो जाती है। विशेष रूप से वितरित सिस्टम में संभावित नेटवर्क त्रुटियों को सहजता से हैंडल करें।

स्ट्रीमिंग प्रतिक्रियाएं

अपने अनुरोध में stream: true सेट करके स्ट्रीमिंग सक्षम करें। इससे आपको आंशिक प्रतिक्रियाएँ प्राप्त होती हैं जैसे ही वे जनरेट होती हैं, जिससे उपयोगकर्ताओं के लिए अनुभवी विलंबता में सुधार होता है। API स्ट्रीमिंग के लिए Server-Sent Events (SSE) का समर्थन करता है। यह उन चैट इंटरफ़ेसों के लिए महत्वपूर्ण है जहाँ तत्काल प्रतिक्रिया की उम्मीद की जाती है। स्ट्रीमिंग मॉडल के आउटपुट गुणवत्ता या कॉन्टेक्स्ट विंडो को प्रभावित नहीं करती।

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

अपने क्लाइंट कोड में स्ट्रीम इवेंट्स हैंडल करें। प्रत्येक चंक अंतिम प्रतिक्रिया का एक हिस्सा होता है। पूर्ण संदेश को पुनर्निर्मित करने के लिए इन चंक्स को एग्रीगेट करें। यह दृष्टिकोण Python और Node.js दोनों में OpenAI SDKs के साथ सहजता से काम करता है।

रेट लिमिट, त्रुटियां और कॉन्टेक्स्ट विंडो

API प्रति कुंजी प्रति मिनट 300 अनुरोध की सीमा लागू करता है। अधिकतम अनुरोध बॉडी आकार 8 MB है। यदि आप रेट लिमिट से अधिक हो जाते हैं, तो आपको 429 त्रुटि मिलेगी। 402 त्रुटि का अर्थ है कि प्रीपेड क्रेडिट अपर्याप्त है। सुनिश्चित करें कि आप अपनी उपयोगिता की निगरानी करें और डैशबोर्ड के माध्यम से अपने खाते में टॉप-अप करें। क्रेडिट कभी समाप्त नहीं होता, और आप क्रिप्टो (USDT या USDC) का उपयोग करके भुगतान कर सकते हैं।

कॉन्टेक्स्ट विंडो 100,000 टोकन का है, जिसमें प्रॉम्प्ट और पूर्णता दोनों शामिल हैं। यह विस्तृत संवादों या बड़े दस्तावेज़ प्रोसेसिंग की अनुमति देता है। यदि आप सीमा से अधिक हो जाते हैं, तो API अनुरोध को अस्वीकार कर देगा। मॉडल की पहचान uncensored है, और यह विस्तृत क्षमताओं के लिए टूल/फ़ंक्शन कॉलिंग का समर्थन करता है।

API विवरण

API की सभी असली सीमाएँ और सुविधाएँ एक जगह — क्रेडिट जोड़ने से पहले इन्हें देख लें।

मदमान
API फ़ॉर्मेटOpenAI के अनुकूल: कोई भी OpenAI SDK चलेगा — बस base URL और कुंजी बदलें
मॉडल IDuncensored
एंडपॉइंटPOST /v1/chat/completions · GET /v1/models
प्रमाणीकरणAuthorization: Bearer YOUR_KEY
Base URLhttps://api.uncensoredlocalllm.com/v1
फ़ंक्शन कॉलिंगहाँ — tools, tool_choice; जवाब में tool_calls, स्ट्रीमिंग में भी; नतीजे role: tool संदेश से भेजें
पैरामीटरtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
कॉन्टेक्स्ट विंडो100,000 टोकन (इनपुट + आउटपुट मिलाकर)
अधिकतम आउटपुट100,000-टोकन विंडो के शेष हिस्से तक; max_tokens वैकल्पिक (अलग सीमा नहीं)
JSON मोडresponse_format: {"type": "json_object"}
स्ट्रीमिंगहाँ — server-sent events; आख़िरी हिस्से में टोकन उपयोग
अनुरोध का आकार8 MB तक
रिस्पॉन्स हेडरX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
समानांतर अनुरोधप्रति कुंजी एक साथ 8 तक
रेट लिमिटप्रति कुंजी प्रति मिनट 300 अनुरोध
बोनस$50 से +5%, $100 से +10%
टॉप-अपUSDT (TRC20) या USDC (Base), $10 से $500 तक कोई भी पूरी राशि
कीमतप्रति 10 लाख इनपुट टोकन $0.25 · प्रति 10 लाख आउटपुट टोकन $1.00
मुफ़्त ट्रायल क्रेडिट$0.50, 7 दिन, कार्ड की ज़रूरत नहीं · ट्रायल कुंजी: 2 समानांतर अनुरोध, 60 प्रति मिनट; पहले टॉप-अप के बाद पूरी सीमाएँ (8 और 300)
बिलिंगप्रीपेड क्रेडिट, असली उपयोग के अनुसार; त्रुटियाँ और अस्वीकृतियाँ मुफ़्त
वैधताभुगतान किया क्रेडिट कभी समाप्त नहीं होता, कोई सदस्यता नहीं
साइन इनGoogle या ईमेल और पासवर्ड
कुंजियाँहर खाते में एक सक्रिय कुंजी; नई कुंजी पुरानी की जगह लेती है
सामग्रीवयस्क सामग्री की अनुमति; नाबालिगों से जुड़ी यौन सामग्री अस्वीकार

त्रुटि कोड

त्रुटियाँ JSON में स्थिर type के साथ आती हैं; विफल या अस्वीकृत अनुरोधों का शुल्क नहीं लगता।

कोडप्रकारअर्थ
400bad_requestअमान्य JSON, खाली संदेश, गलत पैरामीटर या कॉन्टेक्स्ट विंडो से अधिक
401missing_key · invalid_key · key_revokedकुंजी नहीं, गलत कुंजी या नई कुंजी से बदली गई
402no_creditक्रेडिट ख़त्म — टॉप-अप करें, तुरंत चालू
403content_blockedनाबालिगों से जुड़ी यौन सामग्री — अस्वीकार, कोई शुल्क नहीं
404not_foundअज्ञात एंडपॉइंट
413request_too_largeबॉडी 8 MB से बड़ी
429rate_limited · concurrency300/मिनट या 8 समानांतर से अधिक — रुककर फिर कोशिश करें
503upstream_busyमॉडल व्यस्त — कुछ सेकंड बाद फिर कोशिश करें

प्रश्न और उत्तर

कॉन्टेक्स्ट विंडो का आकार क्या है?

API 100,000 टोकन की कॉन्टेक्स्ट विंडो का समर्थन करता है, जिसमें इनपुट प्रॉम्प्ट और आउटपुट कंप्लीशन दोनों शामिल हैं। इससे एक ही अनुरोध में विस्तृत बातचीत या बड़े दस्तावेज़ों को प्रोसेस करने की सुविधा मिलती है।

स्ट्रीमिंग प्रतिक्रियाओं को कैसे हैंडल करें?

सर्वर-सेंट इवेंट्स (SSE) प्राप्त करने के लिए अपने अनुरोध में <code>stream: true</code> सेट करें। Python और Node.js में OpenAI SDKs इस फ्लैग सक्षम होने पर स्ट्रीमिंग को स्वचालित रूप से हैंडल करते हैं। फिर आप प्रत्येक चंक को आने पर प्रोसेस कर सकते हैं।

यदि क्रेडिट खत्म हो जाए तो क्या होता है?

आपको <code>402</code> त्रुटि मिलेगी जिसका संकेत है कि कोई क्रेडिट उपलब्ध नहीं है। आप क्रिप्टो (USDT या USDC) का उपयोग करके न्यूनतम $10 के साथ अपने खाते में टॉप-अप कर सकते हैं। क्रेडिट कभी एक्सपायर नहीं होते हैं, और बड़े टॉप-अप के लिए बोनस लागू होते हैं।

uncensoredlocalllm.com

आपकी कुंजी बस एक फ़ॉर्म दूर है

एक खाता बनाएं, कुंजी कॉपी करें, बेस यूआरएल बदलें। सेटअप यही है।