Zintegruj API Uncensored Local LLM
Zintegruj API Uncensored Local LLM, wskazując kompatybilnego klienta OpenAI na nasz endpoint. Otrzymujesz okno kontekstu 100k tokenów, wsparcie dla strumieniowania i surowe wyniki modelu bez konieczności zarządzania infrastrukturą GPU.
- Bazowy URL
- https://api.uncensoredlocalllm.com/v1
- Model
- bez cenzury
Base URL i uwierzytelnianie
Nasz API jest w pełni kompatybilny z SDK OpenAI. Musisz tylko zaktualizować base_url i podać swój klucz API. Zarejestruj się na stronie Pobierz klucz API, aby otrzymać klucz natychmiast. Nie jest wymagany numer telefonu ani karta kredytowa, aby rozpocząć pracę z darmowym kredytem próbnym. Base URL to https://api.uncensoredlocalllm.com/v1. Chroń swój klucz; możesz go wygenerować ponownie w dowolnym momencie, co natychmiast unieważni poprzedni. Zapewnia to zawsze pojedynczy, stabilny endpoint dla Twoich aplikacji bez konieczności zarządzania wnioskowaniem lokalnym.
Pierwsze zapytanie
Wykonaj pierwsze zapytanie API za pomocą preferowanego klienta HTTP. Endpoint obsługuje standardowy format chat-completions. Poniżej znajduje się przykład cURL demonstrujący podstawowe zapytanie. Zastąp YOUR_API_KEY swoim rzeczywistym kluczem. To zapytanie wysyła prompt i oczekuje odpowiedzi tekstowej. ID modelu to uncensored. Ten model o otwartych wagach jest dostrojony do odpowiadania bez odmów treści dla użytku dorosłego, zapewniając bezpośrednie wyniki dla Twojego przypadku użycia.
curl https://api.uncensoredlocalllm.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Odpowiedź będzie zawierać wygenerowany tekst w tablicy choices. Jeśli napotkasz błąd 401, Twój klucz API jest nieprawidłowy lub brakuje go. Upewnij się, że używasz właściwego base URL i że Twój klucz nie został unieważniony po jego ponownym wygenerowaniu.
Integracja z Python SDK
Użyj oficjalnego SDK OpenAI dla Pythona, aby szybko zintegrować usługę. Ustaw base_url i api_key podczas inicjalizacji klienta. Ta metoda pozwala używać znanych metod takich jak chat.completions.create(). SDK automatycznie obsługuje serializację JSON i żądania HTTP. Jest to idealne dla usług backendowych lub skryptów, które muszą przetwarzać duże ilości tekstu. Pamiętaj, że ID modelu pozostaje uncensored niezależnie od używanej wersji SDK.
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredlocalllm.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Ta metoda jest skuteczna przy przetwarzaniu wsadowym lub gdy musisz obsłużyć logikę odpowiedzi w Pythonie. Upewnij się, że w Twoim środowisku zainstalowany jest pakiet openai. SDK obsługuje zarówno operacje synchroniczne, jak i asynchroniczne, pasując do różnych potrzeb architektonicznych.
Integracja z Node SDK
W środowiskach JavaScript lub TypeScript podobne doświadczenie zapewnia SDK Node.js OpenAI. Zainicjuj klienta, podając base URL i klucz API. Jest to szczególnie przydatne w aplikacjach webowych lub funkcjach serverless. SDK abstrahuje szczegóły HTTP, pozwalając skupić się na logice aplikacji. Możesz wywołać endpoint completions z tą samą strukturą co w innych usługach kompatybilnych z OpenAI.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredlocalllm.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Użyj tej integracji dla interfejsów webowych w czasie rzeczywistym lub mikroserwisów Node.js. SDK obsługuje wzorce promise i async/await, ułatwiając obsługę błędów. Upewnij się, że obsługujesz potencjalne błędy sieciowe w sposób elegancki, szczególnie w systemach rozproszonych.
Odpowiedzi strumieniowe
Włącz strumieniowanie, ustawiając stream: true w swoim zapytaniu. Pozwala to otrzymwać częściowe odpowiedzi w miarę ich generowania, co poprawia postrzeganą opóźnienie dla użytkowników. API obsługuje zdarzenia Server-Sent Events (SSE) dla strumieniowania. Jest to kluczowe dla interfejsów czatu, gdzie oczekiwana jest natychmiastowa informacja zwrotna. Strumieniowanie nie wpływa na jakość wyjścia modelu ani okno kontekstu.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Obsłuż zdarzenia strumienia w kodzie klienta. Każdy fragment zawiera część ostatecznej odpowiedzi. Zaggregate te fragmenty, aby odtworzyć pełną wiadomość. Ta metoda działa bezproblemowo z SDK OpenAI zarówno w Pythonie, jak i Node.js.
Limity zapytań, błędy i okno kontekstu
API narzuca limit 300 zapytań na minutę na klucz. Maksymalny rozmiar ciała zapytania to 8 MB. Otrzymasz błąd 429, jeśli przekroczysz limit zapytań. Błąd 402 oznacza niewystarczający przedpłacony kredyt. Monitoruj swoje zużycie i doładuj konto przez panel. Kredyt nie wygasa, a płatność możesz zrealizować kryptowalutami (USDT lub USDC).
Okno kontekstu wynosi 100 000 tokenów, obejmując zarówno prompt, jak i uzupełnienie. Pozwala to na długie rozmowy lub przetwarzanie dużych dokumentów. Jeśli przekroczysz limit, API odrzuci zapytanie. ID modelu to uncensored, a obsługuje ono wywoływanie funkcji/narzędzi dla rozszerzonych możliwości.
Parametry API
Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.
| Element | Wartość |
|---|---|
| Format API | zgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz |
| ID modelu | uncensored |
| Endpointy | POST /v1/chat/completions · GET /v1/models |
| Uwierzytelnianie | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.uncensoredlocalllm.com/v1 |
| Wywoływanie funkcji | tak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool |
| Parametry | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Okno kontekstu | 100 000 tokenów (wejście + odpowiedź) |
| Maks. odpowiedź | do reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu) |
| Tryb JSON | response_format: {"type": "json_object"} |
| Strumieniowanie | tak — server-sent events; ostatni fragment zawiera zużycie tokenów |
| Rozmiar zapytania | do 8 MB |
| Nagłówki odpowiedzi | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Równoległe zapytania | do 8 jednocześnie na klucz |
| Limit zapytań | 300 zapytań na minutę na klucz |
| Bonus | +5% od $50, +10% od $100 |
| Doładowanie | USDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500 |
| Cena | $0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia |
| Darmowy kredyt | $0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu |
| Rozliczenie | przedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe |
| Ważność | opłacony kredyt nie wygasa, bez subskrypcji |
| Logowanie | Google albo e-mail i hasło |
| Klucze | jeden aktywny klucz na konto; nowy zastępuje stary |
| Treści | treści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane |
Kody błędów
Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.
| Kod | Typ | Znaczenie |
|---|---|---|
400 | bad_request | błędny JSON, puste wiadomości, zły parametr lub za długi kontekst |
401 | missing_key · invalid_key · key_revoked | brak klucza, zły klucz lub klucz zastąpiony nowym |
402 | no_credit | brak kredytu — doładuj, działa od razu |
403 | content_blocked | treści seksualne z nieletnimi — odmowa, bez opłaty |
404 | not_found | nieznany endpoint |
413 | request_too_large | treść większa niż 8 MB |
429 | rate_limited · concurrency | ponad 300/min lub 8 równolegle — odczekaj i ponów |
503 | upstream_busy | model zajęty — ponów za kilka sekund |
Pytania i odpowiedzi
Jaki jest rozmiar okna kontekstu?
API obsługuje okno kontekstu 100 000 tokenów, obejmujące zarówno prompt wejściowy, jak i wygenerowaną odpowiedź. Pozwala to na długie rozmowy lub przetwarzanie dużych dokumentów w jednym zapytaniu.
Jak obsłużyć odpowiedzi strumieniowe?
Ustaw <code>stream: true</code> w zapytaniu, aby otrzymywać zdarzenia Server-Sent Events (SSE). SDK OpenAI w Pythonie i Node.js obsługują strumieniowanie automatycznie po włączeniu tej flagi. Możesz przetwarzać każdy fragment po jego otrzymaniu.
Co się stanie, gdy zabraknie kredytu?
Otrzymasz błąd <code>402</code> informujący o braku dostępnego kredytu. Możesz doładować konto kwotą od 10 USD za pomocą kryptowalut (USDT lub USDC). Kredyty nie wygasają, a przy większych doładowaniach przysługują bonusy.
uncensoredlocalllm.com
Twój klucz jest o jeden formularz stąd
Utwórz konto, skopiuj klucz, zmień base URL. To cały proces konfiguracji.