PL ▾
Pobierz klucz API

uncensoredlocalllm.comDokumentacja

Zintegruj API Uncensored Local LLM

Zintegruj API Uncensored Local LLM, wskazując kompatybilnego klienta OpenAI na nasz endpoint. Otrzymujesz okno kontekstu 100k tokenów, wsparcie dla strumieniowania i surowe wyniki modelu bez konieczności zarządzania infrastrukturą GPU.

Bazowy URL
https://api.uncensoredlocalllm.com/v1
Model
bez cenzury

Base URL i uwierzytelnianie

Nasz API jest w pełni kompatybilny z SDK OpenAI. Musisz tylko zaktualizować base_url i podać swój klucz API. Zarejestruj się na stronie Pobierz klucz API, aby otrzymać klucz natychmiast. Nie jest wymagany numer telefonu ani karta kredytowa, aby rozpocząć pracę z darmowym kredytem próbnym. Base URL to https://api.uncensoredlocalllm.com/v1. Chroń swój klucz; możesz go wygenerować ponownie w dowolnym momencie, co natychmiast unieważni poprzedni. Zapewnia to zawsze pojedynczy, stabilny endpoint dla Twoich aplikacji bez konieczności zarządzania wnioskowaniem lokalnym.

Pierwsze zapytanie

Wykonaj pierwsze zapytanie API za pomocą preferowanego klienta HTTP. Endpoint obsługuje standardowy format chat-completions. Poniżej znajduje się przykład cURL demonstrujący podstawowe zapytanie. Zastąp YOUR_API_KEY swoim rzeczywistym kluczem. To zapytanie wysyła prompt i oczekuje odpowiedzi tekstowej. ID modelu to uncensored. Ten model o otwartych wagach jest dostrojony do odpowiadania bez odmów treści dla użytku dorosłego, zapewniając bezpośrednie wyniki dla Twojego przypadku użycia.

curl https://api.uncensoredlocalllm.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Odpowiedź będzie zawierać wygenerowany tekst w tablicy choices. Jeśli napotkasz błąd 401, Twój klucz API jest nieprawidłowy lub brakuje go. Upewnij się, że używasz właściwego base URL i że Twój klucz nie został unieważniony po jego ponownym wygenerowaniu.

Integracja z Python SDK

Użyj oficjalnego SDK OpenAI dla Pythona, aby szybko zintegrować usługę. Ustaw base_url i api_key podczas inicjalizacji klienta. Ta metoda pozwala używać znanych metod takich jak chat.completions.create(). SDK automatycznie obsługuje serializację JSON i żądania HTTP. Jest to idealne dla usług backendowych lub skryptów, które muszą przetwarzać duże ilości tekstu. Pamiętaj, że ID modelu pozostaje uncensored niezależnie od używanej wersji SDK.

from openai import OpenAI

client = OpenAI(base_url="https://api.uncensoredlocalllm.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Ta metoda jest skuteczna przy przetwarzaniu wsadowym lub gdy musisz obsłużyć logikę odpowiedzi w Pythonie. Upewnij się, że w Twoim środowisku zainstalowany jest pakiet openai. SDK obsługuje zarówno operacje synchroniczne, jak i asynchroniczne, pasując do różnych potrzeb architektonicznych.

Integracja z Node SDK

W środowiskach JavaScript lub TypeScript podobne doświadczenie zapewnia SDK Node.js OpenAI. Zainicjuj klienta, podając base URL i klucz API. Jest to szczególnie przydatne w aplikacjach webowych lub funkcjach serverless. SDK abstrahuje szczegóły HTTP, pozwalając skupić się na logice aplikacji. Możesz wywołać endpoint completions z tą samą strukturą co w innych usługach kompatybilnych z OpenAI.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.uncensoredlocalllm.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Użyj tej integracji dla interfejsów webowych w czasie rzeczywistym lub mikroserwisów Node.js. SDK obsługuje wzorce promise i async/await, ułatwiając obsługę błędów. Upewnij się, że obsługujesz potencjalne błędy sieciowe w sposób elegancki, szczególnie w systemach rozproszonych.

Odpowiedzi strumieniowe

Włącz strumieniowanie, ustawiając stream: true w swoim zapytaniu. Pozwala to otrzymwać częściowe odpowiedzi w miarę ich generowania, co poprawia postrzeganą opóźnienie dla użytkowników. API obsługuje zdarzenia Server-Sent Events (SSE) dla strumieniowania. Jest to kluczowe dla interfejsów czatu, gdzie oczekiwana jest natychmiastowa informacja zwrotna. Strumieniowanie nie wpływa na jakość wyjścia modelu ani okno kontekstu.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Obsłuż zdarzenia strumienia w kodzie klienta. Każdy fragment zawiera część ostatecznej odpowiedzi. Zaggregate te fragmenty, aby odtworzyć pełną wiadomość. Ta metoda działa bezproblemowo z SDK OpenAI zarówno w Pythonie, jak i Node.js.

Limity zapytań, błędy i okno kontekstu

API narzuca limit 300 zapytań na minutę na klucz. Maksymalny rozmiar ciała zapytania to 8 MB. Otrzymasz błąd 429, jeśli przekroczysz limit zapytań. Błąd 402 oznacza niewystarczający przedpłacony kredyt. Monitoruj swoje zużycie i doładuj konto przez panel. Kredyt nie wygasa, a płatność możesz zrealizować kryptowalutami (USDT lub USDC).

Okno kontekstu wynosi 100 000 tokenów, obejmując zarówno prompt, jak i uzupełnienie. Pozwala to na długie rozmowy lub przetwarzanie dużych dokumentów. Jeśli przekroczysz limit, API odrzuci zapytanie. ID modelu to uncensored, a obsługuje ono wywoływanie funkcji/narzędzi dla rozszerzonych możliwości.

Parametry API

Wszystkie rzeczywiste limity i funkcje API w jednym miejscu — sprawdź je przed doładowaniem.

ElementWartość
Format APIzgodne z OpenAI: działa każdy SDK OpenAI — zmień base URL i klucz
ID modeluuncensored
EndpointyPOST /v1/chat/completions · GET /v1/models
UwierzytelnianieAuthorization: Bearer YOUR_KEY
Base URLhttps://api.uncensoredlocalllm.com/v1
Wywoływanie funkcjitak — tools, tool_choice; odpowiedź zawiera tool_calls, także w strumieniu; wyniki jako role: tool
Parametrytemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Okno kontekstu100 000 tokenów (wejście + odpowiedź)
Maks. odpowiedźdo reszty okna 100 000 tokenów; max_tokens opcjonalne (bez osobnego limitu)
Tryb JSONresponse_format: {"type": "json_object"}
Strumieniowanietak — server-sent events; ostatni fragment zawiera zużycie tokenów
Rozmiar zapytaniado 8 MB
Nagłówki odpowiedziX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Równoległe zapytaniado 8 jednocześnie na klucz
Limit zapytań300 zapytań na minutę na klucz
Bonus+5% od $50, +10% od $100
DoładowanieUSDT (TRC20) lub USDC (Base), dowolna pełna kwota od $10 do $500
Cena$0,25 za 1 mln tokenów wejścia · $1,00 za 1 mln tokenów wyjścia
Darmowy kredyt$0,50 na 7 dni, bez karty · Klucz próbny: 2 równoległe żądania, 60 na minutę; pełne limity (8 i 300) po pierwszym doładowaniu
Rozliczenieprzedpłacony kredyt według rzeczywistego zużycia; błędy i odmowy są darmowe
Ważnośćopłacony kredyt nie wygasa, bez subskrypcji
LogowanieGoogle albo e-mail i hasło
Kluczejeden aktywny klucz na konto; nowy zastępuje stary
Treścitreści dla dorosłych dozwolone; treści seksualne z udziałem nieletnich są odrzucane

Kody błędów

Błędy wracają jako JSON ze stałym type; nieudane i odrzucone zapytania są bezpłatne.

KodTypZnaczenie
400bad_requestbłędny JSON, puste wiadomości, zły parametr lub za długi kontekst
401missing_key · invalid_key · key_revokedbrak klucza, zły klucz lub klucz zastąpiony nowym
402no_creditbrak kredytu — doładuj, działa od razu
403content_blockedtreści seksualne z nieletnimi — odmowa, bez opłaty
404not_foundnieznany endpoint
413request_too_largetreść większa niż 8 MB
429rate_limited · concurrencyponad 300/min lub 8 równolegle — odczekaj i ponów
503upstream_busymodel zajęty — ponów za kilka sekund

Pytania i odpowiedzi

Jaki jest rozmiar okna kontekstu?

API obsługuje okno kontekstu 100 000 tokenów, obejmujące zarówno prompt wejściowy, jak i wygenerowaną odpowiedź. Pozwala to na długie rozmowy lub przetwarzanie dużych dokumentów w jednym zapytaniu.

Jak obsłużyć odpowiedzi strumieniowe?

Ustaw <code>stream: true</code> w zapytaniu, aby otrzymywać zdarzenia Server-Sent Events (SSE). SDK OpenAI w Pythonie i Node.js obsługują strumieniowanie automatycznie po włączeniu tej flagi. Możesz przetwarzać każdy fragment po jego otrzymaniu.

Co się stanie, gdy zabraknie kredytu?

Otrzymasz błąd <code>402</code> informujący o braku dostępnego kredytu. Możesz doładować konto kwotą od 10 USD za pomocą kryptowalut (USDT lub USDC). Kredyty nie wygasają, a przy większych doładowaniach przysługują bonusy.

uncensoredlocalllm.com

Twój klucz jest o jeden formularz stąd

Utwórz konto, skopiuj klucz, zmień base URL. To cały proces konfiguracji.