NL ▾
API-sleutel aanvragen

uncensoredlocalllm.comDocs

Integreer de Uncensored Local LLM API

Integreer de Uncensored Local LLM API door je OpenAI-compatibele client te wijzen naar ons endpoint. Je krijgt een contextvenster van 100k tokens, streaming-ondersteuning en ruwe modeluitvoer zonder lokaal GPU-infrastructuur te beheren.

Basis-URL
https://api.uncensoredlocalllm.com/v1
Model
ongecensureerd

Basis-URL en authenticatie

Onze API is volledig compatibel met de OpenAI SDK's. Je hoeft alleen de base_url aan te passen en je API-sleutel op te geven. Meld je aan op de API-sleutel ophalen-pagina om je sleutel direct te ontvangen. Er is geen telefoonnummer of creditcard nodig om te beginnen met het gratis proeftegoed. De base URL is https://api.uncensoredlocalllm.com/v1. Bewaar je sleutel veilig; je kunt hem op elk moment regeneren, waardoor de oude sleutel direct ongeldig wordt. Zo heb je altijd een stabiele endpoint voor je applicaties zonder de complexiteit van lokaal inferentiebeheer.

Eerste verzoek

Maak je eerste API-aanroep met je favoriete HTTP-client. De endpoint ondersteunt de standaard chat-completions-indeling. Hieronder vind je een cURL-voorbeeld dat een basisverzoek demonstreert. Vervang YOUR_API_KEY door je daadwerkelijke sleutel. Dit verzoek verzendt een prompt en verwacht een tekstantwoord. De model-id is uncensored. Dit open-weight model is afgestemd op het geven van antwoorden zonder inhoudelijke weigeringen voor wettelijk volwassen gebruik, en levert directe outputs voor jouw toepassing.

curl https://api.uncensoredlocalllm.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

De reactie bevat de gegenereerde tekst in de choices-array. Als je een 401-foutmelding krijgt, is je API-sleutel ongeldig of ontbreekt deze. Zorg dat je de juiste base URL gebruikt en dat je sleutel niet is ingetrokken na het opnieuw genereren.

Python SDK-integratie

Gebruik de officiële OpenAI Python SDK voor snelle integratie. Stel de base_url en api_key in bij het initialiseren van je client. Deze aanpak stelt je in staat bekende methoden zoals chat.completions.create() te gebruiken. De SDK verwerkt JSON-serialisatie en HTTP-verzoeken automatisch. Dit is ideaal voor backend-diensten of scripts die grote hoeveelheden tekst moeten verwerken. Onthoud dat de model-id altijd uncensored blijft, ongeacht de SDK-versie die je gebruikt.

from openai import OpenAI

client = OpenAI(base_url="https://api.uncensoredlocalllm.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Deze methode is efficiënt voor batchverwerking of wanneer je de antwoordlogica in Python wilt afhandelen. Zorg dat je omgeving het openai-pakket geïnstalleerd heeft. De SDK ondersteunt zowel synchrone als asynchrone bewerkingen, wat past bij verschillende architectuurnoden.

Node SDK-integratie

Voor JavaScript- of TypeScript-omgevingen biedt de OpenAI Node SDK een vergelijkbare ervaring. Initialiseer de client met je basis-URL en API-sleutel. Dit is vooral nuttig voor webapplicaties of serverless functies. De SDK abstrahert de HTTP-details, zodat je je kunt concentreren op applicatielogica. Je kunt het completions-endpoint aanroepen met dezelfde structuur als andere OpenAI-compatibele diensten.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.uncensoredlocalllm.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Gebruik deze integratie voor realtime webinterfaces of Node.js-microservices. De SDK ondersteunt promises en async/await-patronen, waardoor foutafhandeling eenvoudig is. Zorg dat je netwerkfouten afhandelt met de nodige zorg, vooral in gedistribueerde systemen.

Streaming-antwoorden

Schakel streaming in door stream: true in te stellen in je verzoek. Hierdoor ontvang je gedeeltelijke antwoorden terwijl ze worden gegenereerd, wat de waargenomen latentie voor gebruikers verbetert. De API ondersteunt Server-Sent Events (SSE) voor streaming. Dit is cruciaal voor chatinterfaces waarbij directe feedback wordt verwacht. Streaming heeft geen invloed op de outputkwaliteit van het model of het contextvenster.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Verwerk de stream-events in je clientcode. Elke chunk bevat een deel van het uiteindelijke antwoord. Aggregateer deze chunks om het volledige bericht te reconstrueren. Deze aanpak werkt naadloos met de OpenAI SDK's voor zowel Python als Node.js.

Rate limits, fouten en contextvenster

De API hanteert een limiet van 300 verzoeken per minuut per sleutel. De maximale grootte van de request body is 8 MB. Je ontvangt een 429-foutmelding als je de rate limit overschrijdt. Een 402-foutmelding geeft aan dat er onvoldoende prepaid tegoed beschikbaar is. Houd je gebruik in de gaten en laad je account op via het dashboard. Credits vervallen nooit en je kunt betalen met crypto (USDT of USDC).

Het contextvenster is 100.000 tokens, inclusief zowel prompt als completion. Dit stelt je in staat uitgebreide gesprekken te voeren of grote documenten te verwerken. Als je de limiet overschrijdt, wijst de API het verzoek af. De model-id is uncensored en het ondersteunt tool/function calling voor uitgebreide mogelijkheden.

API-specificaties

Alle echte limieten en functies van de API op één plek — controleer ze voordat je opwaardeert.

OnderdeelWaarde
API-formaatOpenAI-compatibel: elke OpenAI-SDK werkt — vervang alleen base URL en sleutel
Model-IDuncensored
EndpointsPOST /v1/chat/completions · GET /v1/models
AuthenticatieAuthorization: Bearer YOUR_KEY
Base URLhttps://api.uncensoredlocalllm.com/v1
Function callingja — tools, tool_choice; antwoorden bevatten tool_calls, ook bij streaming; resultaten als role: tool
Parameterstemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Contextvenster100.000 tokens (invoer + uitvoer)
Max. uitvoertot de rest van het venster van 100.000 tokens; max_tokens optioneel (geen aparte limiet)
JSON-modusresponse_format: {"type": "json_object"}
Streamingja — server-sent events; het laatste deel bevat het tokenverbruik
Verzoekgroottetot 8 MB
ResponsheadersX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Gelijktijdige verzoekentot 8 tegelijk per sleutel
Rate limit300 verzoeken per minuut per sleutel
Bonus+5% vanaf $50, +10% vanaf $100
OpwaarderenUSDT (TRC20) of USDC (Base), elk heel bedrag van $10 tot $500
Prijs$0,25 per 1 mln invoertokens · $1,00 per 1 mln uitvoertokens
Gratis proeftegoed$0,50 voor 7 dagen, zonder kaart · Proefsleutel: 2 parallelle verzoeken, 60 per minuut; volledige limieten (8 en 300) na eerste opwaardering
Afrekeningprepaid tegoed op basis van echt verbruik; fouten en weigeringen zijn gratis
Geldigheidbetaald tegoed verloopt niet, geen abonnement
InloggenGoogle of e-mail en wachtwoord
Sleutelséén actieve sleutel per account; een nieuwe vervangt de oude
Inhoudinhoud voor volwassenen toegestaan; seksuele inhoud met minderjarigen wordt geweigerd

Foutcodes

Fouten komen als JSON met een vaste type; mislukte of geweigerde verzoeken kosten niets.

CodeTypeBetekenis
400bad_requestongeldige JSON, lege berichten, verkeerde parameter of context te lang
401missing_key · invalid_key · key_revokedsleutel ontbreekt, is onjuist of is vervangen
402no_creditgeen tegoed — waardeer op en ga direct verder
403content_blockedseksuele inhoud met minderjarigen — geweigerd, niet gerekend
404not_foundonbekend endpoint
413request_too_largebody groter dan 8 MB
429rate_limited · concurrencymeer dan 300/min of 8 tegelijk — wacht en probeer opnieuw
503upstream_busymodel bezet — probeer het over enkele seconden opnieuw

Vragen en antwoorden

Wat is de grootte van het contextvenster?

De API ondersteunt een contextvenster van 100.000 tokens, inclusief zowel de input-prompt als de uitvoer. Dit stelt je in staat uitgebreide gesprekken te voeren of grote documenten in één verzoek te verwerken.

Hoe verwerk ik streaming-antwoorden?

Stel <code>stream: true</code> in je verzoek in om Server-Sent Events (SSE) te ontvangen. De OpenAI SDK's voor Python en Node.js verwerken streaming automatisch wanneer deze vlag is ingeschakeld. Je kunt vervolgens elke chunk verwerken zodra deze aankomt.

Wat gebeurt er als ik mijn tegoed op heb?

Je ontvangt een <code>402</code>-foutmelding dat er geen tegoed beschikbaar is. Je kunt je account opwaarderen met minimaal $10 met crypto (USDT of USDC). Credits vervallen nooit en voor grotere opwaarderingen krijg je bonus.

uncensoredlocalllm.com

Je sleutel is nog maar één formulier verwijderd

Maak een account aan, kopieer de sleutel, pas de basis-URL aan. Dat is de hele setup.