NL ▾
API-sleutel aanvragen

uncensoredlocalllm.com

Ongecensureerd LLM API

LLM zonder gpu API voor ontwikkelaars

Krijg ruwe, ongecensureerde modeloutputs via een enkel OpenAI-compatible endpoint zonder GPUs of lokale inferentie-infrastructuur te beheren.

  • 100k contextvenster
  • $0,25 per 1M input tokens
  • Geen creditcard nodig voor proefperiode

Probeer het met één verzoek

curl https://api.uncensoredlocalllm.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'
per 1M input tokens
$0,25
Output tokens / 1M
$1,00
context van tokens
100.000
proeftegoed
$0,50
verzoeken per minuut
300

Wat je krijgt

OpenAI-compatible

Drop-in vervanging voor bestaande clients. Werkt met de officiële OpenAI SDK's door de base URL en API-sleutel aan te passen.

Ruwe Outputs

Het model weigert geen wettelijke volwassen, fictieve of controversiële onderwerpen. Het geeft directe antwoorden zonder guardrail-filtering.

Eenvoudige Prijzen

Pay-as-you-go prepaid credit. Geen maandelijkse kosten, geen abonnementen en betaald tegoed verloopt nooit.

Streaming & Tools

Ondersteunt Server-Sent Events (SSE) voor streaming responses en standaard tool/function calling voor agent workflows.

Geen Hardware Nodig

Krijg toegang tot onze GPU-servers via internet. Je hoeft geen weights te downloaden, VRAM niet te beheren of vLLM lokaal te configureren.

Privacy Eerst

Prompts worden niet gebruikt voor training. Meld je aan met alleen een e-mail en wachtwoord voor directe toegang.

Hoe het werkt

1 / 3

Aanmelden

Maak een account aan met e-mail en wachtwoord om direct je unieke API-sleutel te ontvangen.

2 / 3

Client Configureren

Stel je base URL in op https://api.uncensoredlocalllm.com/v1 en injecteer je API-sleutel in je SDK.

3 / 3

Verzoeken Versturen

POST naar /v1/chat/completions met het model id "uncensored" om ruwe tekstantwoorden te ontvangen.

Wat mensen ermee bouwen

  1. Content Generatie

    Genereer creatieve fictie of roleplay zonder dat het model weigert op basis van standaard contentbeleid. Ideaal voor schrijvers die ruwe output willen.

  2. Security Research

    Test modelgrenzen voor jailbreaks of gevoelige onderwerpen zonder kunstmatige guardrails die je analyse verstoren. Gebruik voor wettelijke tests.

  3. Data Annotation

    Verwerk grote datasets via de API om data te labelen of taggen zonder je zorgen te maken over contextvensterlimieten of lokale hardwarebeperkingen.

  4. Ongefilterde Chatbots

    Bouw aangepaste chatinterfaces waarmee gebruikers elk onderwerp vrij kunnen verkennen. Perfect voor niche communities of volwassen-applicaties.

Wat is een Ongecensureerd LLM?

Een ongecensureerd LLM is een large language model dat is afgestemd of "ge-abliterated" om standaard inhoudsrefusals te verwijderen. Terwijl modellen zoals GPT-4 of Claude misschien weigeren vragen te beantwoorden over controversiële politiek, NSFW-onderwerpen of gevoelig security research, zal een ongecensureerd model direct antwoorden.

Ons model, geïdentificeerd als "uncensored", is een open-weight model gehost op onze GPU-servers. Het is ontworpen om ruwe outputs te bieden zonder filtering voor wettelijk volwassen gebruik. Het is geen GPT, Claude, Gemini, Grok of DeepSeek. Het is een apart model geoptimaliseerd voor onbeperkt gesprek. Houd er rekening mee dat we, hoewel we standaard guardrails verwijderen, nog steeds seksuele inhoud met minderjarigen blokkeren. Dit maakt het ideaal voor gebruikers die controle willen over hun contentmodulatie in plaats van te vertrouwen op een filter van een derde partij.

Waar het hosten in plaats van lokaal draaien?

Een ongecensureerd lokaal LLM zelf draaien vereist aanzienlijke hardware. Je hebt een GPU nodig met voldoende VRAM om grote weights te laden, en je moet de software stack beheren (bijv. ollama, vLLM). Updates kunnen je lokale setup breken, en niet iedereen heeft de ruimte of stroom voor een dedicated machine.

Onze gehoste API elimineert deze complexiteit. Je krijgt onmiddellijke toegang tot een contextvenster van 100k tokens en ruwe modelkracht vanaf elk apparaat met een internetverbinding. Je hoeft geen multi-gigabyte bestanden te downloaden of je zorgen te maken over hardwarecompatibiliteit. Het is de snelste manier om met abliterated modellen aan de slag te gaan zonder de infrastructuur-hoofdpijn.

OpenAI-compatible endpoints

We bieden een stabiel endpoint dat zich precies gedraagt als de OpenAI API. Dit betekent dat je je bestaande code met minimale wijzigingen kunt gebruiken. Het primaire endpoint is POST /v1/chat/completions, dat streaming ondersteunt via Server-Sent Events (SSE) en standaard tool/function calling. We bieden ook GET /v1/models om beschikbare modellen te vermelden.

We bieden geen embeddings, afbeeldings-, audio- of videogeneratie. Als je die nodig hebt, moet je een andere service gebruiken. Onze focus ligt puur op tekstcompletion en chat. De basis-URL is https://api.uncensoredlocalllm.com/v1. Je kunt de officiële OpenAI SDKs gebruiken door ze eenvoudig naar deze basis-URL te wijzen en je API-sleutel op te geven.

Prijzen & Geen verborgen kosten

Onze prijzen zijn transparant en pay-as-you-go. Je betaalt $0,25 per 1M input tokens en $1,00 per 1M output tokens. Er zijn geen maandelijkse kosten, geen abonnementen en geen verborgen kosten. Je prepaid credit verloopt nooit. Je kunt opwaarderen vanaf $10 met crypto (USDT of USDC). We bieden ook bonus credits: +5% op $50 en +10% op $100.

Nieuwe accounts krijgen $0,50 aan trial credit geldig voor 7 dagen. Er is geen creditcard nodig om te beginnen. Limieten zijn ingesteld op 300 verzoeken per minuut per sleutel en een request body van 8 MB. Elk account krijgt één API-sleutel, die je op elk moment kunt regenereren om de oude te revoken.

Vragen en antwoorden

Is dit hetzelfde als GPT-4 of Claude?

Nee. Ons model is een open-weight model dat verschilt van GPT, Claude, Gemini, Grok of DeepSeek. Het is specifiek afgestemd op ongecensureerde uitvoer en deelt niet dezelfde architectuur of trainingsdata als die propriëtaire modellen. Het is GEEN GPT, Claude, Gemini, Grok, DeepSeek of enig ander model van een leverancier.

Bewaar je mijn prompts?

We gebruiken je prompts niet voor training. Je gegevensprivacy wordt gerespecteerd. Je hebt alleen een e-mail en wachtwoord nodig om in te loggen, en je API-sleutel wordt onmiddellijk gegenereerd zonder dat een creditcard nodig is.

Wat is de grootte van het contextvenster?

Onze API ondersteunt een contextvenster van 100.000 tokens voor zowel de prompt als de completion. Hierdoor kun je grote documenten verwerken of lange gesprekskronieken bijhouden zonder tegen de limieten aan te lopen die gebruikelijk zijn bij kleinere modellen.

Kan ik dit gebruiken voor NSFW-inhoud?

Ja. Het model is ongecensureerd en zal wettelijke volwassen onderwerpen zonder weigering beantwoorden. We handhaven echter een harde inhoudslimiet: seksuele inhoud met minderjarigen wordt altijd geblokkeerd. Alle andere volwassen inhoud is toegestaan.

Bied je afbeeldingsgeneratie of embeddings aan?

Nee. We bieden alleen tekstgebaseerde chatvoltooiingen. We bieden geen embeddings, afbeeldings-, audio- of video-generatie. Als je die mogelijkheden nodig hebt, moet je een andere service gebruiken. Onze API is strikt voor tekstinput en -output.

uncensoredlocalllm.com

Je sleutel is nog maar één formulier verwijderd

Maak een account aan, kopieer de sleutel, verander de base URL. Dat is de hele setup.