DE ▾
API-Schlüssel erhalten

uncensoredlocalllm.com

Unzensierte LLM API

LLM API ohne gpu für Entwickler

Erhalte rohe, unzensierte Modellausgaben über einen einzigen OpenAI-kompatiblen Endpunkt, ohne GPUs oder lokale Inferenz-Infrastruktur verwalten zu müssen.

  • 100k Kontextfenster
  • $0,25 pro 1M Input-Token
  • Keine Karte für Testguthaben nötig

Probiere es mit einer einzigen Anfrage aus

curl https://api.uncensoredlocalllm.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'
pro 1M Input-Token
$0,25
Output-Token / 1M
$1,00
Token-Kontext
100.000
Testguthaben
$0,50
Anfragen pro Minute
300

Was du bekommst

OpenAI-kompatibel

Sofort einsetzbar als Ersatz für bestehende Clients. Funktioniert mit den offiziellen OpenAI SDKs durch Änderung der Base URL und des API-Schlüssels.

Rohdaten-Ausgaben

Das Modell lehnt legale erwachsene, fiktive oder kontroverse Themen nicht ab. Es liefert direkte Antworten ohne Guardrail-Filterung.

Einfache Preisgestaltung

Pay as you go Prepaid-Guthaben. Keine monatlichen Gebühren, keine Abonnements, und das bezahlte Guthaben verfällt nie.

Streaming & Tools

Unterstützt Server-Sent Events (SSE) für Streaming-Antworten und standardmäßiges Function Calling für Agent-Workflows.

Keine Hardware nötig

Greife über das Internet auf unsere GPU-Server zu. Kein Herunterladen von Gewichten, kein Verwalten von VRAM und keine lokale vLLM-Konfiguration nötig.

Datenschutz zuerst

Prompts werden nicht zum Training verwendet. Melde dich nur mit E-Mail und Passwort an, um sofortigen Zugang zu erhalten.

So funktioniert es

1 / 3

Registrieren

Erstelle ein Konto mit E-Mail und Passwort, um deinen einzigartigen API-Schlüssel sofort zu erhalten.

2 / 3

Client konfigurieren

Setze deine Base URL auf https://api.uncensoredlocalllm.com/v1 und füge deinen API-Schlüssel in dein SDK ein.

3 / 3

Anfragen senden

POST an /v1/chat/completions mit der Modell-ID „uncensored“, um Rohtext-Antworten zu erhalten.

Was Leute damit bauen

  1. Inhaltsgenerierung

    Generiere kreative Fiktion oder Roleplay, ohne dass das Modell aufgrund standardmäßiger Inhaltsrichtlinien verweigert. Ideal für Autoren, die rohe Ausgaben wünschen.

  2. Sicherheitsforschung

    Untersuche Modellgrenzen für Jailbreaks oder sensible Themen ohne künstliche Guardrails, die deine Analyse stören. Zur Nutzung für legale Tests.

  3. Datenannotation

    Verarbeite große Datensätze über die API, um Daten zu kennzeichnen oder zu taggen, ohne dich um Kontextfenster-Limits oder lokale Hardwarebeschränkungen kümmern zu müssen.

  4. Ungefilterte Chatbots

    Erstelle benutzerdefinierte Chat-Schnittstellen, die es Nutzern ermöglichen, jedes Thema frei zu erkunden. Perfekt für Nischen-Communities oder erwachsenenorientierte Anwendungen.

Was ist ein unzensiertes LLM?

Ein unzensiertes LLM ist ein Large Language Model, das so trainiert oder "ablitiert" wurde, dass es Standard-Inhaltsablehnungen entfernt. Während Modelle wie GPT-4 oder Claude möglicherweise Fragen zu kontroverser Politik, NSFW-Themen oder sensiblen Sicherheitsforschungen verweigern, wird ein unzensiertes Modell direkt antworten.

Unser Modell, gekennzeichnet als „unzensiert“, ist ein Open-Weight-Modell, das auf unseren GPU-Servern gehostet wird. Es wurde entwickelt, um Rohausgaben ohne Filterung für die legale erwachsene Nutzung bereitzustellen. Es ist kein GPT, Claude, Gemini, Grok oder DeepSeek. Es ist ein eigenständiges Modell, das für uneingeschränkte Gespräche optimiert ist. Beachte, dass wir zwar Standard-Guardrails entfernen, aber weiterhin sexuellen Inhalt mit Minderjährigen blockieren. Dies macht es ideal für Nutzer, die die Kontrolle über ihre Inhaltsmoderation selbst übernehmen möchten, anstatt sich auf einen Drittanbieter-Filter zu verlassen.

Warum es hosten statt lokal ausführen?

Das lokale Ausführen eines unzensierten LLM erfordert erhebliche Hardware. Du benötest eine GPU mit ausreichend VRAM, um große Gewichte zu laden, und musst den Software-Stack verwalten (z. B. ollama, vLLM). Updates können deine lokale Einrichtung stören, und nicht jeder hat den Platz oder die Leistung für eine dedizierte Maschine.

Unsere gehostete API eliminiert diese Komplexität. Du erhältst sofortigen Zugriff auf ein 100k-Kontextfenster und rohe Modellleistung von jedem Gerät mit Internetverbindung. Du musst keine Multi-Gigabyte-Dateien herunterladen oder dir Gedanken über Hardwarekompatibilität machen. Es ist der schnellste Weg, ablitierte Modelle ohne Infrastruktur-Kopfzerren zu nutzen.

OpenAI-kompatible Endpunkte

Wir bieten einen einzigen, stabilen Endpunkt, der sich exakt wie die OpenAI-API verhält. Das bedeutet, dass du deinen bestehenden Code mit minimalen Änderungen nutzen kannst. Der primäre Endpunkt ist POST /v1/chat/completions, der Streaming über Server-Sent Events (SSE) und standardmäßiges Tool-/Function Calling unterstützt. Wir bieten auch GET /v1/models an, um verfügbare Modelle aufzulisten.

Wir bieten keine Embeddings, Bild-, Audio- oder Videoerstellung an. Wenn du diese benötigst, musst du einen anderen Dienst nutzen. Unser Fokus liegt ausschließlich auf Textvervollständigung und Chat. Die Base URL ist https://api.uncensoredlocalllm.com/v1. Du kannst die offiziellen OpenAI SDKs nutzen, indem du sie einfach auf diese Base URL zeigst und deinen API-Schlüssel angibst.

Preise & Keine versteckten Gebühren

Unsere Preisgestaltung ist transparent und Pay as you go. Du zahlst $0,25 pro 1M Input-Token und $1,00 pro 1M Output-Token. Es gibt keine monatlichen Gebühren, keine Abonnements und keine versteckten Kosten. Dein Prepaid-Guthaben verfällt nie. Du kannst ab $10 mit Krypto (USDT oder USDC) aufladen. Wir bieten auch Bonusguthaben: +5% bei $50 und +10% bei $100.

Neue Konten erhalten $0,50 an Testguthaben, das 7 Tage gültig ist. Es wird keine Kreditkarte benötigt, um zu starten. Die Limits liegen bei 300 Anfragen pro Minute pro Schlüssel und einem 8 MB großen Request-Body. Jedes Konto erhält einen API-Schlüssel, den du jederzeit regenerieren kannst, um den alten zu widerrufen.

Fragen und Antworten

Ist das dasselbe wie GPT-4 oder Claude?

Nein. Unser Modell ist ein Open-Weight-Modell, das sich von GPT, Claude, Gemini, Grok oder DeepSeek unterscheidet. Es wurde speziell für unzensierte Ausgaben angepasst und teilt nicht die gleiche Architektur oder Trainingsdaten wie diese proprietären Modelle. Es ist KEIN GPT, Claude, Gemini, Grok, DeepSeek oder ein Modell eines anderen Anbieters.

Speichert ihr meine Prompts?

Wir verwenden deine Prompts nicht zum Training. Deine Datenschutzrechte werden respektiert. Du benötigst nur eine E-Mail und ein Passwort, um dich anzumelden, und dein API-Schlüssel wird sofort generiert, ohne dass eine Kreditkarte erforderlich ist.

Wie groß ist das Kontextfenster?

Unsere API unterstützt ein Kontextfenster mit 100.000 Token sowohl für Prompt als auch für Completion. Dies ermöglicht es dir, große Dokumente zu verarbeiten oder lange Konversationsverläufe beizubehalten, ohne die Limits zu erreichen, die bei kleineren Modellen üblich sind.

Kann ich das für NSFW-Inhalte verwenden?

Ja. Das Modell ist unzensiert und beantwortet legale Erwachsenenthemen ohne Verweigerung. Wir enforcing jedoch eine harte Inhaltsgrenze: Sexuelle Inhalte mit Minderjährigen werden immer blockiert. Alle anderen Erwachseneninhalte sind erlaubt.

Bietet ihr Bilderstellung oder Embeddings an?

Nein. Wir bieten nur textbasierte Chat-Completions an. Wir stellen keine Embeddings, Bild-, Audio- oder Videoerstellung bereit. Wenn du diese Funktionen benötigst, solltest du einen anderen Dienst nutzen. Unsere API ist strikt für Texteingabe und -ausgabe.

uncensoredlocalllm.com

Dein Schlüssel ist nur ein Formular entfernt

Erstelle ein Konto, kopiere den Schlüssel, ändere die Base URL. Das ist die gesamte Einrichtung.