Compatible OpenAI
Remplacement prêt à l’emploi pour les clients existants. Fonctionne avec les SDK officiels OpenAI en modifiant l'URL de base et la clé API.
API LLM sans censure
Obtenez des sorties brutes du modèle sans censure via un endpoint compatible OpenAI, sans gérer de GPU ni d'infrastructure d'inférence locale.
curl https://api.uncensoredlocalllm.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredlocalllm.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredlocalllm.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Remplacement prêt à l’emploi pour les clients existants. Fonctionne avec les SDK officiels OpenAI en modifiant l'URL de base et la clé API.
Le modèle ne refuse pas les sujets adultes légaux, fictifs ou controversés. Il fournit des réponses directes sans filtrage par garde-fous.
Crédit prépayé paiement à l'usage. Pas de frais mensuels, pas d'abonnement, et le crédit payé n'expire jamais.
Prend en charge les Server-Sent Events (SSE) pour le streaming et l'appel de fonctions standard pour les workflows d'agents.
Accédez à nos serveurs GPU via Internet. Pas besoin de télécharger les poids, de gérer la VRAM ou de configurer vLLM localement.
Les prompts ne sont pas utilisés pour l'entraînement. Inscrivez-vous avec un e-mail et un mot de passe pour obtenir un accès immédiat.
1 / 3
Créez un compte avec e-mail et mot de passe pour recevoir votre clé API unique instantanément.
2 / 3
Définissez votre URL de base sur https://api.uncensoredlocalllm.com/v1 et injectez votre clé API dans votre SDK.
3 / 3
POST vers /v1/chat/completions avec l'identifiant de modèle "uncensored" pour recevoir des réponses textuelles brutes.
Générez de la fiction créative ou du jeu de rôle sans que le modèle ne refuse en fonction des politiques de contenu standard. Idéal pour les auteurs souhaitant des sorties brutes.
Testez les limites du modèle pour les jailbreaks ou les sujets sensibles sans que des garde-fous artificiels n'interfèrent avec votre analyse. À utiliser pour des tests légaux.
Traitez en lot de grands ensembles de données via l'API pour étiqueter ou taguer des données sans vous soucier des limites de fenêtre de contexte ou des contraintes matérielles locales.
Créez des interfaces de chat personnalisées permettant aux utilisateurs d'explorer n'importe quel sujet librement. Parfait pour les communautés de niche ou les applications à orientation adulte.
Un LLM sans censure est un grand modèle de langage qui a été ajusté ou « ablité » pour supprimer les refus de contenu standards. Alors que des modèles comme GPT-4 ou Claude peuvent refuser de répondre à des questions sur la politique controversée, les sujets NSFW ou la recherche en sécurité sensible, un modèle sans curation répondra directement.
Notre modèle, identifié comme « sans censure », est un modèle à poids ouverts hébergé sur nos serveurs GPU. Il est conçu pour fournir des sorties brutes sans filtrage pour une utilisation adulte légale. Il ne s'agit pas de GPT, Claude, Gemini, Grok ou DeepSeek. C'est un modèle distinct optimisé pour une conversation sans restriction. Notez que bien que nous supprimions les garde-fous standard, nous bloquons toujours le contenu sexuel impliquant des mineurs. Cela le rend idéal pour les utilisateurs qui souhaitent contrôler leur modération de contenu plutôt que de dépendre d'un filtre tiers.
Faire tourner un LLM local sans censure vous-même nécessite du matériel important. Vous avez besoin d'un GPU avec suffisamment de VRAM pour charger de grands poids, et vous devez gérer la pile logicielle (par ex. ollama, vLLM). Les mises à jour peuvent casser votre configuration locale, et tout le monde n'a pas l'espace ou la puissance pour une machine dédiée.
Notre API hébergée élimine cette complexité. Vous obtenez un accès immédiat à une fenêtre de contexte de 100k tokens et à la puissance brute du modèle depuis n'importe quel appareil avec une connexion internet. Vous n'avez pas besoin de télécharger des fichiers de plusieurs gigaoctets ni de vous soucier de la compatibilité matérielle. C'est le moyen le plus rapide de commencer à utiliser des modèles ablités sans les tracas de l'infrastructure.
Nous fournissons un endpoint unique et stable qui se comporte exactement comme l'API OpenAI. Cela signifie que vous pouvez utiliser votre code existant avec des modifications minimales. L'endpoint principal est POST /v1/chat/completions, qui prend en charge le streaming via Server-Sent Events (SSE) et l'appel de fonctions standard. Nous fournissons également GET /v1/models pour lister les modèles disponibles.
Nous ne proposons pas d'embeddings, de génération d'images, d'audio ou de vidéo. Si vous en avez besoin, vous devez utiliser un autre service. Notre axe est purement la complétion de texte et le chat. L'URL de base est https://api.uncensoredlocalllm.com/v1. Vous pouvez utiliser les SDK officiels OpenAI en les pointant simplement vers cette URL de base et en fournissant votre clé API.
Notre tarification est transparente et en paiement à l'usage. Vous payez 0,25 $ par 1M de tokens d'entrée et 1,00 $ par 1M de tokens de sortie. Il n'y a pas de frais mensuels, pas d'abonnements et pas de coûts cachés. Votre crédit prépayé n'expire jamais. Vous pouvez recharger à partir de 10 $ en utilisant des cryptomonnaies (USDT ou USDC). Nous offrons également des crédits bonus : +5 % sur 50 $ et +10 % sur 100 $.
Les nouveaux comptes reçoivent 0,50 $ de crédit d'essai valable 7 jours. Aucune carte bancaire n'est nécessaire pour commencer. Les limites sont fixées à 300 requêtes par minute par clé et un corps de requête de 8 Mo. Chaque compte dispose d'une clé API, que vous pouvez régénérer à tout moment pour révoquer l'ancienne.
Non. Notre modèle est un modèle à poids ouverts distinct de GPT, Claude, Gemini, Grok ou DeepSeek. Il est spécifiquement ajusté pour une sortie sans censure et ne partage pas la même architecture ou les mêmes données d'entraînement que ces modèles propriétaires. Il n'est PAS GPT, Claude, Gemini, Grok, DeepSeek ou le modèle d'un autre fournisseur.
Nous n'utilisons pas vos prompts pour l'apprentissage. Votre confidentialité des données est respectée. Vous n'avez besoin que d'un e-mail et d'un mot de passe pour vous inscrire, et votre clé API est générée immédiatement sans nécessiter de carte bancaire.
Notre API prend en charge une fenêtre de contexte de 100 000 tokens pour le prompt et la complétion. Cela vous permet de traiter de grands documents ou de maintenir de longs historiques de conversation sans atteindre les limites courantes des modèles plus petits.
Oui. Le modèle est sans censure et répondra aux sujets adultes légaux sans refus. Cependant, nous appliquons une limite stricte de contenu : le contenu sexuel impliquant des mineurs est toujours bloqué. Tout autre contenu pour adulte est autorisé.
Non. Nous proposons uniquement des complétions de chat textuel. Nous ne fournissons pas d'embeddings, de génération d'images, d'audio ou de vidéo. Si vous avez besoin de ces fonctionnalités, vous devriez utiliser un autre service. Notre API est strictement destinée à l'entrée et à la sortie de texte.
uncensoredlocalllm.com
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.