Intégrer l'API Uncensored Local LLM
Intégrez l'API Uncensored Local LLM en pointant votre client compatible OpenAI vers notre endpoint hébergé. Vous bénéficiez d'une fenêtre de contexte de 100k tokens, du support du streaming et des sorties brutes du modèle sans gérer l'infrastructure GPU locale.
- URL de base
- https://api.uncensoredlocalllm.com/v1
- Modèle
- sans censure
URL de base et authentification
Notre API est entièrement compatible avec les SDK OpenAI. Vous devez uniquement mettre à jour base_url et fournir votre clé API. Inscrivez-vous sur la page Obtenir la clé API pour recevoir votre clé immédiatement. Aucun numéro de téléphone ni carte bancaire n'est requis pour commencer avec le crédit d'essai. L'URL de base est https://api.uncensoredlocalllm.com/v1. Gardez votre clé en sécurité ; vous pouvez la régénérer à tout moment, ce qui révoque instantanément l'ancienne. Cela garantit que vous disposez toujours d'un endpoint unique et stable pour vos applications, sans la complexité de la gestion de l'inférence locale.
Première requête
Effectuez votre première requête API avec votre client HTTP préféré. L'endpoint prend en charge le format standard chat-completions. Voici un exemple cURL illustrant une requête basique. Remplacez YOUR_API_KEY par votre clé réelle. Cette requête envoie un prompt et attend une réponse textuelle. L'identifiant du modèle est uncensored. Ce modèle à poids ouverts est optimisé pour répondre sans refus de contenu pour un usage adulte légal, fournissant des sorties directes pour votre cas d'utilisation.
curl https://api.uncensoredlocalllm.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
La réponse contiendra le texte généré dans le tableau choices. Si vous rencontrez une erreur 401, votre clé API est invalide ou manquante. Assurez-vous d'utiliser la bonne URL de base et que votre clé n'a pas été révoquée après sa régénération.
Intégration SDK Python
Utilisez le SDK Python officiel d'OpenAI pour une intégration rapide. Définissez base_url et api_key lors de l'initialisation de votre client. Cette approche vous permet d'utiliser des méthodes familières comme chat.completions.create(). Le SDK gère automatiquement la sérialisation JSON et les requêtes HTTP. C'est idéal pour les services backend ou les scripts qui doivent traiter de grandes quantités de texte. Rappelez-vous que l'identifiant du modèle reste uncensored quelle que soit la version du SDK que vous utilisez.
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredlocalllm.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Cette méthode est efficace pour le traitement par lots ou lorsque vous devez gérer la logique de réponse en Python. Assurez-vous que le package openai est installé dans votre environnement. Le SDK prend en charge les opérations synchrones et asynchrones, s'adaptant à divers besoins architecturaux.
Intégration SDK Node.js
Pour les environnements JavaScript ou TypeScript, le SDK Node.js d'OpenAI offre une expérience similaire. Initialisez le client avec votre URL de base et votre clé API. C'est particulièrement utile pour les applications web ou les fonctions serverless. Le SDK abstrait les détails HTTP, vous permettant de vous concentrer sur la logique de l'application. Vous pouvez appeler l'endpoint de complétions avec la même structure que les autres services compatibles OpenAI.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredlocalllm.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Utilisez cette intégration pour les interfaces web en temps réel ou les microservices Node.js. Le SDK prend en charge les promesses et les motifs async/await, rendant la gestion des erreurs simple. Assurez-vous de gérer les erreurs réseau potentielles de manière élégante, en particulier dans les systèmes distribués.
Réponses en streaming
Activez le streaming en définissant stream: true dans votre requête. Cela vous permet de recevoir des réponses partielles au fur et à mesure de leur génération, améliorant la latence perçue pour les utilisateurs. L'API prend en charge les Server-Sent Events (SSE) pour le streaming. C'est crucial pour les interfaces de chat où un retour immédiat est attendu. Le streaming n'affecte pas la qualité de sortie du modèle ni la fenêtre de contexte.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Gérez les événements de streaming dans le code de votre client. Chaque segment contient une partie de la réponse finale. Agrégez ces segments pour reconstituer le message complet. Cette approche fonctionne sans problème avec les SDK OpenAI en Python et Node.js.
Limites de débit, erreurs et fenêtre de contexte
L'API impose une limite de 300 requêtes par minute par clé. La taille maximale du corps de la requête est de 8 Mo. Vous recevrez une erreur 429 si vous dépassez la limite de débit. Une erreur 402 indique un crédit prépayé insuffisant. Assurez-vous de surveiller votre utilisation et de recharger votre compte via le tableau de bord. Le crédit n'expire pas, et vous pouvez payer avec des cryptomonnaies (USDT ou USDC).
La fenêtre de contexte est de 100 000 tokens, couvrant à la fois le prompt et la complétion. Cela permet des conversations étendues ou le traitement de grands documents. Si vous dépassez la limite, l'API rejettera la requête. L'identifiant du modèle est uncensored, et il prend en charge l'appel de fonctions/outils pour des capacités étendues.
Fiche technique de l'API
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| ID du modèle | uncensored |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Authentification | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.uncensoredlocalllm.com/v1 |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Mode JSON | response_format: {"type": "json_object"} |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Taille | jusqu'à 8 Mo par requête |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Concurrence | 8 requêtes simultanées par clé |
| Limite de débit | 300 requêtes par minute et par clé |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Connexion | Google ou e-mail et mot de passe |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
Erreurs et solutions
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions et réponses
Quelle est la taille de la fenêtre de contexte ?
L'API prend en charge une fenêtre de contexte de 100 000 tokens, incluant à la fois le prompt d'entrée et la complétion de sortie. Cela permet des conversations étendues ou le traitement de grands documents en une seule requête.
Comment gérer les réponses en streaming ?
Définissez <code>stream: true</code> dans votre requête pour recevoir des Server-Sent Events (SSE). Les SDK OpenAI en Python et Node.js gèrent le streaming automatiquement lorsque ce drapeau est activé. Vous pouvez ensuite traiter chaque segment à mesure qu'il arrive.
Que se passe-t-il si je manque de crédit ?
Vous recevrez une erreur <code>402</code> indiquant qu'aucun crédit n'est disponible. Vous pouvez recharger votre compte avec aussi peu que 10 $ en utilisant des cryptomonnaies (USDT ou USDC). Les crédits n'expirent jamais, et des bonus sont appliqués pour les recharges plus importantes.
uncensoredlocalllm.com
Votre clé est à un formulaire de vous
Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.