FR ▾
Obtenir une clé API

uncensoredlocalllm.comDocs

Intégrer l'API Uncensored Local LLM

Intégrez l'API Uncensored Local LLM en pointant votre client compatible OpenAI vers notre endpoint hébergé. Vous bénéficiez d'une fenêtre de contexte de 100k tokens, du support du streaming et des sorties brutes du modèle sans gérer l'infrastructure GPU locale.

URL de base
https://api.uncensoredlocalllm.com/v1
Modèle
sans censure

URL de base et authentification

Notre API est entièrement compatible avec les SDK OpenAI. Vous devez uniquement mettre à jour base_url et fournir votre clé API. Inscrivez-vous sur la page Obtenir la clé API pour recevoir votre clé immédiatement. Aucun numéro de téléphone ni carte bancaire n'est requis pour commencer avec le crédit d'essai. L'URL de base est https://api.uncensoredlocalllm.com/v1. Gardez votre clé en sécurité ; vous pouvez la régénérer à tout moment, ce qui révoque instantanément l'ancienne. Cela garantit que vous disposez toujours d'un endpoint unique et stable pour vos applications, sans la complexité de la gestion de l'inférence locale.

Première requête

Effectuez votre première requête API avec votre client HTTP préféré. L'endpoint prend en charge le format standard chat-completions. Voici un exemple cURL illustrant une requête basique. Remplacez YOUR_API_KEY par votre clé réelle. Cette requête envoie un prompt et attend une réponse textuelle. L'identifiant du modèle est uncensored. Ce modèle à poids ouverts est optimisé pour répondre sans refus de contenu pour un usage adulte légal, fournissant des sorties directes pour votre cas d'utilisation.

curl https://api.uncensoredlocalllm.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

La réponse contiendra le texte généré dans le tableau choices. Si vous rencontrez une erreur 401, votre clé API est invalide ou manquante. Assurez-vous d'utiliser la bonne URL de base et que votre clé n'a pas été révoquée après sa régénération.

Intégration SDK Python

Utilisez le SDK Python officiel d'OpenAI pour une intégration rapide. Définissez base_url et api_key lors de l'initialisation de votre client. Cette approche vous permet d'utiliser des méthodes familières comme chat.completions.create(). Le SDK gère automatiquement la sérialisation JSON et les requêtes HTTP. C'est idéal pour les services backend ou les scripts qui doivent traiter de grandes quantités de texte. Rappelez-vous que l'identifiant du modèle reste uncensored quelle que soit la version du SDK que vous utilisez.

from openai import OpenAI

client = OpenAI(base_url="https://api.uncensoredlocalllm.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Cette méthode est efficace pour le traitement par lots ou lorsque vous devez gérer la logique de réponse en Python. Assurez-vous que le package openai est installé dans votre environnement. Le SDK prend en charge les opérations synchrones et asynchrones, s'adaptant à divers besoins architecturaux.

Intégration SDK Node.js

Pour les environnements JavaScript ou TypeScript, le SDK Node.js d'OpenAI offre une expérience similaire. Initialisez le client avec votre URL de base et votre clé API. C'est particulièrement utile pour les applications web ou les fonctions serverless. Le SDK abstrait les détails HTTP, vous permettant de vous concentrer sur la logique de l'application. Vous pouvez appeler l'endpoint de complétions avec la même structure que les autres services compatibles OpenAI.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.uncensoredlocalllm.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Utilisez cette intégration pour les interfaces web en temps réel ou les microservices Node.js. Le SDK prend en charge les promesses et les motifs async/await, rendant la gestion des erreurs simple. Assurez-vous de gérer les erreurs réseau potentielles de manière élégante, en particulier dans les systèmes distribués.

Réponses en streaming

Activez le streaming en définissant stream: true dans votre requête. Cela vous permet de recevoir des réponses partielles au fur et à mesure de leur génération, améliorant la latence perçue pour les utilisateurs. L'API prend en charge les Server-Sent Events (SSE) pour le streaming. C'est crucial pour les interfaces de chat où un retour immédiat est attendu. Le streaming n'affecte pas la qualité de sortie du modèle ni la fenêtre de contexte.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Gérez les événements de streaming dans le code de votre client. Chaque segment contient une partie de la réponse finale. Agrégez ces segments pour reconstituer le message complet. Cette approche fonctionne sans problème avec les SDK OpenAI en Python et Node.js.

Limites de débit, erreurs et fenêtre de contexte

L'API impose une limite de 300 requêtes par minute par clé. La taille maximale du corps de la requête est de 8 Mo. Vous recevrez une erreur 429 si vous dépassez la limite de débit. Une erreur 402 indique un crédit prépayé insuffisant. Assurez-vous de surveiller votre utilisation et de recharger votre compte via le tableau de bord. Le crédit n'expire pas, et vous pouvez payer avec des cryptomonnaies (USDT ou USDC).

La fenêtre de contexte est de 100 000 tokens, couvrant à la fois le prompt et la complétion. Cela permet des conversations étendues ou le traitement de grands documents. Si vous dépassez la limite, l'API rejettera la requête. L'identifiant du modèle est uncensored, et il prend en charge l'appel de fonctions/outils pour des capacités étendues.

Fiche technique de l'API

Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.

ÉlémentValeur
Formatcompatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé
ID du modèleuncensored
EndpointsPOST /v1/chat/completions · GET /v1/models
AuthentificationAuthorization: Bearer YOUR_KEY
Base URLhttps://api.uncensoredlocalllm.com/v1
Appel de fonctionsoui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool
Paramètrestemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Fenêtre de contexte100 000 tokens (entrée + sortie)
Sortie max.jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct)
Mode JSONresponse_format: {"type": "json_object"}
Streamingoui — server-sent events ; le dernier bloc contient l'usage des tokens
Taillejusqu'à 8 Mo par requête
En-têtesX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Concurrence8 requêtes simultanées par clé
Limite de débit300 requêtes par minute et par clé
Bonus+5 % dès 50 $, +10 % dès 100 $
RechargeUSDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $
Prix0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie
Essai gratuit0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge
Facturationcrédit prépayé selon l'usage réel ; erreurs et refus gratuits
Validitéle crédit payé n'expire jamais, sans abonnement
ConnexionGoogle ou e-mail et mot de passe
Clésune clé active par compte ; une nouvelle remplace l'ancienne
Contenucontenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé

Erreurs et solutions

Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.

CodeTypeSignification
400bad_requestJSON invalide, messages vides, mauvais paramètre ou contexte trop long
401missing_key · invalid_key · key_revokedclé absente, erronée ou remplacée
402no_creditplus de crédit — rechargez, la reprise est immédiate
403content_blockedcontenu sexuel impliquant des mineurs — refusé, non facturé
404not_foundendpoint inconnu
413request_too_largecorps supérieur à 8 Mo
429rate_limited · concurrencyau-delà de 300/min ou 8 en parallèle — patientez
503upstream_busymodèle occupé — réessayez dans quelques secondes

Questions et réponses

Quelle est la taille de la fenêtre de contexte ?

L'API prend en charge une fenêtre de contexte de 100 000 tokens, incluant à la fois le prompt d'entrée et la complétion de sortie. Cela permet des conversations étendues ou le traitement de grands documents en une seule requête.

Comment gérer les réponses en streaming ?

Définissez <code>stream: true</code> dans votre requête pour recevoir des Server-Sent Events (SSE). Les SDK OpenAI en Python et Node.js gèrent le streaming automatiquement lorsque ce drapeau est activé. Vous pouvez ensuite traiter chaque segment à mesure qu'il arrive.

Que se passe-t-il si je manque de crédit ?

Vous recevrez une erreur <code>402</code> indiquant qu'aucun crédit n'est disponible. Vous pouvez recharger votre compte avec aussi peu que 10 $ en utilisant des cryptomonnaies (USDT ou USDC). Les crédits n'expirent jamais, et des bonus sont appliqués pour les recharges plus importantes.

uncensoredlocalllm.com

Votre clé est à un formulaire de vous

Créez un compte, copiez la clé, modifiez l'URL de base. C'est toute la configuration.