Integra la API de Uncensored Local LLM
Integra la API de Uncensored Local LLM apuntando tu cliente compatible con OpenAI a nuestro endpoint. Obtienes una ventana de contexto de 100k tokens, soporte de streaming y salidas del modelo sin gestionar infraestructura de GPU local.
- URL base
- https://api.uncensoredlocalllm.com/v1
- Modelo
- sin censura
URL base y autenticación
Nuestra API es totalmente compatible con los SDKs de OpenAI. Solo necesitas actualizar el base_url y proporcionar tu clave de API. Regístrate en la página Obtener clave de API para recibir tu clave de inmediato. No se requiere número de teléfono ni tarjeta de crédito para comenzar con el crédito de prueba. La URL base es https://api.uncensoredlocalllm.com/v1. Mantén tu clave segura; puedes regenerarla en cualquier momento, lo que revoca instantáneamente la anterior. Esto asegura que siempre tengas un único endpoint estable para tus aplicaciones sin la complejidad de gestionar inferencias locales.
Primera petición
Realiza tu primera llamada a la API usando tu cliente HTTP preferido. El endpoint admite el formato estándar chat-completions. A continuación se muestra un ejemplo con cURL que demuestra una petición básica. Reemplaza YOUR_API_KEY con tu clave real. Esta petición envía un prompt y espera una respuesta de texto. El id del modelo es uncensored. Este modelo de pesos abiertos está ajustado para responder sin rechazos de contenido para uso adulto lícito, proporcionando salidas directas para tu caso de uso.
curl https://api.uncensoredlocalllm.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
La respuesta contendrá el texto generado en la matriz choices. Si encuentras un error 401, tu clave de API es inválida o falta. Asegúrate de estar usando la URL base correcta y que tu clave no haya sido revocada después de la regeneración.
Integración con SDK de Python
Usa el SDK oficial de Python de OpenAI para integrar rápidamente. Establece el base_url y el api_key en la inicialización de tu cliente. Este enfoque te permite usar métodos familiares como chat.completions.create(). El SDK maneja la serialización JSON y las peticiones HTTP automáticamente. Esto es ideal para servicios backend o scripts que necesitan procesar grandes cantidades de texto. Recuerda que el id del modelo sigue siendo uncensored independientemente de la versión del SDK que uses.
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredlocalllm.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Este método es eficiente para procesamiento por lotes o cuando necesitas manejar la lógica de respuesta en Python. Asegúrate de que tu entorno tenga el paquete openai instalado. El SDK admite operaciones tanto sincrónicas como asíncronas, adaptándose a diversas necesidades arquitectónicas.
Integración con SDK de Node.js
Para entornos JavaScript o TypeScript, el SDK de Node.js de OpenAI proporciona una experiencia similar. Inicializa el cliente con tu URL base y clave de API. Esto es particularmente útil para aplicaciones web o funciones serverless. El SDK abstrae los detalles HTTP, permitiéndote centrarte en la lógica de la aplicación. Puedes llamar al endpoint de completions con la misma estructura que otros servicios compatibles con OpenAI.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredlocalllm.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Usa esta integración para interfaces web en tiempo real o microservicios en Node.js. El SDK admite promesas y patrones async/await, facilitando el manejo de errores. Asegúrate de manejar los errores de red de manera elegante, especialmente en sistemas distribuidos.
Respuestas en streaming
Habilita el streaming estableciendo stream: true en tu petición. Esto te permite recibir respuestas parciales a medida que se generan, mejorando la latencia percibida para los usuarios. La API admite Eventos Enviados por Servidor (SSE) para streaming. Esto es crucial para interfaces de chat donde se espera retroalimentación inmediata. El streaming no afecta la calidad de salida del modelo ni la ventana de contexto.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Maneja los eventos del stream en el código de tu cliente. Cada fragmento contiene una parte de la respuesta final. Agrrega estos fragmentos para reconstruir el mensaje completo. Este enfoque funciona sin problemas con los SDKs de OpenAI tanto en Python como en Node.js.
Límites de peticiones, errores y ventana de contexto
La API impone un límite de 300 peticiones por minuto por clave. El tamaño máximo del cuerpo de la petición es de 8 MB. Recibirás un error 429 si excedes el límite de tasa. Un error 402 indica crédito prepago insuficiente. Asegúrate de monitorear tu uso y recargar tu cuenta a través del panel. El crédito no caduca y puedes pagar con criptomonedas (USDT o USDC).
La ventana de contexto es de 100.000 tokens, cubriendo tanto el prompt como la finalización. Esto permite conversaciones extensas o procesamiento de documentos grandes. Si excedes el límite, la API rechazará la petición. El id del modelo es uncensored, y admite tool/function calling para capacidades extendidas.
Ficha técnica de la API
Todos los límites y funciones reales de la API en un solo lugar: revísalos antes de recargar.
| Elemento | Valor |
|---|---|
| Formato | compatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave |
| ID del modelo | uncensored |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Autenticación | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.uncensoredlocalllm.com/v1 |
| Llamadas a funciones | sí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool |
| Parámetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Ventana de contexto | 100.000 tokens (entrada + salida) |
| Salida máxima | hasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte) |
| Modo JSON | response_format: {"type": "json_object"} |
| Streaming | sí: server-sent events; el último fragmento incluye el uso de tokens |
| Tamaño de petición | hasta 8 MB |
| Cabeceras | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Concurrencia | 8 peticiones a la vez por clave |
| Límite de peticiones | 300 por minuto por clave |
| Bono | +5 % desde $50, +10 % desde $100 |
| Recarga | USDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500 |
| Precio | $0,25 por 1M tokens de entrada · $1,00 por 1M de salida |
| Prueba gratis | $0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga |
| Facturación | crédito prepago por uso real; errores y rechazos no se cobran |
| Caducidad | el crédito pagado no caduca, sin suscripción |
| Acceso | Google o correo y contraseña |
| Claves | una clave activa por cuenta; una nueva reemplaza a la anterior |
| Contenido | contenido adulto permitido; se rechaza el contenido sexual con menores |
Errores y qué hacer
Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo |
401 | missing_key · invalid_key · key_revoked | falta la clave, es incorrecta o fue reemplazada |
402 | no_credit | sin crédito: recarga y sigue al instante |
403 | content_blocked | contenido sexual con menores: rechazado, no se cobra |
404 | not_found | endpoint desconocido |
413 | request_too_large | cuerpo mayor de 8 MB |
429 | rate_limited · concurrency | más de 300/min o 8 en paralelo: espera y reintenta |
503 | upstream_busy | modelo ocupado: reintenta en unos segundos |
Preguntas y respuestas
¿Cuál es el tamaño de la ventana de contexto?
La API admite una ventana de contexto de 100.000 tokens, que incluye tanto el prompt de entrada como la respuesta generada. Esto permite conversaciones extensas o el procesamiento de documentos grandes en una sola petición.
¿Cómo manejo las respuestas en streaming?
Establece <code>stream: true</code> en tu petición para recibir Eventos Enviados por Servidor (SSE). Los SDKs de OpenAI en Python y Node.js manejan el streaming automáticamente cuando esta opción está habilitada. Luego puedes procesar cada fragmento a medida que llega.
¿Qué sucede si me quedo sin crédito?
Recibirás un error <code>402</code> indicando que no hay crédito disponible. Puedes recargar tu cuenta con tan solo $10 usando criptomonedas (USDT o USDC). Los créditos no caducan y se aplican bonificaciones por recargas mayores.
uncensoredlocalllm.com
Tu clave está a un formulario de distancia
Crea una cuenta, copia la clave, cambia la URL base. Eso es toda la configuración.