ES ▾
Obtener clave de API

uncensoredlocalllm.comDocs

Integra la API de Uncensored Local LLM

Integra la API de Uncensored Local LLM apuntando tu cliente compatible con OpenAI a nuestro endpoint. Obtienes una ventana de contexto de 100k tokens, soporte de streaming y salidas del modelo sin gestionar infraestructura de GPU local.

URL base
https://api.uncensoredlocalllm.com/v1
Modelo
sin censura

URL base y autenticación

Nuestra API es totalmente compatible con los SDKs de OpenAI. Solo necesitas actualizar el base_url y proporcionar tu clave de API. Regístrate en la página Obtener clave de API para recibir tu clave de inmediato. No se requiere número de teléfono ni tarjeta de crédito para comenzar con el crédito de prueba. La URL base es https://api.uncensoredlocalllm.com/v1. Mantén tu clave segura; puedes regenerarla en cualquier momento, lo que revoca instantáneamente la anterior. Esto asegura que siempre tengas un único endpoint estable para tus aplicaciones sin la complejidad de gestionar inferencias locales.

Primera petición

Realiza tu primera llamada a la API usando tu cliente HTTP preferido. El endpoint admite el formato estándar chat-completions. A continuación se muestra un ejemplo con cURL que demuestra una petición básica. Reemplaza YOUR_API_KEY con tu clave real. Esta petición envía un prompt y espera una respuesta de texto. El id del modelo es uncensored. Este modelo de pesos abiertos está ajustado para responder sin rechazos de contenido para uso adulto lícito, proporcionando salidas directas para tu caso de uso.

curl https://api.uncensoredlocalllm.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

La respuesta contendrá el texto generado en la matriz choices. Si encuentras un error 401, tu clave de API es inválida o falta. Asegúrate de estar usando la URL base correcta y que tu clave no haya sido revocada después de la regeneración.

Integración con SDK de Python

Usa el SDK oficial de Python de OpenAI para integrar rápidamente. Establece el base_url y el api_key en la inicialización de tu cliente. Este enfoque te permite usar métodos familiares como chat.completions.create(). El SDK maneja la serialización JSON y las peticiones HTTP automáticamente. Esto es ideal para servicios backend o scripts que necesitan procesar grandes cantidades de texto. Recuerda que el id del modelo sigue siendo uncensored independientemente de la versión del SDK que uses.

from openai import OpenAI

client = OpenAI(base_url="https://api.uncensoredlocalllm.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Este método es eficiente para procesamiento por lotes o cuando necesitas manejar la lógica de respuesta en Python. Asegúrate de que tu entorno tenga el paquete openai instalado. El SDK admite operaciones tanto sincrónicas como asíncronas, adaptándose a diversas necesidades arquitectónicas.

Integración con SDK de Node.js

Para entornos JavaScript o TypeScript, el SDK de Node.js de OpenAI proporciona una experiencia similar. Inicializa el cliente con tu URL base y clave de API. Esto es particularmente útil para aplicaciones web o funciones serverless. El SDK abstrae los detalles HTTP, permitiéndote centrarte en la lógica de la aplicación. Puedes llamar al endpoint de completions con la misma estructura que otros servicios compatibles con OpenAI.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.uncensoredlocalllm.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Usa esta integración para interfaces web en tiempo real o microservicios en Node.js. El SDK admite promesas y patrones async/await, facilitando el manejo de errores. Asegúrate de manejar los errores de red de manera elegante, especialmente en sistemas distribuidos.

Respuestas en streaming

Habilita el streaming estableciendo stream: true en tu petición. Esto te permite recibir respuestas parciales a medida que se generan, mejorando la latencia percibida para los usuarios. La API admite Eventos Enviados por Servidor (SSE) para streaming. Esto es crucial para interfaces de chat donde se espera retroalimentación inmediata. El streaming no afecta la calidad de salida del modelo ni la ventana de contexto.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Maneja los eventos del stream en el código de tu cliente. Cada fragmento contiene una parte de la respuesta final. Agrrega estos fragmentos para reconstruir el mensaje completo. Este enfoque funciona sin problemas con los SDKs de OpenAI tanto en Python como en Node.js.

Límites de peticiones, errores y ventana de contexto

La API impone un límite de 300 peticiones por minuto por clave. El tamaño máximo del cuerpo de la petición es de 8 MB. Recibirás un error 429 si excedes el límite de tasa. Un error 402 indica crédito prepago insuficiente. Asegúrate de monitorear tu uso y recargar tu cuenta a través del panel. El crédito no caduca y puedes pagar con criptomonedas (USDT o USDC).

La ventana de contexto es de 100.000 tokens, cubriendo tanto el prompt como la finalización. Esto permite conversaciones extensas o procesamiento de documentos grandes. Si excedes el límite, la API rechazará la petición. El id del modelo es uncensored, y admite tool/function calling para capacidades extendidas.

Ficha técnica de la API

Todos los límites y funciones reales de la API en un solo lugar: revísalos antes de recargar.

ElementoValor
Formatocompatible con OpenAI: cualquier SDK de OpenAI funciona cambiando la base URL y la clave
ID del modelouncensored
EndpointsPOST /v1/chat/completions · GET /v1/models
AutenticaciónAuthorization: Bearer YOUR_KEY
Base URLhttps://api.uncensoredlocalllm.com/v1
Llamadas a funcionessí: tools, tool_choice; la respuesta trae tool_calls, también en streaming; resultados como role: tool
Parámetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Ventana de contexto100.000 tokens (entrada + salida)
Salida máximahasta el resto de la ventana de 100.000 tokens; max_tokens opcional (sin límite aparte)
Modo JSONresponse_format: {"type": "json_object"}
Streamingsí: server-sent events; el último fragmento incluye el uso de tokens
Tamaño de peticiónhasta 8 MB
CabecerasX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Concurrencia8 peticiones a la vez por clave
Límite de peticiones300 por minuto por clave
Bono+5 % desde $50, +10 % desde $100
RecargaUSDT (TRC20) o USDC (Base), cualquier importe entero de $10 a $500
Precio$0,25 por 1M tokens de entrada · $1,00 por 1M de salida
Prueba gratis$0,50 durante 7 días, sin tarjeta · Clave de prueba: 2 solicitudes paralelas, 60 por minuto; límites completos (8 y 300) tras la primera recarga
Facturacióncrédito prepago por uso real; errores y rechazos no se cobran
Caducidadel crédito pagado no caduca, sin suscripción
AccesoGoogle o correo y contraseña
Clavesuna clave activa por cuenta; una nueva reemplaza a la anterior
Contenidocontenido adulto permitido; se rechaza el contenido sexual con menores

Errores y qué hacer

Los errores llegan como JSON con un type fijo; las peticiones fallidas o rechazadas no se cobran.

CódigoTipoSignificado
400bad_requestJSON inválido, mensajes vacíos, parámetro incorrecto o contexto demasiado largo
401missing_key · invalid_key · key_revokedfalta la clave, es incorrecta o fue reemplazada
402no_creditsin crédito: recarga y sigue al instante
403content_blockedcontenido sexual con menores: rechazado, no se cobra
404not_foundendpoint desconocido
413request_too_largecuerpo mayor de 8 MB
429rate_limited · concurrencymás de 300/min o 8 en paralelo: espera y reintenta
503upstream_busymodelo ocupado: reintenta en unos segundos

Preguntas y respuestas

¿Cuál es el tamaño de la ventana de contexto?

La API admite una ventana de contexto de 100.000 tokens, que incluye tanto el prompt de entrada como la respuesta generada. Esto permite conversaciones extensas o el procesamiento de documentos grandes en una sola petición.

¿Cómo manejo las respuestas en streaming?

Establece <code>stream: true</code> en tu petición para recibir Eventos Enviados por Servidor (SSE). Los SDKs de OpenAI en Python y Node.js manejan el streaming automáticamente cuando esta opción está habilitada. Luego puedes procesar cada fragmento a medida que llega.

¿Qué sucede si me quedo sin crédito?

Recibirás un error <code>402</code> indicando que no hay crédito disponible. Puedes recargar tu cuenta con tan solo $10 usando criptomonedas (USDT o USDC). Los créditos no caducan y se aplican bonificaciones por recargas mayores.

uncensoredlocalllm.com

Tu clave está a un formulario de distancia

Crea una cuenta, copia la clave, cambia la URL base. Eso es toda la configuración.