Integre a API Uncensored Local LLM
Integre a API Uncensored Local LLM apontando seu cliente compatível com OpenAI para nosso endpoint. Você obtém uma janela de contexto de 100k, suporte a streaming e saídas brutas do modelo sem gerenciar infraestrutura local de GPU.
- URL base
- https://api.uncensoredlocalllm.com/v1
- Modelo
- sem censura
URL Base e Autenticação
Nossa API é totalmente compatível com os SDKs da OpenAI. Você só precisa atualizar o base_url e fornecer sua chave de API. Crie uma conta na página Obter chave de API para receber sua chave imediatamente. Não é necessário número de telefone ou cartão de crédito para começar com o crédito de teste. A URL base é https://api.uncensoredlocalllm.com/v1. Mantenha sua chave segura; você pode regenerá-la a qualquer momento, o que revoga instantaneamente a anterior. Isso garante que você sempre tenha um endpoint único e estável para suas aplicações, sem a complexidade do gerenciamento de inferência local.
Primeira Requisição
Faça sua primeira chamada de API usando seu cliente HTTP preferido. O endpoint suporta o formato padrão de chat-completions. Abaixo está um exemplo em cURL demonstrando uma requisição básica. Substitua YOUR_API_KEY pela sua chave real. Esta requisição envia um prompt e espera uma resposta de texto. O ID do modelo é uncensored. Este modelo de pesos abertos é ajustado para responder sem recusas de conteúdo para uso adulto lícito, fornecendo saídas diretas para seu caso de uso.
curl https://api.uncensoredlocalllm.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
A resposta conterá o texto gerado no array choices. Se você encontrar um erro 401, sua chave de API é inválida ou está ausente. Certifique-se de estar usando a URL base correta e que sua chave não tenha sido revogada após a regeneração.
Integração com SDK Python
Use o SDK Python oficial da OpenAI para integrar rapidamente. Defina o base_url e o api_key na inicialização do seu cliente. Esta abordagem permite que você use métodos familiares como chat.completions.create(). O SDK lida com a serialização JSON e as requisições HTTP automaticamente. Isso é ideal para serviços de backend ou scripts que precisam processar grandes quantidades de texto. Lembre-se de que o ID do modelo permanece uncensored independentemente da versão do SDK que você usar.
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredlocalllm.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Este método é eficiente para processamento em lote ou quando você precisa lidar com a lógica de resposta em Python. Certifique-se de que seu ambiente tenha o pacote openai instalado. O SDK suporta operações síncronas e assíncronas, atendendo a várias necessidades de arquitetura.
Integração com SDK Node.js
Para ambientes JavaScript ou TypeScript, o SDK Node.js da OpenAI oferece uma experiência similar. Inicialize o cliente com sua URL base e chave de API. Isso é particularmente útil para aplicações web ou funções serverless. O SDK abstrai os detalhes HTTP, permitindo que você se concentre na lógica da aplicação. Você pode chamar o endpoint de completions com a mesma estrutura de outros serviços compatíveis com OpenAI.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredlocalllm.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Use esta integração para interfaces web em tempo real ou microsserviços Node.js. O SDK suporta promessas e padrões async/await, tornando o tratamento de erros direto. Certifique-se de lidar com erros de rede potenciais de forma elegante, especialmente em sistemas distribuídos.
Respostas em Streaming
Ative o streaming definindo stream: true na sua requisição. Isso permite que você receba respostas parciais conforme são geradas, melhorando a latência percebida para os usuários. A API suporta Server-Sent Events (SSE) para streaming. Isso é crucial para interfaces de chat onde o feedback imediato é esperado. O streaming não afeta a qualidade da saída do modelo ou a janela de contexto.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Lide com os eventos de stream no código do seu cliente. Cada chunk contém uma parte da resposta final. Agregue esses chunks para reconstruir a mensagem completa. Esta abordagem funciona perfeitamente com os SDKs OpenAI em Python e Node.js.
Limites de Requisição, Erros e Janela de Contexto
A API impõe um limite de 300 requisições por minuto por chave. O tamanho máximo do corpo da requisição é 8 MB. Você receberá um erro 429 se exceder o limite de requisições. Um erro 402 indica crédito pré-pago insuficiente. Certifique-se de monitorar seu uso e recarregar sua conta via painel. O crédito nunca expira, e você pode pagar com criptomoedas (USDT ou USDC).
A janela de contexto é de 100.000 tokens, abrangendo tanto o prompt quanto a conclusão. Isso permite conversas extensas ou processamento de documentos grandes. Se você exceder o limite, a API rejeitará a requisição. O ID do modelo é uncensored, e ele suporta chamada de funções/ferramentas para capacidades estendidas.
Ficha técnica da API
Todos os limites e recursos reais da API em um só lugar — confira antes de recarregar.
| Item | Valor |
|---|---|
| Formato | compatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave |
| ID do modelo | uncensored |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Autenticação | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.uncensoredlocalllm.com/v1 |
| Chamada de funções | sim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool |
| Parâmetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Janela de contexto | 100.000 tokens (entrada + saída) |
| Saída máxima | até o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado) |
| Modo JSON | response_format: {"type": "json_object"} |
| Streaming | sim — server-sent events; o último bloco traz o uso de tokens |
| Tamanho | até 8 MB por requisição |
| Cabeçalhos | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Concorrência | 8 requisições ao mesmo tempo por chave |
| Limite de taxa | 300 requisições por minuto por chave |
| Bônus | +5% a partir de $50, +10% a partir de $100 |
| Recarga | USDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500 |
| Preço | $0,25 por 1M tokens de entrada · $1,00 por 1M de saída |
| Teste grátis | $0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga |
| Cobrança | crédito pré-pago pelo uso real; erros e recusas são grátis |
| Validade | crédito pago não expira, sem assinatura |
| Login | Google ou e-mail e senha |
| Chaves | uma chave ativa por conta; uma nova substitui a anterior |
| Conteúdo | conteúdo adulto permitido; conteúdo sexual com menores é recusado |
Erros e o que fazer
Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais |
401 | missing_key · invalid_key · key_revoked | chave ausente, errada ou substituída |
402 | no_credit | sem crédito — recarregue e continue na hora |
403 | content_blocked | conteúdo sexual com menores — recusado, sem cobrança |
404 | not_found | endpoint desconhecido |
413 | request_too_large | corpo acima de 8 MB |
429 | rate_limited · concurrency | acima de 300/min ou 8 em paralelo — aguarde e tente de novo |
503 | upstream_busy | modelo ocupado — tente em alguns segundos |
Perguntas e respostas
Qual é o tamanho da janela de contexto?
A API suporta uma janela de contexto de 100.000 tokens, que inclui tanto o prompt de entrada quanto a conclusão gerada. Isso permite conversas extensas ou o processamento de documentos grandes em uma única requisição.
Como lidar com respostas em streaming?
Defina <code>stream: true</code> na sua requisição para receber Eventos Enviados pelo Servidor (SSE). Os SDKs OpenAI em Python e Node.js lidam com o streaming automaticamente quando essa flag está habilitada. Você pode então processar cada chunk conforme ele chega.
O que acontece se eu ficar sem crédito?
Você receberá um erro <code>402</code> indicando que não há crédito disponível. Você pode recarregar sua conta com apenas $10 usando criptomoedas (USDT ou USDC). Os créditos nunca expiram e bônus são aplicados para recargas maiores.
uncensoredlocalllm.com
Sua chave está a um formulário de distância
Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.