PT ▾
Obter chave de API

uncensoredlocalllm.comDocumentação

Integre a API Uncensored Local LLM

Integre a API Uncensored Local LLM apontando seu cliente compatível com OpenAI para nosso endpoint. Você obtém uma janela de contexto de 100k, suporte a streaming e saídas brutas do modelo sem gerenciar infraestrutura local de GPU.

URL base
https://api.uncensoredlocalllm.com/v1
Modelo
sem censura

URL Base e Autenticação

Nossa API é totalmente compatível com os SDKs da OpenAI. Você só precisa atualizar o base_url e fornecer sua chave de API. Crie uma conta na página Obter chave de API para receber sua chave imediatamente. Não é necessário número de telefone ou cartão de crédito para começar com o crédito de teste. A URL base é https://api.uncensoredlocalllm.com/v1. Mantenha sua chave segura; você pode regenerá-la a qualquer momento, o que revoga instantaneamente a anterior. Isso garante que você sempre tenha um endpoint único e estável para suas aplicações, sem a complexidade do gerenciamento de inferência local.

Primeira Requisição

Faça sua primeira chamada de API usando seu cliente HTTP preferido. O endpoint suporta o formato padrão de chat-completions. Abaixo está um exemplo em cURL demonstrando uma requisição básica. Substitua YOUR_API_KEY pela sua chave real. Esta requisição envia um prompt e espera uma resposta de texto. O ID do modelo é uncensored. Este modelo de pesos abertos é ajustado para responder sem recusas de conteúdo para uso adulto lícito, fornecendo saídas diretas para seu caso de uso.

curl https://api.uncensoredlocalllm.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

A resposta conterá o texto gerado no array choices. Se você encontrar um erro 401, sua chave de API é inválida ou está ausente. Certifique-se de estar usando a URL base correta e que sua chave não tenha sido revogada após a regeneração.

Integração com SDK Python

Use o SDK Python oficial da OpenAI para integrar rapidamente. Defina o base_url e o api_key na inicialização do seu cliente. Esta abordagem permite que você use métodos familiares como chat.completions.create(). O SDK lida com a serialização JSON e as requisições HTTP automaticamente. Isso é ideal para serviços de backend ou scripts que precisam processar grandes quantidades de texto. Lembre-se de que o ID do modelo permanece uncensored independentemente da versão do SDK que você usar.

from openai import OpenAI

client = OpenAI(base_url="https://api.uncensoredlocalllm.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Este método é eficiente para processamento em lote ou quando você precisa lidar com a lógica de resposta em Python. Certifique-se de que seu ambiente tenha o pacote openai instalado. O SDK suporta operações síncronas e assíncronas, atendendo a várias necessidades de arquitetura.

Integração com SDK Node.js

Para ambientes JavaScript ou TypeScript, o SDK Node.js da OpenAI oferece uma experiência similar. Inicialize o cliente com sua URL base e chave de API. Isso é particularmente útil para aplicações web ou funções serverless. O SDK abstrai os detalhes HTTP, permitindo que você se concentre na lógica da aplicação. Você pode chamar o endpoint de completions com a mesma estrutura de outros serviços compatíveis com OpenAI.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.uncensoredlocalllm.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Use esta integração para interfaces web em tempo real ou microsserviços Node.js. O SDK suporta promessas e padrões async/await, tornando o tratamento de erros direto. Certifique-se de lidar com erros de rede potenciais de forma elegante, especialmente em sistemas distribuídos.

Respostas em Streaming

Ative o streaming definindo stream: true na sua requisição. Isso permite que você receba respostas parciais conforme são geradas, melhorando a latência percebida para os usuários. A API suporta Server-Sent Events (SSE) para streaming. Isso é crucial para interfaces de chat onde o feedback imediato é esperado. O streaming não afeta a qualidade da saída do modelo ou a janela de contexto.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Lide com os eventos de stream no código do seu cliente. Cada chunk contém uma parte da resposta final. Agregue esses chunks para reconstruir a mensagem completa. Esta abordagem funciona perfeitamente com os SDKs OpenAI em Python e Node.js.

Limites de Requisição, Erros e Janela de Contexto

A API impõe um limite de 300 requisições por minuto por chave. O tamanho máximo do corpo da requisição é 8 MB. Você receberá um erro 429 se exceder o limite de requisições. Um erro 402 indica crédito pré-pago insuficiente. Certifique-se de monitorar seu uso e recarregar sua conta via painel. O crédito nunca expira, e você pode pagar com criptomoedas (USDT ou USDC).

A janela de contexto é de 100.000 tokens, abrangendo tanto o prompt quanto a conclusão. Isso permite conversas extensas ou processamento de documentos grandes. Se você exceder o limite, a API rejeitará a requisição. O ID do modelo é uncensored, e ele suporta chamada de funções/ferramentas para capacidades estendidas.

Ficha técnica da API

Todos os limites e recursos reais da API em um só lugar — confira antes de recarregar.

ItemValor
Formatocompatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave
ID do modelouncensored
EndpointsPOST /v1/chat/completions · GET /v1/models
AutenticaçãoAuthorization: Bearer YOUR_KEY
Base URLhttps://api.uncensoredlocalllm.com/v1
Chamada de funçõessim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool
Parâmetrostemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Janela de contexto100.000 tokens (entrada + saída)
Saída máximaaté o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado)
Modo JSONresponse_format: {"type": "json_object"}
Streamingsim — server-sent events; o último bloco traz o uso de tokens
Tamanhoaté 8 MB por requisição
CabeçalhosX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Concorrência8 requisições ao mesmo tempo por chave
Limite de taxa300 requisições por minuto por chave
Bônus+5% a partir de $50, +10% a partir de $100
RecargaUSDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500
Preço$0,25 por 1M tokens de entrada · $1,00 por 1M de saída
Teste grátis$0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga
Cobrançacrédito pré-pago pelo uso real; erros e recusas são grátis
Validadecrédito pago não expira, sem assinatura
LoginGoogle ou e-mail e senha
Chavesuma chave ativa por conta; uma nova substitui a anterior
Conteúdoconteúdo adulto permitido; conteúdo sexual com menores é recusado

Erros e o que fazer

Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.

CódigoTipoSignificado
400bad_requestJSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais
401missing_key · invalid_key · key_revokedchave ausente, errada ou substituída
402no_creditsem crédito — recarregue e continue na hora
403content_blockedconteúdo sexual com menores — recusado, sem cobrança
404not_foundendpoint desconhecido
413request_too_largecorpo acima de 8 MB
429rate_limited · concurrencyacima de 300/min ou 8 em paralelo — aguarde e tente de novo
503upstream_busymodelo ocupado — tente em alguns segundos

Perguntas e respostas

Qual é o tamanho da janela de contexto?

A API suporta uma janela de contexto de 100.000 tokens, que inclui tanto o prompt de entrada quanto a conclusão gerada. Isso permite conversas extensas ou o processamento de documentos grandes em uma única requisição.

Como lidar com respostas em streaming?

Defina <code>stream: true</code> na sua requisição para receber Eventos Enviados pelo Servidor (SSE). Os SDKs OpenAI em Python e Node.js lidam com o streaming automaticamente quando essa flag está habilitada. Você pode então processar cada chunk conforme ele chega.

O que acontece se eu ficar sem crédito?

Você receberá um erro <code>402</code> indicando que não há crédito disponível. Você pode recarregar sua conta com apenas $10 usando criptomoedas (USDT ou USDC). Os créditos nunca expiram e bônus são aplicados para recargas maiores.

uncensoredlocalllm.com

Sua chave está a um formulário de distância

Crie uma conta, copie a chave, altere a URL base. Essa é toda a configuração.