IT ▾
Ottieni la chiave API

uncensoredlocalllm.comDocs

Integra l'API Uncensored Local LLM

Integra l'API Uncensored Local LLM puntando il tuo client compatibile con OpenAI al nostro endpoint. Ottieni una finestra di contesto da 100k, il supporto per lo streaming e output grezzi del modello senza gestire l'infrastruttura GPU locale.

URL di base
https://api.uncensoredlocalllm.com/v1
Modello
senza censura

URL base e autenticazione

La nostra API è pienamente compatibile con gli SDK di OpenAI. Devi solo aggiornare base_url e fornire la tua chiave API. Iscriviti alla pagina Recupera chiave API per ricevere la tua chiave immediatamente. Non è necessario un numero di telefono o una carta di credito per iniziare con il credito di prova gratuito. L'URL di base è https://api.uncensoredlocalllm.com/v1. Mantieni la tua chiave al sicuro; puoi rigenerarla in qualsiasi momento, revocando istantaneamente quella vecchia. Questo garantisce che tu abbia sempre un singolo endpoint stabile per le tue applicazioni senza la complessità della gestione dell'inferenza locale.

Prima richiesta

Esegui la tua prima chiamata API utilizzando il tuo client HTTP preferito. L'endpoint supporta il formato standard chat-completions. Di seguito è riportato un esempio cURL che dimostra una richiesta di base. Sostituisci YOUR_API_KEY con la tua chiave effettiva. Questa richiesta invia un prompt e si aspetta una risposta testuale. L'ID del modello è uncensored. Questo modello a pesi aperti è ottimizzato per rispondere senza rifiuti di risposta per l'uso adulto legale, fornendo output diretti per il tuo caso d'uso.

curl https://api.uncensoredlocalllm.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

La risposta conterrà il testo generato nell'array choices. Se riscontri un errore 401, la tua chiave API non è valida o mancante. Assicurati di utilizzare l'URL base corretto e che la tua chiave non sia stata revocata dopo la rigenerazione.

Integrazione SDK Python

Utilizza l'SDK Python ufficiale di OpenAI per un'integrazione rapida. Imposta base_url e api_key nell'inizializzazione del tuo client. Questo approccio ti consente di utilizzare metodi familiari come chat.completions.create(). L'SDK gestisce automaticamente la serializzazione JSON e le richieste HTTP. È ideale per servizi backend o script che devono elaborare grandi quantità di testo. Ricorda che l'ID del modello rimane uncensored indipendentemente dalla versione SDK che utilizzi.

from openai import OpenAI

client = OpenAI(base_url="https://api.uncensoredlocalllm.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Questo metodo è efficiente per l'elaborazione in batch o quando devi gestire la logica di risposta in Python. Assicurati che il tuo ambiente abbia il pacchetto openai installato. L'SDK supporta operazioni sia sincrone che asincrone, adattandosi a varie esigenze architetturali.

Integrazione SDK Node.js

Per ambienti JavaScript o TypeScript, l'SDK Node.js di OpenAI offre un'esperienza simile. Inizializza il client con il tuo URL base e chiave API. Questo è particolarmente utile per applicazioni web o funzioni serverless. L'SDK astrae i dettagli HTTP, permettendoti di concentrarti sulla logica dell'applicazione. Puoi chiamare l'endpoint di completamento con la stessa struttura dei servizi compatibili con OpenAI.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.uncensoredlocalllm.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Utilizza questa integrazione per interfacce web in tempo reale o microservizi Node.js. L'SDK supporta promesse e modelli async/await, rendendo la gestione degli errori semplice. Assicurati di gestire gli errori di rete in modo elegante, specialmente nei sistemi distribuiti.

Risposte in streaming

Abilita lo streaming impostando stream: true nella tua richiesta. Ciò ti consente di ricevere risposte parziali man mano che vengono generate, migliorando la latenza percepita per gli utenti. L'API supporta Server-Sent Events (SSE) per lo streaming. Questo è cruciale per le interfacce chat dove ci si aspetta un feedback immediato. Lo streaming non influisce sulla qualità dell'output del modello o sulla finestra di contesto.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Gestisci gli eventi di streaming nel codice del tuo client. Ogni frammento contiene una parte della risposta finale. Aggrega questi frammenti per ricostruire il messaggio completo. Questo approccio funziona perfettamente con gli SDK OpenAI sia in Python che in Node.js.

Limiti di richiesta, errori e finestra di contesto

L'API impone un limite di 300 richieste al minuto per chiave. La dimensione massima del corpo della richiesta è di 8 MB. Riceverai un errore 429 se superi il limite di richieste. Un errore 402 indica credito prepagato insufficiente. Assicurati di monitorare il tuo utilizzo e di ricaricare il tuo account tramite la dashboard. Il credito non scade e puoi pagare con criptovalute (USDT o USDC).

La finestra di contesto è di 100.000 token, che coprono sia il prompt che il completamento. Ciò consente conversazioni estese o l'elaborazione di documenti di grandi dimensioni. Se superi il limite, l'API rifiuterà la richiesta. L'ID del modello è uncensored e supporta la chiamata di funzioni per funzionalità estese.

Scheda tecnica dell'API

Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.

VoceValore
Formatocompatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave
ID modellouncensored
EndpointPOST /v1/chat/completions · GET /v1/models
AutenticazioneAuthorization: Bearer YOUR_KEY
Base URLhttps://api.uncensoredlocalllm.com/v1
Function callingsì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool
Parametritemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Finestra di contesto100.000 token (input + output)
Output massimofino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato)
Modalità JSONresponse_format: {"type": "json_object"}
Streamingsì — server-sent events; l'ultimo blocco riporta l'uso dei token
Dimensionefino a 8 MB per richiesta
HeaderX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Concorrenza8 richieste contemporanee per chiave
Limite di frequenza300 richieste al minuto per chiave
Bonus+5% da $50, +10% da $100
RicaricaUSDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500
Prezzo$0,25 per 1M token in input · $1,00 per 1M in output
Prova gratuita$0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica
Fatturazionecredito prepagato in base all'uso reale; errori e rifiuti gratuiti
Scadenzail credito pagato non scade, nessun abbonamento
AccessoGoogle oppure e-mail e password
Chiaviuna chiave attiva per account; una nuova sostituisce la precedente
Contenuticontenuti per adulti consentiti; rifiutati i contenuti sessuali con minori

Codici di errore

Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.

CodiceTipoSignificato
400bad_requestJSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo
401missing_key · invalid_key · key_revokedchiave mancante, errata o sostituita
402no_creditcredito esaurito — ricarica e riparti subito
403content_blockedcontenuti sessuali con minori — rifiutato, non addebitato
404not_foundendpoint sconosciuto
413request_too_largecorpo oltre 8 MB
429rate_limited · concurrencyoltre 300/min o 8 in parallelo — attendi e riprova
503upstream_busymodello occupato — riprova tra pochi secondi

Domande e risposte

Qual è la dimensione della finestra di contesto?

L'API supporta una finestra di contesto da 100.000 token, che include sia il prompt di input che il completamento di output. Ciò consente conversazioni estese o l'elaborazione di documenti di grandi dimensioni in una singola richiesta.

Come gestire le risposte in streaming?

Imposta <code>stream: true</code> nella tua richiesta per ricevere gli eventi Server-Sent (SSE). Gli SDK OpenAI in Python e Node.js gestiscono lo streaming automaticamente quando questa opzione è attivata. Puoi quindi elaborare ogni frammento man mano che arriva.

Cosa succede se rimango senza credito?

Riceverai un errore <code>402</code> che indica la mancanza di credito. Puoi ricaricare il tuo account con un minimo di $10 utilizzando criptovalute (USDT o USDC). I crediti non scadono mai e vengono applicati bonus per ricariche più grandi.

uncensoredlocalllm.com

La tua chiave è a un modulo di distanza

Crea un account, copia la chiave, modifica l'URL base. È tutta qui la configurazione.