Integra l'API Uncensored Local LLM
Integra l'API Uncensored Local LLM puntando il tuo client compatibile con OpenAI al nostro endpoint. Ottieni una finestra di contesto da 100k, il supporto per lo streaming e output grezzi del modello senza gestire l'infrastruttura GPU locale.
- URL di base
- https://api.uncensoredlocalllm.com/v1
- Modello
- senza censura
URL base e autenticazione
La nostra API è pienamente compatibile con gli SDK di OpenAI. Devi solo aggiornare base_url e fornire la tua chiave API. Iscriviti alla pagina Recupera chiave API per ricevere la tua chiave immediatamente. Non è necessario un numero di telefono o una carta di credito per iniziare con il credito di prova gratuito. L'URL di base è https://api.uncensoredlocalllm.com/v1. Mantieni la tua chiave al sicuro; puoi rigenerarla in qualsiasi momento, revocando istantaneamente quella vecchia. Questo garantisce che tu abbia sempre un singolo endpoint stabile per le tue applicazioni senza la complessità della gestione dell'inferenza locale.
Prima richiesta
Esegui la tua prima chiamata API utilizzando il tuo client HTTP preferito. L'endpoint supporta il formato standard chat-completions. Di seguito è riportato un esempio cURL che dimostra una richiesta di base. Sostituisci YOUR_API_KEY con la tua chiave effettiva. Questa richiesta invia un prompt e si aspetta una risposta testuale. L'ID del modello è uncensored. Questo modello a pesi aperti è ottimizzato per rispondere senza rifiuti di risposta per l'uso adulto legale, fornendo output diretti per il tuo caso d'uso.
curl https://api.uncensoredlocalllm.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
La risposta conterrà il testo generato nell'array choices. Se riscontri un errore 401, la tua chiave API non è valida o mancante. Assicurati di utilizzare l'URL base corretto e che la tua chiave non sia stata revocata dopo la rigenerazione.
Integrazione SDK Python
Utilizza l'SDK Python ufficiale di OpenAI per un'integrazione rapida. Imposta base_url e api_key nell'inizializzazione del tuo client. Questo approccio ti consente di utilizzare metodi familiari come chat.completions.create(). L'SDK gestisce automaticamente la serializzazione JSON e le richieste HTTP. È ideale per servizi backend o script che devono elaborare grandi quantità di testo. Ricorda che l'ID del modello rimane uncensored indipendentemente dalla versione SDK che utilizzi.
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredlocalllm.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Questo metodo è efficiente per l'elaborazione in batch o quando devi gestire la logica di risposta in Python. Assicurati che il tuo ambiente abbia il pacchetto openai installato. L'SDK supporta operazioni sia sincrone che asincrone, adattandosi a varie esigenze architetturali.
Integrazione SDK Node.js
Per ambienti JavaScript o TypeScript, l'SDK Node.js di OpenAI offre un'esperienza simile. Inizializza il client con il tuo URL base e chiave API. Questo è particolarmente utile per applicazioni web o funzioni serverless. L'SDK astrae i dettagli HTTP, permettendoti di concentrarti sulla logica dell'applicazione. Puoi chiamare l'endpoint di completamento con la stessa struttura dei servizi compatibili con OpenAI.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredlocalllm.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Utilizza questa integrazione per interfacce web in tempo reale o microservizi Node.js. L'SDK supporta promesse e modelli async/await, rendendo la gestione degli errori semplice. Assicurati di gestire gli errori di rete in modo elegante, specialmente nei sistemi distribuiti.
Risposte in streaming
Abilita lo streaming impostando stream: true nella tua richiesta. Ciò ti consente di ricevere risposte parziali man mano che vengono generate, migliorando la latenza percepita per gli utenti. L'API supporta Server-Sent Events (SSE) per lo streaming. Questo è cruciale per le interfacce chat dove ci si aspetta un feedback immediato. Lo streaming non influisce sulla qualità dell'output del modello o sulla finestra di contesto.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Gestisci gli eventi di streaming nel codice del tuo client. Ogni frammento contiene una parte della risposta finale. Aggrega questi frammenti per ricostruire il messaggio completo. Questo approccio funziona perfettamente con gli SDK OpenAI sia in Python che in Node.js.
Limiti di richiesta, errori e finestra di contesto
L'API impone un limite di 300 richieste al minuto per chiave. La dimensione massima del corpo della richiesta è di 8 MB. Riceverai un errore 429 se superi il limite di richieste. Un errore 402 indica credito prepagato insufficiente. Assicurati di monitorare il tuo utilizzo e di ricaricare il tuo account tramite la dashboard. Il credito non scade e puoi pagare con criptovalute (USDT o USDC).
La finestra di contesto è di 100.000 token, che coprono sia il prompt che il completamento. Ciò consente conversazioni estese o l'elaborazione di documenti di grandi dimensioni. Se superi il limite, l'API rifiuterà la richiesta. L'ID del modello è uncensored e supporta la chiamata di funzioni per funzionalità estese.
Scheda tecnica dell'API
Tutti i limiti e le funzioni reali dell'API in un unico posto: controllali prima di ricaricare.
| Voce | Valore |
|---|---|
| Formato | compatibile OpenAI: qualsiasi SDK OpenAI funziona cambiando base URL e chiave |
| ID modello | uncensored |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Autenticazione | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.uncensoredlocalllm.com/v1 |
| Function calling | sì — tools, tool_choice; risposte con tool_calls anche in streaming; risultati come role: tool |
| Parametri | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Finestra di contesto | 100.000 token (input + output) |
| Output massimo | fino al resto della finestra di 100.000 token; max_tokens opzionale (nessun limite separato) |
| Modalità JSON | response_format: {"type": "json_object"} |
| Streaming | sì — server-sent events; l'ultimo blocco riporta l'uso dei token |
| Dimensione | fino a 8 MB per richiesta |
| Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Concorrenza | 8 richieste contemporanee per chiave |
| Limite di frequenza | 300 richieste al minuto per chiave |
| Bonus | +5% da $50, +10% da $100 |
| Ricarica | USDT (TRC20) o USDC (Base), qualsiasi importo intero da $10 a $500 |
| Prezzo | $0,25 per 1M token in input · $1,00 per 1M in output |
| Prova gratuita | $0,50 per 7 giorni, senza carta · Chiave di prova: 2 richieste parallele, 60 al minuto; limiti completi (8 e 300) dopo la prima ricarica |
| Fatturazione | credito prepagato in base all'uso reale; errori e rifiuti gratuiti |
| Scadenza | il credito pagato non scade, nessun abbonamento |
| Accesso | Google oppure e-mail e password |
| Chiavi | una chiave attiva per account; una nuova sostituisce la precedente |
| Contenuti | contenuti per adulti consentiti; rifiutati i contenuti sessuali con minori |
Codici di errore
Gli errori arrivano in JSON con un type fisso; le richieste fallite o rifiutate non si pagano.
| Codice | Tipo | Significato |
|---|---|---|
400 | bad_request | JSON non valido, messaggi vuoti, parametro errato o contesto troppo lungo |
401 | missing_key · invalid_key · key_revoked | chiave mancante, errata o sostituita |
402 | no_credit | credito esaurito — ricarica e riparti subito |
403 | content_blocked | contenuti sessuali con minori — rifiutato, non addebitato |
404 | not_found | endpoint sconosciuto |
413 | request_too_large | corpo oltre 8 MB |
429 | rate_limited · concurrency | oltre 300/min o 8 in parallelo — attendi e riprova |
503 | upstream_busy | modello occupato — riprova tra pochi secondi |
Domande e risposte
Qual è la dimensione della finestra di contesto?
L'API supporta una finestra di contesto da 100.000 token, che include sia il prompt di input che il completamento di output. Ciò consente conversazioni estese o l'elaborazione di documenti di grandi dimensioni in una singola richiesta.
Come gestire le risposte in streaming?
Imposta <code>stream: true</code> nella tua richiesta per ricevere gli eventi Server-Sent (SSE). Gli SDK OpenAI in Python e Node.js gestiscono lo streaming automaticamente quando questa opzione è attivata. Puoi quindi elaborare ogni frammento man mano che arriva.
Cosa succede se rimango senza credito?
Riceverai un errore <code>402</code> che indica la mancanza di credito. Puoi ricaricare il tuo account con un minimo di $10 utilizzando criptovalute (USDT o USDC). I crediti non scadono mai e vengono applicati bonus per ricariche più grandi.
uncensoredlocalllm.com
La tua chiave è a un modulo di distanza
Crea un account, copia la chiave, modifica l'URL base. È tutta qui la configurazione.