IT ▾
Ottieni la chiave API

uncensoredlocalllm.com

API LLM senza censura

LLM senza censura per sviluppatori

Ottieni output grezzi del modello senza censura tramite un singolo endpoint compatibile con OpenAI senza gestire GPU o infrastrutture di inferenza locali.

  • Finestra di contesto da 100k
  • $0,25 per 1M token di input
  • Nessuna carta necessaria per la prova

Provalo con una sola richiesta

curl https://api.uncensoredlocalllm.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'
per 1M token di input
$0,25
Token di output / 1M
$1,00
contesto di token
100.000
credito di prova
$0,50
richieste al minuto
300

Cosa ottieni

Compatibile con OpenAI

Sostituzione pronta all'uso per i client esistenti. Funziona con gli SDK ufficiali di OpenAI modificando l'URL di base e la chiave API.

Output grezzi

Il modello non rifiuta argomenti adulti leciti, di fantasia o controversi. Fornisce risposte dirette senza filtraggio dei guardrail.

Prezzi semplici

Credito prepagato a consumo. Nessun canone mensile, nessun abbonamento e il credito pagato non scade mai.

Streaming e strumenti

Supporta Server-Sent Events (SSE) per risposte in streaming e chiamata di funzioni/strumenti standard per flussi di lavoro agent.

Nessun hardware necessario

Accedi ai nostri server GPU tramite internet. Non è necessario scaricare i pesi, gestire la VRAM o configurare vLLM localmente.

Privacy prima di tutto

I prompt non vengono utilizzati per l'addestramento. Registrati solo con email e password per ottenere accesso immediato.

Come funziona

1 / 3

Registrati

Crea un account con email e password per ricevere la tua chiave API unica istantaneamente.

2 / 3

Configura client

Imposta il tuo Base URL su https://api.uncensoredlocalllm.com/v1 e inserisci la tua chiave API nel tuo SDK.

3 / 3

Invia richieste

POST a /v1/chat/completions con l'ID modello "uncensored" per ricevere risposte di testo grezzo.

Cosa costruiscono le persone

  1. Generazione di contenuti

    Genera narrativa creativa o roleplay senza che il modello rifiuti in base alle policy standard sui contenuti. Ideale per gli scrittori che vogliono output grezzo.

  2. Ricerca sulla sicurezza

    Sonda i limiti del modello per jailbreak o argomenti sensibili senza che i guardrail artificiali interferiscano con la tua analisi. Usa per test leciti.

  3. Annotazione dati

    Elabora in batch grandi set di dati tramite l'API per etichettare o taggare i dati senza preoccuparti dei limiti della finestra di contesto o dei vincoli dell'hardware locale.

  4. Chatbot senza filtri

    Crea interfacce chat personalizzate che permettono agli utenti di esplorare qualsiasi argomento liberamente. Perfetto per comunità di nicchia o applicazioni orientate agli adulti.

Cos'è un LLM senza censura?

Un LLM senza censura è un modello linguistico di grandi dimensioni che è stato ottimizzato o "abliterato" per rimuovere i rifiuti standard sui contenuti. Mentre modelli come GPT-4 o Claude potrebbero rifiutarsi di rispondere a domande su politica controversa, argomenti NSFW o ricerche di sicurezza sensibili, un modello senza censura risponde direttamente.

Il nostro modello, identificato come "senza censura", è un modello a pesi aperti ospitato sui nostri server GPU. È progettato per fornire output grezzi senza filtri per l'uso adulto legale. Non è GPT, Claude, Gemini, Grok o DeepSeek. È un modello distinto ottimizzato per conversazioni senza restrizioni. Nota che mentre rimuoviamo i guardrail standard, blocciamo ancora i contenuti sessuali che coinvolgono minori. Questo lo rende ideale per gli utenti che vogliono il controllo sulla moderazione dei contenuti invece di affidarsi a un filtro di terze parti.

Perché ospitarlo invece di eseguirlo localmente?

Gestire un LLM locale senza censura richiede hardware significativo. Hai bisogno di una GPU con VRAM sufficiente per caricare i pesi grandi e devi gestire lo stack software (es. ollama, vLLM). Gli aggiornamenti possono rompere la tua configurazione locale e non tutti hanno lo spazio o l'alimentazione per una macchina dedicata.

La nostra API ospitata elimina questa complessità. Ottieni accesso immediato a una finestra di contesto da 100k e alla potenza grezza del modello da qualsiasi dispositivo con una connessione internet. Non devi scaricare file di diversi gigabyte o preoccuparti della compatibilità hardware. È il modo più veloce per iniziare a utilizzare modelli abliterati senza i problemi infrastrutturali.

Endpoint compatibili con OpenAI

Forniamo un singolo endpoint stabile che si comporta esattamente come l'API OpenAI. Questo significa che puoi utilizzare il tuo codice esistente con modifiche minime. L'endpoint principale è POST /v1/chat/completions, che supporta lo streaming tramite Server-Sent Events (SSE) e la chiamata standard di strumenti/funzioni. Forniamo anche GET /v1/models per elencare i modelli disponibili.

Non offriamo embeddings, generazione di immagini, audio o video. Se ne hai bisogno, devi usare un servizio diverso. Il nostro focus è puramente sul completamento del testo e sulla chat. Il Base URL è https://api.uncensoredlocalllm.com/v1. Puoi usare gli SDK ufficiali di OpenAI semplicemente puntandoli a questo Base URL e fornendo la tua chiave API.

Prezzi e nessuna tariffa nascosta

La nostra tariffazione è trasparente e pagamento a consumo. Paghi $0,25 per 1M di token di input e $1,00 per 1M di token di output. Non ci sono canoni mensili, abbonamenti o costi nascosti. Il tuo credito prepagato non scade mai. Puoi ricaricare a partire da $10 usando cripto (USDT o USDC). Offriamo anche crediti bonus: +5% su $50 e +10% su $100.

I nuovi account ricevono $0,50 di credito di prova valido per 7 giorni. Non serve una carta di credito per iniziare. I limiti sono impostati a 300 richieste al minuto per chiave e un corpo della richiesta di 8 MB. Ogni account ottiene una chiave API, che puoi rigenerare in qualsiasi momento per revocare quella vecchia.

Domande e risposte

È lo stesso di GPT-4 o Claude?

No. Il nostro modello è un modello a pesi aperti distinto da GPT, Claude, Gemini, Grok o DeepSeek. È modificato specificamente per output senza censura e non condivide la stessa architettura o dati di addestramento di quei modelli proprietari. NON è GPT, Claude, Gemini, Grok, DeepSeek o il modello di nessun altro fornitore.

Archiviate i miei prompt?

Non utilizziamo i tuoi prompt per l'addestramento. La tua privacy dei dati è rispettata. Hai bisogno solo di un'email e una password per accedere, e la tua chiave API viene generata immediatamente senza richiedere una carta di credito.

Qual è la dimensione della finestra di contesto?

La nostra API supporta una finestra di contesto di 100.000 token sia per il prompt che per il completamento. Questo ti permette di elaborare documenti di grandi dimensioni o mantenere lunghe cronologie di conversazioni senza raggiungere i limiti comuni nei modelli più piccoli.

Posso usarlo per contenuti NSFW?

Sì. Il modello è senza censura e risponderà agli argomenti adulti legali senza rifiuti. Tuttavia, applichiamo un limite rigido ai contenuti: i contenuti sessuali che coinvolgono minori sono sempre bloccati. Tutti gli altri contenuti adulti sono consentiti.

Offrite la generazione di immagini o embeddings?

No. Offriamo solo completamenti di chat basati su testo. Non forniamo embeddings, generazione di immagini, audio o video. Se hai bisogno di quelle funzionalità, dovresti utilizzare un servizio diverso. La nostra API è strettamente per input e output di testo.

uncensoredlocalllm.com

La tua chiave è a un modulo di distanza

Crea un account, copia la chiave, cambia l'URL di base. È tutta la configurazione.