ID ▾
Dapatkan kunci API

uncensoredlocalllm.comDokumentasi

Integrasikan API Uncensored Local LLM

Integrasikan API Uncensored Local LLM dengan mengarahkan klien kompatibel OpenAI Anda ke endpoint yang dihosting kami. Anda mendapatkan jendela konteks 100k, dukungan streaming, dan output model mentah tanpa mengelola infrastruktur GPU lokal.

URL dasar
https://api.uncensoredlocalllm.com/v1
Model
tanpa sensor

URL Dasar dan Autentikasi

API kami sepenuhnya kompatibel dengan SDK OpenAI. Anda hanya perlu memperbarui base_url dan menyediakan kunci API Anda. Daftar di halaman Dapatkan kunci API untuk menerima kunci Anda secara instan. Tidak diperlukan nomor telepon atau kartu kredit untuk memulai dengan kredit uji coba. Base URL adalah https://api.uncensoredlocalllm.com/v1. Jaga kunci Anda dengan aman; Anda dapat membuat ulang kunci tersebut kapan saja, yang secara instan mencabut kunci lama. Ini memastikan Anda selalu memiliki endpoint tunggal yang stabil untuk aplikasi Anda tanpa kompleksitas manajemen inferensi lokal.

Permintaan Pertama

Lakukan panggilan API pertama Anda menggunakan klien HTTP pilihan Anda. Endpoint ini mendukung format chat-completions standar. Di bawah ini adalah contoh cURL yang menunjukkan permintaan dasar. Ganti YOUR_API_KEY dengan kunci Anda yang sebenarnya. Permintaan ini mengirimkan prompt dan mengharapkan respons teks. ID model adalah uncensored. Model bobot terbuka ini disetel untuk menjawab tanpa penolakan konten untuk penggunaan dewasa yang sah, memberikan output langsung untuk kasus penggunaan Anda.

curl https://api.uncensoredlocalllm.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Respons akan berisi teks yang dihasilkan dalam array choices. Jika Anda mengalami kesalahan 401, kunci API Anda tidak valid atau hilang. Pastikan Anda menggunakan URL dasar yang benar dan bahwa kunci Anda belum dicabut setelah pembuatan ulang.

Integrasi SDK Python

Gunakan SDK Python OpenAI resmi untuk integrasi cepat. Atur base_url dan api_key dalam inisialisasi klien Anda. Pendekatan ini memungkinkan Anda menggunakan metode yang sudah familiar seperti chat.completions.create(). SDK menangani serialisasi JSON dan permintaan HTTP secara otomatis. Ini sangat ideal untuk layanan backend atau skrip yang perlu memproses jumlah teks besar. Ingatlah bahwa ID model tetap uncensored terlepas dari versi SDK yang Anda gunakan.

from openai import OpenAI

client = OpenAI(base_url="https://api.uncensoredlocalllm.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Metode ini efisien untuk pemrosesan batch atau ketika Anda perlu menangani logika respons di Python. Pastikan lingkungan Anda memiliki paket openai yang terinstal. SDK mendukung operasi sinkron dan asinkron, sesuai dengan berbagai kebutuhan arsitektur.

Integrasi SDK Node

Untuk lingkungan JavaScript atau TypeScript, SDK Node OpenAI memberikan pengalaman yang serupa. Inisialisasi klien dengan base URL dan kunci API Anda. Ini sangat berguna untuk aplikasi web atau fungsi serverless. SDK mengabstraksi detail HTTP, memungkinkan Anda fokus pada logika aplikasi. Anda dapat memanggil endpoint completions dengan struktur yang sama dengan layanan yang kompatibel dengan OpenAI lainnya.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.uncensoredlocalllm.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Gunakan integrasi ini untuk antarmuka web waktu nyata atau mikro layanan Node.js. SDK mendukung pola janji dan async/await, membuat penanganan kesalahan menjadi sederhana. Pastikan Anda menangani kesalahan jaringan potensial secara halus, terutama dalam sistem terdistribusi.

Respons Streaming

Aktifkan streaming dengan mengatur stream: true dalam permintaan Anda. Ini memungkinkan Anda menerima respons parsial saat dihasilkan, meningkatkan latensi yang dirasakan bagi pengguna. API mendukung Server-Sent Events (SSE) untuk streaming. Ini sangat penting untuk antarmuka obrolan di mana umpan balik segera diharapkan. Streaming tidak memengaruhi kualitas output model atau jendela konteks.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Tangani peristiwa stream dalam kode klien Anda. Setiap bagian berisi sebagian dari respons akhir. Kumpulkan bagian-bagian ini untuk membangun kembali pesan lengkap. Pendekatan ini bekerja dengan mulus dengan SDK OpenAI di Python dan Node.js.

Batas Laju, Kesalahan, dan Jendela Konteks

API memberlakukan batas 300 permintaan per menit per kunci. Ukuran badan permintaan maksimum adalah 8 MB. Anda akan menerima error 429 jika melebihi batas laju. Error 402 menunjukkan saldo prabayar tidak mencukupi. Pastikan Anda memantau penggunaan Anda dan mengisi saldo akun melalui dasbor. Saldo tidak kedaluwarsa, dan Anda dapat membayar dengan kripto (USDT atau USDC).

Jendela konteks adalah 100.000 token, mencakup prompt dan completion. Hal ini memungkinkan percakapan yang panjang atau pemrosesan dokumen besar. Jika Anda melebihi batas, API akan menolak permintaan. ID model adalah uncensored, dan mendukung pemanggilan fungsi/alat untuk kemampuan yang lebih luas.

Spesifikasi API

Semua batas dan fitur API yang sebenarnya di satu tempat — cek dulu sebelum isi saldo.

ItemNilai
Formatkompatibel OpenAI: SDK OpenAI apa pun bisa dipakai, cukup ganti base URL dan kunci
ID modeluncensored
EndpointPOST /v1/chat/completions · GET /v1/models
AutentikasiAuthorization: Bearer YOUR_KEY
Base URLhttps://api.uncensoredlocalllm.com/v1
Function callingya — tools, tool_choice; balasan berisi tool_calls, juga saat streaming; hasil dikirim sebagai role: tool
Parametertemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Jendela konteks100.000 token (input + output)
Output maksimalhingga sisa jendela 100.000 token; max_tokens opsional (tanpa batas terpisah)
Mode JSONresponse_format: {"type": "json_object"}
Streamingya — server-sent events; potongan terakhir berisi penggunaan token
Ukuran permintaanhingga 8 MB
Header responsX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Konkurensi8 permintaan bersamaan per kunci
Batas laju300 permintaan per menit per kunci
Bonus+5% mulai $50, +10% mulai $100
Isi saldoUSDT (TRC20) atau USDC (Base), nominal bulat berapa pun dari $10 sampai $500
Harga$0,25 per 1 juta token input · $1,00 per 1 juta token output
Uji coba gratis$0,50 selama 7 hari, tanpa kartu · Kunci uji coba: 2 permintaan paralel, 60 per menit; batas penuh (8 dan 300) setelah isi saldo pertama
Penagihansaldo prabayar sesuai pemakaian nyata; error dan penolakan gratis
Masa berlakusaldo berbayar tidak kedaluwarsa, tanpa langganan
MasukGoogle atau email dan kata sandi
Kuncisatu kunci aktif per akun; kunci baru menggantikan yang lama
Kontenkonten dewasa diizinkan; konten seksual yang melibatkan anak di bawah umur ditolak

Kode error

Error dikirim sebagai JSON dengan type tetap; permintaan gagal atau ditolak tidak ditagih.

KodeTipeArti
400bad_requestJSON tidak valid, pesan kosong, parameter salah, atau konteks terlalu panjang
401missing_key · invalid_key · key_revokedkunci tidak ada, salah, atau sudah diganti
402no_creditsaldo habis — isi ulang dan lanjut seketika
403content_blockedkonten seksual dengan anak di bawah umur — ditolak, tidak ditagih
404not_foundendpoint tidak dikenal
413request_too_largebody lebih dari 8 MB
429rate_limited · concurrencylebih dari 300/menit atau 8 paralel — tunggu lalu coba lagi
503upstream_busymodel sibuk — coba lagi beberapa detik lagi

Tanya jawab

Berapa ukuran jendela konteks?

API mendukung jendela konteks 100.000 token, yang mencakup prompt input dan completion output. Hal ini memungkinkan percakapan yang panjang atau pemrosesan dokumen besar dalam satu permintaan.

Bagaimana cara menangani respons streaming?

Atur <code>stream: true</code> dalam permintaan Anda untuk menerima Server-Sent Events (SSE). SDK OpenAI di Python dan Node.js menangani streaming secara otomatis ketika bendera ini diaktifkan. Anda kemudian dapat memproses setiap bagian saat tiba.

Apa yang terjadi jika kredit habis?

Anda akan menerima kesalahan <code>402</code> yang menunjukkan tidak ada kredit yang tersedia. Anda dapat mengisi saldo akun Anda dengan minimal $10 menggunakan kripto (USDT atau USDC). Kredit tidak pernah kedaluwarsa, dan bonus diterapkan untuk pengisian yang lebih besar.

uncensoredlocalllm.com

Kunci Anda hanya selangkah lagi dari satu formulir

Buat akun, salin kuncinya, ubah URL dasar. Itu saja seluruh pengaturannya.