Integrasikan API Uncensored Local LLM
Integrasikan API Uncensored Local LLM dengan mengarahkan klien kompatibel OpenAI Anda ke endpoint yang dihosting kami. Anda mendapatkan jendela konteks 100k, dukungan streaming, dan output model mentah tanpa mengelola infrastruktur GPU lokal.
- URL dasar
- https://api.uncensoredlocalllm.com/v1
- Model
- tanpa sensor
URL Dasar dan Autentikasi
API kami sepenuhnya kompatibel dengan SDK OpenAI. Anda hanya perlu memperbarui base_url dan menyediakan kunci API Anda. Daftar di halaman Dapatkan kunci API untuk menerima kunci Anda secara instan. Tidak diperlukan nomor telepon atau kartu kredit untuk memulai dengan kredit uji coba. Base URL adalah https://api.uncensoredlocalllm.com/v1. Jaga kunci Anda dengan aman; Anda dapat membuat ulang kunci tersebut kapan saja, yang secara instan mencabut kunci lama. Ini memastikan Anda selalu memiliki endpoint tunggal yang stabil untuk aplikasi Anda tanpa kompleksitas manajemen inferensi lokal.
Permintaan Pertama
Lakukan panggilan API pertama Anda menggunakan klien HTTP pilihan Anda. Endpoint ini mendukung format chat-completions standar. Di bawah ini adalah contoh cURL yang menunjukkan permintaan dasar. Ganti YOUR_API_KEY dengan kunci Anda yang sebenarnya. Permintaan ini mengirimkan prompt dan mengharapkan respons teks. ID model adalah uncensored. Model bobot terbuka ini disetel untuk menjawab tanpa penolakan konten untuk penggunaan dewasa yang sah, memberikan output langsung untuk kasus penggunaan Anda.
curl https://api.uncensoredlocalllm.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
Respons akan berisi teks yang dihasilkan dalam array choices. Jika Anda mengalami kesalahan 401, kunci API Anda tidak valid atau hilang. Pastikan Anda menggunakan URL dasar yang benar dan bahwa kunci Anda belum dicabut setelah pembuatan ulang.
Integrasi SDK Python
Gunakan SDK Python OpenAI resmi untuk integrasi cepat. Atur base_url dan api_key dalam inisialisasi klien Anda. Pendekatan ini memungkinkan Anda menggunakan metode yang sudah familiar seperti chat.completions.create(). SDK menangani serialisasi JSON dan permintaan HTTP secara otomatis. Ini sangat ideal untuk layanan backend atau skrip yang perlu memproses jumlah teks besar. Ingatlah bahwa ID model tetap uncensored terlepas dari versi SDK yang Anda gunakan.
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredlocalllm.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
Metode ini efisien untuk pemrosesan batch atau ketika Anda perlu menangani logika respons di Python. Pastikan lingkungan Anda memiliki paket openai yang terinstal. SDK mendukung operasi sinkron dan asinkron, sesuai dengan berbagai kebutuhan arsitektur.
Integrasi SDK Node
Untuk lingkungan JavaScript atau TypeScript, SDK Node OpenAI memberikan pengalaman yang serupa. Inisialisasi klien dengan base URL dan kunci API Anda. Ini sangat berguna untuk aplikasi web atau fungsi serverless. SDK mengabstraksi detail HTTP, memungkinkan Anda fokus pada logika aplikasi. Anda dapat memanggil endpoint completions dengan struktur yang sama dengan layanan yang kompatibel dengan OpenAI lainnya.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredlocalllm.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
Gunakan integrasi ini untuk antarmuka web waktu nyata atau mikro layanan Node.js. SDK mendukung pola janji dan async/await, membuat penanganan kesalahan menjadi sederhana. Pastikan Anda menangani kesalahan jaringan potensial secara halus, terutama dalam sistem terdistribusi.
Respons Streaming
Aktifkan streaming dengan mengatur stream: true dalam permintaan Anda. Ini memungkinkan Anda menerima respons parsial saat dihasilkan, meningkatkan latensi yang dirasakan bagi pengguna. API mendukung Server-Sent Events (SSE) untuk streaming. Ini sangat penting untuk antarmuka obrolan di mana umpan balik segera diharapkan. Streaming tidak memengaruhi kualitas output model atau jendela konteks.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
Tangani peristiwa stream dalam kode klien Anda. Setiap bagian berisi sebagian dari respons akhir. Kumpulkan bagian-bagian ini untuk membangun kembali pesan lengkap. Pendekatan ini bekerja dengan mulus dengan SDK OpenAI di Python dan Node.js.
Batas Laju, Kesalahan, dan Jendela Konteks
API memberlakukan batas 300 permintaan per menit per kunci. Ukuran badan permintaan maksimum adalah 8 MB. Anda akan menerima error 429 jika melebihi batas laju. Error 402 menunjukkan saldo prabayar tidak mencukupi. Pastikan Anda memantau penggunaan Anda dan mengisi saldo akun melalui dasbor. Saldo tidak kedaluwarsa, dan Anda dapat membayar dengan kripto (USDT atau USDC).
Jendela konteks adalah 100.000 token, mencakup prompt dan completion. Hal ini memungkinkan percakapan yang panjang atau pemrosesan dokumen besar. Jika Anda melebihi batas, API akan menolak permintaan. ID model adalah uncensored, dan mendukung pemanggilan fungsi/alat untuk kemampuan yang lebih luas.
Spesifikasi API
Semua batas dan fitur API yang sebenarnya di satu tempat — cek dulu sebelum isi saldo.
| Item | Nilai |
|---|---|
| Format | kompatibel OpenAI: SDK OpenAI apa pun bisa dipakai, cukup ganti base URL dan kunci |
| ID model | uncensored |
| Endpoint | POST /v1/chat/completions · GET /v1/models |
| Autentikasi | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.uncensoredlocalllm.com/v1 |
| Function calling | ya — tools, tool_choice; balasan berisi tool_calls, juga saat streaming; hasil dikirim sebagai role: tool |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Jendela konteks | 100.000 token (input + output) |
| Output maksimal | hingga sisa jendela 100.000 token; max_tokens opsional (tanpa batas terpisah) |
| Mode JSON | response_format: {"type": "json_object"} |
| Streaming | ya — server-sent events; potongan terakhir berisi penggunaan token |
| Ukuran permintaan | hingga 8 MB |
| Header respons | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Konkurensi | 8 permintaan bersamaan per kunci |
| Batas laju | 300 permintaan per menit per kunci |
| Bonus | +5% mulai $50, +10% mulai $100 |
| Isi saldo | USDT (TRC20) atau USDC (Base), nominal bulat berapa pun dari $10 sampai $500 |
| Harga | $0,25 per 1 juta token input · $1,00 per 1 juta token output |
| Uji coba gratis | $0,50 selama 7 hari, tanpa kartu · Kunci uji coba: 2 permintaan paralel, 60 per menit; batas penuh (8 dan 300) setelah isi saldo pertama |
| Penagihan | saldo prabayar sesuai pemakaian nyata; error dan penolakan gratis |
| Masa berlaku | saldo berbayar tidak kedaluwarsa, tanpa langganan |
| Masuk | Google atau email dan kata sandi |
| Kunci | satu kunci aktif per akun; kunci baru menggantikan yang lama |
| Konten | konten dewasa diizinkan; konten seksual yang melibatkan anak di bawah umur ditolak |
Kode error
Error dikirim sebagai JSON dengan type tetap; permintaan gagal atau ditolak tidak ditagih.
| Kode | Tipe | Arti |
|---|---|---|
400 | bad_request | JSON tidak valid, pesan kosong, parameter salah, atau konteks terlalu panjang |
401 | missing_key · invalid_key · key_revoked | kunci tidak ada, salah, atau sudah diganti |
402 | no_credit | saldo habis — isi ulang dan lanjut seketika |
403 | content_blocked | konten seksual dengan anak di bawah umur — ditolak, tidak ditagih |
404 | not_found | endpoint tidak dikenal |
413 | request_too_large | body lebih dari 8 MB |
429 | rate_limited · concurrency | lebih dari 300/menit atau 8 paralel — tunggu lalu coba lagi |
503 | upstream_busy | model sibuk — coba lagi beberapa detik lagi |
Tanya jawab
Berapa ukuran jendela konteks?
API mendukung jendela konteks 100.000 token, yang mencakup prompt input dan completion output. Hal ini memungkinkan percakapan yang panjang atau pemrosesan dokumen besar dalam satu permintaan.
Bagaimana cara menangani respons streaming?
Atur <code>stream: true</code> dalam permintaan Anda untuk menerima Server-Sent Events (SSE). SDK OpenAI di Python dan Node.js menangani streaming secara otomatis ketika bendera ini diaktifkan. Anda kemudian dapat memproses setiap bagian saat tiba.
Apa yang terjadi jika kredit habis?
Anda akan menerima kesalahan <code>402</code> yang menunjukkan tidak ada kredit yang tersedia. Anda dapat mengisi saldo akun Anda dengan minimal $10 menggunakan kripto (USDT atau USDC). Kredit tidak pernah kedaluwarsa, dan bonus diterapkan untuk pengisian yang lebih besar.
uncensoredlocalllm.com
Kunci Anda hanya selangkah lagi dari satu formulir
Buat akun, salin kuncinya, ubah URL dasar. Itu saja seluruh pengaturannya.