整合 Uncensored Local LLM API
透過將你的 OpenAI 相容用戶端指向我們的託管端點來整合 Uncensored Local LLM API。你將獲得 100k 上下文視窗、串流輸出支援,以及無需管理本地 GPU 基礎設施的原始模型輸出。
- Base URL
- https://api.uncensoredlocalllm.com/v1
- 模型
- 無審查
基礎 URL 與驗證
我們的 API 完全相容於 OpenAI SDK。你只需更新 base_url 並提供你的 API 金鑰即可。在 取得 API 金鑰 頁面註冊,即可立即獲得金鑰。開始使用免費試用額度無需電話號碼或信用卡。基礎 URL 為 https://api.uncensoredlocalllm.com/v1。請妥善保管你的金鑰;你可以隨時重新產生金鑰,舊金鑰將立即失效。這確保了你的應用程式始終擁有單一、穩定的端點,無需處理本地推理管理的複雜性。
首次請求
使用你偏好的 HTTP 用戶端進行第一次 API 請求。該端點支援標準 chat-completions 格式。下方是一個 cURL 範例,展示基本請求。請將 YOUR_API_KEY 替換為你的實際金鑰。此請求發送提示詞,並預期獲得文本回應。模型 ID 為 uncensored。此開放權重模型經過調整,能在合法成人用途下無內容拒絕地回答,為你的應用場景提供直接輸出。
curl https://api.uncensoredlocalllm.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
回應將包含 choices 陣列中的生成文本。如果你遇到 401 錯誤,表示你的 API 金鑰無效或缺失。確保你使用正確的 Base URL,且你的金鑰在重新產生後未被撤銷。
Python SDK 整合
使用官方 OpenAI Python SDK 可快速整合。在客戶端初始化時設定 base_url 與 api_key。此方法可讓你使用熟悉的函式,例如 chat.completions.create()。SDK 會自動處理 JSON 序列化與 HTTP 請求。這非常適合需要處理大量文字的後端服務或腳本。請記住,無論使用哪個 SDK 版本,模型 ID 仍為 uncensored。
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredlocalllm.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
此方法對於批次處理或在 Python 中處理回應邏輯非常有效。確保你的環境已安裝 openai 套件。SDK 支援同步和非同步操作,適合各種架構需求。
Node SDK 整合
對於 JavaScript 或 TypeScript 環境,OpenAI Node SDK 提供了類似的體驗。使用你的基礎 URL 和 API 金鑰初始化客戶端。這對於 Web 應用程式或無伺服器函式特別有用。SDK 抽象化了 HTTP 細節,讓你可以專注於應用程式邏輯。你可以使用與其他 OpenAI 相容服務相同的結構呼叫完成端點。
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredlocalllm.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
對於即時 Web 介面或 Node.js 微服務,請使用此整合。SDK 支援 promises 和 async/await 模式,使錯誤處理變得簡單。確保以優雅的方式處理潛在的網路錯誤,特別是在分散式系統中。
串流輸出回應
在請求中設定 stream: true 以啟用串流輸出。這允許你接收生成的部分回應,改善用戶的感知延遲。API 支援伺服器發送的事件 (SSE) 進行串流輸出。這對於預期立即回饋的聊天介面至關重要。串流輸出不會影響模型的輸出品質或上下文視窗。
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
在客戶端程式碼中處理串流輸出事件。每個區塊包含最終回應的一部分。聚合這些區塊以重建完整訊息。此方法與 Python 和 Node.js 中的 OpenAI SDK 無縫協作。
速率限制、錯誤與上下文視窗
API 對每個金鑰實施每分鐘 300 次請求的限制。最大請求主體大小為 8 MB。如果超過速率限制,你將收到 429 錯誤。402 錯誤表示預付額度不足。請確保監控你的使用情況,並透過儀表板為帳戶儲值。額度不會過期,你可以使用加密貨幣(USDT 或 USDC)付款。
上下文視窗為 100,000 token,涵蓋提示詞和補全。這允許進行廣泛的對話或處理大型文件。如果你超過限制,API 將拒絕請求。模型 ID 為 uncensored,並支援工具/函式呼叫以擴展功能。
API 技術參數
購買額度前,請先確認介面是否符合你的需求——以下是全部真實參數。
| 項目 | 說明 |
|---|---|
| 介面格式 | 相容 OpenAI:任何 OpenAI SDK 只需更換 base URL 和金鑰 |
| 模型 ID | uncensored |
| 端點 | POST /v1/chat/completions · GET /v1/models |
| 驗證 | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.uncensoredlocalllm.com/v1 |
| 函式呼叫 | 支援 tools、tool_choice;回覆包含 tool_calls(串流同樣支援),結果以 role: tool 訊息回傳 |
| 取樣參數 | temperature、top_p、stop、seed、presence_penalty、frequency_penalty |
| 上下文視窗 | 100,000 tokens(輸入與輸出合計) |
| 最大輸出 | 不另設輸出上限;提示+回覆共 100,000 個 token 視窗內,max_tokens 可選 |
| JSON 模式 | response_format: {"type": "json_object"} |
| 串流輸出 | 支援 SSE,最後一段包含 token 用量 |
| 請求大小 | 每次請求不超過 8 MB |
| 回應標頭 | X-Request-Id、X-Balance-USD、X-RateLimit-Limit-Requests、X-RateLimit-Limit-Concurrency |
| 並行請求 | 每把金鑰同時最多 8 個請求 |
| 速率限制 | 每把金鑰每分鐘 300 次請求 |
| 贈送額度 | 滿 $50 送 5%,滿 $100 送 10% |
| 儲值 | USDT(TRC20)或 USDC(Base),$10–$500 任意整數金額 |
| 價格 | 輸入 $0.25 / 百萬 tokens · 輸出 $1.00 / 百萬 tokens |
| 免費試用 | $0.50,有效期 7 天,不需信用卡 · 試用金鑰:2 個並行請求,每分鐘 60 次;首次儲值後恢復完整限額(8 和 300) |
| 計費 | 預付額度,按實際 token 用量扣費;錯誤和拒絕不收費 |
| 額度效期 | 付費額度永不過期,無訂閱 |
| 登入 | Google 或電子郵件 + 密碼 |
| 金鑰 | 每個帳戶一把有效金鑰;產生新金鑰後舊金鑰失效 |
| 內容政策 | 允許成人內容;涉及未成年人的性內容一律拒絕 |
錯誤代碼
錯誤以 JSON 回傳,type 欄位固定;失敗或被拒絕的請求不計費。
| 狀態碼 | 類型 | 含義 |
|---|---|---|
400 | bad_request | JSON 無效、訊息為空、參數錯誤或超出上下文視窗 |
401 | missing_key · invalid_key · key_revoked | 缺少金鑰、金鑰錯誤或已被新金鑰取代 |
402 | no_credit | 餘額不足——儲值後立即恢復 |
403 | content_blocked | 涉及未成年人的性內容——拒絕且不計費 |
404 | not_found | 未知端點 |
413 | request_too_large | 請求內容超過 8 MB |
429 | rate_limited · concurrency | 超過每分鐘 300 次或 8 個並行——稍後重試 |
503 | upstream_busy | 模型忙碌——幾秒後重試 |
問答
上下文視窗的大小是多少?
API 支援 100,000 token 的上下文視窗,包含輸入提示詞與輸出補全。這允許在單一請求中進行廣泛的對話或處理大型文件。
我該如何處理串流輸出回應?
在請求中設定 <code>stream: true</code> 以接收伺服器發送的事件 (SSE)。當啟用此旗標時,Python 和 Node.js 的 OpenAI SDK 會自動處理串流輸出。然後你可以處理每個到達的區塊。
如果我的額度用完了會怎樣?
你將收到 <code>402</code> 錯誤,表示沒有可用額度。你可以使用加密貨幣(USDT 或 USDC)儲值,最低金額為 10 美元。額度永不過期,且儲值金額較大時會獲得獎勵。