เชื่อมต่อ API Uncensored Local LLM
ผสาน API Uncensored Local LLM โดยชี้ไคลเอนต์ที่เข้ากันได้กับ OpenAI ไปยังเอนด์พอยต์ที่โฮสต์ของเรา คุณจะได้หน้าต่างบริบท 100k การรองรับสตรีมมิง และผลลัพธ์โมเดลดิบโดยไม่ต้องจัดการโครงสร้างพื้นฐาน GPU ท้องถิ่น
- URL พื้นฐาน
- https://api.uncensoredlocalllm.com/v1
- โมเดล
- ไม่เซ็นเซอร์
Base URL และการตรวจสอบสิทธิ์
API ของเราเข้ากันได้กับ SDK ของ OpenAI อย่างสมบูรณ์ คุณเพียงอัปเดต base_url และระบุคีย์ API ของคุณ ลงทะเบียนที่หน้า รับคีย์ API เพื่อรับคีย์ของคุณทันที ไม่ต้องใช้หมายเลขโทรศัพท์หรือบัตรเครดิตเพื่อเริ่มต้นด้วยเครดิตทดลองใช้ URL พื้นฐานคือ https://api.uncensoredlocalllm.com/v1 เก็บคีย์ของคุณให้ปลอดภัย คุณสามารถสร้างคีย์ใหม่ได้ทุกเมื่อ ซึ่งจะเพิกเฉยคีย์เก่าทันที สิ่งนี้ทำให้คุณมีเอนด์พอยต์เดียวที่เสถียรสำหรับแอปพลิเคชันของคุณโดยไม่มีความซับซ้อนในการจัดการการอนุมานแบบท้องถิ่น
คำขอแรก
ทำการเรียก API ครั้งแรกโดยใช้ไคลเอนต์ HTTP ที่คุณต้องการ เอนด์พอยต์รองรับรูปแบบ chat-completions มาตรฐาน ด้านล่างคือตัวอย่าง cURL ที่แสดงคำขอพื้นฐาน แทนที่ YOUR_API_KEY ด้วยคีย์จริงของคุณ คำขอนี้ส่งพรอมต์และคาดหวังการตอบสนองข้อความ รหัสโมเดลคือ uncensored โมเดลแบบเปิดน้ำหนักนี้ได้รับการปรับแต่งเพื่อตอบโดยไม่มีการปฏิเสธเนื้อหาสำหรับการใช้งานผู้ใหญ่ที่ถูกต้องตามกฎหมาย ให้ผลลัพธ์โดยตรงสำหรับกรณีการใช้งานของคุณ
curl https://api.uncensoredlocalllm.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'
การตอบกลับจะประกอบด้วยข้อความที่สร้างขึ้นในอาร์เรย์ choices หากคุณพบข้อผิดพลาด 401 แสดงว่าคีย์ API ของคุณไม่ถูกต้องหรือหายไป ตรวจสอบว่าคุณใช้ base URL ที่ถูกต้องและคีย์ของคุณไม่ได้ถูกเพิกเฉยหลังการสร้างใหม่
การผสาน SDK Python
ใช้ Python SDK ทางการของ OpenAI เพื่อผสานรวมอย่างรวดเร็ว กำหนดค่า base_url และ api_key ในการเริ่มต้นไคลเอนต์ วิธีนี้ช่วยให้คุณใช้วิธีการที่คุ้นเคยเช่น chat.completions.create() ได้ SDK จัดการการแปลง JSON และการขอ HTTP โดยอัตโนมัติ เหมาะสำหรับบริการแบ็กเอนด์หรือสคริปต์ที่ต้องประมวลผลข้อความปริมาณมาก โปรดจำไว้ว่า id ของโมเดลคือ uncensored ไม่ว่าคุณจะใช้อะไรก็ตาม
from openai import OpenAI
client = OpenAI(base_url="https://api.uncensoredlocalllm.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)
วิธีนี้มีประสิทธิภาพสำหรับการประมวลผลแบบแบตช์หรือเมื่อคุณต้องการจัดการตรรกะการตอบสนองใน Python ตรวจสอบให้แน่ใจว่าสภาพแวดล้อมของคุณมีแพ็คเกจ openai ติดตั้งแล้ว SDK รองรับทั้งการดำเนินการแบบซิงโครนัสและอะซิงโครนัส ซึ่งเหมาะกับความต้องการทางสถาปัตยกรรมที่หลากหลาย
การผสาน SDK Node
สำหรับสภาพแวดล้อม JavaScript หรือ TypeScript SDK Node ของ OpenAI ให้ประสบการณ์ที่คล้ายกัน เริ่มต้นไคลเอนต์ด้วย Base URL และคีย์ API ของคุณ สิ่งนี้มีประโยชน์เป็นพิเศษสำหรับเว็บแอปพลิเคชันหรือฟังก์ชันแบบไร้เซิร์ฟเวอร์ SDK หักล้างรายละเอียด HTTP ทำให้คุณสามารถมุ่งเน้นไปที่ตรรกะแอปพลิเคชัน คุณสามารถเรียกเอนด์พอยต์การเติมเต็มด้วยโครงสร้างเดียวกันกับบริการที่เข้ากันได้กับ OpenAI อื่นๆ
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.uncensoredlocalllm.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);
ใช้การผสานนี้สำหรับอินเทอร์เฟซเว็บแบบเรียลไทม์หรือไมโครเซอร์วิส Node.js SDK รองรับแพทเทิร์น Promise และ async/await ทำให้การจัดการข้อผิดพลาดเป็นเรื่องง่าย ตรวจสอบให้แน่ใจว่าคุณจัดการข้อผิดพลาดของเครือข่ายได้อย่างเหมาะสม โดยเฉพาะในระบบแบบกระจาย
การตอบสนองแบบสตรีมมิง
เปิดใช้งานสตรีมมิงโดยตั้งค่า stream: true ในการขอของคุณ สิ่งนี้ช่วยให้คุณได้รับคำตอบบางส่วนเมื่อมันถูกสร้างขึ้น ซึ่งช่วยปรับปรุงเวลาแฝงที่ผู้ใช้รู้สึก API รองรับ Server-Sent Events (SSE) สำหรับสตรีมมิง สิ่งนี้สำคัญสำหรับอินเทอร์เฟซแชทที่คาดหวังการตอบกลับทันที การสตรีมมิงไม่ส่งผลต่อคุณภาพเอาต์พุตหรือหน้าต่างบริบทของโมเดล
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)
จัดการเหตุการณ์สตรีมมิงในโค้ดไคลเอนต์ของคุณ แต่ละชิ้นมีสัดส่วนของการตอบสนองสุดท้าย รวมชิ้นเหล่านี้เพื่อสร้างข้อความเต็มรูปแบบ วิธีนี้ทำงานได้อย่างราบรื่นกับ SDK ของ OpenAI ทั้งใน Python และ Node.js
ขีดจำกัดอัตรา ข้อผิดพลาด และหน้าต่างบริบท
API กำหนดขีดจำกัด 300 คำขอต่อนาทีต่อคีย์ ขนาดร่างกายคำขอสูงสุดคือ 8 MB คุณจะได้รับข้อผิดพลาด 429 หากเกินขีดจำกัดอัตรา ข้อผิดพลาด 402 บ่งชี้ว่าเครดิตแบบเติมเงินล่วงหน้าไม่เพียงพอ ตรวจสอบให้แน่ใจว่าคุณติดตามการใช้งานและเติมเงินบัญชีผ่านแดชบอร์ด เครดิตไม่หมดอายุ และคุณสามารถจ่ายด้วยคริปโต (USDT หรือ USDC)
หน้าต่างบริบทคือ 100,000 โทเคน ซึ่งครอบคลุมทั้งพรอมต์และการตอบกลับ สิ่งนี้ทำให้สามารถสนทนาที่ยาวนานหรือประมวลผลเอกสารขนาดใหญ่ได้ หากเกินขีดจำกัด API จะปฏิเสธคำขอ id ของโมเดลคือ uncensored และรองรับการเรียกใช้เครื่องมือ/ฟังก์ชันสำหรับความสามารถที่ขยายเพิ่มเติม
ข้อมูลจำเพาะ API
ขีดจำกัดและความสามารถจริงทั้งหมดของ API ในที่เดียว ตรวจสอบก่อนเติมเงิน
| รายการ | ค่า |
|---|---|
| รูปแบบ API | รองรับ OpenAI: ใช้ OpenAI SDK ใดก็ได้ แค่เปลี่ยน base URL และคีย์ |
| ID โมเดล | uncensored |
| เอนด์พอยต์ | POST /v1/chat/completions · GET /v1/models |
| การยืนยันตัวตน | Authorization: Bearer YOUR_KEY |
| Base URL | https://api.uncensoredlocalllm.com/v1 |
| การเรียกใช้ฟังก์ชัน | รองรับ — tools, tool_choice คำตอบมี tool_calls รวมถึงตอนสตรีม ส่งผลลัพธ์กลับด้วย role: tool |
| พารามิเตอร์ | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| หน้าต่างบริบท | 100,000 โทเคน (อินพุตรวมเอาต์พุต) |
| เอาต์พุตสูงสุด | ได้ถึงส่วนที่เหลือของหน้าต่าง 100,000 โทเคน; max_tokens ไม่บังคับ (ไม่มีเพดานแยก) |
| โหมด JSON | response_format: {"type": "json_object"} |
| สตรีมมิง | รองรับ — server-sent events ชิ้นสุดท้ายมีจำนวนโทเคนที่ใช้ |
| ขนาดคำขอ | ไม่เกิน 8 MB |
| เฮดเดอร์ของคำตอบ | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| คำขอพร้อมกัน | สูงสุด 8 คำขอพร้อมกันต่อคีย์ |
| ขีดจำกัดอัตรา | 300 คำขอต่อนาทีต่อคีย์ |
| โบนัส | +5% เมื่อเติมตั้งแต่ $50, +10% ตั้งแต่ $100 |
| เติมเงิน | USDT (TRC20) หรือ USDC (Base) จำนวนเต็มใดก็ได้ตั้งแต่ $10 ถึง $500 |
| ราคา | $0.25 ต่อ 1 ล้านโทเคนอินพุต · $1.00 ต่อ 1 ล้านโทเคนเอาต์พุต |
| เครดิตทดลองใช้ฟรี | $0.50 ใช้ได้ 7 วัน ไม่ต้องใช้บัตร · คีย์ทดลอง: 2 คำขอพร้อมกัน, 60 ครั้งต่อนาที; ขีดจำกัดเต็ม (8 และ 300) หลังเติมเงินครั้งแรก |
| การคิดเงิน | เครดิตแบบเติมเงินล่วงหน้าตามการใช้งานจริง ข้อผิดพลาดและการปฏิเสธไม่คิดเงิน |
| อายุเครดิต | เครดิตที่ซื้อไม่มีวันหมดอายุ ไม่มีการสมัครรายเดือน |
| เข้าสู่ระบบ | Google หรืออีเมลและรหัสผ่าน |
| คีย์ | หนึ่งบัญชีมีคีย์ที่ใช้งานได้หนึ่งคีย์ คีย์ใหม่จะแทนคีย์เดิม |
| เนื้อหา | อนุญาตเนื้อหาสำหรับผู้ใหญ่ ปฏิเสธเนื้อหาทางเพศที่เกี่ยวข้องกับผู้เยาว์ |
รหัสข้อผิดพลาด
ข้อผิดพลาดส่งกลับเป็น JSON พร้อม type ที่คงที่ คำขอที่ล้มเหลวหรือถูกปฏิเสธไม่คิดเงิน
| รหัส | ประเภท | ความหมาย |
|---|---|---|
400 | bad_request | JSON ไม่ถูกต้อง ข้อความว่าง พารามิเตอร์ผิด หรือเกินหน้าต่างบริบท |
401 | missing_key · invalid_key · key_revoked | ไม่มีคีย์ คีย์ผิด หรือคีย์ถูกแทนที่แล้ว |
402 | no_credit | เครดิตหมด เติมเงินแล้วใช้งานต่อได้ทันที |
403 | content_blocked | เนื้อหาทางเพศเกี่ยวกับผู้เยาว์ ถูกปฏิเสธ ไม่คิดเงิน |
404 | not_found | ไม่รู้จักเอนด์พอยต์ |
413 | request_too_large | ขนาดเกิน 8 MB |
429 | rate_limited · concurrency | เกิน 300/นาที หรือ 8 พร้อมกัน รอแล้วลองใหม่ |
503 | upstream_busy | โมเดลไม่ว่าง ลองใหม่ในไม่กี่วินาที |
ถาม-ตอบ
ขนาดหน้าต่างบริบทคือเท่าใด?
API รองรับหน้าต่างบริบทขนาด 100,000 โทเคน ซึ่งรวมถึงพรอมต์ขาเข้าและการสร้างผลลัพธ์ขาออก ช่วยให้การสนทนาที่ยาวนานหรือการประมวลผลเอกสารขนาดใหญ่ทำได้ในคำขอเดียว
ฉันจัดการการตอบสนองแบบสตรีมมิงได้อย่างไร?
ตั้งค่า <code>stream: true</code> ในคำขอของคุณเพื่อรับ Server-Sent Events (SSE) SDK ของ OpenAI ใน Python และ Node.js จะจัดการสตรีมมิงโดยอัตโนมัติเมื่อเปิดใช้งานตัวเลือกนี้ จากนั้นคุณสามารถประมวลผลแต่ละชิ้นเมื่อได้รับ
เกิดอะไรขึ้นหากเครดิตหมด?
คุณจะได้รับข้อผิดพลาด <code>402</code> ที่ระบุว่าไม่มีเครดิตเหลืออยู่ คุณสามารถเติมเงินบัญชีด้วยจำนวนน้อยที่สุด $10 โดยใช้คริปโต (USDT หรือ USDC) เครดิตไม่หมดอายุ และโบนัสจะถูกนำไปใช้สำหรับการเติมเงินจำนวนมากขึ้น
uncensoredlocalllm.com
คีย์ของคุณอยู่ห่างแค่แบบฟอร์มเดียว
สร้างบัญชี คัดลอกคีย์ เปลี่ยน Base URL นั่นคือการตั้งค่าทั้งหมด