TH ▾
รับคีย์ API

uncensoredlocalllm.comGuide

คู่มือการผสานรวมแชท LLM ไม่เซ็นเซอร์ฉบับสมบูรณ์

LLM แบบไม่เซ็นเซอร์ให้ผลลัพธ์โมเดลแบบดิบและไม่มีตัวกรองเนื้อหาตามกลไกการควบคุมที่มีใน API การค้าทั่วไป การใช้เอนด์พอยต์แบบโฮสต์ช่วยให้คุณหลีกเลี่ยงความซับซ้อนของฮาร์ดแวร์และโครงสร้างพื้นฐานของการประมวลผลแบบท้องถิ่น ขณะที่ยังคงอิสระทางความคิดและบริบทเต็มที่สำหรับกรณีการใช้งานสำหรับผู้ใหญ่ วิจัย หรือเรื่องแต่ง

อัปเดต

ประเด็นสำคัญ

  • โมเดลแบบไม่เซ็นเซอร์จะไม่ปฏิเสธหัวข้อสำหรับผู้ใหญ่ที่ถูกต้องตามกฎหมาย เรื่อง controversal หรืองานวิจัยด้านความปลอดภัย โดยอิงตามนโยบายของบริษัทแบบตามอำเภอใจ
  • API แบบโฮสต์ขจัดความจำเป็นใน GPU ที่มีราคาแพงและการจัดการ VRAM พร้อมให้เอนด์พอยต์ที่เข้ากันได้กับ OpenAI
  • บริการของเราเสนอหน้าต่างบริบท 100k การรองรับสตรีมมิง และการเรียกใช้ฟังก์ชันพร้อมราคาโปร่งใสตามการใช้งาน
  • เครดิตทดลองใช้ได้ทันทีโดยไม่ต้องใช้บัตรเครดิต เพื่อให้คุณตรวจสอบพฤติกรรมของโมเดลก่อนจ่ายเงิน

ทำความเข้าใจโมเดลไม่เซ็นเซอร์เทียบกับโมเดลเซ็นเซอร์

โมเดลภาษาขนาดใหญ่มาตรฐานได้รับการฝึกด้วย Reinforcement Learning from Human Feedback (RLHF) เพื่อปรับผลลัพธ์ให้สอดคล้องกับนโยบายความปลอดภัยของบริษัท กระบวนการนี้ทำให้เกิด "การเซ็นเซอร์" เมื่อโมเดลปฏิเสธที่จะตอบคำถามเกี่ยวกับหัวข้อที่โต้แย้ง สร้างคำอธิบายความรุนแรงที่นุ่มนวลลง หรือบล็อกเนื้อหาผู้ใหญ่แม้ว่าจะเกี่ยวข้องกับบริบทก็ตาม LLM ไม่เซ็นเซอร์ ลบเลเยอร์การปรับแต่งเหล่านี้ ทำให้โมเดลพื้นฐานสร้างข้อความตามข้อมูลการฝึกและคำสั่งพรอมต์เพียงอย่างเดียว ผลลัพธ์คือความถูกต้องตามเจตนาของผู้ใช้สูงขึ้น โดยเฉพาะสำหรับการเขียนเชิงสร้างสรรค์ การสวมบทบาท หรือการวิเคราะห์ทางเทคนิคที่ความละเอียดอ่อนมักสูญหายในการกรองความปลอดภัย

ข้อแลกเปลี่ยนคือโมเดลอาจผลิตเนื้อหาที่ดิบ ไม่ผ่านการขัดเกลา หรือเฉียบคมมากขึ้น ไม่ได้หมายความว่าโมเดลเสีย แต่หมายความว่าไม่ถูกจำกัดโดยเทียม สำหรับนักพัฒนาที่สร้างแอปพลิเคชันที่ผู้ใช้ปลายทางควบคุมบริบท ความสามารถดิบนี้มักเป็นที่ต้องการมากกว่าความสุภาพทั่วไปของทางเลือกที่เซ็นเซอร์

เหตุผลสำหรับแชท LLM ไม่เซ็นเซอร์

การใช้อินเทอร์เฟซแชท LLM แบบไม่เซ็นเซอร์ เป็นสิ่งจำเป็นสำหรับกรณีการใช้งานที่ข้อจำกัดของเนื้อหาขัดขวางการใช้งาน ตัวอย่างเช่น เมื่อนักพัฒนาทดสอบแอปสำหรับผู้ใหญ่ โมเดลที่มีการเซ็นเซอร์อาจปฏิเสธการสร้างฉากโรแมนติกง่ายๆ ซึ่งทำลายประสบการณ์ผู้ใช้ เช่นเดียวกันในงานวิจัยด้านความปลอดภัย โมเดลแบบไม่เซ็นเซอร์จะตรวจจับจุดบกพร่องได้ดีกว่าโดยไม่ลดทอนคำตอบเนื่องจากตัวกรองความปลอดภัย สำหรับนักเขียนเชิงสร้างสรรค์ ความสามารถในการสร้างเนื้อหาชัดเจนหรือเรื่องเล่าที่ไม่ธรรมดาโดยไม่จำเป็นต้องสั่งโมเดลให้ "ระวัง" ช่วยประหยัดเวลาและโทเคนได้อย่างมาก

นอกจากนี้ โมเดลไม่เซ็นเซอร์มักปฏิบัติตามคำสั่งที่ซับซ้อนได้ถูกต้องกว่า เนื่องจากไม่มีความลำเอียงในการให้คำตอบที่ "ปลอดภัย" หรือ "สมดุล" พวกมันสามารถรับบทบาทเฉพาะหรือสไตล์น้ำเสียงได้อย่างมีประสิทธิภาพมากขึ้น ทำให้เหมาะสำหรับแชทบอทที่ต้องการรักษาตัวละครที่สอดคล้องกันโดยไม่เบี่ยงเบนไปเป็นภาษาองค์กรเมื่อหัวข้อกลายเป็นเรื่องแปลกเล็กน้อย

ท้องถิ่น vs โฮสต์: การแลกเปลี่ยนด้านฮาร์ดแวร์

การรันโมเดลไม่เซ็นเซอร์แบบท้องถิ่นให้คุณมีความเป็นส่วนตัวสมบูรณ์และไม่มีค่าใช้จ่ายต่อเนื่อง แต่ต้องการการลงทุนด้านฮาร์ดแวร์อย่างมาก คุณต้องการ GPU ที่มี VRAM เพียงพอเพื่อโหลดโมเดลขนาดใหญ่ (เช่น 7B ถึง 70B พารามิเตอร์) การจัดการสิ่งนี้เกี่ยวข้องกับการดาวน์โหลดน้ำหนัก การกำหนดค่าเครื่องอนุมานเช่น Ollama หรือ vLLM และการจัดการอัปเดตที่อาจทำลายการตั้งค่าของคุณ หากอินเทอร์เน็ตของคุณขัดข้องหรือฮาร์ดแวร์ล้มเหลว บริการของคุณจะหยุดทำงาน

บริการแบบโฮสต์เสนอการแลกเปลี่ยนที่แตกต่างกัน: ความสะดวกและความมั่นคงในราคาต่อโทเคน โดยใช้เอนด์พอยต์แบบโฮสต์ คุณโยนภาระฮาร์ดแวร์ให้ผู้ให้บริการ คุณได้รับระดับประสิทธิภาพที่สม่ำเสมอ การใช้งานตลอด 24/7 และไม่ต้องจัดการไดรเวอร์หรือเวอร์ชัน CUDA สำหรับนักพัฒนาจำนวนมาก ความสามารถในการเริ่มอินเทอร์เฟซแชทบนอุปกรณ์ใดๆ ที่มีอินเทอร์เน็ตเข้าถึงมีค่ามากกว่าการประหยัดจากการอนุมานแบบท้องถิ่น โดยเฉพาะเมื่อจัดการกับปริมาณการจราจรที่แปรผัน

วิธีผสานรวม API แชท LLM ไม่เซ็นเซอร์

การผสานรวมเป็นเรื่องง่ายหาก API ปฏิบัติตามมาตรฐาน OpenAI เอนด์พอยต์ของเรายอมรับคำขอ chat-completions มาตรฐาน ซึ่งหมายความว่าคุณสามารถใช้ SDK และไลบรารีไคลเอนต์ที่มีอยู่ได้ เพียงอัปเดต Base URL ของคุณไปยังบริการแบบโฮสต์ของเราและระบุคีย์ API ของคุณ รหัสโมเดลมักจะตั้งค่าเป็น "uncensored" เพื่อให้แน่ใจว่าคุณเข้าถึงเครื่องอนุมานที่ถูกต้อง

  • Endpoint: POST /v1/chat/completions
  • Base URL: https://api.uncensoredlocalllm.com/v1
  • Model: "uncensored"

แนวทางนี้ช่วยให้คุณสลับระหว่างโมเดลเซ็นเซอร์และไม่เซ็นเซอร์โดยการเปลี่ยนตัวแปรการกำหนดค่าเดียวในโค้ดแอปพลิเคชันของคุณ รองรับทั้งการตอบสนองแบบซิงโครนัสและสตรีมมิง ทำให้สร้างอินเทอร์เฟซแชทที่ตอบสนองได้รวดเร็ว

การตอบสนองแบบสตรีมมิงเพื่อ UX ที่ดีขึ้น

เมื่อสร้างอินเทอร์เฟซแชท ความล่าช้าเป็นปัจจัยสำคัญ การรอให้คำตอบทั้งหมดสร้างเสร็จก่อนแสดงผลอาจรู้สึกช้า โดยเฉพาะกับหน้าต่างบริบทขนาดใหญ่ สตรีมมิงช่วยให้คุณแสดงโทเคนเมื่อสร้างเสร็จ ซึ่งปรับปรุงประสิทธิภาพที่รับรู้ของแอปพลิเคชันของคุณ API ของเรารองรับ Server-Sent Events (SSE) สำหรับสตรีมมิง ซึ่งเข้ากันได้กับ SDK JavaScript และ Python สมัยใหม่มากมาย

สตรีมมิงมีประโยชน์เป็นพิเศษสำหรับโมเดลไม่เซ็นเซอร์เพราะพวกมันอาจสร้างคำตอบที่ยาวและละเอียดมากขึ้น โดยการแสดงโทเคนแบบเรียลไทม์ คุณเก็บผู้ใช้ให้มีส่วนร่วมและอนุญาตให้หยุดการสร้างหากโมเดลเริ่มเบี่ยงเบนจากหัวข้อ นี่เป็นฟีเจอร์มาตรฐานในการใช้งานแชทคุณภาพสูงและรับประกันประสบการณ์ผู้ใช้ที่ราบรื่น

การจัดการหน้าต่างบริบทในแชทไม่เซ็นเซอร์

ขนาดหน้าต่างบริกบทกำหนดว่าโมเดลสามารถจำประวัติการสนทนาได้มากเพียงใด หน้าต่างบริบทที่ใหญ่กว่าอนุญาตให้มีการสนทนาที่ลึกซึ้งและสอดคล้องกันมากขึ้น และการจัดการเอกสารหรือโค้ดเบสที่ยาวนานได้ดีขึ้น บริการของเราเสนอ หน้าต่างบริบท 100,000 โทเคน ซึ่งใหญ่กว่าขีดจำกัดมาตรฐาน 8k หรือ 32k ที่พบใน API พื้นฐานบางแห่งอย่างมีนัยสำคัญ

ความจุนี้สำคัญมากสำหรับแอปพลิเคชันแชทไม่เซ็นเซอร์ที่ผู้ใช้อาจมีส่วนร่วมในการสวมบทบาทที่ยาวและละเอียดอ่อน หรือวางโค้ดจำนวนมาก มันรับประกันว่าโมเดลจะรักษาบริบทเต็มของการสนทนา ลดโอกาสที่มันจะ "ลืม" คำสั่งหรือรายละเอียดก่อนหน้านี้ เมื่อออกแบบแอปพลิเคชันของคุณ พิจารณาวิธีที่คุณจัดการหน่วยความจำ: ในขณะที่ API จัดการหน้าต่างขนาดใหญ่ ไคลเอนต์ของคุณควรจัดโครงสร้างพรอมต์อย่างมีประสิทธิภาพเพื่อหลีกเลี่ยงการใช้งานโทเคนที่ไม่จำเป็น

ข้อจำกัดเนื้อหาและกรณีใช้งานผู้ใหญ่

แม้ว่าโมเดลจะไม่เซ็นเซอร์ แต่ก็ไม่ได้ไม่มีข้อจำกัดโดยสิ้นเชิง ข้อจำกัดหลักคือเนื้อหาทางเพศที่เกี่ยวข้องกับเด็ก ซึ่งถูกบล็อกเพื่อให้สอดคล้องกับมาตรฐานเนื้อหาทั่วไป นอกเหนือจากนี้ โมเดลจะสร้างเนื้อหาผู้ใหญ่ ความรุนแรง หรือความคิดเห็นที่โต้แย้งหากได้รับคำสั่ง ทำให้เหมาะสำหรับแอปพลิเคชัน LLM NSFW การสวมบทบาทผู้ใหญ่ และการเล่าเรื่องแบบไม่มีข้อจำกัด

สำหรับนักพัฒนา นี่หมายความว่าคุณไม่จำเป็นต้องสร้างชั้นการตรวจสอบเนื้อหาของคุณเองสำหรับเนื้อหาผู้ใหญ่ส่วนใหญ่ คุณสามารถพึ่งพาพฤติกรรมพื้นฐานของโมเดลได้ อย่างไรก็ตาม หากคุณต้องการตัวกรองเนื้อหาเฉพาะ (เช่น บล็อกเพียงเนื้อนองเลือดแต่อนุญาตให้เพศ) คุณอาจต้องดำเนินการประมวลผลหลังหรือใช้วิศวกรรมพรอมต์เพื่อแนะนำโมเดล ข้อได้เปรียบหลักคือโมเดลพื้นฐานไม่ปฏิเสธหัวข้อเหล่านี้โดยพลการ

ความเป็นส่วนตัวและการใช้งานข้อมูล

ความเป็นส่วนตัวเป็นข้อกังวลสำคัญเมื่อใช้ LLM แบบคลาวด์ ผู้ให้บริการบางรายใช้พรอมต์ของคุณเพื่อฝึกโมเดลของพวกเขา ซึ่งหมายความว่าข้อมูลของคุณอาจถูกใช้เพื่อปรับปรุงผลิตภัณฑ์เชิงพาณิชย์ของพวกเขา บริการของเรารับประกันว่า พรอมต์ไม่ถูกใช้ในการฝึก สิ่งนี้สำคัญมากสำหรับธุรกิจหรือบุคคลที่ต้องการเก็บข้อมูลการสนทนาของตนเป็นกรรมสิทธิ์

นอกจากนี้ กระบวนการลงชื่อเข้าใช้ของเราต้องการเพียงอีเมลและรหัสผ่าน โดยไม่ต้องใช้หมายเลขโทรศัพท์หรือบัตรเครดิตสำหรับการทดลองใช้ ซึ่งลดปริมาณข้อมูลส่วนบุคคลที่คุณแบ่งปัน ในขณะที่เราโฮสต์การอนุมาน เราไม่ได้เรียกร้องความเป็นเจ้าของเอาต์พุตของคุณ ความโปร่งใสนี้ช่วยให้คุณผสานรวม API เข้ากับเวิร์กโฟลว์ของคุณได้อย่างมั่นใจ โดยรู้ว่าคุณข้อมูลของคุณถูกใช้เพื่อสร้างการตอบสนองเท่านั้น

ถาม-ตอบ

ความแตกต่างระหว่างโมเดลไม่เซ็นเซอร์และแบบไม่มีตัวกรองคืออะไร

โมเดลไม่เซ็นเซอร์มักถูกลดเลเยอร์การปรับแต่ง RLHF ออก ทำให้ตอบคำถามโดยไม่ปฏิเสธตามนโยบายความปลอดภัยของบริษัท คำว่าไม่มีตัวกรองอาจหมายถึงโมเดลที่ยังไม่ได้ปรับแต่งสำหรับการปฏิบัติตามคำสั่ง แต่ทั้งสองคำหมายถึงการไม่มีข้อจำกัดเนื้อหา โมเดลของเราปรับให้ตอบโดยไม่ปฏิเสธแต่ยังคงปฏิบัติตามคำสั่ง

โมเดลไม่เซ็นเซอร์รองรับการเรียกใช้ฟังก์ชันหรือไม่

ใช่ API ของเรารองรับการเรียกใช้ฟังก์ชัน/เครื่องมือ (tool/function calling) ซึ่งช่วยให้คุณนำโมเดลไปรวมกับแอปพลิเคชันที่ต้องโต้ตอบกับ API ภายนอก ฐานข้อมูล หรือเครื่องคำนวณ คุณสมบัตินี้มีให้ใช้ผ่านเอนด์พอยต์ chat-completions มาตรฐาน

ระบบราคาทำงานอย่างไร

เราใช้โมเดลการจ่ายตามการใช้งานพร้อมเครดิตแบบเติมเงินล่วงหน้า ค่าใช้จ่ายคือ $0.25 ต่อ 1M โทเคนอินพุต และ $1.00 ต่อ 1M โทเคนเอาต์พุต ไม่มีค่าธรรมเนียมรายเดือน และเครดิตที่ไม่ได้ใช้จะไม่หมดอายุ คุณสามารถเติมเงินเริ่มต้นที่ $10 พร้อมโบนัสสำหรับยอดที่สูงขึ้น

ฉันสามารถใช้สำหรับเนื้อหา NSFW ได้หรือไม่

ใช่ โมเดลถูกออกแบบมาเพื่อรองรับเนื้อหาสำหรับผู้ใหญ่และไม่ปฏิเสธหัวข้อ NSFW ที่ถูกต้องตามกฎหมาย ขีดจำกัดเดียวคือเนื้อหาทางเพศที่เกี่ยวข้องกับเด็ก ทำให้เหมาะสำหรับแชทบอทสำหรับผู้ใหญ่ การสวมบทบาท และการเขียนเชิงสร้างสรรค์

uncensoredlocalllm.com

คีย์ของคุณอยู่ห่างแค่แบบฟอร์มเดียว

สร้างบัญชี คัดลอกคีย์ API เปลี่ยน Base URL แค่นี้ก็พร้อมใช้งานแล้ว