วิธีโฮสต์ LLM แบบไม่เซ็นเซอร์ผ่าน API ที่เข้ากันได้กับ OpenAI
การโฮสต์ LLM ที่ไม่เซ็นเซอร์ให้เอนด์พอยต์การอนุมานโดยตรงที่ไร้การปฏิเสธ ซึ่งปรับแต่งมาสำหรับการสร้างเนื้อหาสำหรับผู้ใหญ่ สร้างสรรค์ หรือไร้ข้อจำกัด โดยใช้สถาปัตยกรรมที่เข้ากันได้กับ OpenAI คุณจะสามารถผสาน SDK ได้ทันทีโดยไม่ต้องแบกรับภาระการกำหนดเส้นทางโมเดลหรือการผูกขาดผู้ให้บริการที่ซับซ้อน
อัปเดต
จุดสำคัญ
- ใช้สถาปัตยกรรมโมเดลเดี่ยวเพื่อกำจัดความซับซ้อนของการกำหนดเส้นทางและรับประกันพฤติกรรมแบบไม่เซ็นเซอร์ที่สม่ำเสมอ
- เอนด์พอยต์ที่เข้ากันได้กับ OpenAI ช่วยให้คุณเปลี่ยนคีย์ API และ URL พื้นฐานเพื่อผสานรวมได้ทันที
- การเรียกเก็บเงินแบบโปร่งใสต่อโทเคนพร้อมเครดิตคริปโตแบบเติมเงินล่วงหน้ารับประกันว่าคุณจ่ายเฉพาะการใช้งานจริง โดยข้อผิดพลาดและการปฏิเสธนับเป็นฟรี
- ความเป็นส่วนตัวได้รับการรักษาโดยการเก็บพรอมต์ออกจากข้อมูลการฝึก พร้อมการบล็อกเนื้อหาทางเพศที่เกี่ยวข้องกับผู้เยาว์อย่างเด็ดขาดโดยไม่คำนึงถึงความอดทนทั่วไปของโมเดล
ทำไมต้องโฮสต์ LLM แบบไม่เซ็นเซอร์?
API LLM มาตรฐานมักใช้ตัวกรองเนื้อหาที่เข้มงวดซึ่งอาจปฏิเสธหัวข้อผู้ใหญ่ที่ถูกกฎหมาย งานเขียนเชิงสร้างสรรค์ที่ละเอียดอ่อน หรือหัวข้อที่ถกเถกันได้ การโฮสต์ LLM แบบไม่เซ็นเซอร์หมายความว่าคุณควบคุมชั้นการอนุมาน ทำให้มั่นใจว่าโมเดลจะตอบสนองต่อพรอมต์ของคุณโดยไม่มีการปฏิเสธแบบสุ่ม สิ่งนี้สำคัญมากสำหรับแอปพลิเคชันที่ต้องการการสร้างข้อความดิบที่ไม่มีการกรอง เช่น เครื่องยนต์บทบาทสมมติ ผู้ช่วยงานเขียนเชิงสร้างสรรค์ หรือเครื่องมือวิจัยที่วิเคราะห์ข้อมูลที่ละเอียดอ่อน
ต่างจากตัวรวมที่ส่งคำขอผ่านโมเดลหลายตัว API ของ LLM ที่โฮสต์และไม่มีเซ็นเซอร์มักจะให้บริการโมเดลเดียวที่ปรับแต่งแล้ว ซึ่งช่วยทำให้การแก้ไขข้อบกพร่องง่ายขึ้นและรักษาพฤติกรรมที่สอดคล้องกันตลอดแอปพลิเคชันของคุณ คุณหลีกเลี่ยงความไม่แน่นอนจากการกำหนดเวอร์ชันโมเดลหรือการเปลี่ยนแปลงนโยบายอย่างกะทันหันจากผู้ให้บริการรายใหญ่ ผลลัพธ์คือบริการข้อความเข้า/ข้อความออกที่เชื่อถือได้ กำหนดผลลัพธ์ได้ ซึ่งเคารพพารามิเตอร์อินพุตของคุณ
การเลือกสถาปัตยกรรมที่เหมาะสม
สถาปัตยกรรมที่มีประสิทธิภาพที่สุดสำหรับการอนุมานแบบไม่เซ็นเซอร์คือการตั้งค่าโมเดลเดียว ตัวรวมมักเพิ่มความล่าช้าและความซับซ้อนโดยการส่งคำขอไปยังโมเดลต่างๆ ซึ่งอาจทำให้ลักษณะแบบไม่เซ็นเซอร์ของโมเดลหลักของคุณเจือจางลง โดยการโฮสต์โมเดลภาษาขนาดใหญ่เพียงตัวเดียว คุณควบคุมเส้นทางการอนุมานได้เต็มที่และรับประกันว่าการปรับแต่งโมเดลเพื่อความทนทานต่อเนื้อหาจะถูกนำไปใช้อย่างสม่ำเสมอ
มองหา API ที่เปิดใช้งานเฉพาะเอนด์พอยต์ที่จำเป็น: POST /v1/chat/completions สำหรับการสร้างข้อความ และ GET /v1/models สำหรับข้อมูลเมตา หลีกเลี่ยงบริการที่เสนอ embeddings การสร้างภาพ หรือการปรับแต่งเฉพาะทาง เว้นแต่คุณต้องการใช้งานจริง เนื่องจากฟีเจอร์เหล่านี้เพิ่มภาระที่ไม่จำเป็น API ที่เน้นเฉพาะช่วยลดเวลาแฝงและต้นทุน ให้บริการสร้างข้อความบริสุทธิ์ที่ผสานรวมกับไคลเอนต์ที่เข้ากันได้กับ OpenAI ได้อย่างราบรื่น
โครงสร้าง API Endpoint
API ที่เข้ากันได้กับ OpenAI ปฏิบัติตามโครงสร้าง RESTful มาตรฐาน เพื่อสร้างข้อความ คุณส่งคำขอ POST ไปยัง /v1/chat/completions พร้อมข้อความและพารามิเตอร์ของคุณ URL พื้นฐานมักจะคล้ายกับ https://api.uncensoredgpt.cc/v1 คุณต้องรวมคีย์ API ของคุณในหัว Authorization
เอนด์พอยต์ GET /v1/models จะแสดงรายการโมเดลที่มีให้บริการ ซึ่งในการตั้งค่าโมเดลเดียวมักจะแสดงรายการเพียงรายการเดียว สิ่งนี้ยืนยันว่าบริการเปิดใช้งานและพร้อมรับคำขอ ไม่มีตารางกำหนดเส้นทางที่ซับซ้อนหรือกลไกสำรอง API ถูกออกแบบมาสำหรับการโต้ตอบโดยตรงที่ทำนายได้
- POST /v1/chat/completions: เอนด์พอยต์หลักสำหรับการสร้างข้อความ
- GET /v1/models: เอนด์พอยต์เพื่อตรวจสอบความพร้อมของโมเดล
- Authorization: จำเป็นต้องมีโทเคน Bearer สำหรับคำขอทั้งหมด
การจัดการหน้าต่างบริบท
หน้าต่างบริบทขนาด 100,000 โทเคนอนุญาตให้ใช้อินพุตและเอาต์พุตจำนวนมากภายในคำขอเดียว ความจุนี้จำเป็นสำหรับการสร้างเนื้อหาแบบยาว งานการให้เหตุผลที่ซับซ้อน หรือการประมวลผลเอกสารขนาดใหญ่ หน้าต่างบริบทรวมถึงทั้งพรอมต์ (อินพุต) และการสร้างผลลัพธ์ (เอาต์พุต) คุณต้องมั่นใจว่าจำนวนโทเคนรวมไม่เกินขีดจำกัดนี้
ควรระวังความยาวสูงสุดของผลลัพธ์ แม้หน้าต่างบริบทจะรองรับ 100,000 โทเคน แต่ความยาวสูงสุดของผลลัพธ์ต่อคำขออาจถูกจำกัดไว้ที่ 32,000 โทเคน หากไม่ระบุพารามิเตอร์ max_tokens ความยาวผลลัพธ์เริ่มต้นอาจถูกจำกัดไว้ที่ 2,048 โทเคน โปรดวางแผนพรอมต์ของคุณ accordingly เพื่อใช้ประโยชน์จากหน้าต่างบริบทที่มีอยู่ให้สูงสุดโดยไม่ชนกับขีดจำกัด
สตรีมมิงและเอาต์พุตแบบเรียลไทม์
รองรับสตรีมมิงผ่าน Server-Sent Events (SSE) สิ่งนี้ช่วยให้คุณรับโทเคนแบบเรียลไทม์เมื่อถูกสร้าง ซึ่งปรับปรุงประสบการณ์ผู้ใช้สำหรับแอปพลิเคชันแบบโต้ตอบ API จะสตรีมข้อมูลการใช้งานโทเคนในชิ้นสุดท้าย ให้ข้อมูลการเรียกเก็บเงินที่แม่นยำแม้ในช่วงเซสชันสตรีมมิง
เพื่อเปิดใช้งานสตรีมมิง ให้ตั้งค่าพารามิเตอร์ stream เป็น true ในคำขอของคุณ การตอบกลับจะเป็นชุดของเหตุการณ์ แต่ละเหตุการณ์มีเนื้อหาบางส่วน สิ่งนี้เหมาะสำหรับอินเทอร์เฟซแชท การสร้างโค้ดแบบสด และสถานการณ์ใดๆ ที่ความล่าช้าสำคัญ คุณสามารถแยกวิเคราะห์เหตุการณ์เหล่านี้โดยใช้ไลบรารีไคลเอนต์ HTTP มาตรฐาน
การใช้งานเครื่องมือและการเรียกใช้ฟังก์ชัน
API รองรับ function calling ซึ่งอนุญาตให้โมเดลสร้างข้อมูลที่มีโครงสร้างหรือเรียกใช้เครื่องมือภายนอก คุณสามารถกำหนดสคีมาฟังก์ชันในพารามิเตอร์ tools และระบุ tool_choice เพื่อควบคุมวิธีที่โมเดลตัดสินใจใช้งานสิ่งเหล่านี้ สิ่งนี้เปิดใช้งานเวิร์กโฟลว์ที่ซับซ้อนที่ LLM สามารถดึงข้อมูล ดำเนินการคำนวณ หรือกระตุ้นการกระทำตามอินพุตของผู้ใช้
โหมด JSON ก็พร้อมใช้งานผ่านพารามิเตอร์ response_format ที่ตั้งค่าเป็น {"type": "json_object"} สิ่งนี้รับประกันว่าโมเดลจะส่งออก JSON ที่ถูกต้อง ซึ่งสำคัญสำหรับการผสานรวมแบบโปรแกรม คุณสามารถปรับพารามิเตอร์เช่น temperature, top_p และ seed เพื่อควบคุมความคิดสร้างสรรค์และความสามารถในการทำซ้ำ คุณลักษณะเหล่านี้ทำให้ API เหมาะสำหรับการสร้างแอปพลิเคชัน AI ที่ซับซ้อน
การจัดการโทเคนและการเรียกเก็บเงิน
การเรียกเก็บเงินมีความโปร่งใสและอิงตามการใช้งานโทเคนจริง ราคาคือ $0.25 ต่อ 1M โทเคนอินพุต และ $1.00 ต่อ 1M โทเคนเอาต์พุต ข้อผิดพลาดและการปฏิเสธเป็นฟรี หมายความว่าคุณจ่ายเฉพาะการสร้างผลลัพธ์ที่สำเร็จ ไม่มีค่าธรรมเนียมรายเดือนหรือการสมัครสมาชิก คุณเติมเครดิตล่วงหน้าซึ่งไม่หมดอายุ
การเติมเงินรับได้ผ่านคริปโทเคอร์เรนซี ได้แก่ USDT (TRC20) หรือ USDC (Base) จำนวนเงินเติมขั้นต่ำอยู่ที่ $10 ถึง $500 พร้อมเครดิตโบนัสสำหรับยอดที่สูงขึ้น ไม่รับบัตรเครดิตหรือ PayPal สำหรับการเติมเงิน บัญชีใหม่จะได้รับเครดิตทดลองใช้ $0.50 ใช้งานได้ 7 วัน ไม่ต้องใช้บัตรจำกัดรวมถึง 300 คำขอต่อนาที และ 8 คำขอพร้อมกันต่อกีย์
ความเป็นส่วนตัวและการจัดการข้อมูล
ความเป็นส่วนตัวเป็นข้อพิจารณาสำคัญสำหรับผู้ใช้จำนวนมาก API ไม่ใช้พรอมต์ของคุณสำหรับข้อมูลการฝึก ซึ่งรักษาความเป็นส่วนตัวของข้อมูลอินพุตของคุณ การสร้างบัญชีต้องการเพียงที่อยู่อีเมล ไม่ต้องใช้หมายเลขโทรศัพท์ ซึ่งลดการเก็บรวบรวมข้อมูลส่วนบุคคลให้น้อยที่สุดขณะยังคงให้การเข้าถึง API เต็มรูปแบบ
ข้อจำกัดของเนื้อหามีน้อยแต่เฉพาะเจาะจง โมเดลไม่ปฏิเสธหัวข้อผู้ใหญ่ที่ถูกกฎหมาย สมมติ หรือที่ถกเถกัน อย่างไรก็ตาม มีขีดจำกัดเด็ดขาด: เนื้อหาทางเพศที่เกี่ยวข้องกับผู้เยาว์จะถูกบล็อกเสมอ ซึ่งรักษาความสอดคล้องกับมาตรฐานกฎหมายพื้นฐานขณะรักษาสภาพแวดล้อมที่อนุญาตเนื้อหาประเภทอื่นได้อย่างสูง
เริ่มต้นใช้งานคีย์ของคุณ
การสมัครใช้งานเป็นเรื่องง่าย คุณสามารถใช้ "ดำเนินการต่อด้วย Google" หรือสร้างบัญชีด้วยอีเมลและรหัสผ่าน เมื่อลงทะเบียนเสร็จสิ้น คีย์ API ของคุณจะแสดงทันที ทำให้คุณสามารถเริ่มส่งคำขอได้ทันทีโดยไม่ต้องรอ ไม่ต้องมีการยืนยันหมายเลขโทรศัพท์ และกระบวนการถูกออกแบบมาเพื่อความเร็ว
เพื่อผสานรวม ให้อัปเดต URL พื้นฐานของไคลเอนต์ของคุณเป็น https://api.uncensoredgpt.cc/v1 และตั้งค่าคีย์ API ใช้ ID โมเดล "uncensored" สำหรับคำขอทั้งหมด วิธีการโมเดลเดียวนี้รับประกันความสม่ำเสมอและกำจัดความซับซ้อนของการกำหนดเส้นทาง คุณสามารถเริ่มสตรีม เรียกฟังก์ชัน หรือสร้างข้อความยาวได้ทันที
ถาม-ตอบ
API นี้เหมาะสำหรับเนื้อหา NSFW หรือไม่?
ใช่ โมเดลไม่เซ็นเซอร์และไม่ปฏิเสธหัวข้อผู้ใหญ่ที่ถูกกฎหมาย สมมติ หรือที่ถกเถกัน ออกแบบมาเพื่อจัดการเนื้อหา NSFW โดยไม่มีข้อจำกัดแบบสุ่ม ยกเว้นการบล็อกเนื้อหาทางเพศที่เกี่ยวข้องกับผู้เยาว์อย่างเด็ดขาด
ฉันจะชำระเงินสำหรับ API ได้อย่างไร?
ชำระเงินผ่านคริปโทเคอร์เรนซีเท่านั้น: USDT (TRC20) หรือ USDC (Base) ไม่มีตัวเลือกบัตรเครดิต PayPal หรือโอนเงินผ่านธนาคาร ยอดเติมเงินมีตั้งแต่ $10 ถึง $500 และเครดิตไม่หมดอายุ
ขนาดหน้าต่างบริบทคือเท่าใด?
หน้าต่างบริบทมีขนาด 100,000 โทเคน ซึ่งรวมถึงทั้งพรอมต์และการสร้างข้อความ เอาต์พุตสูงสุดต่อคำขอคือ 32,000 โทเคน หรือ 2,048 หากไม่ได้ระบุ <code>max_tokens</code>
API ใช้ข้อมูลของฉันสำหรับการฝึกโมเดลหรือไม่
ไม่ พรอมต์ไม่ถูกนำไปใช้ในการฝึกบริการนี้ออกแบบมาเพื่อความเป็นส่วนตัว โดยต้องการเพียงอีเมลสำหรับการสร้างบัญชี และรับประกันว่าข้อมูลอินพุตของคุณจะเป็นของคุณ
คีย์ของคุณอยู่ห่างแค่แบบฟอร์มเดียว
สร้างบัญชี คัดลอกคีย์ เปลี่ยน URL พื้นฐาน นั่นคือการตั้งค่าทั้งหมด