如何透過 OpenAI 相容 API 託管無審查 LLM
託管無審查 LLM 可提供直接且無拒絕的推理端點,專為成人、創意或不受限制的內容生成而設計。透過採用 OpenAI 相容架構,你無需承受模型路由的額外開銷或複雜的供應商鎖定,即可立即進行 SDK 整合。
更新
重點摘要
- 使用單一模型架構以消除路由複雜性,並確保一致的無審查行為。
- OpenAI 相容端點允許您插入 API 金鑰和基礎 URL,即可立即進行整合。
- 透明的每 token 計費與預付加密額度確保您僅為實際使用付費,錯誤與拒絕視為免費。
- 隱私透過將提示詞排除在訓練資料之外來維持,無論模型的整體容忍度為何,都會嚴格禁止未成年人性內容。
為何要託管無審查 LLM?
標準 LLM API 通常會套用嚴格的内容篩選器,拒絕合法的成人主題、細膩的創意寫作或爭議性主題。託管無審查 LLM 意味著您控制推論層,確保模型回應您的提示詞而不會任意拒絕。這對於需要原始、無過濾文本生成的應用程式(如角色扮演引擎、創意寫作助手或分析敏感資料的研究工具)至關重要。
與透過多個模型路由請求的聚合器不同,託管的無審查 LLM API 通常提供單一、經過微調的模型。這簡化了除錯過程,並確保您的應用程式行為一致。您避免了模型版本或大型供應商突然政策變更帶來的不可預測性。結果是一個可靠、確定性的文本輸入/輸出服務,尊重您的輸入參數。
選擇合適的架構
無審查推論最高效的架構是單一模型設定。聚合器通常透過將請求路由到各種模型來引入延遲和複雜性,這可能會稀釋主要模型的無審查特性。透過託管單一大型語言模型,您可以完全控制推論管線,確保模型對內容容忍度的微調得到一致應用。
尋找僅暴露必要端點的 API:POST /v1/chat/completions 用於生成,GET /v1/models 用於元數據。除非您需要,否則避免提供嵌入、圖像生成或微調的服務,因為這些會增加不必要的開銷。專注的 API 可降低延遲和成本,提供與現有 OpenAI 相容客戶端無縫整合的純文本生成服務。
API 端點結構
OpenAI 相容的 API 遵循標準的 RESTful 結構。要生成文字,請發送 POST 請求至 /v1/chat/completions,並附上你的訊息與參數。基礎 URL 通常類似於 https://api.uncensoredgpt.cc/v1。你必須在 Authorization 標頭中包含你的 API 金鑰。
GET /v1/models 端點會回傳可用模型清單;在單一模型設定下,通常只會列出單一項目。這確認服務已啟動並準備好接受請求。沒有複雜的路由表或備援機制;API 設計用於直接且可預測的互動。
- POST /v1/chat/completions:文字生成的主要端點。
- GET /v1/models:驗證模型可用性的端點。
- Authorization:所有請求均需 Bearer token。
處理上下文視窗
100,000 token 的上下文視窗允許在單一請求中處理大量的輸入與輸出。這種容量對於長篇內容生成、複雜推理任務或處理大型文件至關重要。上下文視窗包含提示詞(輸入)與補全(輸出)。你必須確保總 token 數量不超過此限制。
注意最大輸出長度。雖然上下文視窗為 100,000 token,但每次請求的最大輸出可能限制為 32,000 token。如果您未指定 max_tokens 參數,預設輸出長度可能限制為 2,048 token。請相應規劃您的提示詞,以在不觸及硬性限制的情況下最大化可用上下文。
串流輸出與即時輸出
支援透過伺服器發送事件 (SSE) 進行串流輸出。這允許你在 token 生成時即時接收,改善互動式應用程式的使用者體驗。API 會在最後一個區塊中串流輸出 token 使用資訊,即使在串流工作階段中也能提供準確的計費資料。
要啟用串流輸出,請在請求中將 stream 參數設為 true。回應將是一系列事件,每個事件包含部分補全結果。這非常適合聊天介面、即時程式碼生成以及任何對延遲敏感的場景。你可以使用標準 HTTP 用戶端程式庫來解析這些事件。
工具使用與函式呼叫
API 支援函式呼叫,允許模型生成結構化資料或調用外部工具。您可以在 tools 參數中定義函式架構,並指定 tool_choice 以控制模型如何使用它們。這允許複雜的工作流程,其中 LLM 可以根據使用者輸入獲取資料、執行計算或觸發動作。
也可透過將 response_format 參數設為 {"type": "json_object"} 來使用 JSON 模式。這能確保模型輸出有效的 JSON,對於程式化整合至關重要。你可以調整 temperature、top_p 和 seed 等參數以控制創造力與可重現性。這些功能使 API 適合建構複雜的 AI 驅動應用程式。
Token 管理與計費
計費透明且基於實際 token 使用量。價格為每 1M 輸入 token $0.25,每 1M 輸出 token $1.00。錯誤與拒絕免費,也就是說你只需為成功的補全付費。沒有月費或訂閱費;你預先儲值額度,且永不過期。
接受透過加密貨幣進行儲值,具體為 USDT (TRC20) 或 USDC (Base)。最低儲值金額介於 $10 至 $500 之間,較大量儲值享有額外額度。不接受信用卡或 PayPal 進行儲值。新帳戶會獲得 $0.50 的免費試用額度,有效期 7 天,無需信用卡。限制包括每分鐘 300 次請求,每支金鑰 8 個並行請求。
隱私與資料處理
隱私是許多使用者的關鍵考量。API 不會將您的提示詞用於訓練資料,確保您的輸入保持私密。帳戶建立僅需電子郵件地址,無需電話號碼。這在提供 API 完整存取權的同時,最小化了個人資料收集。
內容限制很少但具體。該模型不會拒絕合法的成人、虛構或爭議性主題。然而,有一個硬性限制:涉及未成年人的性內容始終會被封鎖。這確保了符合基本法律標準,同時為其他類型內容保持高度寬鬆的環境。
使用您的金鑰開始
註冊非常簡單。您可以使用「使用 Google 繼續」或建立電子郵件和密碼帳戶。註冊後,您的 API 金鑰會立即顯示,讓您無需延遲即可開始發送請求。無需電話號碼驗證,該流程設計為快速。
要進行整合,請將客戶端的基础 URL 更新為 https://api.uncensoredgpt.cc/v1 並設定 API 金鑰。對於所有請求,使用模型 ID "uncensored"。這種單一模型方法確保一致性並消除路由的複雜性。您可以立即開始串流輸出、呼叫函式或生成長文本。
問答
此 API 適合 NSFW 內容嗎?
是的,該模型為無審查模型,不會拒絕合法的成人、虛構或爭議性主題。它設計用於處理 NSFW 內容,無任意限制,僅對涉及未成年人的性內容有硬性封鎖。
我該如何為 API 付費?
僅接受加密貨幣付款:USDT (TRC20) 或 USDC (Base)。沒有信用卡、PayPal 或銀行轉帳選項。儲值金額介於 $10 至 $500 之間,且額度永不過期。
上下文視窗的大小是多少?
上下文視窗為 100,000 token,包含提示詞與補全內容。每次請求的最大輸出為 32,000 token;若未指定 <code>max_tokens</code>,則上限為 2,048 token。
API 會將我的資料用於訓練嗎?
不會,提示詞不會用於訓練。該服務設計為隱私導向,僅需電子郵件即可建立帳戶,並確保您的輸入資料仍由您擁有。
只差一張表單,即可取得金鑰
建立帳戶、複製金鑰、更改基礎 URL。設定即如此簡單。