中文 ▾
获取 API 密钥

如何通过 OpenAI 兼容 API 托管无审查 LLM

托管无审查 LLM 可提供直接、无拒绝的推理接口,专为成人、创意或无限制内容生成而定制。使用 OpenAI 兼容架构,你可立即进行 SDK 集成,无需模型路由或复杂的供应商锁定开销。

更新于

要点

  • 使用单模型架构以消除路由复杂性,并确保一致的无审查行为。
  • OpenAI 兼容接口允许你插入 API 密钥和基础 URL,实现即插即用集成。
  • 透明的按 token 计费与预付加密额度确保你只为实际使用付费,错误和拒绝视为免费。
  • 隐私通过确保提示词不进入训练数据来维持,并对轻度色情内容实行硬性屏蔽,无论模型的一般容忍度如何。

为何托管无审查 LLM?

标准 LLM API 通常应用严格的内容过滤器,可能会拒绝合法的成人主题、细微的创意写作或争议性话题。托管无审查 LLM 意味着你控制推理层,确保模型对你的提示词做出响应,而不会出现任意拒绝。这对于需要原始、无过滤文本生成的应用至关重要,例如角色扮演引擎、创意写作助手或分析敏感数据的研究工具。

与通过多个模型路由请求的聚合器不同,托管的无审查 LLM API 通常提供单一、经过微调的模型。这简化了调试过程,并确保你的应用程序中行为的一致性。你避免了模型版本控制或大型提供商突然政策变更的不可预测性。结果是一个可靠、确定性的文本到文本服务,尊重你的输入参数。

选择正确的架构

无审查推理最高效的架构是单模型设置。聚合器通常通过向各种模型路由请求来引入延迟和复杂性,这可能会稀释你主要模型的无审查特性。通过托管单一大型语言模型,你可以完全控制推理管道,并确保模型的内容容忍度调整得到一致应用。

寻找仅暴露必要接口的 API:POST /v1/chat/completions 用于生成,GET /v1/models 用于元数据。除非你需要,否则避免提供嵌入、图像生成或微调的服务,因为这些会增加不必要的开销。专注的 API 可降低延迟和成本,提供与现有 OpenAI 兼容客户端无缝集成的纯文本生成服务。

API 接口结构

兼容 OpenAI 的 API 遵循标准的 RESTful 结构。要生成文本,你需向 POST 请求 /v1/chat/completions 发送消息和参数。基础 URL 通常为 https://api.uncensoredgpt.cc/v1。你必须在 Authorization 头中包含 API 密钥。

GET /v1/models 接口返回可用模型列表,在单模型设置中,通常只列出一个条目。这确认服务已激活并准备接受请求。没有复杂的路由表或回退机制;API 旨在提供直接、可预测的交互。

  • POST /v1/chat/completions:文本生成的主接口。
  • GET /v1/models:验证模型可用性的接口。
  • Authorization:所有请求都需要 Bearer 令牌。

处理上下文窗口

100,000 token 的上下文窗口允许在单个请求中进行大量的输入和输出。这种容量对于长文本内容生成、复杂推理任务或处理大型文档至关重要。上下文窗口包含提示词(输入)和补全(输出)。你必须确保总 token 数不超过此限制。

注意最大输出长度。虽然上下文窗口为 100,000 token,但每次请求的最大输出可能限制为 32,000 token。如果你未指定 max_tokens 参数,默认输出长度可能限制为 2,048 token。相应地规划你的提示词,以在不触及硬性限制的情况下最大化可用上下文的效用。

流式输出与实时输出

支持通过服务器发送事件 (SSE) 进行流式输出。这允许你在生成 token 时实时接收它们,从而提高交互式应用程序的用户体验。API 在最后一个块中流式传输 token 使用信息,即使在流式传输会话期间也能提供准确的计费数据。

要启用流式输出,请在请求中将 stream 参数设置为 true。响应将是一系列事件,每个事件包含部分补全。这对于聊天界面、实时代码生成以及任何对延迟敏感的场景都非常理想。你可以使用标准 HTTP 客户端库解析这些事件。

工具使用与函数调用

API 支持函数调用,允许模型生成结构化数据或调用外部工具。你可以在 tools 参数中定义函数模式,并指定 tool_choice 来控制模型决定如何使用它们。这启用了复杂的工作流,其中 LLM 可以根据用户输入获取数据、执行计算或触发操作。

JSON 模式也可通过设置 response_format 参数为 {"type": "json_object"} 获得。这确保模型输出有效的 JSON,这对于程序化集成至关重要。你可以调整 temperature、top_p 和 seed 等参数来控制创造力和可重复性。这些功能使 API 适合构建复杂的 AI 驱动应用程序。

Token 管理与计费

计费透明,基于实际 token 使用量。价格为每 1M 输入 token $0.25,每 1M 输出 token $1.00。错误和拒绝免费,意味着你只为成功的补全付费。没有月费或订阅;你预加载额度,且永不失效。

充值仅接受加密货币,具体为 USDT (TRC20) 或 USDC (Base)。最低充值金额范围为 $10 至 $500,大额充值有额外额度赠送。不接受信用卡或 PayPal 充值。新账户获得 $0.50 试用额度,有效期 7 天,无需信用卡。限制包括每分钟 300 次请求和每个密钥 8 个并发请求。

隐私与数据处理

隐私是许多用户的关键考虑因素。API 不将你的提示词用于训练数据,确保你的输入保持私密。创建账户仅需电子邮件,无需电话号码。这最大限度地减少了个人数据收集,同时提供对 API 的完全访问权限。

内容限制很少但具体。模型不会拒绝合法的成人、虚构或争议性话题。但是,有一个硬性限制:涉及未成年人的性内容始终被屏蔽。这确保了符合基本法律标准,同时为其他类型的内容保持高度宽松的环境。

使用密钥入门

注册非常简单。你可以使用“使用 Google 继续”或创建带有电子邮件和密码的账户。注册后,你的 API 密钥将立即显示,允许你立即开始发出请求。无需电话号码验证,该流程专为速度而设计。

要集成,请将客户端的基础 URL 更新为 https://api.uncensoredgpt.cc/v1 并设置 API 密钥。对所有请求使用模型 ID "uncensored"。这种单模型方法可确保一致性并消除路由的复杂性。你可以立即开始流式输出、调用函数或生成长文本。

问答

此 API 是否适合 NSFW 内容?

是的,该模型无审查,不会拒绝合法的成人、虚构或争议性话题。它专为处理 NSFW 内容而设计,没有任意限制,仅对涉及未成年人的性内容有硬性屏蔽。

我如何为 API 付费?

仅接受加密货币支付:USDT (TRC20) 或 USDC (Base)。没有信用卡、PayPal 或银行转账选项。充值范围为 $10 至 $500,额度永不过期。

上下文窗口大小是多少?

上下文窗口为 100,000 token,包含提示词和补全。每次请求的最大输出为 32,000 token,若未指定 <code>max_tokens</code> 则为 2,048。

API 是否使用我的数据进行训练?

不会,提示词不用于训练。该服务注重隐私,仅需邮箱即可创建账户,并确保你的输入数据归你所有。

只差一张表单,即可获得密钥

创建账户、复制密钥、修改基础 URL。这就是全部设置。

获取 API 密钥