RU ▾
Получить API-ключ

Как развернуть нецензурную LLM через API, совместимый с OpenAI

Размещение LLM без цензуры предоставляет прямой эндпоинт для вывода без отказов, адаптированный для генерации контента для взрослых, творческого или неограниченного. Используя архитектуру, совместимую с OpenAI, вы получаете интеграцию SDK без накладных расходов на маршрутизацию моделей или сложную привязку к поставщику.

Обновлено

Ключевые моменты

  • Используйте архитектуру с одной моделью, чтобы устранить сложность маршрутизации и обеспечить последовательное поведение без цензуры.
  • Эндпоинт, совместимый с OpenAI, позволяет заменить API-ключ и базовый URL для немедленной интеграции без переделки кода.
  • Прозрачная тарификация за токен с предоплаченным крипто-балансом гарантирует, что вы платите только за фактическое использование, а ошибки и отказы считаются бесплатными.
  • Конфиденциальность обеспечивается тем, что промпты не попадают в обучающие данные, при этом жёсткий запрет на сексуальный контент с участием несовершеннолетних действует независимо от общей толерантности модели.

Зачем развертывать нецензурную LLM?

Стандартные API LLM часто применяют строгие фильтры контента, которые могут отказывать в законных темах для взрослых, тонкой творческой литературе или спорных вопросах. Размещение LLM без цензуры означает, что вы контролируете слой вывода, гарантируя, что модель отвечает на ваши промпты без произвольных отказов. Это критично для приложений, требующих генерации текста без фильтров, таких как движки ролевых игр, помощники для творческого письма или исследовательские инструменты, анализирующие чувствительные данные.

В отличие от агрегаторов, которые маршрутизируют запросы через несколько моделей, API развернутой нецензурной LLM обычно обслуживает одну настроенную модель. Это упрощает отладку и обеспечивает последовательное поведение во всем приложении. Вы избегаете непредсказуемости версионирования моделей или внезапных изменений политики крупными провайдерами. Результатом является надежный детерминированный сервис «текст-в-текст», уважающий ваши входные параметры.

Выбор правильной архитектуры

Самая эффективная архитектура для вывода без цензуры — это настройка с одной моделью. Агрегаторы часто добавляют задержки и сложность, маршрутизируя запросы к различным моделям, что может размыть характеристики без цензуры вашей основной модели. Размещая одну большую языковую модель, вы сохраняете полный контроль над конвейером вывода и обеспечиваете последовательное применение настройки модели на толерантность к контенту.

Ищите API, который предоставляет только необходимые эндпоинты: POST /v1/chat/completions для генерации и GET /v1/models для метаданных. Избегайте сервисов, предлагающих эмбеддинги, генерацию изображений или тонкую настройку, если они вам не нужны, так как это добавляет ненужные накладные расходы. Сфокусированный API снижает задержки и стоимость, предоставляя чистую службу генерации текста, которая бесшовно интегрируется с существующими клиентами, совместимыми с OpenAI.

Структура эндпоинта API

API, совместимый с OpenAI, следует стандартной RESTful-структуре. Чтобы сгенерировать текст, вы отправляете POST запрос на /v1/chat/completions с вашими сообщениями и параметрами. Базовый URL обычно выглядит так: https://api.uncensoredgpt.cc/v1. Вы должны указать свой API-ключ в заголовке Authorization.

Эндпоинт GET /v1/models возвращает список доступных моделей, которые в настройке с одной моделью обычно содержат только одну запись. Это подтверждает, что сервис активен и готов принимать запросы. Нет сложных таблиц маршрутизации или механизмов резервирования; API предназначен для прямого, предсказуемого взаимодействия.

  • POST /v1/chat/completions: Основной эндпоинт для генерации текста.
  • GET /v1/models: Эндпоинт для проверки доступности модели.
  • Authorization: Требуется токен Bearer для всех запросов.

Работа с контекстными окнами

Контекстное окно на 100 000 токенов позволяет обрабатывать значительные объемы ввода и вывода в рамках одного запроса. Эта емкость необходима для генерации длинных текстов, сложных задач рассуждения или обработки больших документов. Контекстное окно включает как промпт (ввод), так и завершение (вывод). Вы должны убедиться, что общее количество токенов не превышает этот лимит.

Обратите внимание на максимальную длину вывода. Хотя контекстное окно составляет 100 000 токенов, максимальный объем вывода на запрос может быть ограничен 32 000 токенами. Если вы не укажете параметр max_tokens, длина вывода по умолчанию может быть ограничена 2 048 токенами. Планируйте свои промпты соответствующим образом, чтобы максимально использовать доступный контекст, не достигая жестких ограничений.

Потоковая передача и вывод в реальном времени

Поддерживается потоковая передача через Server-Sent Events (SSE). Это позволяет получать токены в реальном времени по мере их генерации, улучшая пользовательский опыт для интерактивных приложений. API передает информацию об использовании токенов в последнем чанке, обеспечивая точные данные для биллинга даже во время сессий потоковой передачи.

Чтобы включить потоковую передачу, установите параметр stream в значение true в вашем запросе. Ответ будет представлять собой серию событий, каждое из которых содержит частичное завершение. Это идеально подходит для интерфейсов чата, генерации кода в реальном времени и любых сценариев, где важна задержка. Вы можете анализировать эти события с помощью стандартных библиотек HTTP-клиентов.

Использование инструментов и вызов функций

API поддерживает вызов функций, позволяя модели генерировать структурированные данные или вызывать внешние инструменты. Вы можете определить схемы функций в параметре tools и указать tool_choice, чтобы контролировать, как модель решает их использовать. Это позволяет создавать сложные рабочие процессы, где LLM может получать данные, выполнять вычисления или запускать действия на основе ввода пользователя.

JSON-режим также доступен через параметр response_format, установленный в {"type": "json_object"}. Это гарантирует, что модель выводит действительный JSON, что критически важно для программной интеграции. Вы можете настроить параметры, такие как temperature, top_p и seed, чтобы контролировать креативность и воспроизводимость. Эти функции делают API подходящим для создания сложных приложений на основе ИИ.

Управление токенами и биллинг

Биллинг прозрачен и основан на фактическом использовании токенов. Цена составляет $0,25 за 1M входных токенов и $1,00 за 1M выходных токенов. Ошибки и отказы бесплатны, что означает, что вы платите только за успешные завершения. Нет ежемесячных платежей или подписок; вы предварительно загружаете кредиты, которые не сгорают.

Пополнения принимаются криптовалютой, конкретно USDT (TRC20) или USDC (Base). Минимальные суммы пополнения варьируются от $10 до $500, с бонусными кредитами за большие суммы. Для пополнений не принимаются кредитные карты или PayPal. Новый аккаунт получает $0,50 пробного кредита, действительного в течение 7 дней, без необходимости карты. Лимиты включают 300 запросов в минуту и 8 параллельных запросов на ключ.

Конфиденциальность и обработка данных

Конфиденциальность является ключевым соображением для многих пользователей. API не использует ваши промпты для обучающих данных, гарантируя, что ваш ввод остается приватным. Для создания аккаунта требуется только адрес электронной почты, без необходимости номера телефона. Это минимизирует сбор персональных данных, предоставляя полный доступ к API.

Ограничения контента минимальны, но конкретны. Модель не отказывается от законных взрослых, вымышленных или спорных тем. Однако действует жёсткое ограничение: контент сексуального характера с участием несовершеннолетних всегда блокируется. Это обеспечивает соответствие базовым правовым стандартам, сохраняя максимально либеральную среду для других типов контента.

Начало работы с вашим ключом

Регистрация проста. Вы можете использовать «Продолжить с Google» или создать аккаунт с адресом электронной почты и паролем. После регистрации ваш API-ключ отображается немедленно, позволяя начать отправку запросов без задержек. Не требуется проверка номера телефона, и процесс разработан для скорости.

Для интеграции обновите базовый URL клиента на https://api.uncensoredgpt.cc/v1 и установите API-ключ. Используйте идентификатор модели "uncensored" для всех запросов. Этот подход с одной моделью обеспечивает согласованность и устраняет сложность маршрутизации. Вы можете сразу начать потоковую передачу, вызов функций или генерацию длинных текстов.

Вопросы и ответы

Подходит ли этот API для NSFW-контента?

Да, модель без цензуры и не отказывает в законных взрослых, вымышленных или спорных темах. Она создана для обработки NSFW-контента без произвольных ограничений, за исключением жесткого блокирования сексуального контента, который является незначительным по степени.

Как оплатить API?

Оплата принимается только криптовалютой: USDT (TRC20) или USDC (Base). Вариантов оплаты картой, через PayPal или банковский перевод нет. Пополнения от $10 до $500, кредиты не сгорают.

Каков размер контекстного окна?

Контекстное окно составляет 100 000 токенов, включая промпт и завершение. Максимальный вывод на запрос — 32 000 токенов или 2 048, если <code>max_tokens</code> не указан.

Использует ли API ваши данные для обучения?

Нет, промпты не используются для обучения. Сервис спроектирован как приватный: для создания аккаунта требуется только электронная почта, а ваши входные данные остаются вашими.

Ваш ключ — в одной форме от вас

Создайте аккаунт, скопируйте ключ, измените базовый URL. Вот и вся настройка.

Получить API-ключ