VI ▾
Lấy khóa API

Cách triển khai LLM không kiểm duyệt qua API tương thích OpenAI

Lưu trữ một LLM không kiểm duyệt cung cấp cho bạn một endpoint suy luận trực tiếp, không từ chối, được tùy chỉnh cho việc tạo nội dung người lớn, sáng tạo hoặc không giới hạn. Bằng cách sử dụng kiến trúc tương thích OpenAI, bạn có thể tích hợp SDK ngay lập tức mà không cần chịu chi phí của việc định tuyến mô hình hoặc khóa nhà cung cấp phức tạp.

Cập nhật

Điểm chính

  • Sử dụng kiến trúc mô hình đơn để loại bỏ độ phức tạp của việc định tuyến và đảm bảo hành vi không kiểm duyệt nhất quán.
  • Một endpoint tương thích OpenAI cho phép bạn thay thế khóa API và URL cơ sở để tích hợp ngay lập tức.
  • Thanh toán minh bạch theo token với tín dụng crypto trả trước đảm bảo bạn chỉ trả cho việc sử dụng thực tế, với lỗi và từ chối được tính miễn phí.
  • Tính bảo mật được duy trì bằng cách giữ các prompt khỏi dữ liệu huấn luyện, với việc chặn cứng đối với nội dung tình dục liên quan đến trẻ vị thành niên bất kể mức độ dung nạp chung của mô hình.

Tại sao triển khai LLM không kiểm duyệt?

Các API LLM tiêu chuẩn thường áp dụng bộ lọc nội dung nghiêm ngặt có thể từ chối các chủ đề người trưởng thành hợp pháp, văn học sáng tạo tinh tế hoặc các chủ đề gây tranh cãi. Triển khai LLM không kiểm duyệt có nghĩa là bạn kiểm soát lớp suy luận, đảm bảo mô hình phản hồi các prompt của bạn mà không có sự từ chối tùy tiện. Điều này rất quan trọng đối với các ứng dụng yêu cầu tạo văn bản thô, không lọc, chẳng hạn như công cụ nhập vai, trợ lý viết sáng tạo hoặc công cụ nghiên cứu phân tích dữ liệu nhạy cảm.

Khác với các bộ tổng hợp định tuyến yêu cầu qua nhiều mô hình, API LLM không kiểm duyệt được triển khai thường phục vụ một mô hình đã được tinh chỉnh duy nhất. Điều này đơn giản hóa việc gỡ lỗi và đảm bảo hành vi nhất quán trên toàn bộ ứng dụng của bạn. Bạn tránh được sự không chắc chắn của việc phân phối phiên bản mô hình hoặc thay đổi chính sách đột ngột từ các nhà cung cấp lớn. Kết quả là một dịch vụ văn bản đầu vào/đầu ra đáng tin cậy, xác định rõ ràng, tôn trọng các tham số đầu vào của bạn.

Chọn kiến trúc phù hợp

Kiến trúc hiệu quả nhất cho suy luận không kiểm duyệt là thiết lập mô hình đơn. Các bộ tổng hợp thường giới thiệu độ trễ và độ phức tạp bằng cách định tuyến các yêu cầu đến các mô hình khác nhau, điều này có thể làm loãng các đặc tính không kiểm duyệt của mô hình chính của bạn. Bằng cách triển khai một mô hình ngôn ngữ lớn duy nhất, bạn duy trì quyền kiểm soát đầy đủ đối với quy trình suy luận và đảm bảo rằng việc tinh chỉnh mô hình để dung nạp nội dung được áp dụng nhất quán.

Hãy tìm một API chỉ hiển thị các endpoint cần thiết: POST /v1/chat/completions để tạo văn bản và GET /v1/models để lấy siêu dữ liệu. Tránh các dịch vụ cung cấp embedding, tạo hình ảnh hoặc tinh chỉnh trừ khi bạn cần chúng, vì những tính năng này thêm độ trễ không cần thiết. Một API tập trung giảm độ trễ và chi phí, cung cấp một dịch vụ tạo văn bản thuần túy tích hợp liền mạch với các máy khách tương thích OpenAI hiện có.

Cấu trúc endpoint API

Một API tương thích OpenAI tuân theo cấu trúc RESTful tiêu chuẩn. Để tạo văn bản, bạn gửi một yêu cầu POST đến /v1/chat/completions với các thông điệp và tham số của bạn. URL cơ sở thường là https://api.uncensoredgpt.cc/v1. Bạn phải bao gồm khóa API của bạn trong tiêu đề Authorization.

Endpoint GET /v1/models trả về danh sách các mô hình có sẵn, trong thiết lập mô hình đơn thường sẽ chỉ liệt kê một mục. Điều này xác nhận dịch vụ đang hoạt động và sẵn sàng chấp nhận các yêu cầu. Không có bảng định tuyến phức tạp hay cơ chế dự phòng; API được thiết kế cho tương tác trực tiếp, có thể dự đoán được.

  • POST /v1/chat/completions: Endpoint chính để tạo văn bản.
  • GET /v1/models: Endpoint để xác minh khả dụng của mô hình.
  • Authorization: Token Bearer bắt buộc cho tất cả các yêu cầu.

Xử lý cửa sổ ngữ cảnh

Cửa sổ ngữ cảnh 100.000 token cho phép đầu vào và đầu ra đáng kể trong một yêu cầu duy nhất. Dung lượng này rất cần thiết cho việc tạo nội dung dài, các nhiệm vụ suy luận phức tạp hoặc xử lý các tài liệu lớn. Cửa sổ ngữ cảnh bao gồm cả prompt (đầu vào) và kết quả (đầu ra). Bạn phải đảm bảo tổng số token không vượt quá giới hạn này.

Hãy lưu ý độ dài đầu ra tối đa. Mặc dù cửa sổ ngữ cảnh là 100.000 token, nhưng độ dài đầu ra tối đa cho mỗi yêu cầu có thể bị giới hạn ở 32.000 token. Nếu bạn không chỉ định tham số max_tokens, độ dài đầu ra mặc định có thể bị giới hạn ở 2.048 token. Hãy lập kế hoạch cho các prompt của bạn để tối đa hóa tiện ích của ngữ cảnh có sẵn mà không chạm vào các giới hạn cứng.

Truyền phát và đầu ra thời gian thực

Truyền phát được hỗ trợ qua Sự kiện gửi qua máy chủ (SSE). Điều này cho phép bạn nhận các token theo thời gian thực khi chúng được tạo, cải thiện trải nghiệm người dùng cho các ứng dụng tương tác. API truyền phát thông tin sử dụng token trong chunk cuối cùng, cung cấp dữ liệu thanh toán chính xác ngay cả trong các phiên truyền phát.

Để bật truyền phát, hãy đặt tham số stream thành true trong yêu cầu của bạn. Phản hồi sẽ là một chuỗi các sự kiện, mỗi sự kiện chứa một kết quả một phần. Điều này rất lý tưởng cho các giao diện trò chuyện, tạo mã trực tiếp và bất kỳ kịch bản nào nơi độ trễ quan trọng. Bạn có thể phân tích các sự kiện này bằng các thư viện máy khách HTTP tiêu chuẩn.

Sử dụng công cụ và gọi hàm

API hỗ trợ gọi hàm, cho phép mô hình tạo dữ liệu có cấu trúc hoặc gọi các công cụ bên ngoài. Bạn có thể xác định lược đồ hàm trong tham số tools và chỉ định tool_choice để kiểm soát cách mô hình quyết định sử dụng chúng. Điều này cho phép các quy trình làm việc phức tạp nơi LLM có thể lấy dữ liệu, thực hiện tính toán hoặc kích hoạt hành động dựa trên đầu vào của người dùng.

Chế độ JSON cũng có sẵn thông qua tham số response_format được đặt thành {"type": "json_object"}. Điều này đảm bảo mô hình xuất ra JSON hợp lệ, điều rất quan trọng cho tích hợp lập trình. Bạn có thể điều chỉnh các tham số như temperature, top_p và seed để kiểm soát sự sáng tạo và khả năng tái lập. Các tính năng này làm cho API phù hợp để xây dựng các ứng dụng AI tinh vi.

Quản lý token và thanh toán

Thanh toán minh bạch và dựa trên việc sử dụng token thực tế. Giá là $0,25 cho mỗi 1 triệu token đầu vào và $1,00 cho mỗi 1 triệu token đầu ra. Lỗi và từ chối là miễn phí, nghĩa là bạn chỉ trả tiền cho các kết quả thành công. Không có phí hàng tháng hoặc đăng ký; bạn nạp trước tín dụng, không bao giờ hết hạn.

Nạp tiền được chấp nhận qua tiền điện tử, cụ thể là USDT (TRC20) hoặc USDC (Base). Số tiền nạp tối thiểu dao động từ $10 đến $500, với tín dụng bổ sung cho các số tiền lớn hơn. Không chấp nhận thẻ tín dụng hoặc PayPal để nạp tiền. Tài khoản mới nhận được $0,50 tín dụng dùng thử có giá trị trong 7 ngày, không cần thẻ. Các giới hạn bao gồm 300 yêu cầu mỗi phút và 8 yêu cầu đồng thời mỗi khóa.

Quyền riêng tư và xử lý dữ liệu

Quyền riêng tư là một yếu tố quan trọng đối với nhiều người dùng. API không sử dụng các prompt của bạn cho dữ liệu huấn luyện, đảm bảo rằng đầu vào của bạn vẫn được bảo mật. Việc tạo tài khoản chỉ yêu cầu địa chỉ email, không cần số điện thoại. Điều này giảm thiểu việc thu thập dữ liệu cá nhân trong khi cung cấp quyền truy cập đầy đủ vào API.

Các hạn chế nội dung rất ít nhưng cụ thể. Mô hình không từ chối các chủ đề người trưởng thành hợp pháp, hư cấu hoặc gây tranh cãi. Tuy nhiên, một giới hạn cứng áp dụng: nội dung tình dục liên quan đến trẻ vị thành niên luôn bị chặn. Điều này đảm bảo tuân thủ các tiêu chuẩn pháp lý cơ bản trong khi duy trì môi trường rất tự do cho các loại nội dung khác.

Bắt đầu với khóa của bạn

Đăng ký rất đơn giản. Bạn có thể sử dụng "Tiếp tục với Google" hoặc tạo tài khoản bằng email và mật khẩu. Sau khi đăng ký, khóa API của bạn sẽ được hiển thị ngay lập tức, cho phép bạn bắt đầu thực hiện các yêu cầu mà không bị trì hoãn. Không cần xác minh số điện thoại và quy trình được thiết kế để nhanh chóng.

Để tích hợp, hãy cập nhật URL cơ sở của máy khách của bạn thành https://api.uncensoredgpt.cc/v1 và đặt khóa API. Sử dụng ID mô hình "uncensored" cho tất cả các yêu cầu. Cách tiếp cận mô hình đơn này đảm bảo tính nhất quán và loại bỏ độ phức tạp của định tuyến. Bạn có thể bắt đầu truyền phát, gọi hàm hoặc tạo văn bản dài ngay lập tức.

Hỏi đáp

API này có phù hợp cho nội dung NSFW không?

Có, mô hình không kiểm duyệt và không từ chối các chủ đề người trưởng thành hợp pháp, hư cấu hoặc gây tranh cãi. Nó được thiết kế để xử lý nội dung NSFW mà không có hạn chế tùy tiện, ngoại trừ việc chặn cứng nội dung tình dục liên quan đến trẻ vị thành niên.

Tôi thanh toán cho API như thế nào?

Thanh toán chỉ chấp nhận qua tiền điện tử: USDT (TRC20) hoặc USDC (Base). Không có tùy chọn thẻ tín dụng, PayPal hoặc chuyển khoản ngân hàng. Nạp tiền từ $10 đến $500 và tín dụng không bao giờ hết hạn.

Kích thước cửa sổ ngữ cảnh là bao nhiêu?

Cửa sổ ngữ cảnh là 100.000 token, bao gồm cả prompt và phần hoàn thành. Lượng đầu ra tối đa cho mỗi yêu cầu là 32.000 token, hoặc 2.048 nếu bạn không chỉ định <code>max_tokens</code>.

API có sử dụng dữ liệu của bạn để huấn luyện không?

Không, các prompt không được sử dụng để huấn luyện. Dịch vụ được thiết kế để bảo mật, chỉ yêu cầu email để tạo tài khoản và đảm bảo dữ liệu đầu vào của bạn vẫn thuộc về bạn.

Khóa của bạn chỉ cách một biểu mẫu

Tạo tài khoản, sao chép khóa, thay đổi URL cơ sở. Đó là toàn bộ quá trình thiết lập.

Lấy khóa API