Cách tích hợp API Unrestricted AI cho đầu ra không kiểm duyệt
Tích hợp API AI không giới hạn cho phép nhà phát triển bỏ qua bộ lọc nội dung trong đầu ra LLM bằng cách sử dụng endpoint mô hình trọng số mở trực tiếp. Hướng dẫn này bao gồm thiết lập kỹ thuật, giá cả và các ràng buộc khi triển khai API LLM không kiểm duyệt để tạo văn bản thô không bị lọc.
Điểm chính
- API sử dụng giao diện tương thích chuẩn với OpenAI, chỉ yêu cầu thay đổi URL cơ sở và khóa API.
- Giá cả dựa trên mức sử dụng: $0.25 cho mỗi triệu token đầu vào và $1.00 cho mỗi triệu token đầu ra, không có phí hàng tháng.
- Nạp tiền crypto qua USDT hoặc USDC cung cấp tín dụng bonus, trong khi tín dụng dùng thử miễn phí có sẵn cho tài khoản mới.
- Mô hình hỗ trợ truyền phát (streaming), gọi hàm và chế độ JSON, nhưng không cung cấp embedding hay tạo ảnh.
Tại sao sử dụng API không kiểm duyệt?
Các nhà cung cấp LLM tiêu chuẩn thường áp dụng các lớp kiểm duyệt nội dung từ chối các prompt dựa trên tiêu chí chủ quan, chẳng hạn như các mẫu văn học sáng tạo, chủ đề chính trị hoặc chủ đề người lớn. Đối với nhà phát triển xây dựng ứng dụng mà các từ chối này làm gián đoạn trải nghiệm người dùng, API LLM không kiểm duyệt cung cấp đường dẫn trực tiếp đến đầu ra mô hình mà không có các rào cản nhân tạo này. Dịch vụ này lưu trữ một mô hình trọng số mở duy nhất được tinh chỉnh để trả lời mà không từ chối nội dung cho mục đích người lớn hợp pháp, đảm bảo hành vi nhất quán trên các chủ đề đa dạng.
Khác với các bộ tổng hợp định tuyến yêu cầu giữa nhiều mô hình nhà cung cấp, dịch vụ này sử dụng cơ sở hạ tầng chuyên dụng. Điều này loại bỏ sự phức tạp khi quản lý nhiều khóa API và định dạng phản hồi khác nhau. Mô hình không phải là GPT, Claude, Gemini hoặc bất kỳ mô hình của nhà cung cấp nào khác; đó là một mô hình trọng số mở riêng biệt chạy trên máy chủ của chúng tôi. Cách tiếp cận này giảm độ trễ và đảm bảo hành vi 'không kiểm duyệt' nhất quán, vì nó phụ thuộc vào việc tinh chỉnh mô hình cơ sở hơn là lớp kiểm duyệt động được áp dụng bởi bộ tổng hợp bên thứ ba.
Tuy nhiên, đây không phải là giải pháp vạn năng. Nếu bạn yêu cầu embedding, tạo ảnh hoặc nhiều lựa chọn mô hình, API chỉ văn bản này có thể không phù hợp với hệ thống của bạn. Nó được thiết kế đặc biệt cho các nhà phát triển cần đầu ra văn bản thô và muốn tránh gánh nặng định tuyến mô hình hoặc tính không thể đoán trước của giao diện người dùng web-chat.
Hiểu giao diện tương thích OpenAI
API tuân theo lược đồ chat-completions chuẩn của OpenAI, giúp tích hợp dễ dàng cho các nhà phát triển đã quen thuộc với SDK OpenAI. Bạn tương tác với endpoint bằng các phương thức HTTP tiêu chuẩn, chủ yếu là POST cho completions và GET cho thông tin mô hình. URL cơ sở là https://api.unrestrictedai.cc/v1, và bạn có thể sử dụng bất kỳ máy khách tương thích OpenAI nào bằng cách cập nhật base_url và cung cấp khóa API của bạn.
Endpoint chính là POST /v1/chat/completions, chấp nhận mảng message và trả về phản hồi văn bản. Các endpoint bổ sung bao gồm GET /v1/models để liệt kê các mô hình có sẵn. Không có endpoint embeddings, audio, video hay fine-tuning. Sự đơn giản này giúp giảm đường cong học tập và cho phép bạn thay thế bằng mô hình không kiểm duyệt với ít thay đổi mã nhất.
- Phương thức: POST cho completions, GET cho thông tin mô hình.
- Định dạng: Thân yêu cầu JSON với mảng messages.
- Phản hồi: Đối tượng JSON chứa văn bản được tạo.
- Tương thích: Hoạt động với SDK OpenAI chính thức và máy khách bên thứ ba như LangChain hoặc LlamaIndex.
Giao diện này đảm bảo cơ sở mã hiện tại của bạn có thể tận dụng khả năng không kiểm duyệt mà không cần viết lại hoàn toàn. Bạn kiểm soát các tham số, chẳng hạn như temperature và top_p, để điều chỉnh độ sáng tạo và tính xác định của các đầu ra.
Thiết lập khóa API Unrestricted AI của bạn
Bắt đầu cần một tài khoản, có thể được tạo qua 'Tiếp tục với Google' hoặc bằng cách đăng ký bằng email và mật khẩu. Không cần số điện thoại và quy trình được thiết kế để nhanh chóng. Sau khi đăng ký, bạn được chuyển đến trang 'Lấy khóa API', nơi khóa API của bạn được hiển thị ngay lập tức. Khóa này được sử dụng để xác thực tất cả các yêu cầu đến API.
Mỗi tài khoản chỉ giới hạn một khóa hoạt động. Nếu bạn tạo khóa mới, khóa trước đó sẽ bị vô hiệu hóa. Điều này đơn giản hóa quản lý bảo mật, vì bạn không cần theo dõi nhiều khóa cho một tài khoản. Khóa cấp quyền truy cập vào mô hình không kiểm duyệt và được tính phí dựa trên mức sử dụng token thực tế.
Tín dụng dùng thử: Mọi tài khoản mới đều nhận được $0.50 tín dụng dùng thử, có hiệu lực trong 7 ngày. Không cần thẻ tín dụng để nhận dùng thử này, giúp bạn dễ dàng kiểm tra API trước khi cam kết mua hàng. Dùng thử giới hạn một người và không thể kết hợp với các ưu đãi khác.
Quyền riêng tư: Tài khoản của bạn chỉ yêu cầu địa chỉ email. Các prompt gửi đến API không được sử dụng để huấn luyện, đảm bảo dữ liệu của bạn vẫn được bảo mật. Đây là tính năng quan trọng đối với các nhà phát triển cần duy trì tính bảo mật đối với dữ liệu đầu vào ứng dụng của họ.
Gửi yêu cầu đầu tiên
Với khóa API và URL cơ sở sẵn sàng, bạn có thể gửi yêu cầu đầu tiên. API chấp nhận các định dạng thông báo tiêu chuẩn, bao gồm các vai trò system, user và assistant. Đây là một ví dụ sử dụng cURL:
curl https://api.unrestrictedai.cc/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Yêu cầu này gửi một prompt đơn giản đến mô hình. Phản hồi sẽ chứa văn bản được tạo, cùng với thống kê sử dụng token. ID mô hình để gửi là 'uncensored'. Định danh này được sử dụng trong thân yêu cầu để chỉ định mô hình.
Bạn cũng có thể sử dụng SDK Python chính thức của OpenAI. Khởi tạo máy khách với URL cơ sở và khóa API của bạn, sau đó gọi phương thức chat.completions.create. Cấu trúc phản hồi khớp với định dạng OpenAI, bao gồm choices, finish_reason và thống kê sử dụng.
Tham số chính:
- model: 'uncensored'
- messages: Mảng các đối tượng thông báo
- temperature: Điều khiển độ ngẫu nhiên (mặc định 1.0)
- max_tokens: Số token đầu ra tối đa (mặc định 2048)
Cài đặt này cho phép bạn tích hợp nhanh mô hình không kiểm duyệt vào ứng dụng của mình. Thời gian phản hồi thường thấp, phản ánh cơ sở hạ tầng trực tiếp mà không có gánh nặng định tuyến.
Xử lý streaming và công cụ
API hỗ trợ truyền phát (streaming) qua Server-Sent Events (SSE), điều cần thiết cho trải nghiệm người dùng thời gian thực. Khi streaming được bật, API gửi các phản hồi từng phần khi chúng được tạo. Chunk cuối cùng chứa tổng mức sử dụng token, cho phép bạn theo dõi chi phí chính xác. Điều này hữu ích cho các giao diện trò chuyện hiển thị văn bản khi nó được tạo.
Gọi hàm (công cụ) cũng được hỗ trợ. Bạn có thể xác định công cụ trong yêu cầu của mình và mô hình sẽ trả về đầu ra JSON có cấu trúc mà ứng dụng của bạn có thể phân tích cú pháp và thực thi. Điều này cho phép các quy trình làm việc phức tạp, chẳng hạn như tương tác với API hoặc cơ sở dữ liệu bên ngoài.
Chế độ JSON: Bạn có thể bắt buộc đầu ra JSON bằng cách đặt response_format thành json_object. Điều này đảm bảo mô hình trả về JSON hợp lệ, điều quan trọng cho việc tiêu thụ theo chương trình.
Các tham số khác:
- stop: Các chuỗi nơi API sẽ ngừng tạo thêm token.
- seed: Để có đầu ra có thể tái lập.
- presence_penalty: Khuyến khích mô hình nói về các chủ đề mới.
- frequency_penalty: Phạt các token mới dựa trên tần suất hiện có của chúng trong văn bản.
Các tính năng này làm cho API phù hợp cho nhiều ứng dụng khác nhau, từ bot trò chuyện đơn giản đến các hệ thống dựa trên agent phức tạp.
Bảng giá và Thanh toán bằng Tiền mã hóa
Mô hình giá cả đơn giản và dựa trên mức sử dụng. Không có phí hàng tháng hoặc đăng ký. Bạn chỉ trả tiền cho những gì bạn sử dụng:
- Token đầu vào: $0,25 cho mỗi 1 triệu token
- Token đầu ra: $1,00 cho mỗi 1 triệu token
Lỗi và từ chối miễn phí, nghĩa là bạn không phải trả tiền cho các token không được tạo thành công. Tín dụng trả trước và không bao giờ hết hạn, vì vậy bạn có thể nạp tiền khi cần. Mô hình này minh bạch và dễ dự đoán, cho phép bạn ước tính chi phí dựa trên mức sử dụng token dự kiến của bạn.
Quy trình Nạp tiền: Thanh toán chỉ chấp nhận bằng tiền mã hóa. Bạn có thể nạp tiền bằng USDT (TRC20) hoặc USDC (Base). Số tiền nạp tối thiểu là $10 và tối đa là $500. Tín dụng thưởng được cấp cho các lần nạp lớn hơn:
- Nạp $50: +5% tín dụng thưởng
- Nạp $100: +10% tín dụng thưởng
Không hoàn tiền cho số dư tín dụng, nhưng các lỗi như tính phí kép có thể được giải quyết qua trang Hỗ trợ. Mô hình chỉ sử dụng tiền mã hóa này giúp giảm phí giao dịch và đơn giản hóa thanh toán toàn cầu.
Giới hạn tốc độ và Hạn mức
Để đảm bảo sử dụng công bằng và duy trì hiệu suất, API áp dụng các giới hạn sau cho mỗi khóa API:
- Yêu cầu mỗi phút: 300
- Yêu cầu đồng thời: 8
- Kích thước tối đa của thân yêu cầu: 8 MB
Các giới hạn này được áp dụng để ngăn chặn lạm dụng và đảm bảo độ trễ ổn định. Nếu bạn vượt quá giới hạn tốc độ, bạn sẽ nhận được lỗi 429 Too Many Requests. Bạn có thể triển khai logic thử lại với độ trễ tăng dần để xử lý các trường hợp này một cách mượt mà.
Cửa sổ ngữ cảnh là 100.000 token, bao gồm cả prompt và kết quả. Đầu ra tối đa cho mỗi yêu cầu là 32.000 token, hoặc 2.048 nếu max_tokens không được đặt. Điều này cho phép các ứng dụng ngữ cảnh dài, chẳng hạn như phân tích tài liệu hoặc cuộc trò chuyện kéo dài.
Giới hạn nội dung nghiêm ngặt: Mặc dù mô hình không kiểm duyệt, nó luôn từ chối nội dung tình dục liên quan đến trẻ vị thành niên. Đây là giới hạn cứng được áp dụng bởi chính mô hình.
Hiểu các giới hạn này giúp bạn thiết kế ứng dụng của mình để xử lý giới hạn tốc độ và quản lý mức sử dụng token hiệu quả. Đối với hầu hết các trường hợp sử dụng, các giới hạn này là đủ, nhưng các ứng dụng có thông lượng cao có thể cần triển khai cơ chế hàng đợi.
Quyền riêng tư và Sử dụng dữ liệu
Quyền riêng tư là một yếu tố quan trọng đối với nhiều nhà phát triển. Dịch vụ này không sử dụng prompt của bạn để huấn luyện. Dữ liệu của bạn được xử lý để tạo phản hồi và không được lưu trữ để cải thiện mô hình dài hạn. Điều này đảm bảo rằng dữ liệu đầu vào của ứng dụng của bạn vẫn được bảo mật và không được sử dụng để huấn luyện mô hình cơ sở.
Quyền riêng tài khoản: Tài khoản của bạn chỉ yêu cầu địa chỉ email. Không cần số điện thoại hoặc giấy tờ tùy thân. Điều này giảm lượng dữ liệu cá nhân bạn chia sẻ với dịch vụ.
Xử lý dữ liệu: Prompt không được sử dụng để huấn luyện. Đây là một lợi thế đáng kể đối với các doanh nghiệp cần duy trì tính bảo mật đối với dữ liệu độc quyền hoặc đầu vào của người dùng. Dịch vụ được thiết kế để minh bạch về các thực tiễn xử lý dữ liệu của mình.
Không rò rỉ dữ liệu huấn luyện: Vì prompt không được sử dụng để huấn luyện, bạn không cần phải lo lắng về dữ liệu của mình xuất hiện trong các kết quả mô hình trong tương lai. Đây là một điểm khác biệt quan trọng so với một số mô hình miễn phí hoặc dùng chung sử dụng dữ liệu người dùng để huấn luyện.
Cách tiếp cận ưu tiên quyền riêng tư này khiến API phù hợp cho các ứng dụng doanh nghiệp nơi tính bảo mật dữ liệu là ưu tiên hàng đầu. Bạn có thể tích hợp mô hình không kiểm duyệt một cách tự tin, biết rằng dữ liệu của bạn được tôn trọng và không được tái sử dụng.
Hỏi đáp
Mô hình API LLM không kiểm duyệt dựa trên nền tảng nào?
Mô hình là một mô hình trọng số mở được chạy trên máy chủ của chúng tôi, được tinh chỉnh để trả lời mà không từ chối nội dung cho mục đích người lớn hợp pháp. Nó không phải là GPT, Claude, Gemini, Grok, DeepSeek, Qwen, Llama hoặc bất kỳ mô hình của nhà cung cấp nào khác.
Tôi nạp tiền vào tài khoản như thế nào?
Bạn có thể nạp tiền bằng tiền mã hóa: USDT (TRC20) hoặc USDC (Base). Số tiền tối thiểu là $10 và tối đa là $500. Tín dụng thưởng được cấp cho các lần nạp từ $50 trở lên.
API có hỗ trợ truyền phát không?
Có, API hỗ trợ truyền phát qua Sự kiện gửi qua máy chủ (SSE). Mức sử dụng token được bao gồm trong chunk cuối cùng của luồng, cho phép bạn theo dõi chi phí chính xác.
Giới hạn tốc độ là gì?
Các giới hạn là 300 yêu cầu mỗi phút trên mỗi khóa, 8 yêu cầu đồng thời trên mỗi khóa và kích thước thân yêu cầu tối đa là 8 MB. Các giới hạn này đảm bảo sử dụng công bằng và hiệu suất ổn định.
Khóa của bạn chỉ cách một biểu mẫu
Tạo tài khoản, sao chép khóa, thay đổi URL cơ sở. Đó là toàn bộ quy trình thiết lập.