VI ▾
Lấy khóa API

AI không kiểm duyệt: Tránh giới hạn nội dung với Mukenetsu AI

AI không kiểm duyệt là công nghệ cho phép bạn gọi mô hình ngôn ngữ lớn (LLM) mà không bị giới hạn bởi bộ lọc nội dung hoặc mục đích sử dụng. Mukenetsu AI có thể tích hợp ngay lập tức dưới dạng API tương thích OpenAI, cung cấp mô hình trả tiền theo mức sử dụng minh bạch.

Ngày cập nhật

Điểm nổi bật

  • Sử dụng endpoint API tiêu chuẩn tương thích OpenAI, hoạt động trực tiếp với các SDK hoặc client hiện có của bạn.
  • Với cửa sổ ngữ cảnh 100,000 token, bạn có thể xử lý chính xác các ngữ cảnh dài hoặc các hướng dẫn chi tiết.
  • Không có gói đăng ký hàng tháng hay ràng buộc gói dịch vụ; bạn chỉ trả tiền cho số token đã sử dụng.
  • Prompt không được dùng làm dữ liệu huấn luyện, và bạn có thể đăng ký tài khoản chỉ bằng email và mật khẩu.

AI không kiểm duyệt là gì

AI không kiểm duyệt (Uncensored AI) chỉ các mô hình AI không bị áp dụng các bộ lọc nội dung thông thường hoặc hạn chế đề cập đến các chủ đề cụ thể khi tạo nội dung. Các chatbot truyền thống thường tự động chặn hoặc thay đổi cách diễn đạt các phát biểu về chính trị, tôn giáo, biểu hiện tình dục hoặc ngữ cảnh xã hội cụ thể dựa trên quan điểm thương mại hoặc an toàn. Ngược lại, mô hình không kiểm duyệt tạo ra đầu ra tự do hơn, tuân theo ngữ cảnh và ý định của prompt được cung cấp.

Về mặt kỹ thuật, điều này được thực hiện thông qua quá trình tinh chỉnh mô hình hoặc điều chỉnh tham số khi tạo phản hồi. Điểm đặc trưng là không chỉ đơn giản là "trả lời mọi thứ", mà xử lý dữ liệu một cách trung thực với chỉ dẫn của người dùng mà không bị thiên vị do bộ lọc. Đối với nhà phát triển và người sáng tạo, điều này cung cấp môi trường dễ thích ứng với nhiều trường hợp sử dụng khác nhau vì bạn có thể tự kiểm soát nội dung theo quyết định của mình.

Thách thức về kiểm duyệt LLM hiện có

Nhiều dịch vụ LLM hàng đầu áp đặt các quy tắc nghiêm ngặt (guardrails) đối với các chủ đề cụ thể. Ví dụ, chúng có thể từ chối các diễn giải nhất định trong sự kiện lịch sử hoặc tranh luận triết học, hoặc ngừng tạo nội dung chỉ vì có một chút mô tả tình dục. Những điều này dựa trên triết lý thiết kế coi trọng "an toàn", nhưng chúng trở thành hạn chế phiền toái khi người dùng yêu cầu đầu ra trung thực hoặc tạo nội dung theo thể loại cụ thể (ví dụ: khoa học viễn tưởng, kinh dị, người lớn).

Hơn nữa, các hạn chế này thường không thể kiểm soát từ phía người dùng API. Cùng một prompt có thể bị từ chối đột ngột do nâng cấp mô hình hoặc thay đổi chính sách, mặc dù trước đó vẫn hoạt động. Đối với các nhà phát triển muốn tự quản lý nội dung bằng logic của riêng mình, "kiểm duyệt dạng hộp đen" này là rào cản khi tích hợp.

Đặc tính mô hình Mukenetsu AI

Mô hình được cung cấp qua API của dịch vụ này là mô hình open-weight được chỉ định bằng ID "uncensored". Mô hình này chạy trên máy chủ GPU của chúng tôi và được thiết kế để duy trì hoạt động nhất quán, không bị ảnh hưởng bởi các yếu tố bên ngoài như thay đổi luật pháp hoặc thay đổi đặc tả của dịch vụ bên thứ ba. Điểm quan trọng là mô hình này độc lập với các mô hình của bên thứ ba như GPT, Claude hay Gemini, và không kế thừa các tham số hoặc hạn chế độc quyền của các nhà cung cấp đó.

Mô hình tạo nội dung cho các chủ đề tình dục, chủ đề gây tranh cãi hoặc payload trong nghiên cứu bảo mật mà không từ chối không cần thiết (refusal), miễn là nằm trong phạm vi sử dụng hợp pháp cho người trưởng thành. Tuy nhiên, yêu cầu về "nội dung tình dục liên quan đến trẻ em" luôn bị chặn như một giới hạn cứng. Đây không phải là bộ lọc linh hoạt dựa trên quyết định của mô hình, mà là giới hạn được áp dụng ở cấp độ hệ thống.

Lợi ích của cửa sổ ngữ cảnh 100k

Cửa sổ ngữ cảnh là tổng số token mà mô hình có thể ghi nhớ và xử lý cùng một lúc. API của chúng tôi hỗ trợ tối đa 100,000 token cho cả prompt và completion. Điều này cho phép bạn nạp cùng lúc vào mô hình các tài liệu hàng nghìn trang hoặc lịch sử hội thoại dài.

  • Duy trì ngữ cảnh dài: Phù hợp cho các nhiệm vụ sửa đổi hoặc tóm tắt một phần cụ thể sau khi hiểu toàn bộ câu chuyện dài hoặc cơ sở mã.
  • Tự do trong kỹ thuật prompt: Bạn có thể bao gồm nhiều hướng dẫn (System Prompt) và ví dụ (Few-shot examples) để kiểm soát hành vi của mô hình chính xác hơn.
  • Xử lý dữ liệu: Bạn cũng có thể xử lý theo lô nhiều bản ghi hoặc thông tin cấu hình chỉ bằng một lần gọi API.

Đây là yếu tố quan trọng để giảm hiện tượng "chỉ nhớ ngữ cảnh gần đây" thường gặp trong các cuộc hội thoại dài, giúp bạn nhận được phản hồi nhất quán hơn.

Streaming và phản hồi thời gian thực

Khi sử dụng API AI tạo sinh, có hai hình thức: "blocking" (chờ vài giây đến vài chục giây cho đến khi phản hồi hoàn tất) và "streaming" (phản hồi từng token). API của chúng tôi hỗ trợ SSE (Server-Sent Events), cho phép bạn nhận phản hồi qua streaming.

Streaming giúp cải thiện trải nghiệm người dùng (UX). Ngay khi vài token đầu tiên của phản hồi được trả về, chúng sẽ hiển thị trên màn hình, phần còn lại sẽ được truyền tuần tự, giúp người dùng biết ngay lập tức rằng phản hồi đang được tạo. Ngoài ra, phía máy khách API có thể xử lý dữ liệu ngay khi nhận được, nên thiết kế này ít bị ảnh hưởng bởi độ trễ mạng.

Ứng dụng với gọi hàm

Gọi hàm (Function Calling) là tính năng cho phép LLM không chỉ trả lời bằng ngôn ngữ tự nhiên mà còn xuất ra các tham số để gọi các hàm hoặc API bên ngoài dưới dạng dữ liệu có cấu trúc JSON. Điều này cho phép kết hợp với logic ứng dụng vượt xa việc tạo văn bản đơn thuần.

Ví dụ, khi người dùng hỏi "Thời tiết ở Tokyo ngày mai", thay vì dự báo thời tiết, mô hình sẽ trả về hàm và các đối số (vùng, ngày, định dạng) để gọi API thời tiết bên ngoài. Vì là mô hình không kiểm duyệt, nên ít có các từ đệm thừa như "Rất vui được giúp bạn" hoặc các lý do không phù hợp khi gọi hàm, dẫn đến cấu trúc JSON đáng tin cậy hơn.

Quyền riêng tư và sử dụng dữ liệu

Đối với các nhà phát triển coi trọng quyền riêng tư, cách dữ liệu được xử lý là tiêu chí quyết định quan trọng. Để tạo tài khoản API của chúng tôi, bạn chỉ cần email và mật khẩu; việc đăng ký số điện thoại hoặc thông tin thẻ tín dụng không bắt buộc. Đặc biệt, với tài khoản dùng thử, bạn có thể bắt đầu sử dụng mà không cần thẻ tín dụng.

Điểm quan trọng là dữ liệu prompt bạn gửi sẽ không được tái sử dụng để huấn luyện mô hình. Điều này loại bỏ rủi ro tài sản trí tuệ của bạn được sử dụng để cải thiện mô hình của các công ty khác khi bạn gửi logic kinh doanh nhạy cảm hoặc mẫu prompt độc quyền lên API. Ngoài ra, mỗi tài khoản chỉ được cấp tối đa 1 khóa API; bạn có thể tạo lại khóa khi cần để vô hiệu hóa ngay lập tức khóa cũ.

Cấu trúc giá và quản lý chi phí

API này áp dụng mô hình trả theo lượng sử dụng, không có phí cơ bản hàng tháng hay ràng buộc gói dịch vụ. Để tăng tính minh bạch trong quản lý chi phí, bạn mua trước tín dụng (số dư) và sử dụng dịch vụ cho đến khi hết số dư đó. Tín dụng bạn mua không bao giờ hết hạn.

Token đầu vàoToken đầu ra
$0,25 / 1 triệu token$1,00 / 1 triệu token

Bạn có thể nạp tiền bằng tiền điện tử (USDT, USDC) và nhận thêm tín dụng thưởng 5% khi nạp từ 50 USD trở lên, 10% khi nạp từ 100 USD trở lên. Nhờ mô hình tính phí theo lượng sử dụng, bạn không phải lo lắng về rủi ro bot tiêu thụ token đột ngột hay chi phí cố định của các tháng không sử dụng. Bạn cũng có thể mở rộng quy mô linh hoạt trong giới hạn 300 yêu cầu mỗi phút và kích thước yêu cầu tối đa 8 MB.

Các bước tích hợp

Bạn có thể bắt đầu tích hợp trong vài phút bằng cách sử dụng các khách hàng hoặc SDK tương thích với OpenAI. Hãy làm theo các bước sau.

  1. Trang lấy khóa API, bạn tạo tài khoản bằng cách sử dụng địa chỉ email và mật khẩu.
  2. Khóa API sẽ hiển thị ngay sau khi tạo, vì vậy bạn hãy sao chép và lưu trữ nó.
  3. Trong cài đặt khách hàng API, bạn thay đổi Base URL thành https://api.mukenetsuapi.com/v1.
  4. Bạn đặt khóa API vào tiêu đề xác thực và chỉ định ID mô hình là uncensored.

Nhờ đó, bạn có thể gửi yêu cầu bao gồm streaming và gọi hàm thông qua endpoint chat completion của OpenAI POST /v1/chat/completions. Vì hệ thống vận hành trên cơ sở hạ tầng độc lập khác với các nhà cung cấp khác, cấu trúc này ít bị ảnh hưởng bởi việc ngừng dịch vụ hoặc thay đổi thông số kỹ thuật của các nhà cung cấp khác.

Câu hỏi thường gặp

Mukenetsu AI sử dụng mô hình nào?

API này cung cấp endpoint hoàn tất trò chuyện tương thích với OpenAI. Bạn có thể truy cập mô hình trọng số mở độc quyền chạy trên máy chủ GPU của chúng tôi bằng cách đặt Base URL thành <code>https://api.mukenetsuapi.com/v1</code> và chỉ định khóa API cùng ID mô hình <code>uncensored</code>.

Cách tính token như thế nào?

Cả văn bản đầu vào (prompt) và văn bản do mô hình tạo ra (completion) đều được tính. Giá là $0,25 cho mỗi 1 triệu token đầu vào và $1,00 cho mỗi 1 triệu token đầu ra. Bạn có thể kiểm tra số lượng token chính xác bằng thư viện tokenizer của OpenAI hoặc các công cụ tương tự.

Hỗ trợ truyền phát không?

Có, chúng tôi hỗ trợ truyền phát qua định dạng SSE (Server-Sent Events). Bằng cách chỉ định <code>stream: true</code> khi gửi yêu cầu API, bạn có thể nhận phản hồi từng token một.

Dữ liệu có được dùng để huấn luyện không?

Không, dữ liệu prompt bạn gửi không được sử dụng làm dữ liệu huấn luyện cho mô hình trong API này. Chúng tôi áp dụng quy trình vận hành chú trọng quyền riêng tư, và việc tạo tài khoản chỉ yêu cầu email và mật khẩu.

Khóa API có thể lấy chỉ với 1 biểu mẫu

Tạo tài khoản, sao chép khóa và thay đổi Base URL. Đó là tất cả những gì bạn cần để hoàn tất thiết lập.

Lấy khóa API