VI ▾
Lấy khóa API

Bắt đầu nhanh với Mukenetsu AI API

Mukenetsu AI API là dịch vụ LLM không kiểm duyệt với endpoint tiêu chuẩn tương thích OpenAI. Bạn có thể tích hợp ngay lập tức vào SDK hoặc máy khách hiện có chỉ bằng cách thay đổi Base URL và thiết lập khóa API để tạo văn bản không giới hạn nội dung.

Base URL
https://api.mukenetsuapi.com/v1
Mô hình
uncensored

Cấu hình cơ bản và Base URL

Mukenetsu AI được thiết kế dưới dạng REST API tương thích OpenAI. Điều này cho phép bạn sử dụng các máy khách hoặc SDK OpenAI hiện có với rất ít thay đổi. Để giao tiếp với API, bạn hãy sử dụng Base URL sau.

https://api.mukenetsuapi.com/v1

Khác với các dịch vụ LLM khác, bạn không cần chọn nhiều endpoint phức tạp hay cấu hình thêm. Chúng tôi chỉ cung cấp một endpoint chat completion duy nhất và một endpoint danh sách mô hình. Cấu trúc đơn giản này giúp việc phát triển diễn ra nhanh chóng.

Bạn có thể nhận khóa API ngay lập tức khi đăng ký bằng email và mật khẩu trên trang Get API key. Bạn không cần thao tác bảng điều khiển. Ngoài ra, chúng tôi chú trọng quyền riêng tư và không sử dụng dữ liệu prompt để huấn luyện mô hình.

Xác thực và khóa API

Để truy cập API, bạn cần xác thực bằng tiêu đề Authorization: Bearer <API_KEY>. Hãy sử dụng khóa API được tạo khi bạn tạo tài khoản. Mỗi tài khoản được gán một khóa API, nhưng bạn có thể tạo lại khóa bất cứ lúc nào nếu cần. Lưu ý rằng khi tạo lại khóa, khóa cũ sẽ bị vô hiệu hóa.

Khi xảy ra lỗi xác thực, phản hồi thường là 401 (Unauthorized) hoặc 402 (Payment Required). Mã 401 cho biết khóa sai hoặc đã bị vô hiệu hóa; mã 402 có nghĩa là số dư tín dụng của tài khoản không đủ. Tín dụng theo hình thức trả trước, bạn có thể nạp từ $10 trở lên bằng tiền điện tử (USDT, USDC).

Endpoint chat completion

Endpoint chính để tạo văn bản là POST /v1/chat/completions. Bằng cách gửi yêu cầu đến endpoint này, bạn có thể tạo văn bản bao gồm lịch hội thoại và prompt hệ thống. Hãy chỉ định ID mô hình là uncensored. Đây là mô hình trọng số mở độc lập, khác với GPT của OpenAI hoặc các mô hình của nhà cung cấp khác.

Ví dụ dưới đây minh họa cách tạo văn bản cơ bản bằng curl. Các tham số cần thiết là ID mô hình, tin nhắn và tùy chọn là kích hoạt streaming.

curl https://api.mukenetsuapi.com/v1/chat/completions \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "uncensored",
    "messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
  }'

Endpoint này không cung cấp các tính năng như embedding, tạo ảnh hay chuyển đổi giọng nói. Nó chuyên biệt cho việc hoàn thành và tạo văn bản thuần túy.

Streaming (SSE)

Nếu bạn muốn nhận văn bản được tạo ra theo thời gian thực, hãy sử dụng chế độ streaming. Bằng cách bao gồm "stream": true trong yêu cầu, máy chủ sẽ trả dữ liệu từng phần theo định dạng Server-Sent Events (SSE). Điều này cho phép người dùng hiển thị một phần văn bản trước khi quá trình tạo hoàn tất.

Nếu bạn đang sử dụng SDK OpenAI cho Python hoặc thư viện máy khách cho Node.js, việc chỉ định tùy chọn stream=True sẽ tự động xử lý streaming. Trình xử lý sự kiện sẽ nhận các chunk token từng phần.

from openai import OpenAI

client = OpenAI(base_url="https://api.mukenetsuapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

Streaming là tính năng quan trọng để nâng cao trải nghiệm người dùng trong các phản hồi dài hoặc ứng dụng tương tác. Tuy nhiên, nếu kết nối bị ngắt trong khi streaming, bạn sẽ không thể nhận các sự kiện tiếp theo.

Gọi hàm/công cụ

API Mukenetsu AI hỗ trợ gọi hàm/công cụ. Điều này giúp dễ dàng tích hợp với API bên ngoài hoặc cơ sở dữ liệu. Bằng cách bao gồm trường tools và tham số tool_choice trong thân yêu cầu, bạn có thể yêu cầu mô hình thực hiện một hàm cụ thể.

Mô hình sẽ tự quyết định gọi hàm hay trả về văn bản bình thường. Sau khi gọi hàm hoàn tất, bạn có thể thêm kết quả hàm vào messages và gửi lại cho mô hình để nhận câu trả lời chi tiết hơn.

import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.mukenetsuapi.com/v1", apiKey: process.env.API_KEY });

const resp = await client.chat.completions.create({
  model: "uncensored",
  messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);

Tính năng này đặc biệt hữu ích cho các ứng dụng dạng agent hoặc tự động hóa các nhiệm vụ phức tạp. Do tuân thủ định dạng tương thích OpenAI, bạn có thể tái sử dụng logic gọi hàm hiện có mà không cần thay đổi.

Giới hạn tốc độ và hạn chế

Việc sử dụng API có các hạn chế sau: tối đa 300 yêu cầu mỗi phút và kích thước thân yêu cầu tối đa là 8 MB. Nếu vượt quá giới hạn này, lỗi 429 (Too Many Requests) sẽ được trả về. Cửa sổ ngữ cảnh là 100.000 token (tổng prompt + văn bản được tạo). Các đoạn hội thoại hoặc tài liệu dài hơn cần được chia nhỏ thích hợp trước khi gửi.

Khi nhận phản hồi streaming, hãy tuân theo luồng sự kiện sau.

stream = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Tell the story in second person."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Ngoài ra, nội dung tình dục liên quan đến người chưa thành niên bị hạn chế nghiêm ngặt do tuân thủ quy định pháp luật. Các nội dung dành cho người trưởng thành hợp pháp khác, tiểu thuyết, nghiên cứu bảo mật và các chủ đề gây tranh cãi sẽ được tạo mà không kiểm duyệt.

Thông số API

Toàn bộ giới hạn và tính năng thực tế của API ở một nơi — hãy kiểm tra trước khi nạp tiền.

MụcGiá trị
Định dạngtương thích OpenAI: mọi SDK OpenAI đều chạy được, chỉ cần đổi base URL và khóa
ID mô hìnhuncensored
EndpointPOST /v1/chat/completions · GET /v1/models
Base URLhttps://api.mukenetsuapi.com/v1
Xác thựcAuthorization: Bearer YOUR_KEY
Streamingcó — server-sent events; phần cuối chứa lượng token đã dùng
Tham sốtemperature, top_p, stop, seed, presence_penalty, frequency_penalty
Chế độ JSONresponse_format: {"type": "json_object"}
Cửa sổ ngữ cảnh100.000 token (đầu vào + đầu ra)
Đầu ra tối đatối đa phần còn lại của cửa sổ 100.000 token; max_tokens tùy chọn (không giới hạn riêng)
Gọi hàmcó — tools, tool_choice; phản hồi có tool_calls, kể cả khi streaming; kết quả gửi lại bằng role: tool
Kích thước yêu cầutối đa 8 MB
Yêu cầu đồng thờitối đa 8 cùng lúc cho mỗi khóa
Header phản hồiX-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency
Giới hạn tốc độ300 yêu cầu mỗi phút cho mỗi khóa
Dùng thử miễn phí$0,50 trong 7 ngày, không cần thẻ · Khóa dùng thử: 2 yêu cầu song song, 60 yêu cầu/phút; hạn mức đầy đủ (8 và 300) sau lần nạp đầu
Tính phítín dụng trả trước theo mức dùng thực tế; lỗi và từ chối miễn phí
Thời hạntín dụng đã trả không hết hạn, không đăng ký định kỳ
Nạp tiềnUSDT (TRC20) hoặc USDC (Base), số tiền nguyên bất kỳ từ $10 đến $500
Thưởng+5% từ $50, +10% từ $100
Giá$0,25 cho 1 triệu token đầu vào · $1,00 cho 1 triệu token đầu ra
Nội dungcho phép nội dung người lớn; từ chối nội dung tình dục liên quan đến trẻ vị thành niên
Đăng nhậpGoogle hoặc email và mật khẩu
Khóamỗi tài khoản một khóa đang hoạt động; khóa mới thay thế khóa cũ

Mã lỗi

Lỗi trả về dạng JSON với type cố định; yêu cầu lỗi hoặc bị từ chối không bị tính phí.

MãLoạiÝ nghĩa
400bad_requestJSON sai, tin nhắn trống, tham số sai hoặc vượt cửa sổ ngữ cảnh
401missing_key · invalid_key · key_revokedthiếu khóa, sai khóa hoặc khóa đã bị thay
402no_credithết tín dụng — nạp tiền là dùng tiếp ngay
403content_blockednội dung tình dục liên quan trẻ vị thành niên — từ chối, không tính phí
404not_foundendpoint không tồn tại
413request_too_largenội dung lớn hơn 8 MB
429rate_limited · concurrencyvượt 300/phút hoặc 8 đồng thời — chờ rồi thử lại
503upstream_busymô hình đang bận — thử lại sau vài giây

Câu hỏi thường gặp

Tôi lấy khóa API ở đâu?

Bạn có thể nhận khóa API ngay lập tức khi đăng ký bằng email và mật khẩu trên trang "Get API key" của trang web. Bạn không cần thao tác bảng điều khiển; khóa sẽ hiển thị trên màn hình ngay sau khi đăng ký.

Mô hình nào đang được sử dụng?

Model ID "uncensored" sử dụng mô hình trọng số mở của chúng tôi. Không giống như các mô hình của bên khác như GPT, Claude, Gemini, nó chạy trên máy chủ GPU của công ty chúng tôi. Kiến trúc chi tiết và điểm số benchmark của mô hình hiện chưa được công bố.

Điều gì xảy ra nếu có lỗi trong khi streaming?

Nếu kết nối bị ngắt trong khi streaming, bạn sẽ không thể nhận các sự kiện tiếp theo. Nếu cần, bạn có thể gửi lại yêu cầu từ vị trí bị ngắt hoặc gửi một yêu cầu bình thường (không streaming) để nhận phản hồi đầy đủ.

Khóa API có thể lấy chỉ với một biểu mẫu

Tạo tài khoản, sao chép khóa và thay đổi Base URL. Đó là tất cả những gì bạn cần để thiết lập xong.

Lấy khóa API