Início rápido da API Mukenetsu AI
A API Mukenetsu AI é um serviço LLM sem censura com endpoint padrão compatível com OpenAI. Basta alterar a Base URL e configurar a chave de API para integrar imediatamente ao seu SDK ou cliente existente e gerar texto sem restrições de conteúdo.
- URL base
https://api.mukenetsuapi.com/v1- Modelo
uncensored
Configuração básica e URL base
A Mukenetsu AI é projetada como uma API REST compatível com OpenAI. Isso permite que você use clientes e SDKs OpenAI existentes com mínimas alterações. Para se comunicar com a API, use as URLs base a seguir.
https://api.mukenetsuapi.com/v1
Ao contrário de outros serviços LLM, não há necessidade de escolher endpoints complexos ou fazer configurações adicionais. Apenas um endpoint de conclusão de chat e um endpoint de listagem de modelos são fornecidos. Essa estrutura simples permite que o desenvolvimento avance rapidamente.
A chave de API é obtida imediatamente após o cadastro, na página Get API key, usando e-mail e senha. Não é necessário operar no painel. Além disso, priorizamos sua privacidade: os dados do prompt não são usados para treinar o modelo.
Autenticação e chave de API
O acesso à API requer autenticação por meio do cabeçalho Authorization: Bearer <API_KEY>. Use a chave de API gerada ao criar a conta na Mukenetsu AI. Uma chave de API é atribuída por conta, mas você pode regenerá-la a qualquer momento conforme necessário. Ao regenerar a chave, a chave anterior será invalidada, portanto, tome cuidado.
Se ocorrer um erro de autenticação, geralmente será retornada uma resposta 401 (Não autorizado) ou 402 (Pagamento necessário). 401 indica que a chave está incorreta ou foi invalidada; 402 significa que o saldo de crédito da sua conta está insuficiente. O crédito é pré-pago e pode ser recarregado a partir de US$ 10 usando criptomoedas (USDT e USDC).
Endpoint de conclusão de chat
O endpoint principal para geração de texto é POST /v1/chat/completions. Ao enviar uma requisição para este endpoint, você pode gerar texto incluindo histórico de conversas e prompts de sistema. Especifique o ID do modelo como uncensored. Este é um modelo de pesos abertos proprietário, diferente dos modelos GPT da OpenAI ou de outros fornecedores.
O exemplo abaixo mostra como realizar uma geração de texto básica usando curl. Os parâmetros necessários são o ID do modelo, as mensagens e, opcionalmente, a ativação do streaming.
curl https://api.mukenetsuapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Neste endpoint, não são fornecidas funcionalidades como embeddings, geração de imagens ou conversão de áudio. O foco é exclusivamente na conclusão e geração de texto.
Streaming (SSE)
Se você deseja obter o texto gerado em tempo real, pode usar o modo de streaming. Ao incluir "stream": true na requisição, o servidor retorna dados sequencialmente no formato Server-Sent Events (SSE). Isso permite que o usuário exiba parte do texto antes que a geração seja concluída.
Se você estiver usando a SDK OpenAI para Python ou a biblioteca cliente para Node.js, o processamento de streaming será realizado automaticamente ao especificar a opção stream=True. O manipulador de eventos receberá chunks por token.
from openai import OpenAI
client = OpenAI(base_url="https://api.mukenetsuapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)O streaming é uma funcionalidade importante para melhorar a experiência do usuário em respostas longas ou aplicativos interativos. No entanto, se a conexão for interrompida durante o streaming, você não poderá receber eventos subsequentes.
Ferramentas/chamada de funções
A API Mukenetsu AI suporta chamada de funções (ferramentas). Isso facilita a integração com APIs externas ou bancos de dados. Ao incluir o campo tools e o parâmetro tool_choice no corpo da requisição, você pode fazer com que o modelo execute uma função específica.
O modelo decide se deve chamar uma função ou retornar texto normal conforme necessário. Após a conclusão da chamada, você pode obter uma resposta mais detalhada adicionando o resultado da função a messages e passando-o ao modelo.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.mukenetsuapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Esta funcionalidade é particularmente útil para aplicativos do tipo agente ou automação de tarefas complexas. Como adotamos o formato compatível com OpenAI, você pode reutilizar diretamente a lógica existente de chamada de funções.
Limite de requisições e restrições
O uso da API está sujeito às seguintes limitações: máximo de 300 requisições por minuto e tamanho máximo do corpo da requisição de 8 MB. Ao exceder esses limites, será retornado o erro 429 (Too Many Requests). A janela de contexto é de 100.000 tokens (total de prompt + texto gerado). Conversas ou documentos longos que excedam esse limite devem ser divididos adequadamente antes do envio.
Ao receber respostas de streaming, siga o fluxo de eventos abaixo.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Além disso, o conteúdo sexual envolvendo menores é estritamente limitado devido ao cumprimento das leis. Outros conteúdos adultos legais, ficção, pesquisa de segurança e tópicos controversos são gerados sem censura.
Recursos e limites
Uma tabela com cada limite, recurso e preço.
| Item | Valor |
|---|---|
| Formato | compatível com OpenAI: qualquer SDK da OpenAI funciona trocando a base URL e a chave |
| ID do modelo | uncensored |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.mukenetsuapi.com/v1 |
| Autenticação | Authorization: Bearer YOUR_KEY |
| Streaming | sim — server-sent events; o último bloco traz o uso de tokens |
| Parâmetros | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Modo JSON | response_format: {"type": "json_object"} |
| Janela de contexto | 100.000 tokens (entrada + saída) |
| Saída máxima | até o restante da janela de 100.000 tokens; max_tokens opcional (sem limite separado) |
| Chamada de funções | sim — tools, tool_choice; resposta com tool_calls, inclusive em streaming; resultados como role: tool |
| Tamanho | até 8 MB por requisição |
| Concorrência | 8 requisições ao mesmo tempo por chave |
| Cabeçalhos | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Limite de taxa | 300 requisições por minuto por chave |
| Teste grátis | $0,50 por 7 dias, sem cartão · Chave de teste: 2 requisições paralelas, 60 por minuto; limites totais (8 e 300) após a primeira recarga |
| Cobrança | crédito pré-pago pelo uso real; erros e recusas são grátis |
| Validade | crédito pago não expira, sem assinatura |
| Recarga | USDT (TRC20) ou USDC (Base), qualquer valor inteiro de $10 a $500 |
| Bônus | +5% a partir de $50, +10% a partir de $100 |
| Preço | $0,25 por 1M tokens de entrada · $1,00 por 1M de saída |
| Conteúdo | conteúdo adulto permitido; conteúdo sexual com menores é recusado |
| Login | Google ou e-mail e senha |
| Chaves | uma chave ativa por conta; uma nova substitui a anterior |
Códigos de erro
Erros chegam em JSON com um type fixo; requisições com falha ou recusadas não são cobradas.
| Código | Tipo | Significado |
|---|---|---|
400 | bad_request | JSON inválido, mensagens vazias, parâmetro errado ou contexto longo demais |
401 | missing_key · invalid_key · key_revoked | chave ausente, errada ou substituída |
402 | no_credit | sem crédito — recarregue e continue na hora |
403 | content_blocked | conteúdo sexual com menores — recusado, sem cobrança |
404 | not_found | endpoint desconhecido |
413 | request_too_large | corpo acima de 8 MB |
429 | rate_limited · concurrency | acima de 300/min ou 8 em paralelo — aguarde e tente de novo |
503 | upstream_busy | modelo ocupado — tente em alguns segundos |
Perguntas frequentes
Onde obtenho a chave de API?
Você obtém a chave de API imediatamente ao se registrar na página "Get API key" do site usando e-mail e senha. Não é necessário operar o painel; a chave é exibida na tela logo após o cadastro.
Qual modelo é usado?
O modelo ID "uncensored" utiliza um modelo de pesos abertos proprietário. Diferente de modelos de outras empresas como GPT, Claude e Gemini, ele opera em nossos servidores GPU. A arquitetura detalhada do modelo e os resultados de benchmark ainda não estão disponíveis.
O que acontece se ocorrer um erro durante o streaming?
Se a conexão for interrompida durante o streaming, você não poderá receber eventos subsequentes. Se necessário, reenvie a requisição a partir do ponto de interrupção ou envie uma requisição normal (não streaming) para obter a resposta completa.
Obtenha a chave de API com um único formulário
Criação de conta, cópia da chave e alteração da URL base. Isso é tudo que você precisa para concluir a configuração.