Guide de démarrage rapide de l'API Mukenetsu AI
L'API Mukenetsu AI est un service LLM sans censure doté d'endpoints standard compatibles OpenAI. Modifiez simplement l'URL de base et définissez votre clé API pour intégrer instantanément vos SDK ou clients existants et générer du texte sans restrictions de contenu.
- URL de base
https://api.mukenetsuapi.com/v1- Modèle
uncensored
Configuration de base et URL de base
Mukenetsu AI est conçu comme une API REST compatible OpenAI. Vous pouvez ainsi utiliser vos clients et SDK OpenAI existants avec peu de modifications. Utilisez l'URL de base suivante pour communiquer avec l'API.
https://api.mukenetsuapi.com/v1
Contrairement aux autres services LLM, aucune sélection complexe d'endpoints ni configuration supplémentaire n'est nécessaire. Seuls un endpoint de complétion de chat et un endpoint de liste de modèles sont fournis. Cette structure simple accélère le développement.
La clé API s’obtient immédiatement lors de l’inscription sur la page Obtenir la clé API, en utilisant votre adresse e-mail et votre mot de passe. Aucune manipulation du tableau de bord n’est nécessaire. De plus, nous respectons votre vie privée : les données de prompt ne sont pas utilisées pour l’apprentissage des modèles.
Authentification et clé API
L’accès à l’API nécessite une authentification par l’en-tête Authorization: Bearer <API_KEY>. Utilisez la clé API générée lors de la création de votre compte Mukenetsu AI. Une seule clé API est attribuée par compte, mais vous pouvez la régénérer à tout moment si nécessaire. Veuillez noter que la régénération d’une clé invalide la précédente.
En cas d'erreur d'authentification, une réponse 401 (Unauthorized) ou 402 (Payment Required) est généralement renvoyée. Le code 401 indique que la clé est incorrecte ou invalide ; le code 402 signifie que le solde de crédit de votre compte est insuffisant. Le crédit est prépayé et peut être rechargé à partir de 10 $ en cryptomonnaies (USDT, USDC).
Endpoint de complétion de chat
L’endpoint principal pour la génération de texte est POST /v1/chat/completions. En envoyant une requête à cet endpoint, vous pouvez générer du texte en incluant l’historique des conversations et le prompt système. Spécifiez l’ID de modèle uncensored. Il s’agit d’un modèle à poids ouverts unique, différent des modèles GPT d’OpenAI ou d’autres fournisseurs.
L'exemple ci-dessous montre comment effectuer une génération de texte de base à l'aide de curl. Les paramètres requis sont l'ID de modèle, les messages et, en option, l'activation du streaming.
curl https://api.mukenetsuapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Cet endpoint ne propose pas de fonctionnalités telles que les embeddings, la génération d'images ou la conversion audio. Il est spécialisé dans la complétion et la génération de texte pur.
Streaming (SSE)
Pour recevoir le texte généré en temps réel, utilisez le mode streaming. Incluez "stream": true dans la requête ; le serveur renvoie des données au format Server-Sent Events (SSE). Vous pouvez ainsi afficher du texte avant la fin de la génération.
Si vous utilisez le SDK OpenAI en Python ou la bibliothèque cliente Node.js, le traitement en streaming s’effectue automatiquement en spécifiant simplement l’option stream=True. Le gestionnaire d’événements reçoit des chunks par token.
from openai import OpenAI
client = OpenAI(base_url="https://api.mukenetsuapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Le streaming est une fonctionnalité clé pour améliorer l'expérience utilisateur dans les réponses longues ou les applications interactives. Cependant, si la connexion est interrompue pendant le streaming, vous ne recevrez plus les événements suivants.
Appels d'outils/fonctions
L’API Mukenetsu AI prend en charge les appels de fonctions (tool calling). Cela facilite l’intégration avec des API externes ou des bases de données. En incluant le champ tools et le paramètre tool_choice dans le corps de la requête, vous pouvez permettre au modèle d’exécuter une fonction spécifique.
Le modèle décide d'appeler une fonction ou de retourner du texte. Une fois l'appel terminé, ajoutez le résultat à messages et renvoyez-le au modèle pour obtenir une réponse plus détaillée.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.mukenetsuapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Cette fonctionnalité est particulièrement utile pour les applications de type agent ou l'automatisation de tâches complexes. Grâce à sa forme compatible OpenAI, vous pouvez réutiliser directement votre logique d'appels d'outils existante.
Limites de débit et contraintes
L'utilisation de l'API est soumise aux limites suivantes : 300 requêtes par minute maximum et une taille maximale du corps de requête de 8 Mo. Le dépassement de ces limites génère une erreur 429 (Too Many Requests). La fenêtre de contexte est de 100 000 tokens (total des tokens du prompt + du texte généré). Les conversations ou documents plus longs doivent être divisés correctement avant l'envoi.
Lors de la réception d'une réponse en streaming, suivez le flux d'événements suivant.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Par ailleurs, le contenu sexuel impliquant des mineurs est strictement limité pour respecter la législation. En revanche, les autres contenus pour adultes légaux, la fiction, la recherche en sécurité et les sujets controversés sont générés sans censure.
Fonctions et limites
Toutes les limites et fonctions réelles de l'API au même endroit — vérifiez-les avant de recharger.
| Élément | Valeur |
|---|---|
| Format | compatible OpenAI : tout SDK OpenAI fonctionne en changeant la base URL et la clé |
| ID du modèle | uncensored |
| Endpoints | POST /v1/chat/completions · GET /v1/models |
| Base URL | https://api.mukenetsuapi.com/v1 |
| Authentification | Authorization: Bearer YOUR_KEY |
| Streaming | oui — server-sent events ; le dernier bloc contient l'usage des tokens |
| Paramètres | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| Mode JSON | response_format: {"type": "json_object"} |
| Fenêtre de contexte | 100 000 tokens (entrée + sortie) |
| Sortie max. | jusqu'au reste de la fenêtre de 100 000 tokens ; max_tokens optionnel (pas de plafond distinct) |
| Appel de fonctions | oui — tools, tool_choice ; réponse avec tool_calls, aussi en streaming ; résultats en role: tool |
| Taille | jusqu'à 8 Mo par requête |
| Concurrence | 8 requêtes simultanées par clé |
| En-têtes | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Limite de débit | 300 requêtes par minute et par clé |
| Essai gratuit | 0,50 $ pendant 7 jours, sans carte · Clé d'essai : 2 requêtes parallèles, 60 par minute ; limites complètes (8 et 300) après la 1re recharge |
| Facturation | crédit prépayé selon l'usage réel ; erreurs et refus gratuits |
| Validité | le crédit payé n'expire jamais, sans abonnement |
| Recharge | USDT (TRC20) ou USDC (Base), tout montant entier de 10 $ à 500 $ |
| Bonus | +5 % dès 50 $, +10 % dès 100 $ |
| Prix | 0,25 $ par million de tokens en entrée · 1,00 $ par million en sortie |
| Contenu | contenu adulte autorisé ; tout contenu sexuel impliquant des mineurs est refusé |
| Connexion | Google ou e-mail et mot de passe |
| Clés | une clé active par compte ; une nouvelle remplace l'ancienne |
Codes d'erreur
Les erreurs arrivent en JSON avec un type stable ; les requêtes échouées ou refusées ne sont pas facturées.
| Code | Type | Signification |
|---|---|---|
400 | bad_request | JSON invalide, messages vides, mauvais paramètre ou contexte trop long |
401 | missing_key · invalid_key · key_revoked | clé absente, erronée ou remplacée |
402 | no_credit | plus de crédit — rechargez, la reprise est immédiate |
403 | content_blocked | contenu sexuel impliquant des mineurs — refusé, non facturé |
404 | not_found | endpoint inconnu |
413 | request_too_large | corps supérieur à 8 Mo |
429 | rate_limited · concurrency | au-delà de 300/min ou 8 en parallèle — patientez |
503 | upstream_busy | modèle occupé — réessayez dans quelques secondes |
Questions fréquentes
Où obtenir ma clé API ?
Vous pouvez obtenir votre clé API instantanément lors de l'inscription sur la page « Get API key » du site en utilisant votre adresse e-mail et votre mot de passe. Aucune manipulation du tableau de bord n'est nécessaire ; la clé s'affiche à l'écran immédiatement après l'inscription.
Quel modèle est utilisé ?
Nous utilisons notre propre modèle à poids ouverts avec l'ID de modèle « uncensored ». Contrairement aux modèles d'autres éditeurs comme GPT, Claude ou Gemini, il s'exécute sur nos serveurs GPU. L'architecture détaillée et les scores de benchmark du modèle ne sont pas encore publiés.
Que se passe-t-il en cas d'erreur lors du streaming ?
Si la connexion est interrompue pendant le streaming, vous ne pourrez plus recevoir d'événements. Si nécessaire, réenvoyez la requête à partir du point d'interruption, ou envoyez une requête normale (non streaming) pour obtenir la réponse complète.
Obtenez votre clé API en un seul formulaire
Création de compte, copie de la clé, modification de l'URL de base : c'est tout ce qu'il faut pour être opérationnel.