Mukenetsu AI API Schnellstart
Die Mukenetsu AI API ist ein unzensierter LLM-Dienst mit einem OpenAI-kompatiblen Standard-Endpunkt. Durch Ändern der Base URL und des API-Schlüssels kannst du ihn sofort in bestehende SDKs oder Clients integrieren und Text ohne Inhaltsfilter generieren.
- Base URL
https://api.mukenetsuapi.com/v1- Modell
uncensored
Grundkonfiguration und Base URL
Mukenetsu AI ist als OpenAI-kompatible REST API konzipiert. So kannst du bestehende OpenAI-Clients und SDKs mit minimalen Änderungen nutzen. Verwende die folgende Base URL für die Kommunikation.
https://api.mukenetsuapi.com/v1
Im Gegensatz zu anderen LLM-Diensten brauchst du keine komplexe Endpunkt-Auswahl oder zusätzliche Konfiguration. Es gibt nur einen Chat-Completion-Endpunkt und einen Endpunkt für die Modellliste. Diese Einfachheit beschleunigt die Entwicklung.
Den API-Schlüssel erhältst du sofort nach dem Sign-up auf der Seite Get API key mit deiner E-Mail-Adresse und deinem Passwort. Du musst nichts im Dashboard tun. Außerdem ist deine Privatsphäre geschützt: Deine Prompt-Daten werden nicht zum Trainieren von Modellen verwendet.
Authentifizierung und API-Schlüssel
Der Zugriff auf die API erfordert die Authentifizierung über den Header Authorization: Bearer <API_KEY>. Verwende den bei der Kontoerstellung generierten Schlüssel. Pro Konto gibt es einen Schlüssel, den du jederzeit neu generieren kannst. Achte darauf: Nach der Neugenerierung wird der alte Schlüssel ungültig.
Bei Authentifizierungsfehlern erhältst du meist 401 (Unauthorized) oder 402 (Payment Required). 401 bedeutet, der Schlüssel ist falsch oder ungültig; 402 bedeutet, dein Guthaben reicht nicht aus. Guthaben ist Prepaid und kann ab $10 mit Kryptowährungen (USDT, USDC) aufgeladen werden.
Chat-Completion-Endpunkt
Der Haupt-Endpunkt für die Textgenerierung ist POST /v1/chat/completions. Durch das Senden einer Anfrage an diesen Endpunkt kannst du Text generieren, einschließlich des Gesprächsverlaufs und des System-Prompts. Gib als Modell-ID uncensored an. Dies ist ein eigenes Open-Weight-Modell, das sich von GPT von OpenAI oder Modellen anderer Anbieter unterscheidet.
Das folgende Beispiel zeigt die grundlegende Textgenerierung mit curl. Die erforderlichen Parameter sind die Modell-ID, die Nachrichten und optional die Aktivierung des Streamings.
curl https://api.mukenetsuapi.com/v1/chat/completions \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "uncensored",
"messages": [{"role": "user", "content": "Write a blunt product review of a cheap VPN."}]
}'Dieser Endpunkt bietet keine Embeddings, Bildgenerierung oder Stimmumwandlung. Er ist rein auf Text-Completion und -Generierung spezialisiert.
Streaming (SSE)
Wenn du generierten Text in Echtzeit erhalten möchtest, nutze den Streaming-Modus. Durch Hinzufügen von "stream": true sendet der Server Daten sequenziell im SSE-Format. So kannst du Text anzeigen, bevor die Generierung abgeschlossen ist.
Wenn du die Python OpenAI SDK oder die Node.js Client-Bibliothek nutzt, wird das Streaming automatisch aktiviert, wenn du die Option stream=True angibst. Der Event-Handler empfängt Chunks pro Token.
from openai import OpenAI
client = OpenAI(base_url="https://api.mukenetsuapi.com/v1", api_key="YOUR_KEY")
resp = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)Streaming verbessert die User Experience bei langen Antworten oder interaktiven Anwendungen. Bei einem Verbindungsabbruch während des Streamings werden jedoch keine weiteren Events empfangen.
Tools/Funktion-Aufrufe
Die Mukenetsu AI API unterstützt Tool-Funktion-Aufrufe. Dies erleichtert die Integration externer APIs oder Datenbanken. Füge den Body mit dem Feld tools und dem Parameter tool_choice hinzu, um das Modell zu einem bestimmten Funktionsaufruf zu bewegen.
Das Modell entscheidet, ob es eine Funktion aufruft oder normalen Text zurückgibt. Nach Abschluss des Aufrufs kannst du das Funktionsergebnis zu messages hinzufügen und an das Modell übergeben, um detailliertere Antworten zu erhalten.
import OpenAI from "openai";
const client = new OpenAI({ baseURL: "https://api.mukenetsuapi.com/v1", apiKey: process.env.API_KEY });
const resp = await client.chat.completions.create({
model: "uncensored",
messages: [{ role: "user", content: "Draft a villain monologue for my game." }],
});
console.log(resp.choices[0].message.content);Diese Funktion ist besonders nützlich für Agenten-Anwendungen und die Automatisierung komplexer Aufgaben. Da das OpenAI-kompatible Format verwendet wird, kannst du bestehende Logik für Funktion-Aufrufe direkt übernehmen.
Ratenlimit und Einschränkungen
Die API unterliegt folgenden Limits: Maximal 300 Anfragen pro Minute und eine maximale Body-Größe von 8 MB. Bei Überschreitung wird ein 429-Fehler (Too Many Requests) zurückgegeben. Das Kontextfenster beträgt 100.000 Token (Prompt + generierter Text). Längere Konversationen müssen aufgeteilt werden.
Bei der Empfangnahme von Streaming-Antworten folge diesem Event-Fluss.
stream = client.chat.completions.create(
model="uncensored",
messages=[{"role": "user", "content": "Tell the story in second person."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Sexuelle Inhalte mit Minderjährigen sind streng eingeschränkt, wie es das Gesetz vorschreibt. Andere rechtlich zulässige Erwachseneninhalte, Fiktion, Sicherheitsforschung und kontroverse Themen werden ohne Zensur generiert.
Funktionen und Limits
Eine Tabelle mit jedem Limit, jeder Funktion und jedem Preis.
| Merkmal | Wert |
|---|---|
| API-Format | OpenAI-kompatibel: jedes OpenAI-SDK funktioniert – nur Base-URL und Schlüssel ändern |
| Modell-ID | uncensored |
| Endpunkte | POST /v1/chat/completions · GET /v1/models |
| Base-URL | https://api.mukenetsuapi.com/v1 |
| Authentifizierung | Authorization: Bearer YOUR_KEY |
| Streaming | ja – Server-Sent Events, der letzte Chunk enthält die Token-Nutzung |
| Parameter | temperature, top_p, stop, seed, presence_penalty, frequency_penalty |
| JSON-Modus | response_format: {"type": "json_object"} |
| Kontextfenster | 100.000 Tokens (Eingabe + Ausgabe) |
| Max. Ausgabe | bis zum Rest des 100.000-Token-Fensters; max_tokens optional (kein separates Limit) |
| Function Calling | ja – tools, tool_choice; Antworten mit tool_calls, auch im Stream; Ergebnisse als role: tool |
| Anfragegröße | bis 8 MB |
| Parallelität | 8 gleichzeitige Anfragen pro Schlüssel |
| Antwort-Header | X-Request-Id, X-Balance-USD, X-RateLimit-Limit-Requests, X-RateLimit-Limit-Concurrency |
| Ratenlimit | 300 Anfragen pro Minute und Schlüssel |
| Testguthaben | $0,50 für 7 Tage, ohne Karte · Testschlüssel: 2 parallele Anfragen, 60 pro Minute; volle Limits (8 und 300) nach erster Aufladung |
| Abrechnung | Prepaid-Guthaben nach echter Nutzung; Fehler und Ablehnungen sind kostenlos |
| Gültigkeit | bezahltes Guthaben verfällt nie, kein Abo |
| Aufladen | USDT (TRC20) oder USDC (Base), jeder ganze Betrag von $10 bis $500 |
| Bonus | +5 % ab $50, +10 % ab $100 |
| Preis | $0,25 pro 1 Mio. Eingabe-Tokens · $1,00 pro 1 Mio. Ausgabe-Tokens |
| Inhalte | Inhalte für Erwachsene erlaubt; sexuelle Inhalte mit Minderjährigen werden abgelehnt |
| Anmeldung | Google oder E-Mail und Passwort |
| Schlüssel | ein aktiver Schlüssel pro Konto; ein neuer ersetzt den alten |
Fehlercodes
Fehler kommen als JSON mit festem type; fehlgeschlagene oder abgelehnte Anfragen kosten nichts.
| Code | Typ | Bedeutung |
|---|---|---|
400 | bad_request | ungültiges JSON, leere Nachrichten, falscher Parameter oder Kontext zu lang |
401 | missing_key · invalid_key · key_revoked | Schlüssel fehlt, ist falsch oder wurde ersetzt |
402 | no_credit | kein Guthaben – aufladen, dann geht es sofort weiter |
403 | content_blocked | sexuelle Inhalte mit Minderjährigen – abgelehnt, nicht berechnet |
404 | not_found | unbekannter Endpunkt |
413 | request_too_large | Anfrage größer als 8 MB |
429 | rate_limited · concurrency | über 300/Min. oder 8 parallel – kurz warten |
503 | upstream_busy | Modell ausgelastet – in Sekunden erneut versuchen |
Häufig gestellte Fragen
Woher bekomme ich meinen API-Schlüssel?
Den API-Schlüssel erhältst du sofort nach dem Sign-up auf der Seite „Get API key“ mit deiner E-Mail-Adresse und deinem Passwort. Du musst nichts im Dashboard tun, und der Schlüssel wird direkt nach dem Sign-up auf dem Bildschirm angezeigt.
Welches Modell wird verwendet?
Die Modell-ID „uncensored“ verwendet ein eigenes Open-Weight-Modell. Im Gegensatz zu Modellen anderer Anbieter wie GPT, Claude oder Gemini läuft es auf unseren GPU-Servern. Die detaillierte Architektur und die Benchmark-Werte des Modells sind derzeit nicht öffentlich.
Was passiert bei einem Fehler während des Streamings?
Wenn die Verbindung während des Streamings getrennt wird, können nachfolgende Events nicht mehr empfangen werden. Wenn erforderlich, sende die Anfrage ab der Trennstelle erneut oder sende eine normale (nicht gestreamte) Anfrage, um die vollständige Antwort zu erhalten.
Mit nur 1 Formular erhältst du deinen API-Schlüssel
Konto erstellen, Schlüssel kopieren, Base URL ändern. Das war's.