規制なしAI:Mukenetsu AIでコンテンツ制限を回避
規制なしAIは、コンテンツフィルタリングや用途制限を受けずに大規模言語モデル(LLM)を呼び出せる技術です。Mukenetsu AIは、OpenAI互換のAPIとして即座に統合可能で、プライバシーを尊重した透明な従量課金モデルを提供しています。
更新日
ポイント
- OpenAI互換の標準APIエンドポイントを採用し、既存のSDKやクライアントでそのまま動作します。
- 64,000トークンのコンテキストウィンドウにより、長文の文脈や詳細な指示を正確に処理できます。
- 月額課金やプランの縛りなく、使用したトークンのみに対して従量課金で課金されます。
- プロンプトは学習データとして使用されず、アカウントにはメールとパスワードのみで登録できます。
規制なしAIとは何か
規制なしAI(Uncensored AI)とは、大規模言語モデルが生成する際に適用される一般的なコンテンツフィルタリングや、特定のトピックへの言及制限を受けないAIモデルを指します。従来のチャットボットは、商業利用や安全性の観点から、政治、宗教、性的な表現、あるいは特定の社会的文脈での発言を自動で遮断したり、言い回しを変えたりすることがあります。これに対し、規制なしのモデルは、与えられたプロンプトに対して、その文脈や意図に従ってより自由な出力を生成します。
技術的には、これはモデルのファインチューニング過程や、応答生成時のパラメータ調整によって実現されます。単に「何でも答える」だけでなく、ユーザーの指示に忠実に、フィルタリングによるバイアスがかかることなくデータを処理する点が特徴です。開発者やクリエイターにとっては、自らの判断でコンテンツを制御できるため、多様なユースケースに対応しやすい環境を提供します。
既存LLMの検閲の課題
多くの主要なLLMサービスは、特定のトピックに対して厳格なガードレール(制約)を設けています。例えば、歴史的事実や哲学的な議論でも、特定の解釈を「誤り」として拒否したり、性的な描写が少し含まれるだけで生成を停止したりすることがあります。これらは「安全性」を重視する設計理念に基づくものですが、ユーザーが求めているのが忠実な出力や特定のジャンル(例えばSFやホラー、成人向けコンテンツなど)の生成である場合には、煩わしい制限となります。
また、これらの制限はAPIの利用者側からは制御できないことが多く、同じプロンプトでもモデルのバージョンアップやポリシー変更によって、以前は通っていたリクエストが突然拒否されるケースも生じます。自前のロジックでコンテンツを管理したい開発者にとって、これらの「ブラックボックス化された検閲」は統合時の障壁となります。
Mukenetsu AIのモデル特性
当サービスのAPIで提供されるモデルは、「uncensored」というIDで指定されるオープンウェイトモデルです。このモデルは当社のGPUサーバー上で稼働しており、法改正や他社サービスの仕様変更といった外部要因に左右されることなく、一貫した動作を保つ設計になっています。重要な点として、このモデルはGPTやClaude、Geminiなどの他社モデルとは独立しており、それらのベンダーが保有する独自のパラメータや制限事項を継承していません。
モデルは、法的に成人向けの使用が許可される範囲内であれば、性的なトピックや論争的な話題、セキュリティ研究におけるペイロードなどに対しても、不要な拒否応答(refusal)を行わずに生成を行います。ただし、常に適用されるハードリミットとして、「未成年者の性的コンテンツ」へのリクエストはブロックされます。これはモデルの判断に委ねられる柔軟なフィルタリングではなく、システムレベルで適用される制限です。
64kコンテキストウィンドウの利点
コンテキストウィンドウとは、モデルが一度に記憶・処理できるトークンの総量を指します。当APIはプロンプトとcompletionを合わせて最大64,000トークンをサポートしています。これは、数千ページに及ぶドキュメントや、長い会話履歴を一度にモデルに読み込ませることを可能にします。
- 長文のコンテキスト維持: 長い物語やコードベースの全体像を理解した上で、特定の部分のみを修正・要約するタスクに適しています。
- プロンプトエンジニアリングの自由度: 指示(System Prompt)と例題(Few-shot examples)を大量に含めることができ、モデルの挙動をより精密に制御できます。
- データ処理: 一度のAPI呼び出しで、複数のレコードや設定情報をバッチ処理することも可能です。
従来の長い会話でよくある「直近の文脈しか覚えていない」という現象を減らし、より一貫性のある応答を得るための重要な要素となります。
ストリーミングとリアルタイム応答
生成AIのAPIを利用する際、応答が完了するまで数秒から数十秒待たされる「ブロッキング」形式と、トークン単位で逐次返答される「ストリーミング」形式の2つがあります。当APIはSSE(Server-Sent Events)をサポートしており、ストリーミングでの応答取得が可能です。
ストリーミングは、ユーザー体験(UX)の向上に寄与します。応答の最初の数トークンが返された瞬間に画面に表示され、残りが順次流れてくるため、ユーザーは「応答が生成中である」ことを即座に知ることができます。また、APIクライアント側でも、データが届き次第処理を進めることができるため、ネットワークの遅延の影響を受けにくい設計となります。
ツール呼び出しでの応用範囲
ツール呼び出し(Function Calling)とは、LLMが自然言語の応答だけでなく、JSON形式の構造化データとして外部の関数やAPIを呼び出すためのパラメータを出力する機能です。これにより、単なるテキスト生成を超えた、アプリケーションロジックとの連携が可能になります。
例えば、ユーザーが「明日の東京の天気」と尋ねた際、モデルが天気を予測するのではなく、外部の天気APIを呼び出すための関数と引数(地域、日付、形式)を返します。このとき、規制なしモデルであるため、余計な「お役に立てて嬉しいです」といった前置きや、関数呼び出しに対して不適切な理由を付けたりするノイズが少なく、信頼性の高いJSON構造が得られる傾向があります。
プライバシーとデータ使用
プライバシーを重視する開発者にとって、データがどのように扱われるかは重要な判断基準となります。当APIのアカウント作成にはメールアドレスとパスワードのみが必要であり、電話番号やクレジットカード情報の登録は必須ではありません。特にトライアルアカウントでは、クレジットカードなしで利用を開始できます。
重要な点として、送信されたプロンプトデータは、モデルの学習データとして再利用されません。これは、機密性の高いビジネスロジックや独自のプロンプトテンプレートをAPIに送信する際、自社の知的財産が他社のモデル改善に利用されるリスクを排除します。また、APIキーはアカウントごとに1つまで発行され、必要に応じて再生成することで、旧キーの即時無効化が可能です。
価格設定とコスト管理
当APIは、月額基本料やプランの縛りを持たない従量課金制を採用しています。コスト管理の透明性を高めるため、事前にクレジット(残高)を購入し、それを使い切るまでサービスを利用します。購入したクレジットの有効期限はありません。
| 入力トークン | 出力トークン |
|---|---|
| $0.25 / 1Mトークン | $1.00 / 1Mトークン |
残高のチャージはカードまたは暗号通貨で行え、50ドル以上で5%、100ドル以上で10%のボーナスクレジットが付与されます。このように、使った分だけ課金されるため、ボットによる急激なトークン消費や、使わない月の基本料負担といったリスクがありません。1分あたり300リクエスト、リクエストボディ8MBまでの制限内で、必要に応じてスケールさせられるのも利点です。
統合のステップバイステップ
既存のOpenAI互換のクライアントやSDKを使用して、数分で統合を開始できます。以下の手順に従ってください。
- APIキーを取得するページで、メールアドレスとパスワードを使用してアカウントを作成します。
- 作成直後にAPIキーが表示されますので、コピーして保管してください。
- APIクライアントの設定で、Base URLを
https://api.mukenetsuapi.com/v1に変更します。 - APIキーを認証ヘッダーに設定し、モデルIDとして
uncensoredを指定します。
これにより、OpenAIのチャット完了エンドポイント POST /v1/chat/completions を介して、ストリーミングやツール呼び出しを含むリクエストを送信できます。他のベンダーのモデルとは異なる独立したインフラ上で動作するため、他社のサービス停止や仕様変更の影響を受けにくい構造を持っています。
よくある質問
Mukenetsu AIはどのモデルを使っていますか?
当APIは、OpenAI互換のチャット完了エンドポイントを提供しています。Base URLを <code>https://api.mukenetsuapi.com/v1</code> に設定し、APIキーとモデルID <code>uncensored</code> を指定することで、当社のGPUサーバー上で稼働する独自のオープンウェイトモデルにアクセスできます。
トークン数の計算方法は?
入力されるテキスト(プロンプト)とモデルが生成するテキスト(completion)の両方がカウントされます。価格は入力トークンが100万トークンあたり$0.25、出力トークンが100万トークンあたり$1.00です。トークンの正確な数は、OpenAIのトークナイザーライブラリなどで確認できます。
ストリーミングはサポートされていますか?
はい、SSE(Server-Sent Events)形式のストリーミングに対応しています。APIリクエスト時に <code>stream: true</code> を指定することで、トークン単位で逐次応答を受け取ることができます。
データは学習に使われますか?
いいえ、当APIでは送信されたプロンプトデータはモデルのトレーニングデータとして使用されません。プライバシーを重視した運用を採用しており、アカウント作成にはメールとパスワードのみが必要です。
APIキーはフォーム1つで入手可能
アカウント作成、キーのコピー、ベースURLの変更。これだけですべて設定完了です。