ブログ/guides·2026年8月28日·2分·執筆:eroqチーム
ロールプレイにおすすめのAIランキング【2026年】キャラチャット・没入型RP
2026年、本当にキャラクターを保てるAIはどれか。フラッグシップ、オープンソースのRPファインチューン、専用エンジンを一貫性・拒否・コストで比較します。
「ロールプレイにおすすめのAI」を紹介する記事は、どれも同じ項目でランク付けしています。文章の質、コンテキストウィンドウ、1秒あたりのトークン数。そして、実際のユーザーに使われたときにプロダクトが生き残れるかどうかを本当に左右する基準については、小声で素通りしてしまいます。その基準とは、物語が暗い方向へ進んだときに何が起きるかです。
最初にお断りしておきます。これはeroqのブログで、私たちのエンジンもランキングに入っています。そして私たちは、フィルター付きのモデルが最後まで書いてくれない物語のためにプロダクトを作っています。このバイアスと引き換えに差し出せるのは、あなた自身が検証できる評価表です。私たちより優れた点を持つモデルも含め、すべてのモデルに公平に当てはめています。
AIロールプレイを本当に機能させるもの
マーケティングの装飾を取り払うと、ロールプレイはベンチマークでは決して測られない3つの点でモデルに負荷をかけます。
長く続く。 コンパニオンとの会話は1回きりのプロンプトではなく、ひとつの関係の200通目のメッセージです。ほとんどのモデルは10ターン目まではペルソナを見事に保ちますが、50ターン目には親切なアシスタントへと溶けてしまいます。求められるのは第一印象での一貫性ではなく、会話が深まってからの一貫性です。
温度が高い。 良いRPはtemperature 0.8以上で生まれます。文章に手触りが出る領域ですが、同時にほとんどのモデルが同じフレーズを繰り返したり、言葉を濁したり、自分のト書きを読み上げ始めたりする領域でもあります。高温でのモデルの振る舞いは、ベンチマークでの振る舞いとはまったくの別物です。
壁にぶつかる。 緊張は高まり、暴力は描かれ、悪役は長台詞を語ります。フィルター付きのモデルが境界に達した瞬間、キャラクターは文の途中で息絶え、代わりにユーザーへお説教を始めます。それでもAPI呼び出しには課金されます。軽いノリのプロダクトなら問題になりません。しかしホラー、犯罪、戦争、悲劇を書く人にとっては、これこそが最大の問題です。そしてアグリゲーターのまとめ記事が「フィルターの柔軟性」といった婉曲表現の下に埋めてしまうのも、まさにこの問題です。
ランキングの評価基準
スクリーンショット集めではなく、プロダクトを世に出す人のために重み付けした6つの基準です。
- キャラクターの一貫性:会話が深まっても、プレッシャーがかかっても、自前のストレージから再構築したセッションをまたいでも、ペルソナを保てるか。
- 繰り返しへの耐性:RPで使う温度での振る舞いを、雰囲気ではなく100メッセージあたりのループ回数で測ります。
- 拒否の挙動:モデルは描写するのか、明文化されたポリシーに従って予測どおりに拒否するのか、それとも確率的に拒否するのか。プロダクトにとって致命的なのは3つ目だけです。
- メモリの設計:ウィンドウと要約を自分で管理できるステートレスなAPIは、中身を確認もデバッグもできない魔法のメモリに勝ります。
- 文体のコントロール:チャットくらいの長さのDMと、没入感のある小説風の文章は別のプロダクトです。切り替えはパラメーターで行うべきもので、プロンプトとの格闘で行うものではありません。
- コストの予測しやすさ:コンパニオンのユーザーは毎日40〜100通のメッセージを送ります。トークン単位の課金では、最良のユーザーが最も恐ろしいコスト項目に変わってしまいます。
ランキング
1. eroq RP+:キャラクター製品に最適、明文化されたポリシーのもとで検閲なし
私たちのフラッグシップであり、このブログが存在する理由です。RP+には、本番運用中のコンパニオンプラットフォームで計測したサンプリングプロファイルが組み込まれています。繰り返しの抑制、つなぎ言葉の抑制、会話が深まってもペルソナを保つ力。私たち自身がまさにこのエンジンで一般向けのキャラクター製品を運営していて、あらゆる劣化をお客様より先に体感しているからです。
機能も汎用チャットではなく、キャラクター作りに合わせて設計されています。キャラクターシートや世界の状態を会話履歴の外に保持するcontextフィールド、DM型のプロダクト向けにチャットらしい文体で返すmessagingモード、SSEストリーミング、そしてユーザーが送った写真にキャラクターがきちんと反応できるビジョン入力です。
そして壁は、壁があるべき場所にあります。フィルターの気分ではなく、明文化されたポリシーの中にです。ダークなフィクションも、暴力的なフィクションも、激しいフィクションも、毎回キャラクターのまま描写されます。絶対的な制限(未成年なし、実在の人物なし、違法行為なし)に触れた場合は、プロダクト側でプログラム的に処理できる決定的なcontent_blockedエラーが返ります。課金はされず、お説教もありません。さらにRP+とRP miniはeroq独自のモデルなので、ユーザーが書いた内容が上流で保持されることもありません。
料金は静かな武器です。定額のクレジット制で、RP miniは1回の応答につき1クレジット、RP+は3クレジット。ストリーミングの有無も、返答が50トークンか800トークンかも関係ありません。ヘビーユーザーがいちばんおしゃべりな日でも、提供にかかるコストは変わりません。
正直な注意点: RP+はロールプレイの専門家です。ユニットテストは書いてくれませんし、書こうともしていません。
おすすめ: コンパニオンアプリ、キャラクターチャット製品など、「キャラクターを崩さない」ことと「合法なシーンを決して拒否しない」ことが必須条件のものすべて。
2. 大手のフラッグシップ(Claude、GPT、Gemini):文章は最高、壁は最も硬い
公平に言いましょう。最先端のモデルは、業界で最も美しいシーンを書きます。繊細な内面描写、複雑な指示への追従、息づくような会話。純粋な筆力では、このリストのどれも足元に及びません。
一方で、多くのロールプレイが向かう場所よりずっと手前でフィルターがかかり、しかもその拒否は確率的です。同じシーンが火曜日には通り、木曜日には弾かれ、モデルが更新されるたびに違う壊れ方をします。開発者たちは、次のリリースで効かなくなるプロンプトの鎧のために、ロードマップを丸ごと費やしてしまいます。
おすすめ: 軽いノリのインタラクティブフィクション、全年齢向けのストーリーテリング、D&D風のキャンペーン。フィルターがまったく関係しない用途なら、文句なしのトップです。
3. オープンソースのRPファインチューン(MythoMax系、LlamaやQwenのRPチューン):完全なコントロールに最適
コミュニティは何年もロールプレイ用のチェックポイントをチューニングしてきました。優れたものは、ペルソナの表現においてパラメーター数をはるかに超える実力を発揮します。構造上検閲なしで、GPU代を払ってしまえばトークン課金の不安もなく、カスタマイズは無限大。上限を決めるのはあなたです。
ただし、それ以外もすべてあなたが背負います。ホスティング、サンプリングプロファイル、ファインチューン更新後のドリフト、マルチモーダル、土曜の夜のピーク時の稼働率。セルフホストの本当のコスト計算にまとめましたが、要するに、単一モデルで安定した大量のトラフィックがあり、推論の運用を楽しめるMLエンジニアがいる場合には勝ち、それ以外のすべての場面では負けます。
おすすめ: 実際に大量のトラフィックを抱えるセルフホスト派、いじるのが好きな人、データの所在地に要件があるプロダクト。
4. 推論モデル(DeepSeekクラス):最高のダンジョンマスター
過小評価されているニッチです。推論向けにチューニングされたモデルは、驚くほど優れたゲームマスターになります。長期にわたるプロットの論理、ルールやステータスの管理、40ターン後まで覚えている因果関係など、物語系のモデルが取りこぼしがちな部分です。感情表現には文体が乾きすぎていて、コンテンツポリシーはホスト次第ですが、ステータス重視のキャンペーンを支えるロジックエンジンとして使い、キャラクターの声はキャラクター用エンジンに任せれば、この分業は見事に機能します。
おすすめ: RPGのシステム、DMのロジック、会話と同じくらいダイスが重要な世界。
5. アグリゲーター(OpenRouterなど):最高の実験台
1つのキーで50のモデルを使えるのは、調査には最強です。いちばん難しいシーンを午後のうちに候補モデルへ流し、会話ログに判断させましょう。ただし、本番リリースの土台としては脆い場所でもあります。ポリシー、レイテンシ、拒否の挙動は上流のプロバイダーごとに異なり、予告なく変わることがあります。
おすすめ: 自分に合ったモデル探し。そのうえで、自社の利用規約に引用できるポリシーを持つものの上でリリースしましょう。
ロールプレイのスタイル別おすすめAI
| あなたのプロダクト | 選ぶもの | 理由 |
|---|---|---|
| コンパニオン/DM型アプリ | RP mini、messagingモード |
1クレジット、チャットらしい文体、きびきびした応答速度 |
| 長い没入型シーン | RP+ | ペルソナの維持と文章の手触り、定額3クレジット |
| 軽いノリのインタラクティブフィクション | 大手のフラッグシップ | フィルターが作動しない範囲なら、純粋な文章力で最高 |
| ステータス重視のキャンペーン | DM役に推論モデル、声にRP+ | ロジックとキャラクターを、それぞれ専門家が担当 |
| 音声中心のコンパニオン | RP+とTTS | 返答とボイスを1つのAPIで |
| 完全コントロールのセルフホスト | コミュニティのRPファインチューン | 検閲なし、自分のもの、運用も込み |
キャラクターを崩さないための6つのプロンプト習慣
- アイデンティティは会話履歴の外に置く。 システムブロックか
contextフィールドに書きます。最初のユーザーメッセージに書いてはいけません。スクロールして流れていき、ペルソナも一緒に消えてしまいます。 - ウィンドウは積極的に絞る。 履歴は20〜40ターン分、それに約30ターンごとに更新するローリング要約を加えます。無限のコンテキストは記憶ではありません。厳選されたコンテキストこそが記憶です。
- 会話履歴を手入れする。 モデルがキャラクターを崩したターンは、以降のウィンドウから外します。ドリフトは積み重なりますが、削除はタダです。
- 経歴ではなく振る舞いを書く。 「短い文で話し、自分の過去についての質問ははぐらかし、愛称は決して使わない」と書くほうが、モデルが要約して返してくるだけの3段落の背景設定よりも効きます。
- チューニングされた温度を尊重する。 RP+のデフォルトは計測に基づく理由から0.8です。どのモデルでも、チューニングされた値から大きく外すとループが始まります。
- 文体はフォーマットに任せる。 チャット型のプロダクトにはメッセージモード、文章にはシーンモード。プロンプトで簡潔さを懇願するより、パラメーターで文体を切り替えるほうが確実です。
よくある質問
ロールプレイに総合的に最適なAIはどれですか?
キャラクター製品ならRP+です。明文化されたポリシーのもとでの検閲なしの表現幅、RP専用のチューニング、上流での保持なし、そして1回の応答につき3クレジットの定額料金。軽いノリのストーリーテリングなら大手のフラッグシップで、純粋な文章力では今も業界最高です。セルフホストするなら、MythoMax系と最新のRPファインチューンです。
ロールプレイに最適な検閲なしのAIは?
明文化された利用ポリシーを持つ専用エンジンです。eroqはまさにそれです。スタックを自前で持つなら、セルフホストのファインチューンという手もあります。大手モデルのジェイルブレイクはいたちごっこで、アップデートのたびに手口が通用しなくなります。本格的な選択肢は検閲なしAIの総合ランキングで比較しています。
良いRPには巨大なコンテキストウィンドウが必要ですか?
いいえ。必要なのは自分で管理できるメモリです。呼び出しのたびに組み直す、ウィンドウで区切った会話履歴とローリング要約のほうが、手入れのできない巨大なコンテキストに勝ります。ステートレスなAPIは、その設計を隠さず明示してくれます。eroqではプロンプトの上限が24,000文字、max_tokensの最大値が1,200で、きちんと手入れされたウィンドウに必要な容量を十分に上回ります。
キャラクターは画像や音声を送受信できますか?
eroqならできます。チャットは画像1枚につき+2クレジットで画像入力を受け付け、画像生成は10クレジットでキャラクターの自撮りを描き、TTSはVoice Oneなら100文字あたり3クレジット(Voice Turboなら2クレジット)で彼女に声を与えます。すべて1つのキーで使えます。eroqが対応していないのはリップシンクや話すアバターで、音声と画像は別々の呼び出しになります。
AIロールプレイの運用コストはどのくらいですか?
定額クレジットの場合、ライトユーザー(1日約8メッセージ)はRP miniで月およそ$2、熱心なユーザー(1日約40メッセージ)はRP+の割合によって月およそ$10〜16です。コンパニオンアプリの収支で全体の表を詳しく解説しています。それに合わせて無料枠に上限を設けましょう。
契約する前に試せますか?
新規アカウントには50の無料クレジットが付いてきます。miniなら50回、フラッグシップなら16回の返答に相当するので、本当にいちばん難しいシーンをRP+とRP miniで試すには十分です。ドキュメントでは、キーがなくてもサンプルの呼び出しを再生できます。
この記事で使ったモデルで作ってみましょう。無料の50クレジットで始めるか、全エンジンと料金をご覧ください。