ブログ/tutorials·2026年7月28日·2分·執筆:eroqチーム
キャラクター系プロダクトの画像生成:プロンプト、一貫性、コスト
拡散エンジンへのプロンプトの書き方、生成ごとに同じキャラクターに見せる方法、1回10クレジットで画像機能の予算を立てる方法。
チャットはユーザーを定着させ、画像は課金につなげます。ユーザーが見ることのできるキャラクター、つまり新しいシーン、新しい衣装、新しいムードで現れるキャラクターは、このカテゴリーで私たちが知る限り、いちばん強力なプレミアムの仕掛けです。ここでは、eroq-krea2でこの機能をうまく作る方法を紹介します。
拡散モデルの言葉で話す
Krea2は拡散エンジンで、拡散モデルには独自の方言があります。文章もカンマ区切りのタグも読めますが、報われるのは正しい順番での具体性です。
subject and identity, action or pose, outfit, setting, lighting, camera, style
(被写体と特徴、動作やポーズ、衣装、場所、ライティング、カメラ、スタイルの順です。)
{
"model": "eroq-krea2",
"prompt": "young woman with silver bob and amber eyes, leaning on a workbench, grease-stained overalls, spaceship hangar, warm practical lights, 35mm, shallow depth of field",
"negative_prompt": "blurry, extra fingers, watermark, text"
}
ほとんどの仕事をしてくれるのは、次の3つのルールです。
- 特徴を先頭に置く。プロンプトの前のほうにあるトークンほど、重みが大きくなります。髪、目、体格といったキャラクターを決める特徴は、毎回いちばん最初に書きます。
- ネガティブプロンプトを必ず送る。
blurry, extra fingers, watermark, text(ぼやけ、余分な指、透かし、文字)が最低ラインで、そこにスタイル上除外すべきものを足します。無料で品質を上げられるレバーです。 - 1つのプロンプトに1つのシーン。拡散モデルは、競合する指示を平均して、どっちつかずのものにしてしまいます。「格納庫で、しかもビーチで」と書いても、どちらにもなりません。
cfg_scale(プロンプトへの忠実度)のデフォルトは妥当な値です。エンジンが創作上の自由を取りすぎるときは9〜12に向けて上げ、結果が焼けすぎて見えるときは4〜6に向けて下げます。
一貫性の問題
キャラクター画像の難しさは、拡散モデルが呼び出しのたびに新しい顔を生み出すことにあります。プロンプトだけでは、完全には解決しません。ほとんどの仕事をしてくれるのは参照写真です。キャストを参照画像付きのキャラクターとして保存し、elementsでそのキャラクターをchar:<id>として渡せば、何度レンダリングしても同じ顔が返ってきます。残りは、プロンプトの規律が担います。
- 正式な説明を固定する。キャラクターごとに15〜25トークンの特徴ブロックを1つ書き、すべての画像プロンプトの先頭に一字一句そのまま付けます。言葉単位での安定が大事で、類義語を使うと顔がずれていきます。
- スタイルのブロックも固定する。一貫した描画スタイル("35mm, soft grain")があれば、顔立ちが多少揺れても同じ人物に見えます。
- ギャラリーは垂れ流さず、厳選して並べる。キャラクターの公開ギャラリーはまとめて生成し、キャラクターらしく仕上がったものだけを選んで、残りは捨てます。1回10クレジットなら、厳選した12枚のギャラリーは、ボツも含めて約$1.60です。試行ではなく、機能に値段をつけましょう。
拒否された生成や空の生成は、自動で返金されます。エンジンが受け付けなかったプロンプトは、黙って失敗するのではなく明確なcontent_blockedコードを返すので、リトライのロジックで「言い換えるべき」と「もう一度試すべき」を区別できます。
画像がプロダクトのどこに効くか
課金につながるパターンを、手間の少ない順に紹介します。
- お披露目:関係の初期に一度だけ訪れる、「姿が見られる」瞬間。画像1枚で、アクティベーションに絶大な効果があります。
- シーンの静止画:チャット中にユーザーが「この瞬間を見せて」と頼むもの。ユーザーにはレンダリングごとに課金しましょう。あなたのコストは、決まって10クレジットです。
- ギャラリー:厳選し、少しずつ公開し、サブスクリプション限定にするもの。オフピークの時間帯にまとめて生成します。
どれも1回のPOST /v1/images/generations呼び出しに対応します。パラメータはリファレンスにあり、1回の呼び出しで1〜4枚をレンダリングするbatchや、縦長・横長のフレームを指定するaspectも載っています。出力はbase64としてインラインで返ってくるので、自分で保存します。また、すべてのレンダリングは、それを作ったレシピとともにライブラリにも保存されるので、キャラクターのベストショットはあとから見つけて、再実行できます。eroqに何も残してほしくないときは、private: trueを渡してください。ファイルもライブラリのエントリも残らず、利用明細ではプロンプトが星印で表示されます。
予算表
| 機能 | ユーザーあたりの月間レンダリング数 | クレジット | 費用の目安 |
|---|---|---|---|
| お披露目(1回のみ) | 1 | 10 | $0.10 |
| シーンの静止画 | 12 | 120 | $1.20 |
| ギャラリーの配信(厳選率3:1) | 16 | 160 | $1.60 |
月額$10–15のサブスクリプションに対して、画像は、サブスクリプションで買えるものの中でいちばん目に見える存在でありながら、余裕で利益の範囲に収まります。
よくある質問
AIで生成した画像で、同じ顔を保つにはどうすればいいですか?
キャラクターに参照写真を添付し、呼び出しにchar:<id>として渡してください。エンジンは毎回新しい顔を作るのではなく、その顔を保ちます。さらに、15〜25トークンの正式な特徴ブロックを一字一句同じまま繰り返し、スタイルのブロックも固定して補強します。厳選は前提にしましょう。何枚か生成して、キャラクターらしいものを残します。1回10クレジットです。
キャラクター系プロダクトには、どの画像モデルを使うべきですか?
3つとも10クレジットで、パラメータも共通です。Image Oneはフォトリアルのフラッグシップで、自撮り風の画像やシーンの静止画の標準に向いています。Image Animeはマンガやイラストを得意とし、Image Artは絵画的な表現で、長い描写的なプロンプトにより忠実に従います。
ネガティブプロンプトには何を入れるべきですか?
キャラクター制作ではblurry, extra fingers, watermark, textが最低ラインで、そこにスタイル上除外すべきものを足します。費用はかからず、使える中でいちばん安い品質向上のレバーです。cfg_scaleと組み合わせましょう。エンジンが自由を取りすぎるときは9〜12に向けて上げ、結果が焼けすぎて見えるときは4〜6に向けて下げます。
キャラクターには、どんなコンテンツが許可されていますか?
明文化された利用ポリシーのもとでのフィクションです。ダークで激しいテーマも含め、キャラクターが全員18歳以上である限り許可されています。未成年が関わるもの、本人の同意のない実在の特定できる人物、違法なものは絶対に禁止です。そうしたリクエストは明確なcontent_blockedコードを返し、決して課金されないので、リトライのロジックで「言い換えるべき」と「もう一度試すべき」を区別できます。
運用は安く、ユーザーにはプレミアムに感じられる。この組み合わせこそ、チャットの次に追加する機能として、私たちが画像を勧める理由です。
この記事で使ったモデルで作ってみましょう。無料の50クレジットで始めるか、全エンジンと料金をご覧ください。