新規登録でプレミアムプランが割引に割引を受け取る

ブログ/tutorials·2026年9月7日·2分·執筆:eroqチーム

AI動画でキャラクターを一貫させる:どのシーンでも同じ顔に

eroqのキャラクター機能で、AI画像と動画クリップに同じ人物を登場させる方法。参照写真、@メンション、シーンごとのキャスト、シード、変わらないボイス。


動画ジェネレーターに「緑のコートを着た赤毛の女性」と4回書けば、4人の赤毛の女性が出てきます。タイプは同じでも、別人です。雰囲気を見せるリールならそれで構いませんが、物語、シリーズ広告、コンパニオンアプリなど、見る人が誰かを見分けることが前提のものには致命的です。一貫性は、プロンプトを書く技術の問題ではありません。キャスティングの問題です。eroqスタジオもそう捉えています。キャラクターを一度作り、あとはショットに配置するだけです。

テキストだけでは顔を保てない理由

プロンプトが表しているのはカテゴリーです。「そばかす、欠けた前歯、左分けの髪」のように長く書いても、それはエンジンが毎回新たに満たす制約の集まりにすぎず、レンダリングは毎回ゼロから始まります。言葉は範囲を狭めますが、その中の一点を固定はしません。顔を固定できるのは、その顔の写真だけです。以下はすべて、その写真を毎回、できるだけ手間なくエンジンに見せるための話です。

キャラクターは一度作るだけ

キャラクターを開いて、新しく作成します。キャラクターは4つの要素でできています。名前、ペルソナ、参照写真、ボイスです。いちばん重要なのは写真で、エンジンが画像やクリップをまたいで同じ顔を保つための参照画像になります。

写真をどこから用意するかが重要です。

  • 生成する。画像ツールでキャラクターを一度書き、Image One(フォトリアル)かImage Anime(イラスト)で4枚のバッチをレンダリングして、顔がはっきりしていて、正面から光が当たり、何にも隠れていないフレームを残します。次に、それらを参照写真にして2回目のバッチをレンダリングし、斜め、横顔、笑顔などのアングルを揃えます。1枚10クレジットなので、4枚のバッチ2回で、参照セットは80クレジットです。
  • アップロードする。使う権利のある顔だけにしてください。本人の同意なく、実在する特定可能な人物を使うことは利用ポリシーで認められておらず、違反への措置はアカウント単位で行われます。キャラクターはフィクションのためのものです。

ついでにペルソナも書いておきましょう。年齢(18歳以上)、気質、立ち居振る舞いなどです。キャラクターを@メンションしたときに一緒に渡されるのがこのペルソナで、「彼女はドアの前でためらう」の「彼女」が別人になるのを防ぎます。参照セットの作り方は、キャラクターの画像生成ガイドで詳しく解説しています。

@メンションでキャラクターをショットに入れる

動画と画像の入力欄で、@とキャラクターの名前を入力します。メンションすると、そのキャラクターの参照写真とペルソナがレンダリングに添付され、プロンプトではその周りのシーンを描写するだけで済みます。メンションを使った、完全なシーンのプロンプトの例です。

@Maraが深夜3時、誰もいないダイナーのカウンターに座り、飲む気のないコーヒーをかき混ぜている。やがてヘッドライトの光が窓を横切り、彼女は顔を上げる。固定ショット、柔らかなポートレートレンズでf/1.4、頭上から落ちる蛍光灯の光とカウンターの上の暖色のランプ、ノスタルジックな青のパレット、静かで孤独な雰囲気。

プロンプトでは、Maraの顔も髪も服も一切描写していないことに注目してください。それがポイントです。彼女の姿は写真が運んでくれます。改めて描写すると、ずれを招くだけです。

フィルムモードでは、シーンごとにキャストを設定します。Maraをシーン1、3、7に入れ、インサートショットからは外す。シーンのキャストは次のシーンに漏れないので、二人芝居は二人芝居のままです。

場所、オブジェクト、スタイルは、エレメントで同じように扱えます。再利用できる参照を最大50個まで保存でき、これも@メンションできます。繰り返し登場するアパートやトレードマークのコートも一貫性の問題で、解決法は同じです。参照は一度、メンションはどこでも。

描写し直さず、顔を動かす

動画で最も強力なのは、キャラクターを素材にした画像から動画です。素材にキャラクターを選ぶと、エンジンがその参照写真を直接動かします。顔は最初のフレームにあるので、プロンプトでは動きとカメラだけを描写すれば済みます。「5本のクリップで同じ人物」という結果のほとんどは、この方法から生まれています。

さらに役立つ設定が2つあります。

  1. シード。Seedanceのエンジンは、再現用のシードに対応しています。テイクがいい線まで来たらシードを固定し、プロンプトを少しずつ変えましょう。別人ではなく、同じレンダリングのバリエーションが得られます。
  2. エンジンの選択。Kling 2.5 Turboは、なめらかな動きと顔の表現に定評があります。クリップの大半が顔なら、試す価値があります。Motion Oneはすべてのアカウントで使える、検閲なしのエンジンです。

そしてプロンプトのルールがひとつ。書くのは動きだけです。「彼女が振り向き、息を吐き、光が移ろう」と書き、「赤褐色の髪の女性」とは書きません。それは静止画がすでに語っています。

変わらないボイスを与える

キャラクターにはボイスもあります。ライブラリのボイス(温かく親密なAria、低く落ち着いたOrionなど、13言語対応)か、自分の録音からクローンしたボイスです。キャラクターに一度設定すれば、ボイスツールにキャストが表示されるので、「Maraが話す」セリフはいつも同じMaraの声になります。Voice Oneは表現力豊かなフラッグシップで、100文字あたり3クレジット。Voice Turboはより高速で2クレジット、ライブラリのボイスとクローンは同じものを使えます。セリフを生成してMP3をダウンロードし、編集ソフトでクリップの下に敷きましょう。人間らしく聞こえるセリフの書き方は、AIキャラクターのTTSで解説しています。

チェックリスト

  1. きれいな参照写真を数枚(複数のアングル、同じ光)用意して、キャラクターを作る。
  2. ペルソナを2〜3文で書く。
  3. 描写せず、@メンションする。フィルムモードではシーンごとにキャストを設定する。
  4. 顔が大事なクリップでは、キャラクターを素材にした画像から動画を優先する。
  5. Seedanceでテイクがいい線まで来たら、シードを固定する。
  6. キャラクターごとにボイスはひとつ。キャラクターに設定する。

よくある質問

キャラクターには参照写真が何枚必要ですか?

1枚より多く、撮影会ほどは要りません。さまざまなアングルから撮った、明るくきれいな写真が数枚あれば、ほぼ同じ写真20枚に勝ります。

同じキャラクターを画像でも動画でも使えますか?

はい。参照写真は画像モデルでも動画エンジンでも使われるので、静止画で確認した顔が、そのまま動画で動きます。

キャラクター機能を使わずに、キャラクターを一貫させられますか?

ある程度は可能です。画像ツールの参照写真で1回のレンダリングの顔は保てますし、シードでレンダリングを再現できます。プロジェクト全体で自動的に一貫させるなら、キャラクター機能を使いましょう。

最初のキャストは/studio/charactersで作れます。先にAIキャラクター作成の概要を読むのもおすすめです。

タグcharactersconsistencyai-videoreference-photostutorial

この記事で使ったモデルで作ってみましょう。無料の50クレジットで始めるか、全エンジンと料金をご覧ください。