ブログ/guides·2026年9月11日·2分·執筆:eroqチーム
AI動画のちらつきと変形:ショットの途中で顔が崩れる理由
途中で色が変わる服、ずれていく顔、うごめく背景。時間的な不安定さとは何か、何が効いて何が効かないのかを解説します。
クリップを再生すると、最初の2秒は完璧です。ところが、ジャケットがネイビーから黒に変わり、壁のロゴが別のロゴに組み変わり、4秒目あたりでキャラクターの顔が「本人によく似た親戚」の顔になってしまう。何も失敗してはいません。これは時間的な不安定さと呼ばれる現象で、技術的には成功しているレンダリングがそれでも使えない、という事態のいちばんよくある原因です。
モデルは自分の映像を見ていない
動画エンジンは、それまでのフレームとプロンプトを条件にしてフレームを生成します。一方で、シーンの状態をずっと記録しておくことはしません。このジャケットはネイビーとか、3秒前と同じ人物といった変数は、どこにも存在しないのです。フレーム間の一貫性は、モデルが続きを作るのが得意であることから自然に生まれる性質であって、モデルが保証しているものではありません。
つまり、ずれるのが当たり前で、一貫性は勝ち取るものです。ちらつきを抑える方法はどれも、モデルがさまよえる範囲を狭めるか、出発点を固定するかのどちらかで効いています。
最初に崩れる場所
不安定さは均等には現れません。同じものを同じ順番で襲うので、予測ができます。
- 小さな顔。画面の10分の1しか占めない顔は、注意も10分の1しか向けられず、数フレームごとに違う形で再構成されます。
- 手と指。静止画で崩れるのと同じ理由に、さらに動きが加わります。
- 印刷された文字やロゴ。現行のエンジンで、ショット全体を通して文字を読める状態に保てるものはありません。文字は並び替わります。画面内の文字は、必ず崩れるものと考えてください。
- 柄のある生地。ストライプ、チェック、プリント柄は絶えず描き直されます。無地の服は、ヘリンボーンのコートより格段に安定します。
- 群衆や脇役。モデルが注目していない人物は、背景で好き勝手に変形します。
- うごめく背景。木の葉、雨、水、炎、煙。エンジンにはこれらが「動き」に見えるので、毎フレーム喜んで作り直します。
変形が起きているなら、プロンプトに手を付ける前にこのリストを確認してください。ちらつきの苦情の半分は、柄シャツか壁の看板が原因です。
本当に効く対策
効果の大きい順に、5つの変更を紹介します。
短くレンダリングする。ずれは積み重なるので、5秒のクリップは10秒のクリップよりもさまよう余地が小さくなります。10秒で変形するショットも、5秒なら持ちこたえることがよくあります。それに、きれいな5秒のクリップを2本つないだほうが、揺らぐ10秒1本より見栄えがします。
フレームから始める。画像から動画では最初のフレームが固定されます。モデルは被写体を自分で作り出してから覚えきれずに崩すのではなく、承認済みの固定された画像から始めます。これが最大のレバーで、手順も簡単です。静止画をレンダリングして承認し、ライブラリでその画像の動画化を押すだけです。
背景をシンプルにする。壁、空、浅い被写界深度。ぼかしてしまえば、うごめくものはなくなります。プロンプトに書いた「f/1.4」が、ここで実際にもたらしてくれるのはこの効果です。
被写体は1つ。2人は、1人の2倍以上難しくなります。エンジンの注意が分散し、見られていないほうが崩れます。
カメラの動きは1つ、ゆっくりと。速い動きは新しい形状を次々に映し出し、新しい形状とはつまり作り出された形状です。ゆっくりとしたプッシュインが、いちばん安定して撮れるショットです。
5つすべてを踏まえた、そのまま貼り付けられるプロンプトです。
無地のグレーのセーターを着た男性が、何もないキッチンテーブルに座り、窓のほうを見上げてじっとしている。ミディアムショットからのゆっくりとしたプッシュイン、左からのやわらかな窓明かり、背後は無地の壁、浅い被写界深度、静かで辛抱強い雰囲気。
無地の生地、被写体は1つ、アクションも1つ、ゆっくりとした動きが1つ。背景には、作り直されるものが何もありません。
シードが安定させるのは比較であって、クリップではない
Seedanceの3つのエンジンはすべてシードに対応しています。同じシードと同じプロンプトなら、同じテイクが生成されます。これは安定化の機能だと誤解されがちですが、違います。
シードは、ショット内の変形を減らしません。ショットを再現可能にするものです。だからこそ1語だけ変えたとき、目の前の違いがサイコロの目ではなくその1語から来たものだとわかります。ちらつきの原因を突き止めるにはとても役立ちますが、治す手段にはなりません。実用上、覚えておきたい点がひとつあります。シードを固定したまま4テイクをまとめて生成すると、まったく同じクリップが4本できます。バリエーションが欲しいときは、シードを外してください。詳しくはシードとリミックスのワークフローで解説しています。
ループ、リビール、トランジションなど、特定の場所で終わる必要があるショットには、Seedanceファミリーが開始フレームと終了フレームのペアを受け付け、そのあいだを補間します。両端を固定するのが、ここでクリップに与えられるいちばん強い制約で、制約が強いほど安定します。
効かないもの
一貫性を求める形容詞。「一貫した顔、変形なし、安定、まとまりのある」といった言葉は、出力についての言葉であって、映像についての言葉ではありません。モデルにはそれを実現する仕組みがなく、実際に映像を導く言葉を薄めてしまいます。
ほとんどのエンジンでのネガティブプロンプト。ここははっきり言っておく価値があります。この欄はどこでも受け付けられますが、動画のネガティブプロンプトがネイティブに機能するのはKling 2.5 Turboだけです。Motion One、Seedanceの各エンジン、Hailuo、Veoでは、APIが受け取ったあと、エンジンに届く前に黙って破棄されます。「顔の歪みなし」を動画で効かせたいなら、Klingを使うしかありません。
解像度を上げる。1080pでは、変形がより細かく描かれるだけです。それ以外の効果はありません。
シーケンス全体でルックを保つ
ショット内の安定性はひとつの問題で、12ショットにわたってキャラクターを見分けられるように保つのは、また別の問題です。答えも別にあります。参照写真を設定したキャラクターをすべてのシーンで使い回せば、各クリップが同じ文章ではなく、同じ顔から始まります。こちらについてはAI動画で一貫したキャラクターを作る方法でしっかり解説しています。
この2つは、うまく組み合わさります。キャラクターで人物を固定し、画像から動画の開始フレームで画面を固定し、クリップは短く保って、つなぐ。安定して見える映像の多くは、1テイクでレンダリングされたのではなく、こうして組み立てられたものです。
動画スタジオを開いて、変形してしまうショットを、開始フレーム付き・半分の長さで試してみてください。
よくある質問
クリップの途中で服の色が変わるのはなぜですか?
エンジンのどこにも、色が保存されていないからです。各フレームは改めて予測され、柄物や曖昧な色合いの服ほど早くずれていきます。無地でコントラストのはっきりした服は、ストライプやプリント柄よりもはるかにショットを乗り切りやすくなります。参照フレームから始めれば、1フレーム目で色も固定されます。
シードを使えば動画の変形は止まりますか?
止まりません。シードはテイクを再現可能にするので2つのバージョンを公平に比較できますが、そのテイク内のフレーム同士の一貫性を高めるわけではありません。あくまで診断のための道具で、対応しているのもSeedanceのエンジンだけです。ずれを実際に減らすのは、短いクリップと開始フレームです。
AIクリップで文字やロゴを読める状態に保てますか?
ここにあるどのエンジンでも、確実にはできません。文字はフレームごとに再構成されて並び替わってしまうので、タイトルやロゴ、ローワーサードはプロンプトで頼むのではなく、レンダリング後に編集ソフトで追加する前提で計画してください。代わりに、ショットの中にそのためのスペースを空けておきましょう。
動画でネガティブプロンプトが何も効かないのはなぜですか?
ネイティブに機能するのがKling 2.5 Turboだけだからです。ほかの動画エンジンはこの欄を受け付けても無視するので、入力した内容はモデルに届きません。ショットをKlingに移すか、短いクリップ、被写体1つ、シンプルな背景のほうに力を注いでください。
この記事で使ったモデルで作ってみましょう。無料の50クレジットで始めるか、全エンジンと料金をご覧ください。