動画
画像から動画
画像から動画(Image-to-Video)とは、静止画を動かして動画クリップにする手法です。画像が被写体と構図を固定し、プロンプトで動きを指示します。生成動画で特定の顔や商品を一貫して保つための定番の方法です。
参照画像が人物の同一性、構図、スタイルを担うため、プロンプトでは動きだけを指示すれば十分です。振り向く、風になびく、カメラが寄る、といった具合です。開始フレームと終了フレームの両方を受け付けてその間を補間するエンジンもあり、クリップの終わり方を正確にコントロールできます。
eroqでは
Sora 2 Proを除くすべての動画エンジンが開始画像に対応し、Seedance、Veo 3.1、Kling、Hailuoの各エンジンは終了フレームも受け付けます。素材には写真か、画像スタジオで生成した画像(「動画にする」を押します)を使えます。Motion Oneでは保存したキャラクターの画像も使えますが、ほかのエンジンではキャラクターは参照画像として渡されます。
よくある質問
画像から動画で顔は保たれますか?
はい、それこそがこの手法の目的です。KlingとSeedanceは、動きの中でも人物の同一性を特によく保ちます。
プロンプトで画像の内容をもう一度説明すべきですか?
いいえ、動くものだけを記述してください。被写体を改めて説明すると、参照画像とぶつかってしまいます。
画像から動画は、テキストから動画より料金が高いですか?
ほとんどの場合、変わりません。料金を決めるのはエンジン、長さ、解像度で、開始画像の有無は関係ありません。Motion Oneのクリップは、開始画像があってもなくても60クレジットです。例外はGrok Imagineで、フレーム画像ごとに3クレジットが加算されます。またHailuo 3では、参照画像ごと(キャラクターの画像を含む)に11クレジットが加算されます。