ブログ/guides·2026年9月13日·2分·執筆:eroqチーム
プロンプトの長さとエンジンが無視するもの:300語より60語
長いプロンプトは豊かなプロンプトではありません。厳格な上限、エンジンが読む前に削られる部分、そして「種類ごとに指示は1つ」が鉄則である理由を解説します。
どんな生成ツールでも、覚えていく途中でプロンプトが日に日に長くなる時期があります。「cinematic」を足し、次に「8k」を足し、感情のトーンについて3文書き足し、避けたいもののリストを付け加える。すると結果は悪くなります。確実に、ツールが壊れているのかと思うほどに。壊れてはいません。プロンプトは予算であり、ある長さを超えると、その予算を自分のために浪費しているのです。
実際にぶつかる上限
そのうち2つは厳格な上限で、課金より前に適用されます。
動画と画像のプロンプトの上限は2,400文字です。英語でおよそ380語にあたります。超えると、該当フィールドを示す400 invalid_bodyで呼び出しが拒否されます。少なくとも正直に、しかも無料で失敗してくれるわけです。チャットは別の場所で、予算も別です。メッセージ履歴全体とコンテキストを合わせて24,000文字。ロールプレイのシーンは、レンダリングにはない状態を抱えているからです。音声合成は1回の呼び出しにつき5,000文字です。
つまり2,400は天井であって、目標ではありません。上限に近づいて得をする仕組みはどこにもなく、むしろ不利になる仕組みが1つあります。
誰も教えてくれない切り詰め
エンジンが読むのは、あなたのプロンプトそのものではありません。サーバー側で組み立てられたプロンプトです。まずあなたのテキスト、次に選択したエレメント、続いてカメラワーク、カメラ、レンズ、絞り、ライティング、パレット、フィルムの種類、時代、テンポ、そして比率をパラメータとして受け取れないエンジンの場合はアスペクト比。この組み立て部分が演出ラックで、あなたの文章のあとに、この順番で短い断片として追加されます。
そして組み立てられた文字列全体が、送信前に切り詰められます。SeedanceのエンジンとKling、Hailuo、Veoでは2,000文字、Motion Oneでは2,400文字です。
この2つの事実を合わせて読めば、失敗のパターンは明らかです。あなたの文章が先頭なので、文章は残ります。演出ラックは最後なので、削られるのは演出ラックです。Seedanceで2,400文字のプロンプトを書くと、最後のおよそ400文字はエンジンに届きません。そこはまさに、カメラワーク、レンズ、ライティング、パレットが置かれていた場所です。設定パネルでは選択されたままに見えますが、レンダリング結果には反映されません。
これが、上限いっぱいのプロンプトが短いプロンプトに負ける仕組み上の理由です。意図を薄めただけではなく、自分の操作設定を追い出してしまったのです。
種類ごとに指示は1つ
入力欄は、テキストの中から指示を読み取ることもします。「ワイドショット」「アナモルフィック」「35mm」「浅い被写界深度」などと入力すると、そのフレーズがハイライトされ、そのレンダリングの対応するパラメータが設定されます。演出ラックで何を選んでいても、こちらが優先されます。撮影台本がムードボードに勝つように、書かれた言葉が勝つのです。
ただし、効くのは種類ごとに指示1つだけです。カメラワーク1つ、カメラ本体1つ、レンズ1つ、絞り1つ。カメラワークを2つ書くと残るのは1つだけで、それが最初に入力したほうとは限りません。どちらになるかは文の順番ではなく、辞書による照合で決まります。「ワイドのエスタブリッシングショットから、ゆっくりプッシュイン」と書いても、ワイドショットからプッシュインする映像にはなりません。入力欄からは見えないルールで選ばれた、どちらか一方になります。
解決策は、ほかのあらゆるレンダリングの問題と同じです。1クリップにつき動きは1つ。そのショットに本当に2つの動きが必要なら、それは2つのクリップです。
平均化されて消えるもの
上限とは別に、もっと目立たない失敗もあります。拡散モデルや動画モデルは、一定量の注意(アテンション)を、あなたが挙げたすべてのものに配分します。5つ挙げれば、それぞれに届くのは5分の1です。
具体的には、次のような言葉は確実に何の効果もありません。
- 品質を表す形容詞。 「masterpiece, 8k, ultra-detailed, award-winning, highly realistic」は、どの操作にも対応していません。被写体と競合するノイズです。
- 一貫性についての指示。 「顔を一貫させる、安定、モーフィングなし」は、映像の中身ではなく出力の性質を述べています。エンジンにはそれを扱う仕組みがありません。
- ポジティブプロンプト内の否定。 「文字なし、余分な指なし」と書くと、文字と指という単語がプロンプトに入ります。否定はネガティブプロンプト欄に書くものです。ただし動画では、ネガティブプロンプトがネイティブに使えるのはKlingだけで、ほかのエンジンでは黙って無視されます。
- ムードの重ねがけ。 「緊張感、夢見心地、エネルギッシュ、メランコリック」は平均されて、何でもないものになります。
モデルに届いても生き残るのは、具体的で単一のものです。被写体1つ、動作1つ、カメラワーク1つ、光源1つ、ムード1つ。この順番で。
うまくいく形
30〜80語の、流れるような1段落。順番は、被写体、その動作、カメラの動き、光の来る方向、ムード。箇条書きも、キーワードの羅列も、括弧での重み付けもなしです。
黒いエプロンのバーテンダーがグラスを磨き、ドアが開くとそちらに視線を向ける。ワイドショットからミディアムへゆっくりプッシュイン、カウンター上の低い位置に実用照明のランプ、背後の窓越しに雨、張りつめた期待感のあるムード。
英語の原文で44語。そのすべてが仕事をしています。このプロンプトなら約2,150文字の余裕が残るので、演出ラックはまるごと届き、パネルで選んだ設定はすべて実際にエンジンまで届きます。
同じショットの長いバージョン(3文の背景設定、11個の形容詞のリスト、バーの歴史についての1段落)は、より具体的になっているわけではありません。同じ43語の信号のまわりを300語のノイズが取り囲んでいるだけで、プレミアムエンジンでは、カメラワークが切り落とされた状態で届きます。
プロンプトの組み立て方はAI動画プロンプトガイドで、演出ラックが何を加えるかは演出ラックの解説で、さらに詳しく扱っています。
長さを注ぎ込むべき場所
残しておく価値のある細部があるなら、プロンプト欄ではなく、長く使える場所に置きましょう。
エレメントは、場所・オブジェクト・スタイルを、それぞれの説明文と写真付きで保存するものです。@メンションすればどのレンダリングでも再利用でき、説明文は独立した断片として取り込まれます。詳しくはエレメントの使い方をご覧ください。キャラクターは人物像と参照写真を保存し、毎回同じ顔を出してくれます。参照画像1枚は、場所について200語よりも多くを伝えます。この3つはどれも、プロンプトを短く保ちながらレンダリングをより具体的にしてくれます。作文を書くのとは正反対の取引です。
ラフなアイデアを監督級の一文に仕上げたいときは、「強化」が無料でやってくれます。膨らませるのではなく、書き直してくれるのです。納得のいかないプロンプトがあれば、言葉を足し始める前に、まずプロンプト強化を試すのが正解です。
動画スタジオを開いて、いちばん長いプロンプトを60語まで削って試してみてください。たいていは良くなりますし、その理由もわかるはずです。
よくある質問
プロンプトの長さに上限はありますか?
はい。動画と画像のプロンプトは2,400文字が上限で、それより長いとクレジットが動く前に400で拒否されます。チャットは履歴全体で24,000文字、音声合成は1回の呼び出しにつき5,000文字です。ただし実際の限界はもっと低くなります。組み立てられたプロンプトは、エンジンが読む前にもう一度切り詰められるからです。
プロンプトがとても長いと、選んだ設定はどうなりますか?
設定はあなたのテキストのあとに追加されるため、組み立てられたプロンプトが切り詰められるとき(プレミアムエンジンでは2,000文字)に真っ先に削られます。パネルでは選択されたままに見えても、レンダリングでは無視されます。演出ラックを確実に残すには、プロンプトを短く保つことです。
1つのプロンプトにカメラワークを2つ入れられますか?
入力はできますが、効くのは1つだけです。どちらが効くかは、書いた順番ではなく照合する辞書によって決まります。1クリップにつき動きは1つと考え、それ以上必要ならショットを分けてつなぎましょう。レンズ、カメラ本体、絞りも同じです。
プロンプト強化を使うとプロンプトは長くなりますか?
エンジンが反応しやすい形に書き直すので、たいていは長くなるより引き締まります。無料で使えるので、うまくいかないプロンプトに試さない理由はありません。形容詞を手で足し始める前に使ってみてください。
この記事で使ったモデルで作ってみましょう。無料の50クレジットで始めるか、全エンジンと料金をご覧ください。