ブログ/use-cases·2026年8月31日·2分·執筆:eroqチーム
オンライン講座のAI動画:Bロール、オープニング、ボイスクローンでナレーション
eroqでカリキュラム全体のオープニング、Bロール、クローン音声のナレーションを制作。全レッスンで統一したビジュアルと、1モジュールあたりのクレジット計算。
講座を収録するときの地味な真実は、レッスン本編がいちばん楽な部分だということです。内容は知り尽くしているのですから。何週間も食いつぶすのは、そのまわりのすべてです。2014年のテンプレートに見えないオープニング、静止したスライドを前に抽象的な概念を説明する4分間に流すBロール、40本のレッスンでそろったタイトルカード、そしてモジュールの途中で風邪をひいたせいで必要になったレッスン6の撮り直し。生成動画と音声合成が得意なのはまさにそのまわりの層で、あなたがもともと得意な層は苦手です。
レッスンにおける生成動画の役割
何かにクレジットを使う前に、線引きをしておきましょう。
向いている使い方:5秒のオープニング、セクションタイトルの背景に流すエスタブリッシングショット、概念を語るあいだの視覚的なメタファー、章と章のつなぎ、引用の背景に置く静止画、販売ページのメインビジュアル。
向いていない使い方:あなたのふりをするものすべて。eroqにはリップシンクも話すアバターもなく、自分の映像でモデルを学習させることもできません。生成した講師は、口の動きがあなたの言葉と合わない架空の他人です。講座の顔は、これまでどおりあなたのカメラが担います。あなたらしさを本当に担えるのは声だけで、それは操り人形ではなく、クローンです。
計画を立てる前に知っておきたいことがもう1つあります。eroqはクリップをレンダリングするところまでです。トリミング、トランジション、カラーグレーディングは編集ソフトで行います。
カリキュラム全体で1つのルック
レッスン1が温かくフィルムのような質感で、レッスン9が冷たくデジタルな質感だと、講座は素人っぽく見えます。40本のレッスンを1つのビジュアルにまとめる仕組みが3つあります。
スタイルのエレメント。 エレメントは、再利用できる場所・オブジェクト・スタイルのライブラリで、最大50個まで登録でき、それぞれプロンプト内で@メンションできます。講座のルックを一度スタイルのエレメントとして書いておけば、演出ラックの5項目を毎回入力し直して、全部覚えていたことを祈る必要はありません。どのレンダリングにも@メンションを入れるだけです。
演出ラック。 サーバー側でプロンプトに組み込まれるので、あなたのスタイルは毎回即興で書く文章ではなく、プリセットになります。フィルムの種類「ドキュメンタリー」、時代「2010年代」、テンポ「穏やか」、カメラ「35mmフィルム」、パレット「ノスタルジックブルー」、ライティング「ソフトクロスライト」で、まとまりのあるハウススタイルが1つできあがります。一度変更すれば、以降のレッスンはすべてそれに従います。
シード。 Seedanceのエンジンは再現性のためにシードに対応しているので、レッスン1で気に入ったオープニングを、運よく再発見するのではなく、被写体だけ変えて同じ持ち味のまま再レンダリングできます。
オープニングのプロンプト
流れるような1段落で、被写体、動き、カメラ、光、ムードの順に書きます。
夜明けの誰もいない講義室を最後列から見たショット、中央の通路をゆっくりプッシュイン。高い窓から淡い青い光が差し込み、光の筋の中でほこりが舞う。木製の座席の列は柔らかくぼける。f/4のクリアでシャープなレンズ、ノスタルジックブルーのパレット、ソフトクロスライト、穏やかなテンポ、35mmフィルムのドキュメンタリー調、ワイドショット。
モジュールごとに被写体の部分だけを差し替え、最初の読点以降はすべてそのまま残します。統一感のあるカリキュラムのコツはこれだけです。文法は変えず、名詞だけを変えるのです。
1本のクリップではなく連続したシーンが必要なレッスンには、動画スタジオのCinemaモードで、絵コンテを少しずつ組み立てられます。シーンを1つずつ最大12個まで追加でき、追加したシーンはすぐにレンダリングされます。シーンごとのテイク数は×1〜4で、どのシーンも編集、再レンダリング、並べ替え、複製ができます。下書きは「マイフィルム」に保存されるので、来年の改訂は今年の絵コンテから始められます。
自分の声でナレーション
ボイススタジオでは、厳選されたボイス(温かく親密なAria、低く落ち着いたOrion、13言語に対応)で音声合成ができるうえ、自分の音声から声をクローンすることもできます。講座制作者の多くが本当に求めているのはこちらでしょう。クローンを一度録音しておけば、風邪が治るのを待たずにレッスン6を録り直せます。
モデルは2つで、ボイスもクローンも共通です。Voice Turboは100文字あたり2クレジット、表現力の高いフラッグシップのVoice Oneは100文字あたり3クレジット。実践的な習慣としては、全レッスンをTurboで下書きし、聴いて、台本を直してから、本番をVoice Oneでレンダリングします。話し方は句読点と「速度」「表現力」の設定で決まるので、平板なセリフを直すのはたいてい読点1つで済み、別のエンジンで再レンダリングする必要はありません。詳しくはボイスクローンのページをご覧ください。
10レッスンのモジュールにかかるコスト
1モジュールの内訳は、レッスンごとにオープニング1本、Bロール2本、タイトルカード1枚、そしてナレーション。クリップはSeedance 1.0 Liteで5秒(120クレジット)、静止画はImage One(10クレジット)、ナレーションはVoice Turboで1レッスン6,000文字(英語でおよそ1,000語)とします。
- オープニング:10 × 120 = 1,200
- Bロール:20 × 120 = 2,400
- タイトルカード:10 × 10 = 100
- ナレーション:60,000 ÷ 100 × 2 = 1,200
合計4,900クレジットで、エントリー向けパック($10で1,000クレジット)の単価なら約$49です。最終的なナレーションをVoice Oneでレンダリングする場合は60,000 ÷ 100 × 3 = 1,800となり、モジュール全体で5,500になります。
どちらの場合も、Creator($49で6,000クレジット)の1か月分で1モジュールをまるごとまかなえ、半分のレッスンをもう一度作り直せるだけの余裕も残ります。Hobby($15で1,800クレジット)なら月におよそ半モジュール分です。2か月に1モジュールのペースで公開し、残高を繰り越すなら十分です。クレジットに有効期限はありません。失敗したレンダリングは自動で返金されるので、うまくいかなかったバッチで失うのはひと晩の時間だけです。
組み立てと、eroqがしない部分
レンダリングしたものはすべて、レシピ一式とともにライブラリに保存されます。「リミックス」を押せばそのレシピがツールに読み込まれるので、レッスン11はレッスン10から始められます。「動画化」を使えば、気に入った静止画を画像から動画のクリップの素材にできます。承認済みのタイトルカードに動きをつけるには、これがいちばん安い方法です。
あとは書き出すだけです。講座の組み立て(タイムライン、字幕、クイズ、LMSへのアップロード)は、これまでどおりの場所で行います。同じ役割分担を逆の側から説明しているのが顔出しなしYouTubeチャンネルの活用例で、そちらでは生成された層がさらに多くの仕事を担っています。
よくある質問
撮影せずに、自分が教えている動画を作れますか?
いいえ。eroqが生成するのはオリジナルの架空の人物で、リップシンクも、あなたの言葉を話すアバターもありません。自分の映像でモデルを学習させる機能もありません。声はクローンし、顔は撮影しましょう。
ナレーションには実際どれくらいのクレジットがかかりますか?
課金は単語数や分数ではなく、文字数単位です。Voice Turboは100文字あたり2クレジット、Voice Oneは3クレジット。英語で1,000語のレッスンはおよそ6,000文字なので、Turboなら120クレジット、Voice Oneなら180クレジットです。
40本のレッスンの見た目をそろえるには?
ルックをスタイルのエレメントとして保存し、演出ラックのプリセットを1つに固定し、Seedanceのエンジンではシードを使い回します。プロンプトの被写体は変えても、そのあとの文法は決して変えないことです。
今週モジュール1を作るなら、ボイススタジオを開いて、まず声をクローンしましょう。オープニングは台本に合わせて作れば大丈夫です。
この記事で使ったモデルで作ってみましょう。無料の50クレジットで始めるか、全エンジンと料金をご覧ください。