新規登録でプレミアムプランが割引に割引を受け取る

ブログ/guides·2026年9月10日·2分·執筆:eroqチーム

クリエイター向けAI音声生成のおすすめ:課金前に試すべきこと

AI音声生成ツールを表現力、文字単価、ボイスクローン、対応言語、出力形式で選ぶ方法。Voice OneとVoice Turboの料金計算付きで解説します。


テキスト読み上げのデモは、どれもよく聞こえます。どのデモも、よく聞こえるように選ばれた文だからです。買うべきボイスは、あなたの最悪の段落を乗り切れるものです。電話番号が入っていて、略語があり、誰も発音できないブランド名があり、淡々と読まなければならない一文がある、そんな段落です。このガイドでは、デモではなく基準で選ぶこと、文字単価を正直に計算すること、そしてプロジェクトをひとつのボイスに託す前にオーディション用の台本を流すことを解説します。

選定基準(効いてくる順)

1. 表現力か、予測しやすさか。 表現力のあるモデルは、強調やテンポで冒険します。速いモデルは素直に読みます。20分を超えるナレーションなら、たいていは予測しやすいほうが勝ち、キャラクターのセリフなら表現力のあるほうが勝ちます。これがVoice OneとVoice Turboが体現するトレードオフで、なんとなく高いほうを選ぶのではなく、意図して選ぶ価値があります。

2. 操作できる範囲。 変えられるのはボイスだけか、速度や表現力も変えられるか。ボイススタジオでは、どちらも飾りではなく、エンジンにつながったスライダーです。

3. クローン。 自分の音声を提供して、その声を返してもらえるか。どんな音声が必要か、その後どこに保存されるか、クローンがすべてのモデルで使えるのか、ひとつだけなのかを確認しましょう。eroqでは、クローンは自分の録音から作られ、両方の音声モデルと、それを割り当てた任意のキャラクターで使えます。

4. 対応言語。 言語の数を数えたら、実際にどのボイスがその言語に対応しているかを確認します。用意されたボイスのひとつ、Orionは13言語をカバーしています。ボイスのラインナップが多言語対応と言えるのは、個々のボイスが対応している範囲だけです。

5. 出力形式と、その使い道。 Voice Oneの出力はMP3で、ライブラリに自動保存され、APIからストリーミングもできます。ブラウザで再生するだけでファイルを渡してくれないツールは、パイプラインではなくデモです。

6. 文字単価。 何かを比較できる唯一の料金単位です。分単価は読む速さを隠し、単語単価は句読点を隠します。文字は文字です。

7. ポリシーと同意。 使用許可のない声のクローンは論外です。特定可能な実在の人物を同意なく扱うことは全面的に禁止されていて、声もそれに含まれます。架空のキャラクター、自分の声、ライセンスを受けた声なら問題ありません。

8. APIはあるか。 そして、それはUIが使っているものと同じか。スタジオとAPIが食い違っていたら、試作したものと出荷するものが別物になってしまいます。

Voice OneとVoice Turboの料金計算

2つのモデルで、ボイスのラインナップもクローンもコントロールも同じです。違いは、100文字あたり3クレジットか2クレジットかという点だけです。

  • 30秒の広告ナレーション(約450文字):Voice Oneで15クレジット、Turboで10クレジット。どちらでも5セント程度です。
  • 60秒のボイスオーバー(約900文字):27クレジット対18クレジット。まだ微々たるものです。
  • 10分のエピソード(約9,000文字):270クレジット対180クレジット。エントリーパックの単価で約$2.70対$1.80です。
  • 60,000語のオーディオブック(約360,000文字):10,800クレジット対7,200クレジット。Studioプランの単価で、およそ$80対$54です。

この比率は変わりません。Turboは常に3分の1安くなります。つまり判断のポイントは、表現力がどこで効くかだけです。平坦で一貫した読みが目標の長尺ナレーションなら? Turboにして、浮いた分をテイクの数に回しましょう。キャラクターのセリフ、感情の山場、読み方ひとつで成否が決まる広告なら? Voice Oneです。1つのプロジェクトの中で混ぜて使ってもかまいません。ボイスは同じで、変わるのは演技を担うモデルだけです。

句読点が演出のトラックになる

信頼に足る独立した「感情」パラメーターは、どのプラットフォームにもありません。読み方を実際に左右するのはテキストそのものであり、良い結果を出しているクリエイターはエンジンに向けて書いています。

  • 読点は一拍、句点はひと呼吸。 1つの文を2つに分けるほうが、どのスライダーよりもテンポを変えます。
  • 三点リーダーはためらいを生む…… ただし使うのは1回だけ。1段落に3回も使えば、退屈そうなナレーターになります。
  • ダッシュは断ち切る――こんなふうに。 割り込みや言い直しに向いています。
  • 疑問符は語尾を上げる。 だから、文字で読むなら平叙文のほうが自然でも、疑問文で書きましょう。
  • 全部大文字(ALL CAPS)は音量ではない。 強調は語順で表すか、節を分けましょう。
  • 数字は読むとおりに書く。 その文字列で試したことがない限り、「1995」ではなく「せんきゅうひゃくきゅうじゅうご」と書きます。

ボイスエディターの「話し方の構文」ガイドには、これらがクリックひとつで挿入できる例文付きでまとめられています。自分で一から見つけ直すより早いでしょう。

オーディション用の台本

デモでボイスを選んではいけません。これか、これに似たもので選びましょう。うまくいかない要素がすべて詰まっているからです。

どうも――手短にひとつだけ。2027年3月3日に、APIをv2へ移行します。いまeroq.ai/v1をお使いなら、残りはおよそ6か月です。それまでに壊れるものはありません。ご質問は? こちらに返信するか、555-0142の内線9までお電話ください。それと……ええ、わかっています。また移行です。すみません。

この段落を、同じ速度設定ですべての候補ボイスに読ませ、5つの点を聞き分けましょう。ダッシュ、日付、URL、電話番号、そして「それと……ええ、わかっています」が淡々と決まるか、やりすぎになるか。英語の原文でわずか270文字の真実が、1時間のデモリールに勝ります。eroqなら300文字以内の台本はVoice Oneで9クレジット、Turboで6クレジットに収まるので、4つのボイスを試しても1ドルかかりません。

組み込む

スタジオとAPIは同じ仕組みの上にあるので、エディターで調整したものは、呼び出し1回でそのまま再現できます。

curl -X POST https://eroq.ai/v1/audio/speech \
  -H "Authorization: Bearer $EROQ_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "eroq-voice-turbo",
    "voice": "aria",
    "input": "Hey — quick one. On March 3rd, 2027, we are moving the API to v2."
  }' --output audition.mp3

eroq-voice-turboをeroq-voice-oneに替えて、2つのファイルの違いを耳で聞き比べましょう。ariaをクローンのIDに替えるか、char:<id>にすればキャラクターの声を使えます。完全なリファレンスは音声APIのドキュメントに、チャット製品にボイスを組み込む方法は姉妹記事のAIキャラクターのためのTTSにまとめています。

プロジェクトを任せる前に

  • オーディションは、サンプルではなく自分の台本で行いましょう。
  • テストするのは、送る予定の中で最も長い段落です。最も短い段落ではありません。
  • 決める前にクローンを作りましょう。自分が権利を持つ声のクローンは、あなた特有の話し方では、用意されたどのボイスよりも合うことがよくあります。
  • プロジェクト全体を文字数で見積もり、料金ページと照らし合わせましょう。3対2の差がようやく表に出てくるのは、長尺のプロジェクトです。
  • ファイルを1つ生成して、スマホのスピーカーで聞きましょう。ヘッドホンでは何でもよく聞こえます。

よくある質問

Voice OneとVoice Turboの違いは何ですか?

Voice Oneは100文字あたり3クレジットの表現力豊かなフラッグシップで、Voice Turboは2クレジットのより高速なモデルです。ボイスのラインナップ、クローン、速度と表現力のコントロールはどちらも同じ。長く平坦なナレーションにはTurbo、読み方でセリフが決まる場面にはVoice Oneを使いましょう。

AIナレーション1時間の費用はいくらですか?

1時間の音声はおよそ54,000文字なので、Voice Oneで約1,620クレジット、Voice Turboで約1,080クレジットです。パックやプランによって、だいたい$8〜$16になります。見積もりは分ではなく文字数で行いましょう。

自分の声をクローンできますか?

はい、自分の音声から作れます。クローンは両方の音声モデルで使え、割り当てた任意のキャラクターでも使えます。本人の同意なく実在の人物の声をクローンすることは認められていません。

1ドル未満で4つのボイスをオーディションしてみましょう。ボイススタジオはこちら。

タグtext-to-speechvoice-cloningvoice-onevoice-turbo

この記事で使ったモデルで作ってみましょう。無料の50クレジットで始めるか、全エンジンと料金をご覧ください。