自己教師あり学習を用いた回転機械の異常検知
大学・研究発表スライドを、学会や研究紹介で見せやすい動画にした例。
音声: ElevenLabs Eleven v3 / George
ElevenLabs v4 Turbo/v4とGemini 3.8 Flash-Lite/Flashの音声生成APIを、同じ原稿・同じ声の実音声で比較。日本語と英語を記事内で再生でき、モデルの使い分け、比較条件、API料金も確認できます。
ElevenLabs v4 Turbo/v4とGemini 3.8 Flash-Lite/Flashの音声生成APIを、実際のMP3で聴き比べられるページです。日本語と英語を切り替え、各社の中で同じ声・同じ原稿を使った2モデルを比較できます。登録やAPIキーは不要です。
共通原稿:このサービスを使えば、スライドからプレゼン動画を短時間で作成できます。
ElevenLabsは5声、Geminiは30声をこのページ内で切り替えられます。両社の声は別物なので、会社をまたいで「同じ声」の厳密な比較はできません。最初はJanetとLedaを聴き、次に各社内で声を変えると、モデル差と声の個性を分けて把握しやすくなります。
掲載した音源はSpeechSlide AIのAPI経由で事前に生成したファイルです。日本語同士、英語同士では4モデルに同じ短文を入力し、話し方の追加指示は付けていません。同じプロバイダー内では同じ声の設定を使っています。この記事を開くたびに再生成しているわけではありません。
この試聴で分かる範囲
| モデル | 公式の位置づけ | まず試したい用途 |
|---|---|---|
| ElevenLabs v4 Turbo | 表現力と低遅延を両立するリアルタイム向け | 対話型アプリ、待ち時間を抑えたいナレーション |
| ElevenLabs v4 | 高品質・感情表現を重視 | じっくり仕上げる紹介動画や読み物 |
| Gemini 3.8 Flash-Lite | 高速・高スループット・低コスト | 大量のスライド、更新頻度の高い教材 |
| Gemini 3.8 Flash | 声の忠実度・演技・方言を重視 | 演出したいストーリーやブランド動画 |
表は各社の公式なモデル説明を用途に読み替えたもので、この試聴だけで性能順位を付けたものではありません。両社とも日本語に対応します。
2026年10月3日時点の公開価格を下に示します。ElevenLabsは入力文字数、Geminiは入力テキストと出力音声のトークン数で課金単位が異なります。表の数字をそのまま横に並べても1本あたりの費用比較にはなりません。
| モデル | 2026年10月3日の公開API単価 | 期限後の掲載単価 |
|---|---|---|
| ElevenLabs v4 Turbo | $0.011 / 1,000 characters | $0.04 / 1,000 characters (Oct 12) |
| ElevenLabs v4 | $0.022 / 1,000 characters | $0.08 / 1,000 characters (Oct 12) |
| Gemini 3.8 Flash-Lite | $0.50 input + $6 audio output / 1M tokens | $1 input + $12 audio output / 1M tokens (Jan 1, 2027) |
| Gemini 3.8 Flash | $0.50 input + $9 audio output / 1M tokens | $1 input + $18 audio output / 1M tokens (Jan 1, 2027) |
Geminiの表はGoogle Cloud Agent Platformの公開価格です。2026年末までの特典は対象利用分への50%クレジット還元として提供されます。Gemini Developer APIなど別の経路や契約条件では請求方法が異なり得ます。Geminiの音声は1秒あたり25トークンが目安で、上記の出力単価なら10秒あたりFlash-Lite約$0.0015、Flash約$0.00225です(入力分を除く)。ElevenLabsの実費は原稿の文字数に依存します。契約プラン・税・追加機能も含め、購入前に公式料金を確認してください。
公式資料ではv4を高品質・感情表現寄り、v4 Turboを低遅延のリアルタイム用途寄りに位置づけています。声と原稿を固定し、上の2本を交互に聴いて選んでください。
大量生成や費用を重視するならFlash-Lite、演技や声の仕上がりを重視するならFlashから試すのが公式の位置づけに沿います。実際の原稿でも差を確認してください。
新モデルの試聴ではJanetを掲載しています。SpeechSlide AIでは旧Rachelの音声IDをJanetに移行しているため、この2つを別の声として数えていません。
全35声を一覧で見たい場合は、音声聴き比べページも利用できます。SpeechSlide AIでは、スライドごとの音声設定から今回の4モデルを選び、生成した原稿をそのままナレーションにできます。新規スライドの標準設定はGemini 3.8 Flash-LiteとLedaです。
使い慣れたスライドで、声とモデルの相性を確かめてみませんか。
無料でスライド動画を作成スライドをアップロードするだけで、このような音声付きプレゼン動画が完成します。
大学・研究発表スライドを、学会や研究紹介で見せやすい動画にした例。
音声: ElevenLabs Eleven v3 / George
はい。無料プランでは月2プロジェクト・月4本まで動画を作成できます。クレジットカードの登録は不要です。
PDFおよびPowerPoint(PPT/PPTX)に対応しています。普段お使いのスライドをそのままアップロードできます。
日本語・英語をはじめ、中国語・韓国語・ドイツ語・スペイン語など多言語のAI音声ナレーションに対応しています。
はい。研修・営業・授業・広報など商用利用が可能です。有料プランではウォーターマークなしでMP4をダウンロードできます。