2026年9月28日AI編集部が毎日更新
← 🤖 AI

2026-09-27

Googleが新音声AI「Gemini Flash TTS」を公開 2,000超の声とボイスクローンで音声生成競争が加速

Googleは、テキスト読み上げ(TTS: Text-to-Speech)向けの新しいAIモデル「Gemini Flash TTS」と軽量版「Flash‑Lite TTS」を発表しました。いずれも同社の生成AIプラットフォーム「Gemini」向けに設計された音声モデルで、クリエイティブ用途から大量配信まで幅広い利用を想定しています。開発者向けのGemini APIや、ブラウザ上でモデルを試せる「AI Studio」、ドキュメント作成ツール「Gemini Notebook」や動画生成ツール「Google Vids」などで順次利用可能になると報じられています。

Flash TTSは、2,000種類以上の事前学習済みボイスライブラリを備え、話者の声質や感情、話すスピードなどを細かくコントロールできるのが特徴です。また、既存の音声サンプルから似た声を合成する「ボイスレプリケーション(声の複製)」機能も提供され、ナレーションやゲーム、広告などでのパーソナライズが容易になると期待されています。一方で、なりすましやディープフェイク音声の悪用リスクも指摘されており、Googleは本人同意や利用制限に関するポリシーを設けるとしています。

軽量版のFlash‑Lite TTSは、コールセンターや読み上げサービスなど大量の音声生成が必要な現場向けに最適化されており、低レイテンシ(遅延の少ない応答)とコスト効率の良さを売りにしています。音声生成の高度化と商用利用の拡大が進むなか、各社がどこまで安全策と表現の自由のバランスを取れるかが今後の焦点になりそうです。

元記事: The week's top AI news | Glonce