Google、Gemini 3.8 TTS発表——最高表現力の音声生成

Judul asli: Gemini 3.8 text-to-speech

Mengapa Ini Penting

音声AI市場でElevenLabsなど専業勢に対しGoogleが本格的に対抗姿勢を示した。

GoogleはGemini 3.8 Flash TTSとGemini 3.8 Flash-Lite TTSを発表。カスタム音声生成やシーン台詞の制御が可能で、Google AI Studio、Gemini API、Gemini Enterpriseなどで利用できる。

Googleは2026年9月23日、新しい音声生成モデル「Gemini 3.8 Flash TTS」と「Gemini 3.8 Flash-Lite TTS」を発表した。同社は「これまでで最も表現力の高い音声生成モデル」と位置づけている。

両モデルは自然言語プロンプトだけでゼロからカスタムキャラクターボイスを生成したり、既存の声を再現したりできる。さらに台詞を1行ずつ制御し、ペース配分や感情表現、会話中のリアルなサウンドエフェクトまで細かく指示できる点が特徴だ。

利用可能なプラットフォームはGoogle AI Studio、Gemini API、Gemini Enterprise、Gemini Notebook、そしてGoogle Vidsと幅広い。Group Product ManagerのLeland RechisとResearch Science DirectorのAlan Cowanが、Gemini Audioチームを代表して発表した。オーディオブック制作など高品質な音声コンテンツ生成への活用が想定されている。

Sumber

blog.google — Baca artikel asli →