Google lance Gemini 3.8 Flash TTS

Original : Gemini 3.8 text-to-speech

Pourquoi c'est important

La TTS expressive et contrôlable redéfinit les standards pour l'audio généré par IA.

Google a présenté le 23 septembre 2026 deux nouveaux modèles de synthèse vocale : Gemini 3.8 Flash TTS et Gemini 3.8 Flash-Lite TTS. Disponibles sur Google AI Studio, Gemini API et Gemini Notebook, ils permettent de créer des voix personnalisées et de contrôler l'émotion via des instructions en langage naturel.

Google a annoncé le 23 septembre 2026 le lancement de Gemini 3.8 Flash TTS et Gemini 3.8 Flash-Lite TTS, présentés comme les modèles de génération audio les plus expressifs de la gamme Gemini à ce jour. Ces deux modèles sont accessibles sur Google AI Studio, l'API Gemini, Gemini Enterprise, Gemini Notebook et Google Vids.

Les utilisateurs peuvent créer des voix de personnages entièrement originales ou répliquer des voix existantes à partir de simples instructions en langage naturel. Le contrôle s'effectue ligne par ligne, permettant d'ajuster le rythme, l'émotion et même des sons conversationnels réalistes. Ces capacités ouvrent la voie à des applications d'audiobooks et de dialogue de scène, selon Google.

L'annonce est signée par Leland Rechis, Group Product Manager, et Alan Cowen, Director of Research Science, au nom de l'équipe Gemini Audio.

Source

blog.google — Lire l'original →