Le 22 septembre 2026, Google a annoncé que ses modèles TTS Gemini 3.8 Flash et Gemini 3.8 Flash-Lite étaient désormais accessibles à tous. Le modèle phare Flash vise une qualité vocale digne d’un studio, prend en charge les accents régionaux et assure une sortie stable pour les contenus longs. La version Lite, moins coûteuse, est conçue pour les agents vocaux à haut débit ou en temps réel. Les deux modèles sont accessibles via le nouvel endpoint /v1beta/voices et peuvent créer des personas vocaux personnalisés ou reproduire, avec leur consentement, des voix issues d’une bibliothèque de plus de 150 options.
Pourquoi c'est important
Ces modèles permettent aux développeurs d’ajouter à leurs applications une sortie vocale réaliste et peu coûteuse, favorisant le développement des assistants vocaux dopés à l’IA et de la narration automatisée.