Google ha annunciato che Gemini API offre ora due nuovi modelli di sintesi vocale. Gemini 3.8 Flash TTS è un modello vocale di alta qualità, simile a una voce da studio, mentre Gemini 3.8 Flash-Lite TTS è una versione più veloce ed economica, pensata per gli agenti vocali in tempo reale e per un uso su larga scala. Entrambi sono accessibili tramite il nuovo endpoint /v1beta/voices. L’aggiornamento mette a disposizione degli sviluppatori una libreria vocale più ampia, con oltre 150 voci integrate e personalizzate.
Perché conta
Gli sviluppatori possono ora aggiungere alle app una voce più naturale e scalabile, senza dover creare modelli vocali proprietari.