O Google anunciou que a API Gemini agora inclui dois modelos de conversão de texto em fala (TTS). O gemini-3.8-flash-tts, modelo principal, foi ajustado para gerar vozes com qualidade de estúdio, sotaques regionais e conversas longas com múltiplas interações. Já o gemini-3.8-flash-lite-tts, mais rápido e barato, foi desenvolvido para uso em tempo real e em grande escala, substituindo o modelo de prévia gemini-3.1-flash-tts-preview.
Por que importa
Agora, os desenvolvedores podem adicionar às aplicações uma saída de voz de maior qualidade ou menor custo usando a mesma API Gemini.