Google объявила, что в Gemini API теперь доступны две новые модели преобразования текста в речь. Gemini 3.8 Flash TTS — высококачественная модель с голосом студийного уровня, а Gemini 3.8 Flash‑Lite TTS — более быстрая и дешёвая версия, рассчитанная на голосовых агентов реального времени и большие объёмы использования. Обе модели доступны через новый эндпоинт /v1beta/voices. Благодаря обновлению разработчикам стала доступна более богатая библиотека голосов: свыше 150 встроенных и пользовательских вариантов.
Почему это важно
Теперь разработчики могут добавлять в приложения более естественную речь и масштабировать её использование, не создавая собственные голосовые модели.