گوگل در ۲۲ سپتامبر ۲۰۲۶ اعلام کرد مدلهای تبدیل متن به گفتار Gemini 3.8 Flash و Gemini 3.8 Flash-Lite اکنون بهطور عمومی در دسترس هستند. مدل پرچمدار Flash با هدف ارائه صدایی در سطح استودیو، لهجههای منطقهای و خروجی باثبات برای محتوای طولانی طراحی شده است؛ نسخه Lite هم ارزانتر است و برای عاملهای صوتی بلادرنگ یا کاربردهایی با حجم پردازش بالا ساخته شده است. دسترسی به هر دو مدل از طریق نقطه پایانی جدید /v1beta/voices انجام میشود و میتوانند از میان بیش از ۱۵۰ گزینه موجود، شخصیتهای صوتی سفارشی بسازند یا صداهایی را که رضایت صاحبشان برای استفاده از آنها دریافت شده، بازسازی کنند.
چرا مهم است
این مدلها به توسعهدهندگان امکان میدهند خروجی صوتی واقعگرایانه و کمهزینه را به برنامهها اضافه کنند و دامنه دستیارهای صوتی مبتنی بر هوش مصنوعی و روایتگری خودکار را گسترش دهند.