گوگل اعلام کرد که حالا دو مدل جدید تبدیل متن به گفتار در Gemini API ارائه میشوند. Gemini 3.8 Flash TTS مدلی با صدای باکیفیت و استودیویی است؛ در حالی که Gemini 3.8 Flash-Lite TTS نسخهای سریعتر و ارزانتر است که برای عاملهای صوتی بلادرنگ و استفاده در حجم بالا طراحی شده. هر دو مدل از طریق نقطه پایانی جدید /v1beta/voices در دسترساند. این بهروزرسانی کتابخانه صوتی غنیتری با بیش از ۱۵۰ صدای داخلی و سفارشی در اختیار توسعهدهندگان میگذارد.
چرا مهم است
توسعهدهندگان اکنون میتوانند بدون ساخت مدلهای صوتی اختصاصی، گفتاری طبیعیتر و مقیاسپذیرتر به اپلیکیشنهایشان اضافه کنند.