Oossaهوش مصنوعی به‌سرعت پیشرفت می‌کند. ما آن را ساده توضیح می‌دهیم.

گوگل Gemini 3.8 Flash TTS و Flash‑Lite TTS را به API افزود

گوگل در ۲۲ سپتامبر ۲۰۲۶، مدل‌های نسل بعدی تبدیل متن به گفتار خود را از طریق Gemini API در دسترس عموم قرار داد.

خبر کوتاهOossa1 دقیقه مطالعه

گوگل اعلام کرد مدل‌های Gemini 3.8 Flash TTS و Gemini 3.8 Flash‑Lite TTS از طریق Gemini API به‌طور عمومی در دسترس هستند (GA). مدل Flash TTS برای تولید صداهایی باکیفیت و استودیویی، با لهجه‌های منطقه‌ای و پایداری در محتوای طولانی طراحی شده است. نسخه Flash‑Lite سریع‌تر و ارزان‌تر است و برای عامل‌های صوتی بلادرنگ ساخته شده است. توسعه‌دهندگان می‌توانند از طریق نقطه پایانی جدید /v1beta/voices از این مدل‌ها استفاده کنند.

چرا مهم است

این مدل‌ها به اپلیکیشن‌ها امکان می‌دهند با هزینه کمتر، گفتاری طبیعی‌تر و چندزبانه ارائه کنند و تجربه‌های صوت‌محور را گسترش دهند.

آیا این مقاله مفید بود؟
اشتراک‌گذاری

بیشتر بخوانید

Oossa · خبرنامه

هفتهٔ هوش مصنوعی، به زبان ساده

هر دوشنبه: خبرهایی که ارزش دانستن دارند، به زبان ساده. رایگان و بدون هرزنامه.

منابع و ارجاع‌ها

#منبعرسانهتاریخنکته اصلی
1ai.google.dev: 6 Mayıs 2026 ↗Google Gemini API۸ مهر ۱۴۰۵Yaklaşan önemli değişiklik: Etkileşimler API isteği ve yanıt şeması (outputs → steps) ile çıkış biçimi yapılandırması (response_format) değişiyor.

1 منبع

آخرین به‌روزرسانی: ·Markdown·llms.txt