Oossaهوش مصنوعی به‌سرعت پیشرفت می‌کند. ما آن را ساده توضیح می‌دهیم.

گوگل مدل‌های تبدیل متن به گفتار Gemini 3.8 Flash را عرضه کرد

مدل‌های جدید و باکیفیت تبدیل متن به گفتار گوگل، Gemini 3.8 Flash و Flash-Lite، از طریق Gemini API در دسترس عموم قرار گرفتند.

خبر کوتاهOossa1 دقیقه مطالعه

گوگل در ۲۲ سپتامبر ۲۰۲۶ اعلام کرد مدل‌های تبدیل متن به گفتار Gemini 3.8 Flash و Gemini 3.8 Flash-Lite اکنون به‌طور عمومی در دسترس هستند. مدل پرچم‌دار Flash با هدف ارائه صدایی در سطح استودیو، لهجه‌های منطقه‌ای و خروجی باثبات برای محتوای طولانی طراحی شده است؛ نسخه Lite هم ارزان‌تر است و برای عامل‌های صوتی بلادرنگ یا کاربردهایی با حجم پردازش بالا ساخته شده است. دسترسی به هر دو مدل از طریق نقطه پایانی جدید /v1beta/voices انجام می‌شود و می‌توانند از میان بیش از ۱۵۰ گزینه موجود، شخصیت‌های صوتی سفارشی بسازند یا صداهایی را که رضایت صاحبشان برای استفاده از آن‌ها دریافت شده، بازسازی کنند.

چرا مهم است

این مدل‌ها به توسعه‌دهندگان امکان می‌دهند خروجی صوتی واقع‌گرایانه و کم‌هزینه را به برنامه‌ها اضافه کنند و دامنه دستیارهای صوتی مبتنی بر هوش مصنوعی و روایت‌گری خودکار را گسترش دهند.

آیا این مقاله مفید بود؟
اشتراک‌گذاری

بیشتر بخوانید

Oossa · خبرنامه

هفتهٔ هوش مصنوعی، به زبان ساده

هر دوشنبه: خبرهایی که ارزش دانستن دارند، به زبان ساده. رایگان و بدون هرزنامه.

منابع و ارجاع‌ها

#منبعرسانهتاریخنکته اصلی
1ai.google.dev: 17 Şubat 2026 ↗Google Gemini API۷ مهر ۱۴۰۵Aşağıdaki modeller kapatıldı: gemini-2.5-flash-preview-09-25 imagen-4.0-generate-preview-06-06 imagen-4.0-ultra-generate-preview-06-06

1 منبع

آخرین به‌روزرسانی: ·Markdown·llms.txt