Oossaهوش مصنوعی به‌سرعت پیشرفت می‌کند. ما آن را ساده توضیح می‌دهیم.

گوگل مدل‌های تبدیل متن به گفتار Gemini 3.8 را عرضه کرد

مدل‌های جدید به توسعه‌دهندگان امکان می‌دهند با دستورهای متنی صداهای سفارشی بسازند و دوبله‌های پرحجم را گسترش دهند؛ این مدل‌ها از ۲۲ سپتامبر ۲۰۲۶ از طریق Gemini API در دسترس‌اند.

خبر کوتاهOossa1 دقیقه مطالعه

گوگل اعلام کرد مدل‌های Gemini 3.8 Flash TTS و Gemini 3.8 Flash‑Lite TTS اکنون به‌طور عمومی در دسترس‌اند. Flash TTS برای طراحی خلاقانه صدا ساخته شده است؛ کافی است لهجه، لحن و سرعت گفتار یک شخصیت را با زبانی ساده توصیف کنید تا صدایی با کیفیت استودیویی دریافت کنید. Flash‑Lite TTS برای دوبله ارزان و پرحجم و استفاده در عامل‌های صوتی طراحی شده است. هر دو مدل از طریق Gemini API و Google AI Studio در دسترس‌اند.

چرا مهم است

این مدل‌ها راهی ساده در اختیار توسعه‌دهندگان می‌گذارند تا صدای سفارشی و پراحساس را در مقیاس گسترده تولید کنند و امکان‌های تازه‌ای برای کتاب‌های صوتی، بازی‌ها و عامل‌های صوتی بلادرنگ فراهم می‌کنند.

آیا این مقاله مفید بود؟
اشتراک‌گذاری

بیشتر بخوانید

Oossa · خبرنامه

هفتهٔ هوش مصنوعی، به زبان ساده

هر دوشنبه: خبرهایی که ارزش دانستن دارند، به زبان ساده. رایگان و بدون هرزنامه.

منابع و ارجاع‌ها

#منبعرسانهتاریخنکته اصلی
1ai.google.dev: 18 Şubat 2026 ↗Google Gemini API۷ مهر ۱۴۰۵Desteğin sonlandırılmasıyla ilgili duyuru: Aşağıdaki modellerin 1 Haziran 2026'da kapatılacak: gemini-2.0-flash gemini-2.0-flash-001 gemini-

1 منبع

آخرین به‌روزرسانی: ·Markdown·llms.txt