22 सितंबर, 2026 को Google ने घोषणा की कि उसके Gemini 3.8 Flash TTS और Gemini 3.8 Flash-Lite TTS मॉडल अब आम तौर पर उपलब्ध हैं। प्रमुख Flash मॉडल का लक्ष्य स्टूडियो-स्तर की आवाज़ की गुणवत्ता, क्षेत्रीय लहजे और लंबे ऑडियो में स्थिर आउटपुट देना है। वहीं Lite संस्करण किफायती है और बड़े पैमाने पर या रियल-टाइम वॉइस एजेंट के लिए बनाया गया है। दोनों को नए /v1beta/voices एंडपॉइंट के ज़रिए इस्तेमाल किया जा सकता है। इनके ज़रिए 150 से अधिक विकल्पों वाली लाइब्रेरी से कस्टम वॉइस पर्सोना बनाए जा सकते हैं या सहमति लेकर दी गई आवाज़ों की नकल की जा सकती है।
यह क्यों मायने रखता है
इन मॉडलों से डेवलपर ऐप्स में कम लागत पर स्वाभाविक लगने वाली आवाज़ जोड़ सकते हैं। इससे AI-आधारित वॉइस असिस्टेंट और स्वचालित नैरेशन का दायरा बढ़ेगा।