Google hat angekündigt, dass die Gemini API jetzt zwei neue Text-to-Speech-Modelle bietet. Gemini 3.8 Flash TTS ist ein hochwertiges Sprachmodell mit Studioqualität, während Gemini 3.8 Flash-Lite TTS eine schnellere und günstigere Version für Sprachagenten in Echtzeit und Anwendungen mit hohem Volumen ist. Beide sind über den neuen Endpunkt /v1beta/voices verfügbar. Das Update bietet Entwicklern eine größere Auswahl mit mehr als 150 integrierten und benutzerdefinierten Stimmen.
Warum es wichtig ist
Entwickler können jetzt natürlichere und skalierbare Sprachausgabe in Apps integrieren, ohne eigene Sprachmodelle entwickeln zu müssen.