Oossa

Hugging Face lance un classement des modèles TTS open source

Ce nouveau classement évalue les modèles de synthèse vocale open source à l’aide de mesures objectives, en quelques heures au lieu de plusieurs semaines.

BrèveOossaPublié par Oossa: 1 min de lecture

Hugging Face a annoncé le lancement d’un classement des modèles de synthèse vocale (TTS) open source, évalués à l’aide de mesures automatiques. Il mesure l’intelligibilité au moyen du taux d’erreur sur les mots, la vitesse grâce au facteur temps réel et au délai avant le premier son, ainsi que la similarité des voix à partir de la similarité cosinus entre les représentations vectorielles. Le système peut évaluer un modèle en quelques heures, contre plusieurs semaines pour les plateformes fondées sur les préférences humaines. Le classement permet aussi d’écouter les résultats et de donner son avis.

Pourquoi c'est important

Cet outil offre aux développeurs un moyen rapide et reproductible de comparer les modèles vocaux open source et de choisir ceux qui sont plus rapides ou plus précis pour leurs applications.

Cet article vous a-t-il été utile ?
Partager

À lire ensuite

Oossa · Newsletter

La semaine de l'IA, expliquée

Chaque lundi : l'essentiel de l'actualité, en langage clair. Gratuit, sans spam.