Hugging Face از راهاندازی تابلوی رتبهبندی متنباز TTS خبر داد که مدلهای متنبهگفتار متنباز را با معیارهای خودکار ارزیابی میکند. این سامانه وضوح گفتار را با نرخ خطای واژه، سرعت را با عامل بلادرنگ و زمان رسیدن به نخستین صدا، و شباهت گوینده را با شباهت کسینوسیِ تعبیهها میسنجد. ارزیابی یک مدل با این سامانه چند ساعت طول میکشد؛ درحالیکه داوریهای مبتنی بر ترجیح انسان به چند هفته زمان نیاز دارند. این تابلو همچنین به کاربران امکان میدهد خروجیها را بشنوند و بازخورد بدهند.
چرا مهم است
این ابزار راهی سریع و تکرارپذیر برای مقایسه مدلهای گفتاری متنباز در اختیار توسعهدهندگان میگذارد و به آنها کمک میکند گزینههای سریعتر یا دقیقتر را برای اپلیکیشنهایشان انتخاب کنند.