Oossa

Hugging Face推出开放式TTS排行榜,加快模型评估

新排行榜采用客观指标对开源语音模型进行排名,评估仅需数小时,而非数周。

简讯OossaOossa 发布日期: 1 分钟阅读

Hugging Face宣布推出开放式TTS排行榜,利用自动化指标评估开源文本转语音模型。排行榜通过词错误率衡量语音的可懂度,通过实时率和首段音频生成时间衡量速度,并以嵌入向量的余弦相似度评估说话人相似度。系统只需数小时就能完成模型评估,而基于人类偏好的竞技场评测则需要数周。用户还可以收听模型生成的语音并提供反馈。

为什么重要

开发者可以借此快速、可复现地比较开源语音模型,从而为应用挑选速度更快或准确度更高的方案。

这篇文章有帮助吗?
分享

继续阅读

Oossa · 新闻简报

一周 AI,讲明白

每周一,用通俗的语言讲清值得知道的新闻。免费,无垃圾邮件。