Suno 已为一项名为 Speech 的新功能开启公开测试。该工具可以根据脚本或简短描述生成语音,并在同一文件中加入背景音乐。用户可通过 Suno 网站和移动应用使用这项功能,也可以选择开启或关闭音乐,还能输入简单提示词或撰写完整脚本。测试版生成的音频最长约为八分钟。
功能如何运作
在简单模式下,用户输入“海盗船长号召船员”之类的描述,AI 就会生成语音和相配的配乐。在高级模式下,用户可以粘贴脚本、选择语音性别、设定说话风格,并控制 AI 生成内容的变化幅度。该测试版仍处于实验阶段——Suno 表示,英式口音有时会变成澳大利亚口音,停顿也可能显得过于戏剧化。
与其他工具相比有哪些新意
与大多数文本转语音服务不同,Suno 的模型会将语音和音乐生成在同一条音轨中。如果用户只需要清晰的人声,也可以关闭音乐。Suno 希望这项功能适用于多种场景,例如配上舒缓背景音乐的诗歌朗诵,或用于演示文稿的活力旁白。
为什么重要
对于已经用 Suno 创作音乐的人来说,这项语音功能让他们无需离开平台,就能加入旁白或对白。它有望简化短音频广告、播客或课堂录音的制作;不过,由于测试版有时会误读单词或加入奇怪的停顿,生成内容仍需编辑。