Suno запустила публичное бета-тестирование новой функции Speech. Она превращает сценарий или короткое описание в речь и добавляет к ней фоновую музыку в одном файле. Функция доступна на сайте Suno и в мобильном приложении. Пользователи могут включать и выключать музыку, а также выбирать между коротким запросом и полноценным сценарием. Максимальная длительность клипа в бета-версии — около восьми минут.
Как работает функция
В простом режиме достаточно ввести описание, например «капитан-пират воодушевляет свою команду», — ИИ создаст голос и подходящий музыкальный фон. В расширенном режиме можно вставить сценарий, выбрать пол голоса, задать манеру речи и настроить степень вариативности. Бета-версия пока экспериментальная: по словам Suno, британский акцент иногда становится австралийским, а паузы могут быть чересчур драматичными.
Чем функция отличается от других инструментов
В отличие от большинства сервисов синтеза речи, модель Suno одновременно генерирует голос и музыку, объединяя их в одну дорожку. Музыку можно отключить, если нужна только чистая речь. Suno рассчитывает, что эта функция пригодится, например, для поэтических чтений с успокаивающим фоном или энергичной озвучки презентаций.
Почему это важно
Пользователи, которые уже создают музыку в Suno, теперь могут добавлять озвучку или диалоги, не покидая платформу. Это может упростить создание короткой аудиорекламы, подкастов или учебных записей. Однако результат всё ещё нужно редактировать: в бета-версии встречаются ошибки в произношении и странные паузы.