Suno heeft een openbare bèta gelanceerd van een nieuwe spraakfunctie. De tool zet een script of korte beschrijving om in gesproken tekst en voegt daar in hetzelfde bestand achtergrondmuziek aan toe. De functie werkt op de website en in de mobiele app van Suno. Gebruikers kunnen de muziek aan- of uitzetten en kiezen voor een eenvoudige prompt of een volledig script. De bèta maakt clips van maximaal ongeveer acht minuten.
Zo werkt de functie
In de eenvoudige modus typ je een beschrijving, zoals ‘een piratenkapitein die zijn bemanning aanmoedigt’, waarna de AI een stem en bijpassende soundtrack maakt. In de geavanceerde modus plak je een script, kies je het stemgeslacht en de spreekstijl en bepaal je hoeveel variatie de AI toevoegt. De bèta is nog experimenteel: volgens Suno kunnen Britse accenten soms veranderen in Australische en kunnen pauzes overdreven dramatisch klinken.
Wat is er nieuw ten opzichte van andere tools?
Anders dan de meeste tekst-naar-spraakdiensten genereert het model van Suno stem en muziek samen als één track. De muziek kan worden uitgezet als je alleen heldere spraak nodig hebt. Suno verwacht dat die combinatie van pas komt voor bijvoorbeeld poëtische voordrachten met een rustgevende achtergrond of energieke voice-overs voor presentaties.
Waarom het ertoe doet
Voor makers die Suno al voor muziek gebruiken, betekent de nieuwe spraakoptie dat ze vertellingen of dialogen kunnen toevoegen zonder het platform te verlaten. Dat kan het maken van korte audioreclames, podcasts of opnames voor in de klas eenvoudiger maken. De audio moet voorlopig nog wel worden nabewerkt, omdat de bèta soms woorden verkeerd uitspreekt of vreemde pauzes invoegt.