Suno نسخه بتای عمومی قابلیت تازهای به نام Speech را عرضه کرده است. این ابزار میتواند یک متن یا توضیحی کوتاه را به گفتار تبدیل کند و در همان فایل موسیقی پسزمینه هم بگنجاند. این قابلیت در وبسایت و اپلیکیشن موبایل Suno کار میکند. کاربران میتوانند موسیقی را روشن یا خاموش کنند و برای ساخت صدا، توضیحی ساده وارد کنند یا متن کاملی بنویسند. طولانیترین قطعهای که نسخه بتا تولید میکند حدود هشت دقیقه است.
قابلیت چطور کار میکند
در حالت ساده، توضیحی مانند «یک ناخدای دزد دریایی که خدمهاش را به شورش فرامیخواند» وارد میکنید و هوش مصنوعی صدا و موسیقی متن هماهنگ با آن را میسازد. در حالت پیشرفته، متن را وارد میکنید، جنسیت صدا را انتخاب میکنید، سبک گفتار را تنظیم میکنید و میزان تغییراتی را که هوش مصنوعی اعمال میکند، تعیین میکنید. نسخه بتا هنوز آزمایشی است؛ Suno میگوید لهجههای بریتانیایی گاهی به استرالیایی تغییر میکنند و مکثها ممکن است بیش از حد نمایشی باشند.
تفاوت با ابزارهای دیگر چیست
برخلاف بیشتر سرویسهای تبدیل متن به گفتار، مدل Suno صدا و موسیقی را با هم و در قالب یک قطعه تولید میکند. اگر فقط به گفتاری واضح و بدون موسیقی نیاز دارید، میتوانید بخش موسیقی را بیصدا کنید. Suno امیدوار است این ترکیب برای کارهایی مثل خوانش شعر با موسیقی آرامشبخش یا نریشنهای پرانرژی برای ارائهها مفید باشد.
چرا مهم است
برای سازندگانی که از قبل برای موسیقی از Suno استفاده میکنند، قابلیت صوتی تازه یعنی میتوانند بدون خارجشدن از پلتفرم، نریشن یا گفتوگو اضافه کنند. این قابلیت میتواند ساخت آگهیهای صوتی کوتاه، پادکستها یا فایلهای ضبطشده آموزشی را سادهتر کند؛ بااینحال، خروجی هنوز به ویرایش نیاز دارد، چون نسخه بتا گاهی کلمات را نادرست تلفظ میکند یا مکثهای نامعمول میگذارد.