Sakhanda Wire
NVDA $230.86 +1.09% MSFT $512.80 -0.02% GOOGL $338.24 -1.70% META $725.93 +0.10% AMZN $248.23 -0.37%
← Към новините

AI музикалният генератор Suno вече създава говор

Музикалният AI генератор Suno вече създава говор

Новата функция Speech предоставя синтетични гласови записи, допълнени от фонова музика, генерирана от AI.

Новата функция Speech предоставя синтетични гласови записи, допълнени от фонова музика, генерирана от AI.

от Jess Weatherbed
2 октомври 2026 г., 9:42 ч. UTC

Ако купите нещо чрез линк, The Verge може да получи комисиона. Вижте нашата етична декларация.

Изображение: Suno
Jess Weatherbed
Jess Weatherbed е новинарка, която се фокусира върху творческите индустрии, компютърните технологии и интернет културата. Jess започва кариерата си в TechRadar, където отразява новини и пише ревюта на хардуер.

Suno се разширява отвъд света на AI музиката, като стартира нова функция, която генерира говорими гласове въз основа на сценарии или описания, зададени чрез подкана. Speech вече е достъпна в публична бета версия в уеб и мобилните платформи на Suno и ви позволява едновременно да генерирате гласови записи и фонова музика, която да ги съпровожда.

„Музиката винаги ще бъде в основата на Suno и на това, което създаваме. В същото време визията ни винаги е обхващала и други форми на човешко изразяване“, заяви главният продуктов директор на Suno Jack Brody в съобщението. „Днес разширяваме възможностите в Suno със Speech: първият аудиомодел, който генерира глас и музика заедно като един цялостен запис.“

Речта, генерирана от AI, далеч не е нещо ново — DeepMind експериментира с синтез на реч чрез дълбоко обучение от десетилетие, Adobe разполага с инструмент за преобразуване на текст в реч, а ElevenLabs се превърна в една от най-разпознаваемите платформи в тази област след стартирането си през 2023 г. Suno просто се включва в надпреварата — вероятно в опит да диверсифицира платформата, предвид че нейният музикален генератор привлече толкова много съдебни дела.

Съчетаването на AI музика с генерирани гласове е версията на Suno на инструментите за преобразуване на текст в реч. Функцията е опционална, което означава, че лесно можете да изключите фоновата музика чрез превключвател, ако искате само чиста реч, но идеята е тя да допълва определени приложения на генерираното слово — например успокояващ саундтрак за стихотворения или нещо по-енергично за драматични гласови записи и мотивиращи речи.

За да използвате функцията, изберете раздела „Create“ и отворете опцията Speech. Има два режима: Simple, който ви позволява да опишете какво искате да създадете чрез предоставеното поле за подкана (например „пиратски капитан, който сплотява екипажа си“), или Advanced, който ви позволява да добавите персонализиран сценарий, ако вече знаете точно какво искате да каже системата. Разширените настройки също така ви позволяват да регулирате пола на AI гласа, стила на речта и степента на разнообразие при всяко генериране на глас. Speech има максимална продължителност от около осем минути.

Suno признава, че функцията далеч не е съвършена, но заявява, че ще продължи да я подобрява въз основа на обратната връзка от потребителите. „Бета наистина означава бета“, каза Brody. „Понякога британските акценти могат да се отклонят към Австралия и обратно. Драматичните паузи може да са много драматични. Почти сигурно ще откриете приложения на тази функция, които дори не са ни хрумвали.“

Следвайте темите и авторите от тази статия, за да виждате още подобно съдържание в персонализирания си начален поток и да получавате актуализации по имейл.
  • Jess Weatherbed

Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.

Първоначално публикувано от The Verge на

Прочетете оригинала в The Verge ↗

Текстът и изображенията са собственост на The Verge и са възпроизведени тук с посочване на авторството и връзка към оригиналната публикация.

← Към новините

Още новини

Всички последни новини