AI музикалният генератор Suno вече създава говор
Новата функция Speech предоставя синтетични гласови записи, допълнени от фонова музика, генерирана от AI.
Новата функция Speech предоставя синтетични гласови записи, допълнени от фонова музика, генерирана от AI.
Ако купите нещо чрез линк, The Verge може да получи комисиона. Вижте нашата етична декларация.
Suno се разширява отвъд света на AI музиката, като стартира нова функция, която генерира говорими гласове въз основа на сценарии или описания, зададени чрез подкана. Speech вече е достъпна в публична бета версия в уеб и мобилните платформи на Suno и ви позволява едновременно да генерирате гласови записи и фонова музика, която да ги съпровожда.
„Музиката винаги ще бъде в основата на Suno и на това, което създаваме. В същото време визията ни винаги е обхващала и други форми на човешко изразяване“, заяви главният продуктов директор на Suno Jack Brody в съобщението. „Днес разширяваме възможностите в Suno със Speech: първият аудиомодел, който генерира глас и музика заедно като един цялостен запис.“
Речта, генерирана от AI, далеч не е нещо ново — DeepMind експериментира с синтез на реч чрез дълбоко обучение от десетилетие, Adobe разполага с инструмент за преобразуване на текст в реч, а ElevenLabs се превърна в една от най-разпознаваемите платформи в тази област след стартирането си през 2023 г. Suno просто се включва в надпреварата — вероятно в опит да диверсифицира платформата, предвид че нейният музикален генератор привлече толкова много съдебни дела.
Съчетаването на AI музика с генерирани гласове е версията на Suno на инструментите за преобразуване на текст в реч. Функцията е опционална, което означава, че лесно можете да изключите фоновата музика чрез превключвател, ако искате само чиста реч, но идеята е тя да допълва определени приложения на генерираното слово — например успокояващ саундтрак за стихотворения или нещо по-енергично за драматични гласови записи и мотивиращи речи.
За да използвате функцията, изберете раздела „Create“ и отворете опцията Speech. Има два режима: Simple, който ви позволява да опишете какво искате да създадете чрез предоставеното поле за подкана (например „пиратски капитан, който сплотява екипажа си“), или Advanced, който ви позволява да добавите персонализиран сценарий, ако вече знаете точно какво искате да каже системата. Разширените настройки също така ви позволяват да регулирате пола на AI гласа, стила на речта и степента на разнообразие при всяко генериране на глас. Speech има максимална продължителност от около осем минути.
Suno признава, че функцията далеч не е съвършена, но заявява, че ще продължи да я подобрява въз основа на обратната връзка от потребителите. „Бета наистина означава бета“, каза Brody. „Понякога британските акценти могат да се отклонят към Австралия и обратно. Драматичните паузи може да са много драматични. Почти сигурно ще откриете приложения на тази функция, които дори не са ни хрумвали.“
- Jess Weatherbed
Най-популярни
- Amazon пуска нови цветни Kindles — и калъф с физически бутони за прелистване на страниците
- Жителите на Юта срещу Kevin O’Leary
- Отговорът на HP на MacBook Neo е по-тънък, по-лек и идва с OLED дисплей
- Как Microsoft преосмисля мащабно Copilot
- Gears of War: E-Day е страхотна игра, която излиза в ужасен момент
Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.
