ИИ-генератор музыки Suno теперь создаёт речь
Новая функция Speech предоставляет синтетические закадровые голоса, дополненные фоновой музыкой, созданной ИИ.
Новая функция Speech предоставляет синтетические закадровые голоса, дополненные фоновой музыкой, созданной ИИ.
Если вы покупаете что-либо по ссылке, The Verge может получить комиссию. Ознакомьтесь с нашей редакционной политикой.
Suno выходит за рамки мира музыки, созданной ИИ, запуская новую функцию, которая генерирует речь на основе сценариев или описаний, заданных в запросе. Speech уже доступна в рамках общедоступного бета-тестирования на веб-платформе и мобильных платформах Suno и позволяет одновременно создавать закадровую речь и сопровождающую ее фоновую музыку.
«Музыка всегда будет в центре Suno и всего, что мы создаем. В то же время наше видение всегда распространялось и на другие формы человеческого самовыражения», — заявил директор по продукту Suno Джек Броуди в объявлении. «Сегодня мы расширяем возможности Suno с помощью Speech — первой аудиомодели, которая создает голос и музыку вместе, как единый цельный трек».
Речь, созданная ИИ, далеко не нова: DeepMind уже десять лет экспериментирует с синтезом речи на основе глубокого обучения, у Adobe есть инструмент преобразования текста в речь, а ElevenLabs с момента запуска в 2023 году стала одной из самых узнаваемых платформ в этой сфере. Suno лишь вступает в игру — вероятно, пытаясь диверсифицировать платформу, поскольку ее музыкальный генератор привлек так много исков.
Сочетание музыки, созданной ИИ, с сгенерированными голосами — это подход Suno к инструментам преобразования текста в речь. Эта функция необязательна: если вам нужна только чистая речь, фоновую музыку можно легко отключить переключателем. Однако идея заключается в том, что она подойдет для определенных сценариев использования генеративной разговорной речи — например, для создания успокаивающего саундтрека к стихотворениям или чего-то более энергичного для драматичных закадровых текстов и воодушевляющих речей.
Чтобы воспользоваться функцией, выберите вкладку «Create» и перейдите к опции Speech. Доступны два режима: Simple, в котором можно описать желаемый результат в специальном поле запроса (например, «капитан пиратов воодушевляет свою команду»), и Advanced, позволяющий добавить собственный сценарий, если вы уже точно знаете, что должна произнести система. Расширенные настройки также позволяют выбрать пол голоса ИИ, стиль речи и степень разнообразия при каждой генерации голоса. Максимальная продолжительность речи составляет около восьми минут.
Suno признает, что функция далека от совершенства, но обещает продолжать улучшать Speech с учетом отзывов пользователей. «Бета действительно означает бета», — сказал Броуди. «Иногда британские акценты могут отправиться в Австралию и вернуться обратно. Драматические паузы могут оказаться очень драматичными. Вы почти наверняка найдете этой функции применения, которые нам даже не приходили в голову».
- Джесс Уэзербэд
Самое популярное
- Amazon выпускает новые разноцветные Kindle — и чехол с физическими кнопками перелистывания страниц
- Жители Юты против Кевина О’Лири
- Ответ HP на MacBook Neo тоньше, легче и оснащен OLED-дисплеем
- Что стоит за масштабным переосмыслением Copilot в Microsoft
- Gears of War: E-Day — отличная игра, выходящая в ужасное время
Переведено автоматически с английского. Оригинал статьи — по ссылке ниже.
