Sakhanda Wire
NVDA $230.86 +1.09% MSFT $512.80 -0.02% GOOGL $338.24 -1.70% META $725.93 +0.10% AMZN $248.23 -0.37%
← К новостям

ИИ-генератор музыки Suno теперь создаёт речь

Музыкальный ИИ-генератор Suno теперь создает разговорную речь

Новая функция Speech предоставляет синтетические закадровые голоса, дополненные фоновой музыкой, созданной ИИ.

Новая функция Speech предоставляет синтетические закадровые голоса, дополненные фоновой музыкой, созданной ИИ.

автор Джесс Уэзербэд
2 октября 2026 года, 9:42 UTC

Если вы покупаете что-либо по ссылке, The Verge может получить комиссию. Ознакомьтесь с нашей редакционной политикой.

Изображение: Suno
Jess Weatherbed
Джесс Уэзербэд — журналистка, освещающая творческие индустрии, вычислительную технику и интернет-культуру. Джесс начала карьеру в TechRadar, где писала о новостях и обзорах оборудования.

Suno выходит за рамки мира музыки, созданной ИИ, запуская новую функцию, которая генерирует речь на основе сценариев или описаний, заданных в запросе. Speech уже доступна в рамках общедоступного бета-тестирования на веб-платформе и мобильных платформах Suno и позволяет одновременно создавать закадровую речь и сопровождающую ее фоновую музыку.

«Музыка всегда будет в центре Suno и всего, что мы создаем. В то же время наше видение всегда распространялось и на другие формы человеческого самовыражения», — заявил директор по продукту Suno Джек Броуди в объявлении. «Сегодня мы расширяем возможности Suno с помощью Speech — первой аудиомодели, которая создает голос и музыку вместе, как единый цельный трек».

Речь, созданная ИИ, далеко не нова: DeepMind уже десять лет экспериментирует с синтезом речи на основе глубокого обучения, у Adobe есть инструмент преобразования текста в речь, а ElevenLabs с момента запуска в 2023 году стала одной из самых узнаваемых платформ в этой сфере. Suno лишь вступает в игру — вероятно, пытаясь диверсифицировать платформу, поскольку ее музыкальный генератор привлек так много исков.

Сочетание музыки, созданной ИИ, с сгенерированными голосами — это подход Suno к инструментам преобразования текста в речь. Эта функция необязательна: если вам нужна только чистая речь, фоновую музыку можно легко отключить переключателем. Однако идея заключается в том, что она подойдет для определенных сценариев использования генеративной разговорной речи — например, для создания успокаивающего саундтрека к стихотворениям или чего-то более энергичного для драматичных закадровых текстов и воодушевляющих речей.

Чтобы воспользоваться функцией, выберите вкладку «Create» и перейдите к опции Speech. Доступны два режима: Simple, в котором можно описать желаемый результат в специальном поле запроса (например, «капитан пиратов воодушевляет свою команду»), и Advanced, позволяющий добавить собственный сценарий, если вы уже точно знаете, что должна произнести система. Расширенные настройки также позволяют выбрать пол голоса ИИ, стиль речи и степень разнообразия при каждой генерации голоса. Максимальная продолжительность речи составляет около восьми минут.

Suno признает, что функция далека от совершенства, но обещает продолжать улучшать Speech с учетом отзывов пользователей. «Бета действительно означает бета», — сказал Броуди. «Иногда британские акценты могут отправиться в Австралию и вернуться обратно. Драматические паузы могут оказаться очень драматичными. Вы почти наверняка найдете этой функции применения, которые нам даже не приходили в голову».

Подписывайтесь на темы и авторов этой статьи, чтобы видеть больше похожих материалов в персональной ленте на главной странице и получать обновления по электронной почте.
  • Джесс Уэзербэд

Переведено автоматически с английского. Оригинал статьи — по ссылке ниже.

Впервые опубликовано изданием The Verge

Читать оригинал на The Verge ↗

Текст и изображения принадлежат The Verge и приводятся здесь с указанием авторства и ссылкой на оригинальную публикацию.

← К новостям

Ещё новости

Все последние новости