Исландская Treble привлекла $18 млн на платформу голосового моделирования
Голосовой ИИ стал одним из самых востребованных секторов в области ИИ: инвесторы вкладывают миллиарды долларов в решения для самых разных задач — от автоматизации поддержки клиентов и продаж по телефону до создания сервисов для ведения заметок на встречах и разработки умных очков с ИИ, использующих голос в качестве основного интерфейса взаимодействия.
Тем временем лаборатории ИИ стремительно выпускают новые модели, а производители оборудования пытаются создать наилучший пользовательский опыт взаимодействия с устройствами.
Вся эта новая технология нуждается в тестировании и цикле обратной связи для дальнейшего совершенствования. Стартап Treble из Исландии стремится занять центральное место в индустрии голосового ИИ, создавая платформу моделирования, которая может обслуживать разработчиков моделей, робототехнические компании и производителей потребительской электроники.
Компания, основанная в 2020 году инженерами-акустиками Финнуром Пиндом и Йеспером Педерсеном, привлекла $18 млн в рамках расширения раунда финансирования серии A, который возглавила Paladin Capital Group при участии существующих инвесторов KOMPAS VC, Frumtak Ventures, EIC и Omega ehf. В 2024 году она получила инвестиции в размере $12 млн, в результате чего общий объем привлеченных средств превысил $40 млн. Среди клиентов стартапа — Amazon и Logitech.

У Treble есть несколько направлений, связанных с моделированием и данными. Для компаний, работающих в сфере голосового ИИ, у нее есть платформа генерации синтетических данных, которую можно использовать для улучшения речи, подавления шумов и обучения моделей. Она также оценивает модели голосового ИИ в различных условиях, чтобы предоставлять лабораториям обратную связь. Ранее в этом году компания заключила партнерство с Hugging Face для запуска бенчмарка моделей распознавания речи в различных реалистичных условиях.
«Аудио-ИИ — это прежде всего задача, связанная с данными, и именно здесь открывается больше всего возможностей для создания моделей и оборудования следующего поколения. На сегодняшний день практически весь ИИ, связанный со звуком, создавался на основе записей и данных, собранных из интернета. Мы считаем, что точное физическое моделирование может стать альтернативным способом создания звуковых данных», — сказал Пинд TechCrunch.
Стартап также занимается проектированием и тестированием оборудования с точки зрения голосового взаимодействия. Например, он работает с производителями наушников и колонок над виртуальным прототипированием, помогая им понять, как может звучать их продукт. Компания также может проверить, насколько хорошо умная колонка понимает команды в зависимости от ее расположения. В последнее время Treble начала предоставлять услуги по моделированию и тестированию умных очков и устройств с ИИ.
Пинд сказал, что компания заинтересована в работе над носимыми устройствами, которые могут улучшать слух пользователей.
«Меня очень воодушевляет следующее поколение таких устройств, как наушники и умные очки, которые могут обеспечить [функцию вроде] сверхчеловеческого слуха. Это область, в которой можно действительно лучше слышать в сложной акустической среде. Например, вы находитесь в ресторане и хотите слышать только людей в радиусе двух метров, или вы на семинаре и хотите заглушить окружающих», — сказал он.
Treble намерена усилить свое присутствие в сфере физического ИИ, включая робототехнические, автомобильные компании и производителей дронов, помогая им реализовывать функции на основе звука с помощью тестирования и моделирования.
Франсуа Ройтер, вице-президент Paladin Capital Group, рассказал TechCrunch, что платформа Treble, моделирующая различные модели и устройства, выделяется на фоне других; ее важность будет возрастать по мере расширения сфер ее применения.
«Наша инвестиционная гипотеза заключается в том, что по мере того, как все больше продуктов будут зависеть от понимания звука, эта инфраструктура будет становиться все более ценной в таких областях, как голосовой ИИ, носимые устройства, робототехника и физический ИИ. Клиенты сохраняют право собственности на свои модели, продукты и рабочие процессы разработки, одновременно получая преимущества от общей основы в виде акустического инфраструктурного слоя, изначально созданного для моделирования», — сказал Ройтер.
Переведено автоматически с английского. Оригинал статьи — по ссылке ниже.