Исландская компания Treble привлекла 18 миллионов долларов инвестиций для своей платформы имитации голоса.
Голосовой ИИ стал одним из самых перспективных секторов в области искусственного интеллекта, и инвесторы вкладывают миллиарды долларов в решение самых разных задач: от автоматизации звонков в службу поддержки клиентов и отдел продаж до создания программ для ведения протоколов совещаний и разработки умных очков с ИИ, использующих голос в качестве основного средства взаимодействия.
Тем временем лаборатории искусственного интеллекта быстро выпускают модели, а производители оборудования стремятся создать наилучшие условия для взаимодействия потребителей с устройствами.
Все эти новые технологии нуждаются в тестировании и обратной связи для совершенствования. Исландский стартап Treble позиционирует себя как центр индустрии голосового ИИ, создавая платформу моделирования, которая может удовлетворить потребности разработчиков моделей, робототехнических компаний и производителей потребительского оборудования.
Компания, основанная в 2020 году акустическими инженерами Финнуром Пиндом и Йеспером Педерсеном, привлекла 18 миллионов долларов в рамках дополнительного раунда финансирования серии А, возглавляемого Paladin Capital Group, при участии существующих инвесторов KOMPAS VC, Frumtak Ventures, EIC и Omega ehf. В 2024 году компания получила инвестиции в размере 12 миллионов долларов, в результате чего общая сумма привлеченных средств на сегодняшний день превысила 40 миллионов долларов. Среди клиентов стартапа — Amazon и Logitech.
Компания Treble имеет несколько направлений, связанных с моделированием и данными. Для компаний, занимающихся голосовым ИИ, у нее есть платформа для генерации синтетических данных, которую можно использовать для улучшения речи, подавления шума и обучения моделей. Она также оценивает модели голосового ИИ в различных условиях, предоставляя обратную связь лабораториям. Ранее в этом году она сотрудничала с Hugging Face для запуска бенчмарка для моделей распознавания речи в различных реалистичных условиях .
«Искусственный интеллект в области звука — это, по сути, сложная задача, требующая обработки больших объемов данных, и именно здесь кроются наибольшие возможности для создания моделей и оборудования следующего поколения. До настоящего времени практически весь искусственный интеллект, связанный со звуком, создавался на основе записей и данных, собранных из интернета. Мы считаем, что точное моделирование физических процессов может стать альтернативным способом создания данных для звука», — сказал Пинд.
Стартап также специализируется на проектировании и тестировании аппаратного обеспечения с точки зрения голосовых технологий. Например, он сотрудничает с производителями наушников и колонок, предоставляя услуги виртуального прототипирования, чтобы помочь им понять, как может звучать их продукт. Он также может тестировать, как умная колонка понимает команды в зависимости от ее положения. В последнее время Treble также начала предоставлять услуги моделирования и тестирования для умных очков и устройств с искусственным интеллектом.
Пинд заявил, что компания с энтузиазмом относится к работе над носимыми устройствами, которые могли бы улучшить слух пользователей.
«Я очень рад появлению следующего поколения таких устройств, как наушники и умные очки, которые могут обеспечить [например] сверхчеловеческий слух. Это область, где вы действительно сможете лучше слышать в сложных акустических условиях. Например, вы находитесь в ресторане и хотите слышать только людей в радиусе двух метров, или вы на семинаре и хотите заглушить голоса окружающих», — сказал он.
Компания Treble стремится усилить свое внимание к сфере физического искусственного интеллекта, включая робототехнику, автомобильную промышленность и производство дронов, чтобы посредством тестирования и моделирования обеспечить им возможности использования звуковых функций.
Франсуа Рютер, вице-президент Paladin Capital Group, заявил, что платформа Treble, имитирующая различные модели и устройства, выделяется среди других; ее важность будет возрастать по мере расширения сферы ее применения.
«Наша гипотеза заключается в том, что по мере того, как все больше продуктов зависят от понимания звука, эта инфраструктура становится все более ценной в области голосового ИИ, носимых устройств, робототехники и физического ИИ. Клиенты сохраняют право собственности на свои модели, продукты и рабочие процессы разработки, одновременно получая выгоду от общей основы акустической инфраструктуры, изначально предназначенной для моделирования», — сказал Рютер.