Голосовые интерфейсы стали одним из самых финансируемых направлений в ИИ: инвестиции идут в автоматизацию поддержки и продаж, запись встреч и умные очки, где голос — основной способ взаимодействия. Всей этой технике нужны данные для обучения и проверки. Исландская Treble строит платформу, которая моделирует звук физически, а не собирает его из записей.

Компания основана в 2020 году акустическими инженерами Финнуром Пиндом и Йеспером Педерсеном. Расширение Series A на $18 млн возглавил Paladin Capital Group, участвовали действующие инвесторы KOMPAS VC, Frumtak Ventures, EIC и Omega ehf. В 2024 году Treble привлекла $12 млн, общая сумма с учетом нового раунда превышает $40 млн. Среди клиентов — Amazon и Logitech.

ПараметрЗначение
Основана2020
ОснователиФиннур Пинд, Йеспер Педерсен
Новый раунд$18 млн, расширение Series A
Ведущий инвесторPaladin Capital Group
Другие инвесторыKOMPAS VC, Frumtak Ventures, EIC, Omega ehf
Предыдущий раунд$12 млн в 2024 году
Всего привлеченоболее $40 млн
КлиентыAmazon, Logitech

У Treble несколько направлений, связанных с симуляцией и данными. Для разработчиков голосового ИИ компания генерирует синтетические аудиоданные — их используют для улучшения речи, подавления шума и обучения моделей. Отдельно платформа оценивает голосовые модели в разных условиях и возвращает лабораториям обратную связь. В этом году Treble вместе с Hugging Face выпустила benchmark для моделей распознавания речи, проверяющий их в реалистичных акустических сценариях.

Image Credits:Treble
Image Credits:Treble · Источник: TechCrunch AI

«Аудио-ИИ — это на самом деле задача о данных, и именно здесь больше всего возможностей для моделей и устройств следующего поколения. До сих пор почти весь звуковой ИИ создавался из записей и данных, собранных в интернете. Мы считаем, что точная физическая симуляция может стать альтернативным способом создавать данные для звука», — сказал Пинд TechCrunch.

Второе направление — проектирование и тестирование устройств с точки зрения звука. Treble работает с производителями наушников и колонок: виртуальное прототипирование показывает, как продукт будет звучать, а симуляция проверяет, насколько умная колонка понимает команды в зависимости от своего расположения. Недавно компания занялась тестированием умных очков и носимых ИИ-устройств. Пинд говорит, что ему интересны гаджеты, расширяющие слух: например, наушники или очки, которые в шумном ресторане оставляют слышимым только собеседника в двух метрах, а на семинаре приглушают окружающих.

Дальше Treble намерена усилиться в physical ИИ — робототехнике, автомобилях и дронах, где звуковые функции тоже можно проверять симуляцией. Франсуа Рутер, вице-президент Paladin Capital Group, объяснил логику инвестиции: чем больше продуктов зависят от распознавания звука, тем ценнее инфраструктура, общая для голосового ИИ, носимых устройств, роботов и physical ИИ. По его словам, клиенты сохраняют права на свои модели, продукты и процессы разработки, получая при этом общий слой акустической симуляции.

Что остается неопределенным: Treble не раскрывает оценку компании, выручку и число клиентов, а также то, какую долю в ее данных занимает синтетика по сравнению с реальными записями. Неясно и то, насколько физическая симуляция способна заменить полевые испытания в задачах, где важны редкие шумы и акустика конкретных помещений. Ответ на это определит, станет ли подход Treble отраслевым стандартом или останется дополнением к традиционным наборам данных.