堆代码讯 语音AI的投资热度还在不断走高。从客服自动化、销售外呼,到会议纪要工具,再到把语音当作主要交互方式的AI眼镜,投资人正把数十亿美元砸进这个方向。模型迭代越来越快,硬件厂商也在拼命琢磨怎么让用户和设备之间的对话体验更自然。但问题在于,这些新技术从实验室走到真实场景,中间缺一个关键的环节:测试和反馈。冰岛公司Treble盯上的就是这件事。它做的是一个声学模拟平台,客户包括模型开发者、机器人公司,以及消费硬件厂商。
Treble由声学工程师Finnur Pind和Jesper Pedersen在2020年创办。公司最近完成了A轮融资的扩展,新进账1800万美元,该笔投资由Paladin Capital Group领投,老股东KOMPAS VC、Frumtak Ventures、EIC和Omega ehf.继续跟投。加上2024年拿到的1200万美元,Treble累计融资额已经超过4000万美元。亚马逊和罗技都在它的客户名单上。
Treble的业务大致分成几条线。面向语音AI公司,它提供合成数据生成平台,用来做语音增强、噪声抑制和模型训练。同时它也会在不同条件下评估语音AI模型的表现,把结果反馈给实验室。今年早些时候,Treble和Hugging Face合作,推出了一项针对语音识别模型的基准测试,专门考察模型在多样化真实环境下的表现。
Pind对TechCrunch说:“音频AI本质上是一个数据问题,而这里恰恰藏着赋能下一代模型和硬件的最大机会。到目前为止,几乎所有声音相关的AI都是靠录音和从互联网抓取的数据做出来的。我们认为,精确的物理模拟可以成为生成声音数据的另一条路。”
除了数据和模型,Treble也在从声音的角度切入硬件设计和测试。比如,它和耳机、音箱厂商合作做虚拟原型,帮对方提前判断产品听起来会是什么效果。它还能测试智能音箱在不同摆放位置下识别指令的能力。最近,Treble开始为智能眼镜和AI设备提供模拟测试。Pind说,公司对能增强听力的可穿戴设备很感兴趣。
“我很期待下一代耳机和智能眼镜,它们能实现某种超人类听力。在嘈杂的声学环境里,你可以听得更清楚。比如在餐厅,你只想听到两米以内的人说话;或者在研讨会上,你想把周围人的声音屏蔽掉。”Pind说。Treble接下来想加大对物理AI的投入,包括机器人、汽车和无人机公司,通过测试和模拟帮它们实现基于声音的功能。Paladin Capital Group副总裁Francois Ruether对TechCrunch表示,Treble能模拟不同模型和设备的平台是它的独特之处,随着它进入更多领域,这个平台的价值会进一步放大。
Ruether说:“我们的判断是,当越来越多产品依赖对声音的理解,这套基础设施在语音AI、可穿戴设备、机器人和物理AI里的价值会持续上升。客户保留对自己模型、产品和开发流程的控制权,同时又能共用一层以模拟为原生的声学基础设施。”