Modulate获2500万美元融资,专注语音AI分析与防伪检测

波士顿语音智能初创公司Modulate近日完成2500万美元融资,其平台通过小模型组合提供企业级语音转录、情感分析、深度伪造检测及AI音乐识别等服务。随着语音AI技术快速发展,Modulate正着力于...

人工智能

在语音人工智能领域,一家位于波士顿的初创公司Modulate宣布获得2500万美元的新一轮融资。这家成立于2017年的企业专注于开发基于小型模型的语音分析解决方案,旨在为企业客户提供更精准的语音交互支持。

文章配图

Modulate的平台集成了多种功能模块,包括语音转录、情感分析、深度伪造检测以及AI音乐识别等。这些能力特别适用于需要严格合规管理的行业,如金融和医疗领域。例如,在客户服务场景中,系统能够实时分析通话内容,识别潜在的风险行为或违规操作。

"我们发现市场上虽然有很多转录工具,但缺乏能够全面理解和解读对话深层含义的技术,"Modulate联合创始人Carter Huffman在接受TechCrunch采访时说道。他强调,这种对对话完整性的理解对于人与人之间的沟通至关重要。

此次融资由Future Ventures领投,Hyperplane和Lakestar参与跟投。根据PitchBook的数据,Modulate在本轮融资前的估值已达1.7亿美元,累计融资总额达到4100万美元。公司的两位创始人Mike Pappas和Carter Huffman最初是在麻省理工学院攻读物理学时相识,并共同创立了这家公司。

早期的Modulate主要服务于游戏行业的语音变调需求,但随着语音AI技术的发展,公司逐渐转向开发针对语音代理的监管工具。如今,Modulate已经运行超过100个模型,这些模型大致可分为两类:信号提取模型用于理解声音的情感、语调、语言特征以及合成语音判断;分析/检测模型则侧重于识别对话意图、规则违反情况以及潜在的深度伪造呼叫。

"我们的目标是让AI语音更加人性化,同时确保其安全性和可靠性,"Huffman补充道。"这不仅涉及提高语音的真实感,还包括防止恶意使用语音克隆技术进行诈骗等行为。"

随着语音AI技术的普及,相关安全问题也日益凸显。近期,上海就宣判了首例AI声音仿冒案件,涉及《原神》63款角色声音被复刻并被判赔75万元。这一事件凸显了语音AI技术在应用过程中可能带来的法律和伦理挑战。

在技术层面,Modulate的解决方案与当前业界的其他创新紧密相连。例如,复旦大学和上海创智学院的研究团队最近提出了VA-Judger模型,该模型通过人类偏好学习来改进音视频生成质量。此外,世界模型团队XGEN Labs开源的第一人称交互体验模型JING,也为语音AI的应用提供了新的可能性。

尽管Modulate专注于语音分析领域,但其技术发展也受益于大模型性能的提升。Anthropic发布的Claude Opus 5.5模型支持百万Token上下文,API调用价格大幅降低,这为Modulate这样的初创公司提供了更具成本效益的底层技术支持。

展望未来,Modulate计划进一步扩展其产品线,特别是在本地化部署和硬件集成方面。公司正在探索将语音分析技术嵌入到AI眼镜、桌面机器人等终端设备中,以实现更广泛的商业应用场景。

"我们相信,随着语音AI技术的不断成熟,它将在更多行业中发挥重要作用,"Huffman表示。"我们将继续致力于技术创新,同时确保我们的解决方案符合最高的安全和合规标准。"