总部位于波士顿的语音智能初创公司 Modulate 已获得 2500 万美元新融资,用于支持其平台。该平台使用一组小模型,为企业提供转录、情绪分析、深伪和 AI 音乐检测,以及面向受监管行业语音代理的政策执行功能。
该公司也在与其他试图通过分析人类对话来识别其背后意图的公司竞争,同时也在与那些试图保护个人和企业免受深伪电话侵害的公司竞争,因为如今克隆声音已经变得很容易。
Modulate 的新一轮融资由 Future Ventures 领投,Hyperplane 和 Lakestar 参投。PitchBook 的数据显示,在本轮融资前,这家初创公司已融资 4100 万美元,估值为 1.7 亿美元。
随着语音 AI 模型的出现,公司现在正把重点放在检测不同类型的 AI 音频生成,以及分析说话者言语背后的意图。
“我们对语音 AI 领域的判断是,很多人都在做转录,但实际上并没有真正的能力去把对话的全部细微差别和完整理解提炼出来,而这在你与另一个人交流时非常重要,”Huffman 在接受 TechCrunch 电话采访时说。

该公司目前运行着 100 多个模型,主要分为两类:信号提取模型,用于理解声音情绪、语气、语言和合成语音识别;以及分析/检测模型,用于判断意图,例如客户想表达什么、来电者是否违反规则,或者是否试图诈骗接听方。
Huffman 表示,由于公司运行的是更小的模型,因此不需要专用硬件和大量算力,这在 token 账单上升时可能尤为关键。此外,公司也更容易用新能力训练模型,将其纳入模型组,并在需要时由编排器调用。
Modulate 的客户群较为多样,但其专长在于深伪检测,以及向呼叫中心等组织发出潜在诈骗警报。它还会监测 AI 代理如何回应客户,以评估通话质量,并确保 AI 在监管领域遵守合规规则。基于这些产品,Modulate 往往会位于企业正在使用的语音技术栈旁边,仅用于分析通话。
随着越来越多企业采用 AI 驱动的客户服务,了解一次客户来电为何成功或失败正变得重要。在这种情况下,判断客户意图和回应,已比基础分析更为关键。Huffman 说,Modulate 可以为企业提供更细粒度的数据。
“我认为,当公司想到情绪分析时,他们会觉得如果客户是中性或积极的,通话就是成功的;如果客户是消极的,通话就是失败的。但实际上,很多时候人们即使面对 AI 代理或机器人也会保持礼貌。对吧?他们看起来不会很生气,但实际上会非常不满意,”他说。
公司表示,其技术也被用于通过语音通话监测网络攻击。
这家初创公司目前有 40 到 45 名员工,并计划在未来几个月再增加 10 人,以加强模型构建。Modulate 目前还在提升其本地部署和设备端部署能力,以增强隐私保护。












