语音 AI 公司 ElevenLabs 正在把业务从配音、有声书扩展到企业客服和政府场景。TechCrunch 采访其联合创始人兼首席执行官 Mati Staniszewski 时提到,这家公司成立仅四年,据投资人给出的最新估值已达 220 亿美元,年经常性收入约为 6 亿美元。
企业客户占比过半
Staniszewski 表示,公司目前超过 55% 的收入来自传统企业客户,其余收入主要来自中小企业、开发者和内容创作者。ElevenLabs 的客户名单已覆盖 Klarna、德国电信、思科和 Adobe,也在向更多政府机构提供语音能力。
他提到,企业使用语音 AI 的场景正在分化。对于只提供信息查询的客服任务,开源模型已能满足不少需求;但在金融服务、退款、交易查询等容错率极低的场景,前沿模型仍更具优势。
与客户竞争加剧
随着 AI 公司同时做模型、平台和应用,原本清晰的分工正在减弱。Staniszewski 认为,这种边界会继续模糊。一些原本依赖 ElevenLabs 的客户,也开始训练自有语音产品并与其形成竞争。
他举例称,像 Anthropic 这类原本偏模型层的公司,已经在向平台和应用延伸。对 ElevenLabs 来说,这意味着不仅要卖底层语音能力,也要面对更完整产品形态的竞争。
政府项目强调本地化部署
在政府合作方面,Staniszewski 表示,不同国家对模型选择和数据处理要求并不相同。项目可采用开源模型、闭源模型,或客户自行微调的模型,具体取决于应用场景。
以波兰的一个医疗项目为例,患者通过公共医疗系统预约后,约有 18% 不会按时到场。当地部署的语音代理会主动致电提醒,同时保留数据本地存储要求。ElevenLabs 主要负责语音层集成,而不是统一输出单一模型方案。
公司称将为上市做准备
Staniszewski 还表示,企业在现阶段应明确告知用户,通话对象是 AI 还是人工客服。他认为,当前用户仍不习惯在未被告知的情况下与 AI 交互,但这种习惯未来可能变化。
对于外界关注的利润率,他未披露具体数字,只表示如果降低利润率有助于扩大市场份额、向客户让利,公司可以接受。谈及 2028 年 IPO 传闻时,他没有直接确认时间表,仅称公司正在为未来几年具备上市条件打基础。
在训练数据方面,他表示,语音模型的关键不只是数据量,更在于标注质量。公司使用大量外部合同人员标注语音内容、说话时点、语气和情绪,并引入语音教练识别口音特征。











