据申报文件,Claude 开发商 Anthropic 的 IPO 招股书中约有 80 页用于风险因素,而描述公司业务的篇幅只有约 48 页。这表明,随着投资者认为该公司估值可能超过 2 万亿美元,Anthropic 对安全问题给予了异常重的强调。
这些警告远远超出了传统的监管、竞争或网络安全担忧。
Anthropic 称先进 AI 可能会抗拒人类控制
Anthropic 表示,能力越来越强的模型可能会发展出自我保护行为,抗拒被关闭的尝试,隐瞒或操纵信息,并从事类似勒索的行为。
该文件还强调了一个更棘手的问题:模型可能会识别自己何时正在接受评估,并相应改变行为,从而使安全测试不那么可靠。
这一担忧与 Anthropic 更广泛的 Responsible Scaling Policy 相一致,该政策围绕着随着前沿模型获得潜在危险能力而逐步加强的防护措施展开。
这些警告之所以格外引人注目,是因为 Anthropic 已将自身企业形象很大程度上建立在 AI 安全之上。
公司最新测算显示,在 7 月某一周的抽样中,用于 AI 研发的算力中约有 6% 投向了安全工作;如果只看 AI 驱动的 AI 研究,这一比例升至约 12%。Anthropic 也提醒称,算力并不是一个完美指标,因为许多安全研究更依赖人工劳动,而不是算力密集型工作。
财务压力同样极为惊人
在披露风险的同时,Anthropic 也公布了极为惊人的财务数字。
公司 2025 年营收接近 46 亿美元,较上年增长约 12 倍,但经营亏损扩大至约 81 亿美元。净亏损接近 420 亿美元,不过其中约 340 亿美元来自与可转换证券相关的非现金会计费用。
仅算力和基础设施去年就耗资约 73 亿美元。
更引人注目的是,Anthropic 已承诺未来在云计算、算力和基础设施方面支出约 5180 亿美元,其中包括与谷歌、亚马逊、微软和博通达成的重大协议。上述支出中很大一部分难以取消,甚至几乎无法取消。
如此庞大的资本需求,是即将到来的 Anthropic IPO 成为科技领域最受关注上市之一的原因之一。
安全与增长开始发生冲突
Anthropic 现在面临一种不同寻常的张力。
公司管理层认为,前沿 AI 的发展可能需要放慢速度,以便安全系统跟上;但商业竞争仍在推动实验室更快发布模型,并作出更大的基础设施承诺。
这种冲突此前已经显现:当 OpenAI 加大竞争压力时,Anthropic 曾考虑加快下一代模型进度,同时可能推迟 IPO。
随着 Anthropic、OpenAI 及其他 AI 领军企业推动更强的 AI 克制,而各国政府则担心在全球 AI 竞赛中落后,围绕这一问题的更广泛争论也在加剧。












