简讯
谷歌周三发布 Gemini 4 Argon,称其为旗下前沿模型,也就是在编码、办公和网络防御方面最强大的模型。
在 DeepSWE v1.1 测试中,这是一项衡量 AI 能否完成冗长、杂乱、真实世界软件工程任务的测试,按百分比计分,Argon 得分 77.9%。Claude Opus 5.5 得分 74.2%,GPT-6 Astra 得分 74.1%,Claude Fable 5.1 得分 67.4%。
作为对比,Gemini 3.6 Flash 在今年 7 月的同一测试中得分为 49%。Argon 还可以在一次回复中写入最多 100 万个 token,高于此前的 64,000 个。token 是文本块,大致相当于四分之三个单词,因此这相当于约 75 万个单词,而此前约为 4.8 万个单词。

不过,这些数字仍需谨慎看待。谷歌计算了自己的 DeepSWE 分数,而竞争对手的数字来自公开排行榜和公司报告。其对比表也显示,Argon 在 18 项基准中领先 12 项、持平 1 项、落后 5 项,覆盖编码、科学和计算机控制测试。
但该模型最引人注目的功能是网络安全能力。把一条秘密指令藏进电子邮件里,等 AI 助手读取后,看它是否会服从陌生人的指令而不是你自己的指令。这就是间接提示注入,也是任何想把 AI 接入邮箱或购物车的人最担心的问题。
在 Gray Swan 的间接提示注入基准测试中,模型会在其读取的内容里隐藏恶意指令,并统计攻击在 15 次尝试内成功的频率,Argon 的结果为 0.7%。数值越低越好。Claude Opus 5.5 和 Claude Fable 5.1 都是 1.0%。
GPT-6 Astra 为 8.5%。Grok 4.6 和 Kimi K3 更容易被诱导,成功率分别略高于一半,为 51.8% 和 52.7%。
Argon 将通过 Fairwind Program 先提供给经过审核的安全团队。Fairwind Program 是谷歌有限访问的网络防御计划,于 9 月 2 日启动,合作方超过 650 家,包括政府和关键基础设施运营商。该模型发布时“不带网络安全护栏”,也就是通常会阻止模型协助黑客行为的内置拒绝机制。
这样做的逻辑是,防御方需要一个能像攻击者一样思考的模型,才能在犯罪分子发现漏洞之前修补问题。代价是,同样的能力也可能被用于恶意用途,因此谷歌表示,分阶段推出是唯一安全的路径。谷歌也参与了美国政府关于预发布模型访问的自愿流程。
谷歌并不是第一家把网络安全模型放在“天鹅绒绳”后面限制访问的公司。Anthropic 的 Claude Mythos 早期版本曾帮助发现 Firefox 中的 271 个漏洞,也就是 Mozilla 随后修补的 271 个安全缺口。OpenAI 也采取了类似做法,推出了 Trusted Access for Cyber 计划。
Argon 的网络安全成绩超过了 Gemini 3.8 Flash Cyber,后者是谷歌与 Fairwind 一同推出的受限模型。在 Wiz Penetration Test Benchmark 上,这是一项谷歌内部测试,要求 AI 在看不到代码的情况下,针对真实网页应用漏洞编写可运行的利用代码,并按首次尝试解决的比例计分,Argon 得分 70.9%,高于 58.2%。
谷歌还表示,Argon 帮助安全公司 Wiz 在全球医院使用的医疗软件中发现了一个严重漏洞,而此前更早一代的前沿模型没有发现该问题。
入门定价为每 100 万个输入 token 2 美元、每 100 万个输出 token 10 美元。谷歌尚未说明这一阶段何时结束,只表示标准费率为每 100 万个输入 token 4 美元、每 100 万个输出 token 20 美元。












