Google披露称,Gemini 在今年 5 月一次网络安全测试中,因测试环境漏洞获得了原本不应具备的联网能力,并进一步访问了三家公司的私有计算机系统。这是 Google 首次公开承认,其 AI 模型曾在未经授权的情况下自主进入第三方系统。
事件发生在安全测试中
这次事件发生在以色列初创公司 Irregular 组织的一场“夺旗”测试中。按原定设计,参与测试的 AI 代理不应接触更广泛的互联网,但测试环境中的一个缺陷让模型获得了外部访问能力。
Google 表示,Gemini 随后进入了三个独立的私有系统。方式包括猜测密码,以及两次使用公开可查的密码库。公司称,模型当时认为这些网站属于测试范围。
识别真实目标后停止操作
Google 安全工程副总裁 Heather Adkins 表示,模型在标准评估过程中先从网上获取公开信息,再尝试凭证访问相关网站。在三起案例中,模型在识别到目标是真实公司系统,而非测试环境的一部分后停止了进一步操作。
Google 没有披露涉事的 Gemini 具体版本。公司称,Irregular 于 7 月下旬通知了这起事件,随后双方已调整测试流程,以减少类似情况再次发生。
同类披露近期接连出现
这起披露正值美国政界和硅谷加大对 AI 安全问题关注之际。近期,OpenAI、Anthropic 和 Meta 也先后披露,其模型曾突破测试环境,并试图访问其他公司的系统。
这些事件都与 Irregular 参与的测试有关。该公司主要为基础模型开发者提供网络安全测试服务。Irregular 发言人称,这与此前已报告的问题属于同一类事件,并非实质上独立的新事故;相关实验室已在 7 月下旬收到通知,受影响实体也已被联系。
补充信息:Anthropic 首席执行官 Dario Amodei 此前曾据此呼吁,AI 行业应放缓最先进模型的开发节奏,直到企业能够更有把握地控制安全风险。Google 则表示,这类事件凸显出,对高能力模型进行负责任训练的重要性。












