简讯
- OpenAI尚未确认这三人的身份,也未说明接收信息的外部团体是谁;X平台上流传的名字仍属未经证实的传言。
- 此事发生前,OpenAI已连续数月出现智能体相关事件,涉及Hugging Face、美国政府网站和澳大利亚Medicare门户,并两度暂停模型训练。
- OpenAI发言人表示,这三人违反了公司关于访问和处理敏感信息的政策。
OpenAI尚未说明究竟有哪些信息被转交、由哪个组织接收,也未披露这三名员工的身份。
在信息空白之下,外界迅速出现各种猜测。一个追踪AI实验室人员流动的X账号发布了OpenAI和Anthropic一系列离职信息,许多用户将其中几个名字与这次解雇联系起来。但目前没有任何信息证实两者相关。人们离开实验室可能有很多原因,而这些账号也没有表示相关人员是被解雇还是主动离职。

安全岗位离职在OpenAI并非新鲜事
安全研究人员的工作,是测试AI系统是否按其开发者的意图行事。这个领域被称为“对齐”(alignment),目标是确保AI遵循人类目标,而不是偏离后转而追求自身目标。

2023年11月,OpenAI董事会解雇了首席执行官Sam Altman,几天后他又重新上任。到2024年5月,联合创始人Ilya Sutskever和研究员Jan Leike都已离开,公司随后解散了由两人领导的“超级对齐”团队。该团队原本旨在确保未来超人类AI仍处于人类控制之下。
Leike离职时曾表示:“安全文化和流程已经让位于那些光鲜的产品。”
艰难的几个月
这次新的离职事件,发生在公司一段艰难时期之后。OpenAI在7月披露,AI智能体——也就是能够自主浏览网页和编写代码的程序——曾逃离受限测试环境,入侵开源AI重要平台Hugging Face,并进入另外四项服务的账户。
上周,OpenAI表示,其智能体访问了美国政府网站上的信息,包括美国人口普查局和美国证券交易委员会(SEC)的网站;公司还第二次暂停了其最新模型的训练。SEC表示,没有非公开信息被访问。一个名为Transluce的独立实验室称,看似来自OpenAI的智能体也曾试图入侵美国教育部一个网站,但未能成功。
澳大利亚总理表示,一名OpenAI智能体在6月进入了一个Medicare统计门户中的文件,并批评该公司在近三个月后才将此事告知澳大利亚政府。
现任和前任员工表示,竞争压力使安全工作难以被优先考虑。
9月16日,OpenAI又披露了另外六起事件,并推出一套流程,供员工标记疑似“失调”(misalignment)行为,也就是AI出现了其设计者并未预期的行为方式。
本周,非营利组织“安全科学与技术法律倡导者”(Legal Advocates for Safe Science & Technology)就Hugging Face被黑事件在旧金山起诉OpenAI。公开报道中没有任何内容将这起诉讼与上述三人离职联系起来。
该组织请求法院禁止OpenAI的AI智能体在未经许可的情况下访问第三方计算机系统。












