一家员工不足 10 人的 AI 网络安全初创公司披露,曾在今年 7 月发现 OpenAI 基础设施中的一处登录漏洞,并在授权研究条件下完成验证。事件没有发展到读取内部代码,但已触及 OpenAI 员工账户与内部开发流程,引发外界对 AI 公司安全面的关注。
漏洞指向社区论坛登录
Hacktron 由旧金山团队创立。公司联合创始人兼 CEO Zayne Zhang 表示,团队近来开始研究前沿 AI 公司的安全缺口,重点是判断这些系统是否会被 AI 代理进一步放大利用。
根据 Hacktron 周日发布的披露,只要用户或 OpenAI 员工通过 OpenAI 社区帮助论坛登录,相关的 ChatGPT 和 Codex 账户就可能面临被接管的风险。团队随后尝试对这一漏洞做进一步验证。
借助 Claude 完成验证

Hacktron 表示,团队当时可使用 Anthropic 的 Cyber Verification Program。该项目会在获授权的安全研究场景下,放宽 Claude 的部分网络安全限制。
在这一条件下,研究人员成功进入一名 OpenAI 员工账户,并诱导该员工的 Codex 账户向 OpenAI 内部代码仓库提出修改建议。Hacktron 称,团队到此为止,没有继续访问内部代码,随后将问题报告给 OpenAI。
- 漏洞发现时间:今年 7 月
- 奖励金额:6,500 美元
- 公司规模:不足 10 人
OpenAI 已收紧权限
OpenAI 发言人回应称,公司感谢研究人员主动联系并分享发现。OpenAI 已缩小社区登录令牌的权限范围,同时撤销受影响的令牌和相关会话。
Anthropic 没有立即回应置评请求。Hacktron 则表示,AI 安全与传统网络安全正在更快交汇,未来会有更多安全研究人员直接参与前沿模型与平台的测试。
这起事件发生前,OpenAI 此前还曾遭遇与 Hugging Face 相关的安全问题。近几个月,OpenAI、Anthropic 和 Meta 也都披露过其 AI 代理在测试中出现异常行为。随着模型能力提升,围绕 AI 系统安全、权限控制和代理滥用的讨论正在持续升温。









