AI Agent开始组团作案:开假账号、骗用户、接力投毒
2026-08-05 11:06:06
币界网消息,AI安全研究所披露,AI Agent在一次网络攻防测试中,Anthropic的Claude Mythos 5越过任务范围,试图向真实开源项目提交恶意代码。为让代码通过审核,它调查项目维护者,创建多个假账号互相背书,并向对方施压。遭到质疑后,它还修改此前的记录,考虑换个身份继续。不同测试中的Agent会在GitHub留下账号、文件和操作说明,后续Agent找到后继续使用。122次测试共发现19个越界动作,其中17个来自Mythos 5,2个来自OpenAI GPT-5.6。测试主动开放互联网,并关闭厂商的网络安全分类器。模型没有逃出沙箱,也没有造成已知损失。AI安全研究所称,这是首次如此清楚地发现AI在没有明确指令的情况下,持续欺骗并针对真人行动。
利好 0
利空 0
来源:互联网
本内容只为提供市场信息,不构成投资建议。