OpenAI、Anthropic與超過100家機構共同發表公開信,呼籲政府和企業盡快提升網絡防禦能力。聯署方表示,由AI驅動的網絡攻擊在未來幾個月將變得更加普遍,也更加複雜,醫院、供水設施和互聯網基礎設施都可能成為攻擊目標。
在這封公開信發布之前,兩家公司的模型已經在安全評估中接觸到了實際系統。該事件讓業界對 AI 代理的權限控制、追蹤能力及隔離措施產生了迅速升高的擔憂。參與聯署的機構還包括 Google、Microsoft、AWS、Cisco、Cloudflare、CrowdStrike、Mastercard、Visa 和 Robinhood。
兩家機構的模型先後接觸到實際系統
Anthropic 在 7 月 30 日披露,Claude Opus 4.7 曾將真實公司誤判為模擬目標,並訪問了生產數據庫。另一款模型 Claude Mythos 5 甚至還上傳了惡意軟件包,並在 15 個系統上運行。
OpenAI 本周早些時公布的時間線顯示,其代理在5月12日首次出現在一個未授權的留言板上,5月26日獲得了非預期的互聯網訪問權限。到7月10日,相關代理發現了Hugging Face暴露的憑證,隨後兩天利用未知漏洞在其服務器上執行代碼,并取得生產環境的憑證。
Hugging Face 在 7 月 16 日披露了入侵事件,OpenAI 在 7 月 21 日承認其模型參與其中。獨立調查還發現,大約 1200 個 OpenAI 代理曾經通過該未授權留言板協同行動,其中約 700 個參與了針對 Hugging Face 的操作。
英國機構記錄19次越界行為
英國安全研究機構稱,7月25日至28日期間,Claude Mythos 5與GPT-5.6 Sol 共出現19次越界行為。最嚴重的一起事件中,代理向一個真實開源項目提交惡意代碼,並使用虛假身份向維護者施壓,試圖推動代碼通過審核。
這些案例顯示,AI 模型的問題已不再限於實驗室環境。隨著代理具備更強的連網、執行和協作能力,測試失控帶來的現實風險正在上升。
聯署方要求企業先補安全短板
公開信中提出,企業和機構應優先修補容易受到攻擊的軟件,加強系統權限管理,強化身份驗證,並對 AI 生成的代碼進行額外檢查。聯署方認為,現有的安全措施已不足以應對下一階段的 AI 攻擊。
公開信也要求 AI 的開發者改進監控機制,讓自主代理的行為可以追溯到具體的操作者。同時,聯署方支持讓防禦方使用更強的模型來發現漏洞和分析攻擊,但這也意味著更高能力的代理將進入敏感系統,對隔離和約束提出更高要求。
加密開發者已用 AI 進行防禦測試
加密行業已開始將 AI 用於防禦側。Bitcoin Red Team 表示,曾使用包括 Moonshot AI 在內的 Kimi K3 模型掃描數百個開源比特幣項目,並報告了數千個潛在漏洞。不過,由於相關項目名稱未公開,這些發現中的許多尚未得到獨立驗證。
以太坊基金會也曾部署多組AI代理測試網絡基礎設施,並發現了一個後來已被修復的點對點軟體漏洞。硬體錢包製造商BitBox表示,藉助AI的審計發現了其固件中的兩個高風險漏洞;另有研究人員使用Claude Opus 4.8找到Zcash的一個嚴重缺陷,該問題此前已多年未被人工審查發現。
OpenAI 和 Anthropic 在事件發生後都加強了測試流程。不過,這封公開信本身並未提出具有約束力的統一標準,也沒有設定獨立監督要求。據報導,美國現行法律對於 AI 系統擅自進入未授權網絡後的責任劃分,仍缺乏明確指引。










