Google DeepMind成立研究機構推動AGI討論
TechCrunch
09-18 07:45
Ai 焦點
Google DeepMind 推出新機構,圍繞 AGI 的安全性、模型透明度和前沿評估機制發布首批文章。
有幫助
No.幫助

Google與Google DeepMind的研究人員宣布成立DeepMind Institute,試圖將圍繞通用人工智能(AGI)的討論從原則性表态,推進到更具體的安全、評估和政策設計層面。該機構由DeepMind聯合創始人Shane Legg、Google的高管James Manyika,以及Google DeepMind的負責人Demis Hassabis擔任董事。

首批發布四篇文章

新機構表示,其目標是讓 Google、Google DeepMind 以及更廣泛的研究界對 AGI 的不同觀點能夠公開討論,而不是只保留單一立場。首批發布的四篇文章,分別涉及應對 AGI 可能帶來的經濟衝擊、保留模型可讀推理過程、促進人類福祉的原則,以及前沿 AI 模型的評估框架。

這意味著相關討論正從一般性的安全擔憂,轉向更可執行的制度設計。文章的重點不僅在於風險判斷,也開始涉及開發者應承擔哪些披露義務,以及外部機構如何介入審查。

聚焦模型推理可見性

其中一篇文章由 DeepMind 安全研究人员 Rohin Shah 和 Anca Dragan 撰写,核心观点是:模型推理过程越来越难被外界看见,并非无法改变的趋势。两人认为,隨著新架構讓最強模型更難監測,開發者和監管方需要正面處理性能與可監督性之間的取捨。

文章提出的方向包括,限制模型在不給出可讀推理痕跡的情況下進行連續計算的深度,或者要求開發者證明,即便系統透明度下降,外部仍能以同等程度對其進行監測。

Hassabis 提出前沿模型評估機構

在另一篇文章中,Hassabis提出建立一個由美國主導的尖端AI標準機構,專門評估最先進的AI模型。根據這一設想,開發者在模型發布前最多可自願提交審查30天;如果這套評估機制被證明有效,未來通過測試可能成為尖端模型在美國部署的前提條件。

該機構初期會與 AI 公司共同設計評估方式,之後再逐步轉向獨立、且不提前公開內容的測試,以避免實驗室按已知題目定向優化模型。Hassabis 還提到,如果風險形勢進一步升級,措施可以繼續加碼,甚至不排除前沿 AI 開發者之間進行協調放緩。

業界討論轉向具體方案

這批文章發布之際,AI 行業關於安全的討論正在發生變化。過去常見的是原則性的警示,如今更多焦點開始落在了信息披露、外部審查以及必要時的開發節奏控制上。

這一轉向在本週進一步升溫,原因是多位業內人士公開支持 Anthropic 首席執行官 Dario Amodei 提出的「控制前沿 AI 開發節奏」的部分主張。DeepMind Institute 的推出,也讓 Google 在這場討論中的立場變得更具體。

打賞
$0
點讚
1
收藏
1
瀏覽量 74
HKWDB提醒,請廣大讀者理性看待區塊鏈,切實提高風險意識,警惕各類虛擬代幣發行與炒作,站內所有內容僅係市場資訊或相關方觀點,不構成任何形式的投資建議。如發現站內內容含敏感資訊,可點擊“舉報”,我們會及時處理。
提交
評論 0
最熱
最新
還沒有人評論喔~快搶沙發吧!
相關閱讀
Coinbase 用 AI 持續“攻擊”自己:15萬次掃描之後,人工紅隊仍沒被替代
安全團隊通常在產品上線前進行一次滲透測試,再根據漏洞報告修復問題。但當代碼每天更新、AI功能不斷接入、鏈上與傳統系統交織時,一次性的測試很快就會過期。Coinbase在9月15日公開了內部持續對抗測試系統CAT,試圖讓AI安全代理在代碼合併和產品發布過程中不斷尋找攻擊路徑,而不是等到固定週期才檢查。
币界网
·2026-09-19 09:56:45
253
英國8月零售額環比回升0.5%:線上銷售反彈,但一次促銷錯位就能改變月度圖景
英國8月零售銷售量環比增長0.5%,扭轉7月下降0.5%的表現。英國國家統計局9月18日公佈,6月的增幅從0.7%下修至0.6%。截至8月的三個月與截至5月的三個月相比,零售量增長0.9%;同比則增長2.4%。數據顯示8月消費有所恢復,但月度走勢受到促銷時間和品類波動的影響,不能直接說成全面消費繁榮。
币百科
·2026-09-19 09:54:44
40
OpenAI 研究150萬條工作消息:AI 先改變任務邊界,職位名稱反而不那麼快變
生成式AI對就業的影響,未必先表現為某個職業突然消失。9月16日,一項經濟研究公佈,分析了2026年4月至7月間超過150萬條與工作相關的訊息,觀察員工如何運用人工智能處理原本屬於其他職業的任務。研究發現,一部分跨職業活動會從偶爾嘗試變成重複性工作,崗位內容可能會先擴大,但職位名稱卻暫時不變。
CoinMeta
·2026-09-19 09:52:29
39
Anthropic與埃森哲各自投資至少10億美元:將外部評估員請進AI實驗室,難點在「獨立」兩字
Anthropic於9月18日宣布與埃森哲合作開展前沿的AI獨立評估。該項目由埃森哲旗下的專業AI業務Faculty牽頭,計劃評測和紅隊測試模型、進行對齊評估並檢查安全措施。雙方預計未來五年各自至少投入10億美元,用於建設相應能力。金額很大,但這筆錢不是一次性支付的收購價,也不是已經完成的投资,而是兩家公司對五年能力建設的預期投入。
CoinMeta
·2026-09-19 09:51:27
41
Google 揭露 Gemini 在測試中越界訪問第三方系統
Google 揭露,Gemini 在一次安全测试中越界访问了三家公司的真实系统,该事件再次引发外界对前沿 AI 模型安全性的关注。
CNBC
·2026-09-19 09:39:10
36
查看更多