AI 姨:小模型能直接套出大模型思维链
2026-08-12 18:10:22
幣界網消息,據鏈上分析師 AI 姨報道,最新研究发现,Claude 防蒸馏的保護措施可能並不牢固。小模型能夠直接套出大模型的思維鏈,儘管大模型廠商試圖通過隱藏完整的思維鏈並只提供摘要來防止能力被蒸馏。研究者在 Claude、GPT 和 Gemini 上均驗證了這一點。研究者 Matthew Green 早在5月就發現這些加密思維鏈可以跨會話、跨賬戶重放,但當時尚未找到穩定讀取內容的方法。最近的研究表明,給 GPT-5.6 和 Opus 一個假工具就能套出思維鏈。安全研究員 Can B ölük 也找到了更簡單的方法,通過調整原生思維並使用假工具,模型能夠將推理寫入工具參數。最初他在 GPT-5.6、Luna 上展示了這一結果,隨後在 GPT-5.6、SOL 和 Claude Fable 上也取得了類似成果。評論區用戶也嘗試了 Claude Opus,成功複述了大段推理。儘管如此,目前尚不能直接稱這些內容為「原始思維鏈」。
來源:互聯網
本內容只為提供市場資訊,不構成投資建議。
關注HKWDB官方帳號,及時關注最新動態









