AISpot

Anthropic 紅隊:GLM-5.3 在 4% 任務中實現控制流劫持

Simon Willison9/29 23:20觀點研究政策與安全

Anthropic Frontier Red Team 在內部 Binary Exploitation 基準中隨機抽取 100 個任務評估多個模型:GLM-5.3 在 4% 的試驗裡實現了完整控制流劫持,Claude Mythos Preview 為 6%。此前模型 Claude Opus 4.6 與 GLM-5.2 在這些任務中一次都沒有成功。該團隊認為,GLM-5.3 的成績雖低於 Claude Mythos Preview,但一個有意義的能力門檻已被跨過。

GLM 系列在二進位制漏洞利用上首次跨過門檻,你用 coding agent 或日後本地跑開源模型時,需要把這類可自主利用漏洞的能力納入沙箱與安全邊界評估。

原標題:Quoting Anthropic Frontier Red Team
閱讀原文

評分68 / 78(平均 73,門檻 65)
狀態精選(舊聞,已歸檔)