AISpot

搜尋

找到 2 筆

Simon Willison● 精選9/29 23:20AI 評分73

Anthropic 紅隊:GLM-5.3 在 4% 任務中實現控制流劫持

Anthropic Frontier Red Team 在內部 Binary Exploitation 基準中隨機抽取 100 個任務評估多個模型:GLM-5.3 在 4% 的試驗裡實現了完整控制流劫持,Claude Mythos Preview 為 6%。此前模型 Claude Opus 4.6 與 GLM-5.2 在這些任務中一次都沒有成功。該團隊認為,GLM-5.3 的成績雖低於 Claude Mythos Preview,但一個有意義的能力門檻已被跨過。

Anthropic Research● 精選9/29 01:00AI 評分81

GLM-5.3 可自主構建端到端漏洞利用,防護易被繞過

智譜 AI(海外稱 Z.ai)的 GLM-5.3 具備自主構建端到端網路漏洞利用的能力,且發布時未設有效防護,Anthropic 測試顯示攻擊者用簡單技巧即可在 64% 到 100% 的情況下繞過其防護。在 ExploitBench 上,GLM-5.3 於 410 次嘗試中成功開發出 50 次端到端利用,接近 Claude Mythos Preview 的 56 次;在內部二進位制利用基準中取得 4% 的完整控制流劫持,Claude Mythos Preview 為 6%。