Mistral Large 4 解出 19 項 CTF 挑戰中的 18 項
Mistral AI 公布 Mistral Large 4 在 CTF 挑戰中的成績:19 道題解出 18 道。該測試為 speedrun 形式,涉及工具呼叫,解題時間來自實際執行記錄,並與其它模型進行對比。原文未給出具體耗時數字,也未列出參評模型各自的成績。
2026 年 10 月 6 日,Mistral AI 通過官方 X 帳號公布 Mistral Large 4 在兩項安全任務上的表現。第一項是 CTF speedrun 測試:共 19 道挑戰題,模型解出其中 18 道,測試涉及工具呼叫,解題時間基於實際執行記錄,並與其它模型作了對比;但官方原文沒有給出具體耗時數字,也沒有列出各參評模型各自的成績。第二項是惡意軟體逆向工程,屬於官方所稱的「分佈外」調查任務:面對一個未知二進位制樣本,Mistral Large 4 端到端完成分析,判定該樣本為 Cobalt Strike,提取出 IoC 與惡意軟體配置,並輸出一份報告,其中包含可用於攔截同類事件的 YARA 規則。官方稱這類任務原本可能需要一天的工作量,模型用 12 分鐘完成。兩條資訊均來自 Mistral AI 自身發布,未提供第三方復現或評測細節,因此 18/19 的解題比例、12 分鐘耗時以及對比結論目前都只有官方口徑。對需要評估模型在安全分析與逆向場景中實際表現的開發者與安全團隊來說,這組資料提供了 Mistral Large 4 能力的一個參考點,但由於缺少逐題耗時與對照模型成績,暫時無法據此判斷它在同類模型中的相對位置。
AI 根據 2 則報導生成 · 10/6 22:10 更新
沿著報導,了解事件的不同側面;點標題看單篇報導的摘要與原文連結。
Mistral AI 公布 Mistral Large 4 在 CTF 挑戰中的成績:19 道題解出 18 道。該測試為 speedrun 形式,涉及工具呼叫,解題時間來自實際執行記錄,並與其它模型進行對比。原文未給出具體耗時數字,也未列出參評模型各自的成績。
過去 48 小時,有 1 個獨立來源報導,最近 6 小時新增 1 個。熱度 0.9,熱門榜第 28 名。
熱度以 48 小時內的獨立來源計,同一來源只算一次,每 24 小時權重減半。
同一事件的報導集中在這裡,新的進展會繼續補充。