馬斯克稱 Grok 4.7 登頂 AA Cyber Index
馬斯克在 X 上表示,Grok 4.7 在 AA Cyber Index 上排名第一。該帖未給出具體分數、測試範圍或與第二名的差距,也未說明該指數的評測方式與更新日期。
依意思最接近的 8 筆
馬斯克在 X 上表示,Grok 4.7 在 AA Cyber Index 上排名第一。該帖未給出具體分數、測試範圍或與第二名的差距,也未說明該指數的評測方式與更新日期。
馬斯克在 X 上發布一條僅含「Try Grok @Bot」的推文,推廣 Grok 的 @Bot 功能。原文未提供該功能的具體用途、價格、額度或可用範圍等細節。
馬斯克在 X 上發布了一份指南,介紹如何招聘首個 Grok Bot 員工。他表示,這就像僱了一個出色的幫手,能瞭解需求並幾乎每天都在變聰明。該帖未披露 Grok Bot 的具體功能、價格或上線時間。
Google 在 9 月發布新一代前沿模型 Gemini 4 Argon,具備先進推理能力與 100 萬 token 輸出上限,目前通過 Fairwind Program 向受信任的網路安全防禦方分階段開放。
開發者 roofkid 發布 Ninfer 4080,在 RTX 4080 16GB 上以 100k 上下文執行 ISTA-DASLab-Qwen-3.8-27B-GSQ,實測最高 prefill 2720 tok/s、生成 262 tok/s。專案採用 DFlash2 推測解碼與 KV 壓縮,程式碼已在 GitHub 開源並提供 Docker 映象。
Google DeepMind 發布 Gemini 4 Argon,主打程式設計、企業知識工作與網路防禦,在 19 項基準中 13 項達到 SOTA,並首次實現最高 1M token 輸出(Long Decode Continuation 跨呼叫續寫)。目前僅面向政府使用者與 Fairwind 計劃中的可信網路安全人員開放,開發者、企業與消費者訪問時間未定。標準定價為每百萬輸入/輸出 token 4/20 美元,五折優惠後 2/10 美元,快取輸入再降 95%。
微軟推出 FrogNano-4B-2609,一個面向低視訊記憶體裝置的程式設計智慧體模型,基於 Qwen3.5-4B 後訓練而來。其額外訓練為純文字、聚焦倉庫級軟體工程,用約 1500 個合成 SWE 任務環境和基於可執行測試的獎勵做強化學習,不依賴更強模型的解題軌跡蒸餾。模型需配合 Leaf 工具框架生成結構化工具呼叫,產出的補丁須經人工審查、迴歸測試與安全驗證後才能使用。