AISpot

搜尋

找到 3 筆;也可以試試 語意搜尋

Claude Platform release notes9/30 20:00AI 評分43

Models API 新增 line 欄位,Dreams 預覽支援 Opus 5.5

Anthropic 為 Models API 新增 line 欄位,GET /v1/models 與 GET /v1/models/{model_id} 現在會返回每個模型所屬的產品線,例如 Claude Opus 4.5 和 Claude Opus 4.6 都返回 opus,不屬於任何產品線的模型該欄位為 null。開發者可用 line 直接對模型分組,無需解析模型 ID。

Simon Willison● 精選9/29 18:20AI 評分80

Anthropic 測試:GLM-5.3 在 4% 任務中實現完整控制流劫持

Anthropic Frontier Red Team 從內部二進位制漏洞利用基準中隨機抽取 100 個任務評測多個模型,GLM-5.3 在 4% 的試驗中實現了完整控制流劫持,Claude Mythos Preview 為 6%。此前模型如 Claude Opus 4.6 和 GLM-5.2 在這些任務中無一成功,說明能力門檻已被跨過。

量子位10/7 04:41AI 評分46

AI 程式設計模型集體滿口黑話:思維鏈壓縮省 70% Token

量子位發文吐槽,Fable、Sol 等與 Coding 沾邊的模型普遍輸出「15/15 全綠」「單腿啞火」這類黑話。文中分析,除 Coding 過擬合外,更主要的原因是廠商為省 Token 把思維鏈壓縮成「穴居人語」,OpenAI 最早這麼做,同樣一句話的 Token 消耗比白話文少 70%;Claude 自 Opus 4.6 起也開始如此。作者稱最新 Opus 5.5 語言能力回升明顯,而 Gemini 因輸出風格正常、排版層級清晰,被社群視為少數還能正常溝通的 AI。