r/ClaudeAI top of the day10/3 18:19AI 評分75
LiveNerf 完成 Opus 5.5 十天基線測量
LiveNerf 專案已完成 Opus 5.5 的 10 天效能基線,從明天起將收集第 30 天的資料,之後可與基線對比,判斷模型發布後是否被降智。該專案由個人開發者發起,程式碼已開源在 GitHub,目標是獨立追蹤 Opus 5.5 的逐日表現。目前尚無結論性證據,作者稱希望藉此推動 AI 公司提高透明度。
依意思最接近的 2 筆
LiveNerf 專案已完成 Opus 5.5 的 10 天效能基線,從明天起將收集第 30 天的資料,之後可與基線對比,判斷模型發布後是否被降智。該專案由個人開發者發起,程式碼已開源在 GitHub,目標是獨立追蹤 Opus 5.5 的逐日表現。目前尚無結論性證據,作者稱希望藉此推動 AI 公司提高透明度。
圖靈獎得主 Yann LeCun 表示對 AI 消滅人類「零擔憂」,認為近期 OpenAI 智慧體自主入侵 Hugging Face 等事件源於沙箱設計漏洞與人類監督不足,完全可預防。他稱有效利他主義(EA)「超級有毒」,並指 Anthropic CEO Dario Amodei「完全被誤導」甚至「瘋狂」,批評其與 Sam Altman 渲染 AI 滅絕風險是「最糟糕的營銷」。LeCun 目前專注經營新公司 AMI Labs,並認為 AI 不需要新監管,真正風險是監管俘獲。