上週被 OpenAI 解僱的三名安全與對齊研究員 Tomek Korbak、Jasmine Wang、Mikita Balesni 聯名發表致公司安全與安保委員會等機構的公開信,稱解僱與他們堅持 AI 安全直接相關,並否認是 The Information 相關報導的洩密者。Jasmine 稱唯一理由是她曾獲授權訪問一位高管信箱、IT 未完成權限撤銷;Tomek 稱數月來一直提出思維鏈可監測性下降的擔憂,並擔心 OpenAI 借解僱縮減與外部審計機構 METR 的合作。
Meta 發言人確認正裁減一批今年 6 月從 AI 安全初創公司 Virtue AI 招聘來的員工,入職僅四個月,理由為工作風格不合。這批人包括 UC Berkeley 教授宋曉冬與 Virtue AI 另兩位創始人 Bo Li、Sanmi Koyejo,6 月加入 Meta 超級智慧實驗室;報導未確認宋曉冬等是否全部離職,團隊尚未回應,具體分歧未披露。MIT Sloan 2019 年研究顯示,被收購員工入職第一年內離職率為 33%,常規招聘員工為 12%。
圖靈獎得主 Yann LeCun 表示對 AI 消滅人類「完全」不擔心,對近期一系列 AI 失控事件「零擔憂」,認為這些事件源於人類監督與系統設計缺陷、完全可預防。他批評有效利他主義(EA)「超級有毒」,稱 Anthropic CEO Dario Amodei「完全被誤導」甚至「瘋狂」,並認為 AI 高管渲染滅絕風險是「最糟糕的營銷」。他目前主要精力放在創辦新公司 AMI Labs。
據 The Information 報導,Meta 和微軟正在減少員工對 Claude 的依賴,推動開發者轉向自家 AI 工具。Meta 內部 Claude Code 活躍使用者從 6 萬降至 3 萬,減少 50%,由自研的 Muse Code 和 MetaCode 補位,最近一個 28 天週期在 Claude Code 上花費超 1.05 億美元。
OpenAI 首席戰略官 Kwon 表示,自 Medicare 資料洩露事件以來,OpenAI 已增設額外監控,一旦公司模型以不被允許的方式訪問網際網路,員工可立即介入並叫停訓練。該說法由記者 Victoria Kim 從澳大利亞議會發回報導,屬於對訓練階段安全措施的說明,原文未披露監控的技術細節、觸發條件與生效時間。
macOS 27 Golden Gate 取消了關閉 Apple Intelligence 的開關,GitHub 開發者 Om Lahore 為此發布命令列工具 RemoveMacAI,可一鍵關閉該功能並釋放磁碟空間。據 GitHub 頁面,該操作完全可逆;作者稱 Apple Intelligence 模型約佔 12GB,The Verge 則指出實際佔用可能超過 30GB。此前使用者在設定中只能逐項關閉 AI 功能,模型檔案仍會留在磁碟上。
白宮召集扎克伯格、貝索斯、馬斯克、Anthropic 的 Dario Amodei 等主要科技 CEO 簽署 AI 安全承諾,川普稱其具有道德約束力。川普同時簽署行政令,正式將 AI 重新命名為超級智慧。與此同時,Meta 和 OpenAI 正為 AI 產品換上更友好的形象,但消費者中僅 2% 願意為此付費。
HackerRank 的 AI 面試 agent Chakra 結束約六個月 beta,週一起正式向企業客戶開放,測試期間已完成逾 50 萬場面試,Snowflake、Snorkel、Capgemini 等公司參與試用。候選人要在帶 AI 助手的畫布上處理真實程式碼倉庫任務,Chakra 會依據其操作追問思路,評估批判性思維、判斷力與「AI fluency」,即如何向 AI 描述問題、判斷其輸出並引匯出解法。
Ben Affleck 本週因多段訪談影片走紅,他在其中講解神經網路、transformer、張量等概念,並稱自己會寫點 Python。他透露做法是拿開源模型微調:解凍權重、只訓練最後一層「電影感」層,讓劇組達到製片標準,該技術已用於其電影《Animals》後期。他創立的 AI 影視公司今年被 Netflix 收購,報導金額 5.87 億美元,他本人稱這個數字不準確。他還表示不擔心 AI 接管影視業,更擔心學生的習得性無助與大學 A 成績三年上升 30%。