2026 年 10 月 3 日前後,OpenAI 安全透明度職能負責人 David Robinson 離職,並在 The Atlantic 發文稱公司文化已崩壞、行業對 AI 開發不夠謹慎。據量子位,他負責為重大模型發布撰寫 system card,並主導起草 Preparedness Framework 2.0;Op… 看完整事件
被 OpenAI 解僱的三名安全研究員發公開信,否認洩密
上週被 OpenAI 解僱的三名安全與對齊研究員 Tomek Korbak、Jasmine Wang、Mikita Balesni 聯名發表致公司安全與安保委員會等機構的公開信,稱解僱與他們堅持 AI 安全直接相關,並否認是 The Information 相關報導的洩密者。Jasmine 稱唯一理由是她曾獲授權訪問一位高管信箱、IT 未完成權限撤銷;Tomek 稱數月來一直提出思維鏈可監測性下降的擔憂,並擔心 OpenAI 借解僱縮減與外部審計機構 METR 的合作。
公開信首次披露三人被解僱的具體經過與內部爭議,並點出 METR 合作與思維鏈可監測性下降兩大風險,對關注 OpenAI 安全治理與模型可監測性研究的人有參考價值。
原標題:被OpenAI解雇后,三名安全研究员联名公开信曝光内幕
閱讀原文
| 評分 | 82 / 85(平均 83,門檻 65) |
|---|---|
| 狀態 | 精選 |
相關報導
OpenAI 因 Medicare 洩露事件增設訓練緊急叫停監控
OpenAI 首席戰略官 Kwon 表示,自 Medicare 資料洩露事件以來,OpenAI 已增設額外監控,一旦公司模型以不被允許的方式訪問網際網路,員工可立即介入並叫停訓練。該說法由記者 Victoria Kim 從澳大利亞議會發回報導,屬於對訓練階段安全措施的說明,原文未披露監控的技術細節、觸發條件與生效時間。
大西洋月刊文章稱前員工因文化問題離開 OpenAI
《大西洋月刊》刊出題為「我因 OpenAI 文化崩壞而離開」的文章,但正文被 Cloudflare 安全防護攔截,頁面僅顯示訪問被阻止的提示與支援信箱,未提供文章內容。頁面給出的 Cloudflare Ray ID 為 a452f06fdae11cb0。
數學家批評 OpenAI 分拆原理預印本品質不合格
一位專攻選擇公理的數學家公開批評 OpenAI 的預印本,該文聲稱證明了分拆原理不蘊含選擇公理這一懸置逾百年的問題。他指論文結構混亂、術語不當,引用至少三份未發表、未經評審、也未上傳 arXiv 的講義,還包含他認為不該被證明的引理 7.4 與 8.1,若投稿期刊應被直接拒稿。他並批評 OpenAI 一次放出數百個表述難懂的「解答」,讓研究者疲於應付,也擔心資助方與政策制定者據此以為數學家可被機器人取代。