2026 年 10 月 6 日,OpenAI 發布一批由其內部前沿模型產出的數學結果,以 GitHub 倉庫形式公開。倉庫收錄 722 篇數學手稿,分為 372 個族,按數學學科分類,併為其中許多證明提供 Lean 形式化驗證,OpenAI 表示會隨著獲得更多形式化而持續更新。倉庫同時給出 10 份模型推理摘要、以 C… 看完整事件
OpenAI 發布內部前沿模型產出的新數學成果
OpenAI 宣布公開一批由其內部前沿模型產出的數學結果,範圍較廣。OpenAI 表示,發布前諮詢了高等研究院(Institute for Advanced Study)的數學與人工智慧獨立諮詢組,並參考其建議與公開推薦來決定發布方式。公告未披露模型名稱、成果數量與具體內容,僅附一個連結。
罕見地公開內部前沿模型產出的數學成果,並說明引入外部學術諮詢來決定發布方式,對關注模型科研能力與發布安全流程的讀者有參考價值。
原標題:@OpenAI: We’re releasing a broad range of new mathematical results produced by an internal frontier model.
閱讀原文
| 評分 | 82 / 85(平均 83,門檻 60) |
|---|---|
| 狀態 | 精選 |
相關報導
AI 攻入數學界:宣稱解決千禧年大獎難題卻引發反彈
過去一年 OpenAI、Anthropic 等實驗室宣稱在多個長期未解的數學難題上取得突破,其中一項是著名的千禧年大獎難題,能力超出研究者對現有系統的預期。但推進方式被批像失控的推土機,原本該被慶祝的結果反而引發數學界反彈,有數學家要求 OpenAI 證明沒有使用他們的工作。實驗室稱正從早先的錯誤中學習,能否兌現仍待觀察。
陶哲軒轉向 AI 減速派,呼籲模型公司放慢數學研究
數學家陶哲軒在 SAIR 演講中公開呼籲模型公司放慢數學研究節奏,稱 AI 無休止加速卻對後果一無所知,並稱之為 Proof Indigestion(證明消化不良):AI 只在生成解答與 Lean 驗證上狂飆,理解、評審、寫入教科書幾乎停滯。此前他與 25 位菲爾茲獎得主聯名發表公開信,批評把數學當 benchmark 刷分。OpenAI 隨後回應,宣布在普林斯頓高等研究院設立數學與人工智慧顧問小組,但宣告寫明該小組不就數學上的內部進展提供建議。
數學家 Jeremy Avigad 談 AI 衝擊下的數學研究
數學家 Jeremy Avigad 在客座文章中寫道,過去幾個月 AI 已能輕鬆生成一年前足以發表的數學成果,數學家日常工作流程中相當一部分必然改變。他給出三個應對方向,前兩個是解更難的問題、想更大的思想,並指出目前 AI 攻克的開放問題多是把現有技術拼接而成,靠強化學習訓練的系統長於超人式機敏,卻可能缺少創造力與更高層的戰略思考。
OpenAI 安全透明度負責人離職,三名安全員工被開
OpenAI 安全透明度職能負責人 David Robinson 已離職,OpenAI 未公布繼任者,他本人也未公開說明原因。該職能負責撰寫每次重要模型發布時的 system card,並主導起草《Preparedness Framework 2.0》。此前 OpenAI 還以向外部 AI 安全機構分享敏感資訊為由,開除了 Jasmine Wang、Tomek Korbak 和 Mikita Balesni 三名安全與對齊研究方向員工。
OpenCode v1.18.35 發布:修復 xAI 工具結果圖片傳遞
OpenCode 發布 v1.18.35,核心改進是新增 canonical redirects,並提供 JSON 與 Markdown 兩種格式的 agent 可讀統計資料。本次修復讓 xAI 的工具呼叫結果可以攜帶受支援的圖片,不支援的圖片格式會被跳過,做法是把 @ai-sdk/xai 升級到 3.0.139。文件方面,Zen 文件新增 Fledge Alpha Free,生態外掛列表加入 opencode-supabase,該版本同時致謝 3 位社群貢獻者。