2026 年 10 月 6 日,OpenAI 在 GitHub 倉庫公開一批由內部未發布前沿模型產出的數學成果,收錄 722 篇手稿、按 372 個結果族組織,每族聚合主結果、伴隨論證、推論或替代證明,並按數學分支分類。這些結果出自對開放研究問題的評估,評估期間共提出約 4000 個問題,平均每個結果消耗約相當於 3… 看完整事件
OpenAI 發布 722 篇數學論文,來自未公開內部模型
OpenAI 在公開 GitHub 倉庫發布 722 篇數學手稿,稱其來自一個未發布的內部前沿模型。這批結果出自約 4000 道研究問題的評估,分成 372 個結果族,平均每個結果消耗約 3 小時 ChatGPT Pro 算力,發布內容含論文、證明產物與部分推理摘要,模型本身不公開。OpenAI 稱發布方式諮詢過高等研究院的數學與 AI 獨立顧問組,Sam Altman 稱之為“發現的新紀元”。
首次成規模公開內部模型產出的數學證明:722 篇、平均 3 小時算力出一個結果,同時模型不公開、結論未經獨立驗證,對關注 AI 科研能力邊界與驗證方式的人最有用。
原標題:[AINews] Quasi-Riemann-Hypothesis: OpenAI publishes 722 math papers solving 90 of the top 500 open math problems; “the most significant moment” in >100 years of mathematics
閱讀原文
| 評分 | 88 / 92(平均 90,門檻 65) |
|---|---|
| 狀態 | 精選 |
相關報導
OpenAI 等實驗室攻克數學難題引發學界反彈
過去一年,OpenAI、Anthropic 等實驗室宣布解決了多個長期懸而未決的數學問題,其中甚至包括一道千禧年大獎難題,進展超出研究人員預期。但這些實驗室以矽谷式的高速推進,本應被慶祝的成果反而招致學界反彈,有數學家要求 OpenAI 證明未使用其工作成果,也有批評指向其行事方式。實驗室表示正在從早期的失誤中學習,承諾能否兌現尚待觀察。
陶哲軒轉向 AI 減速派,呼籲模型公司放慢數學研究
數學家陶哲軒在 SAIR 演講中公開呼籲模型公司放慢數學研究節奏,稱 AI 無休止加速卻對後果一無所知,並稱之為 Proof Indigestion(證明消化不良):AI 只在生成解答與 Lean 驗證上狂飆,理解、評審、寫入教科書幾乎停滯。此前他與 25 位菲爾茲獎得主聯名發表公開信,批評把數學當 benchmark 刷分。OpenAI 隨後回應,宣布在普林斯頓高等研究院設立數學與人工智慧顧問小組,但宣告寫明該小組不就數學上的內部進展提供建議。
OpenAI 公布歐盟文字溯源方案,API 可選用文字水印
OpenAI 公布應對歐盟 AI 法案的文字溯源方案:全球 API 客戶即日起可為部分模型選擇開啟文字水印(預設關閉),未來幾週將在歐盟的 ChatGPT 與 Codex 文字輸出中加入不可見水印,檢測器僅向獲批研究者與專家組織開放申請。其自研 textGrain 通過統計訊號標記用詞,在 1% 誤報率下對 200 token 段落檢出約 80%、400 token 約 95%,數學等用詞受限內容明顯更低;
OpenAI 發布 GPT-6 家族模型指南
OpenAI 在官網發布 GPT-6 家族模型指南,面向初創公司,內容涵蓋如何選擇 GPT-6 模型、調節推理強度、改進提示詞與技能、協調工具呼叫,以及為生產環境準備工作流。該指南以教程形式發布在 openai.com,Reddit 討論中使用者提及 6.1 在 20 英鎊套餐上效率很高,也有人反映速度偏慢。