數學家 Jeremy Avigad 談 AI 衝擊下的數學研究
數學家 Jeremy Avigad 在客座文章中寫道,過去幾個月 AI 已能輕鬆生成一年前足以發表的數學成果,數學家日常工作流程中相當一部分必然改變。他給出三個應對方向,前兩個是解更難的問題、想更大的思想,並指出目前 AI 攻克的開放問題多是把現有技術拼接而成,靠強化學習訓練的系統長於超人式機敏,卻可能缺少創造力與更高層的戰略思考。
找到 16 筆
數學家 Jeremy Avigad 在客座文章中寫道,過去幾個月 AI 已能輕鬆生成一年前足以發表的數學成果,數學家日常工作流程中相當一部分必然改變。他給出三個應對方向,前兩個是解更難的問題、想更大的思想,並指出目前 AI 攻克的開放問題多是把現有技術拼接而成,靠強化學習訓練的系統長於超人式機敏,卻可能缺少創造力與更高層的戰略思考。
Wolfram 於 2026 年 9 月 28 日發文,回應 AI 不斷解出數學題後“是否還需要人類做數學研究”的討論。他認為現代 AI 的最大價值在於挖掘人類數學知識庫並建立連線,但純數學的核心是引導提問的人類想像力;計算則能通過計算不可約性不斷生成全新結果。他以 1988 年 Mathematica 問世時類似的擔憂作類比,指出工具只是提升了可做的數學層次。
OpenAI 在官方帳號發布連結,指向官網頁面 sharing-ai-progress-in-mathematics,主題是分享數學方向上的 AI 進展。該資料本身只有這一條連結,未披露涉及的具體模型、基準成績、發布時間或使用方式,因此除官方就數學進展對外發聲這一點外,暫無更多可確認的細節。
數學家陶哲軒在 SAIR 演講中公開呼籲模型公司放慢數學研究節奏,稱 AI 無休止加速卻對後果一無所知,並稱之為 Proof Indigestion(證明消化不良):AI 只在生成解答與 Lean 驗證上狂飆,理解、評審、寫入教科書幾乎停滯。此前他與 25 位菲爾茲獎得主聯名發表公開信,批評把數學當 benchmark 刷分。OpenAI 隨後回應,宣布在普林斯頓高等研究院設立數學與人工智慧顧問小組,但宣告寫明該小組不就數學上的內部進展提供建議。
過去一年,OpenAI、Anthropic 等實驗室宣布解決了多個長期懸而未決的數學問題,其中甚至包括一道千禧年大獎難題,進展超出研究人員預期。但這些實驗室以矽谷式的高速推進,本應被慶祝的成果反而招致學界反彈,有數學家要求 OpenAI 證明未使用其工作成果,也有批評指向其行事方式。實驗室表示正在從早期的失誤中學習,承諾能否兌現尚待觀察。
田納西州 18 所中學的兩年叢集隨機試驗顯示,在日常補救數學課中使用 Khan Academy 的 AI 導師 Khanmigo(配置為引導而非直接給答案),學生每學期數學成績提升 1.3 個國家百分位排名,一學年約 0.06 至 0.08 個標準差,全年積極參與的隱含效應為 0.14 個標準差,與沒有 AI 輔助的 Khan Academy 練習效果相近。
OpenAI 於 2026 年 10 月 6 日發布由內部前沿模型產出的多項數學結果,以 GitHub 倉庫形式公開,併為其中許多證明提供 Lean 形式化驗證。倉庫同時給出 10 份模型推理摘要、以 ChatGPT Pro 用量折算的算力估算,以及嘗試題目數量的統計,平均每個結果約消耗相當於 3 小時 ChatGPT Pro 思考的算力。
OpenAI 宣布公開一批由其內部前沿模型產出的數學結果,範圍較廣。OpenAI 表示,發布前諮詢了高等研究院(Institute for Advanced Study)的數學與人工智慧獨立諮詢組,並參考其建議與公開推薦來決定發布方式。公告未披露模型名稱、成果數量與具體內容,僅附一個連結。
Meta AI 在社交平台介紹了一項最佳化領域的新研究:研究者與 Muse Spark 合作,證明了一條明確規則,用於判斷某個簡化在什麼條件下能精確還原原始數學問題、在什麼條件下會留下差距。該結果針對的是用更簡單問題替換困難數學問題的場景,論文連結已隨帖文給出。
Meta AI 團隊與 Muse Spark 合作,在受生物學啟發的數學結構研究中,找到了一個被提出規則的反例,並進一步給出替代性刻畫,經研究人員驗證與完善。相關論文已發布。
Meta AI 披露,研究人員通過找到一個反例,推翻了關於描述對稱性的數學結構的一項既有規則猜想。Muse Spark 生成了用於搜尋該反例的程式碼,團隊隨後驗證了結果並完成了證明。相關論文已放出連結。
Erdős 問題網站 erdosproblems.com 的建立者 Thomas Bloom 於 2026 年 10 月 6 日宣布改版,因為站內公開互動已被大量無解釋的 AI 生成證明佔據。該站 2023 年 5 月上線,現收錄 1221 個問題、9000 多條評論、近 2000 名註冊使用者,日獨立訪客約 1 萬至 2.5 萬。Bloom 稱 2025 年 8 月加入評論功能後社群一度活躍,隨後討論明顯減少,不少數學家因無法與 AI 競爭而不再思考這些問題。
Meta AI 研究人員與 Muse Spark 合作,將數論中的一個想法與弦理論中的一項計算聯絡起來,證明該聯絡在比此前已知更多的情況下成立。這項工作建立在 1980 年代的想法之上,論文已在 Meta AI 研究頁面發布。
一位 Reddit 使用者在 r/ClaudeAI 分享,用 Claude 生成程式碼、基於真實科學資料與物理數學方程繪製出 106 張 4K 桌布,畫面以黑色為主,適配 OLED 螢幕關閉畫素省電的特性。作者強調影像並非 AI 生成,AI 只用於寫程式碼,作品發布在 alistair-roberts.co.uk。
OpenAI 公布應對歐盟 AI 法案的文字溯源方案:全球 API 客戶即日起可為部分模型選擇開啟文字水印(預設關閉),未來幾週將在歐盟的 ChatGPT 與 Codex 文字輸出中加入不可見水印,檢測器僅向獲批研究者與專家組織開放申請。其自研 textGrain 通過統計訊號標記用詞,在 1% 誤報率下對 200 token 段落檢出約 80%、400 token 約 95%,數學等用詞受限內容明顯更低;
丘成桐參與的最新論文在致謝中感謝 GPT 6 Astra 和 Claude Pro,稱其幫助探索了部分證明思路和計算。論文處理的是七維空間 27 種「怪球」能否具有嚴格正截面曲率的問題,該問題 1982 年被丘成桐列入自己的問題清單,懸置約 70 年。論文還附帶 SageMath 驗證程式碼,並宣告人工驗證與寫作由作者負責。