AISpot

搜尋

依意思最接近的 30 筆

Hacker News front pageAI 評分32

OpenAI 發布整數乘法低於 n log n 的數學預印本

OpenAI 於 2026 年 9 月 23 日發布數學預印本 Integer multiplication below n log n,作者署名 OpenAI。該文歸入 OpenAI Math Release preprint 系列,PDF 託管在 GitHub 倉庫 openai/math 的 preprints 目錄下,並隨文給出 BibTeX 引用條目。標題指向整數乘法複雜度低於 n log n 的結果,但原文未附摘要、演算法細節與具體複雜度常數。

Latent Space● 精選AI 評分90

OpenAI 發布 722 篇數學論文,來自未公開內部模型

OpenAI 在公開 GitHub 倉庫發布 722 篇數學手稿,稱其來自一個未發布的內部前沿模型。這批結果出自約 4000 道研究問題的評估,分成 372 個結果族,平均每個結果消耗約 3 小時 ChatGPT Pro 算力,發布內容含論文、證明產物與部分推理摘要,模型本身不公開。OpenAI 稱發布方式諮詢過高等研究院的數學與 AI 獨立顧問組,Sam Altman 稱之為“發現的新紀元”。

Hacker News front pageAI 評分61

數學界組織批評 OpenAI 一次性發布 700 餘份數學手稿

OpenAI 於 10 月 6 日發布了一個包含 700 多份數學手稿的倉庫,聲稱其中含有多項高知名度數學問題的解答。人類數學協會(Association for Human Mathematics)指出,OpenAI 自稱從中獲得正當性的數學與人工智慧諮詢組織,其最初宣告就明確前沿 AI 公司不應在內部模型上測試高等數學問題,OpenAI 的做法無視了這一核心前提。該協會還提到 OpenAI 正面臨抄襲、版權侵權與商標淡化的訴訟,並呼籲數學家停止與 OpenAI 合作。

Hacker News front pageAI 評分41

Wolfram 撰文討論 AI 時代純數學研究的未來

Wolfram 於 2026 年 9 月 28 日發文,回應 AI 不斷解出數學題後“是否還需要人類做數學研究”的討論。他認為現代 AI 的最大價值在於挖掘人類數學知識庫並建立連線,但純數學的核心是引導提問的人類想像力;計算則能通過計算不可約性不斷生成全新結果。他以 1988 年 Mathematica 問世時類似的擔憂作類比,指出工具只是提升了可做的數學層次。

機器之心● 精選AI 評分91

OpenAI 公開 722 篇數學手稿,聲稱攻克多項名題

OpenAI 把一個尚未發布的內部模型產出的 722 篇數學手稿一次性放上 GitHub,歸入 372 個「成果族」,覆蓋數論、幾何、理論計算機、數學物理等 17 個方向。清單裡既有證明也有證偽,摘要中出現「證偽」「反例」的成果族約 50 個;約六成附有 Lean 形式化,其餘只能算聲稱,且絕大多數尚未經過同行評審。涉及的包括準黎曼猜想、BSD 公式、有理數域上的希爾伯特第十問題、唯一遊戲猜想、Hadwiger 猜想反例、埃爾德什等差數列猜想等。

機器之心● 精選AI 評分94

OpenAI 放出 722 篇數學手稿,稱攻下準黎曼猜想等難題

OpenAI 在 GitHub 倉庫 openai/math 公開 722 篇數學手稿,歸入 372 個成果族,全部由一個尚未發布的內部前沿模型產出。據 OpenAI 說明,模型被投餵約 4000 個研究問題,平均每個結果消耗約相當於 3 小時 ChatGPT Pro 思考的算力,手稿日期幾乎集中在 9 月 23 日至 10 月 5 日。372 族中有 235 族附帶 Lean 形式化,約佔六成三;OpenAI 承認未形式化的結果可能存在問題,且未公布模型名稱。

Hacker News front pageAI 評分45

OpenAI 數學倉庫撤回 3 項結果,新增 6 項 Lean 形式化

OpenAI 更新了其 GitHub 數學倉庫,撤回了 3 項已收錄的數學結果。同一批更新還新增 6 項 Lean 形式化、修改 19 項,倉庫目前約有 42% 的 top-line 結果完成形式化。維護者 Dan Roberts 公布了這一變動,並表示會繼續補充新的形式化內容,同時記錄發現的勘誤。

Hacker News front pageAI 評分43

數學家回應學生焦慮:AI 時代還要不要讀數學博士

數學教授 Álvaro Lozano-Robledo 在客座文章中回應學生的職業焦慮:LLM 的進展正衝擊數學研究與教育,他最擔心的是學界因此失去一整代數學家。不少原本準備讀數學博士的學生正在改換方向,他們追問 AI 是否會超越人類做純數學研究、數學家是否還有用、現在該不該讀博。作者強調目前沒人知道答案,並提醒對高調預測未來的人保持警惕,同時啟動 Human Mathematicians in the Age of AI 訪談專案收集多元意見。

X @OpenAI● 精選AI 評分83

OpenAI 發布內部前沿模型產出的新數學成果

OpenAI 宣布公開一批由其內部前沿模型產出的數學結果,範圍較廣。OpenAI 表示,發布前諮詢了高等研究院(Institute for Advanced Study)的數學與人工智慧獨立諮詢組,並參考其建議與公開推薦來決定發布方式。公告未披露模型名稱、成果數量與具體內容,僅附一個連結。

Hacker News front page● 精選AI 評分79

陶哲軒回應 OpenAI 數學成果:數學需轉向 Math 2.0

陶哲軒就 OpenAI 近期數學成果發文,提出數學研究應從「Math 1.0」轉向「Math 2.0」。他指出,AI 提示者自主解出公開問題後並不理解結果,無法答疑或作報告,相關研討會與合作遠少於傳統突破,新人流入減少,有前景的方向還被隱瞞以防被搶發。問題一旦被解決就無法回退,公開問題正被大規模、不可持續地收割,令整個數學領域變得貧瘠。他主張 Math 2.0 淡化單純解題,重視闡述、社群建設與開闢新方向,並重新評估教育、發表與晉升標準。

Hacker News front page● 精選AI 評分86

OpenAI 公開內部模型產出的 722 篇數學手稿

OpenAI 公開了一個倉庫,收錄其內部模型產出的 722 篇數學手稿,分為 372 個族,並附部分 Lean 形式化與 10 項結果的推理摘要。這些成果來自對開放研究問題的評估,絕大多數由同一個未發布的內部模型完成,平均每個結果消耗 3 小時 ChatGPT Pro thinking 算力,評估期間共提出約 4000 個問題。倉庫內的結果處於不同驗證階段,並非都有 Lean 形式化,未形式化的部分可能存在問題;

The Verge AI● 精選AI 評分87

OpenAI 突然發布大量數學成果,數學家稱需數年消化

OpenAI 本週突然公布了一批數學成果,規模之大讓數十位數學家措手不及,他們用「難以置信」「前所未有」「純粹瘋狂」等詞形容這次投放。多位研究者表示,僅弄清 OpenAI 到底發布了什麼就可能需要數年,更不用說判斷數學家自身在其中處於什麼位置。學界在震驚與興奮之外,也對這批結果的含義和後續影響感到焦慮。

Hacker News front page● 精選AI 評分86

OpenAI 公開內部前沿模型數學成果與 Lean 形式化證明

OpenAI 於 2026 年 10 月 6 日發布由內部前沿模型產出的多項數學結果,以 GitHub 倉庫形式公開,併為其中許多證明提供 Lean 形式化驗證。倉庫同時給出 10 份模型推理摘要、以 ChatGPT Pro 用量折算的算力估算,以及嘗試題目數量的統計,平均每個結果約消耗相當於 3 小時 ChatGPT Pro 思考的算力。

量子位● 精選AI 評分89

OpenAI 公開 722 篇數學手稿,涵蓋黎曼猜想與 BSD

OpenAI 一次性公開 722 篇數學手稿,歸為 372 組結果,全部出自一個尚未發布的內部模型,涉及準黎曼猜想、霍奇猜想、BSD 猜想、π的無理性指數、卡塔蘭常數無理性、唯一遊戲猜想等。據 OpenAI 介紹,模型共嘗試約 4000 個研究問題,平均每項結果消耗算力約相當於 ChatGPT Pro 思考 3 小時;論文、原始碼與部分 Lean 證明已上傳 GitHub。倉庫註明各手稿核驗進度不一,部分成果尚無 Lean 形式化證明。

Hacker News front pageAI 評分45

數學家 Jeremy Avigad 談 AI 衝擊下的數學研究

數學家 Jeremy Avigad 在客座文章中寫道,過去幾個月 AI 已能輕鬆生成一年前足以發表的數學成果,數學家日常工作流程中相當一部分必然改變。他給出三個應對方向,前兩個是解更難的問題、想更大的思想,並指出目前 AI 攻克的開放問題多是把現有技術拼接而成,靠強化學習訓練的系統長於超人式機敏,卻可能缺少創造力與更高層的戰略思考。

The Verge AI● 精選AI 評分83

OpenAI 公布 722 篇論文,未發布前沿模型解開數百數學難題

OpenAI 公開了由一款尚未發布的前沿模型產出的 722 篇論文手稿,稱其中解答了數百個長期懸而未決的數學問題。這批手稿覆蓋 372 個結果族,把相關論文歸入同一組,結果已預期數週才公布。新成立的獨立數學家顧問組 AGMAI 負責對外溝通這些成果。此前數學界對這些突破既感震動也存在爭議,並引發了關於研究倫理與學術規範的討論。

TechCrunch AIAI 評分74

OpenAI 發布 719 份數學解答,被指未達學界標準

OpenAI 本週發布 719 份針對高難度數學問題的解答,但未完全滿足普林斯頓高等研究院 AGMAI 上月發布的指南。AGMAI 的首要建議是停止在專有模型上測試高深數學問題,而 OpenAI 明確稱正用開放研究問題評估其專有模型;719 篇手稿中僅 10 篇公開了模型的思維鏈,42% 的證明未做形式化。

量子位● 精選AI 評分75

陶哲軒轉向 AI 減速派,呼籲模型公司放慢數學研究

數學家陶哲軒在 SAIR 演講中公開呼籲模型公司放慢數學研究節奏,稱 AI 無休止加速卻對後果一無所知,並稱之為 Proof Indigestion(證明消化不良):AI 只在生成解答與 Lean 驗證上狂飆,理解、評審、寫入教科書幾乎停滯。此前他與 25 位菲爾茲獎得主聯名發表公開信,批評把數學當 benchmark 刷分。OpenAI 隨後回應,宣布在普林斯頓高等研究院設立數學與人工智慧顧問小組,但宣告寫明該小組不就數學上的內部進展提供建議。

Hacker News front page● 精選AI 評分95

OpenAI 單日發布 372 項數學成果,含 Unique Games 猜想證明

OpenAI 於 10 月 6 日一次性發布 372 項數學成果,其中包括 Subhash Khot 的 Unique Games 猜想證明,部分結果附有 Lean 證書,但並非全部。截至目前似乎還沒有人類讀懂這些證明,理解它們的競賽才剛剛開始。作者妻子、複雜度理論家 Dana Moshkovitz 長期研究 UGC,她稱論文寫得極差、必須靠 AI 輔助才能閱讀,證明構造出一種全新的遞迴編碼與噪聲測試。

Hacker News front pageAI 評分56

OpenAI 撤回 3 篇數學論文,符號錯誤波及兩篇依賴論文

OpenAI 於 10 月 7 日撤回 3 篇數學論文:起因是《Algebraicity of Weil classes on split abelian eightfolds》中的符號錯誤,使 stabilization-trace 消去論證及所用構造失效,另兩篇依賴該構造的論文一併撤回,現已附說明並連結存檔版本。同期還修訂了 14 篇論文的證明、陳述與假設,另有 13 篇論文更新引用;新增 6 項形式化後,核心結果形式化比例為 300/719,約 42%。

X @samaAI 評分32

Sam Altman 稱正進入發現新紀元,附 OpenAI 數學進展頁面

OpenAI CEO Sam Altman 在 X 發帖稱「我們正進入發現的新紀元」,並附上 OpenAI 官網一則題為 Sharing AI progress in mathematics 的頁面連結。推文字身沒有給出更多說明,未披露涉及的具體模型、數學成果或時間表,資訊集中在所連結的頁面上。發帖時間為 2026 年 10 月 7 日。

The Verge AIAI 評分52

OpenAI 等實驗室攻克數學難題引發學界反彈

過去一年,OpenAI、Anthropic 等實驗室宣布解決了多個長期懸而未決的數學問題,其中甚至包括一道千禧年大獎難題,進展超出研究人員預期。但這些實驗室以矽谷式的高速推進,本應被慶祝的成果反而招致學界反彈,有數學家要求 OpenAI 證明未使用其工作成果,也有批評指向其行事方式。實驗室表示正在從早期的失誤中學習,承諾能否兌現尚待觀察。

Hacker News front page● 精選AI 評分94

OpenAI 發布 372 項數學成果,含 Unique Games 猜想證明

OpenAI 公布 372 項數學與理論電腦科學成果,其中包括 Subhash Khot 的 Unique Games Conjecture(UGC)證明,推薦名單有 Timothy Gowers、Edward Witten 等數學家。UGC 意味著許多最佳化問題即使只想比半正定規劃鬆弛略好地近似,也是 NP-hard。部分成果附 Lean 證書,但幾乎所有證明尚未被人類理解;

量子位AI 評分37

陶哲軒牽頭 AHM 發宣告,數學界集體抵制 OpenAI

菲爾茲獎得主陶哲軒領銜的人類數學協會(AHM)發布聯合宣告,敦促全球數學家停止與 OpenAI 合作。導火索是 OpenAI 一次性發布 700 多篇機器生成的證明檔案,聲稱解答了若干數學界知名難題,被批「純粹炫耀算力霸權」;此前陶哲軒已聯合 25 位菲爾茲獎得主呼籲商業公司放慢腳步。宣告還提到 OpenAI 正因非法抄襲、侵犯版權和商標淡化等指控身陷訴訟。

Hacker News front page● 精選AI 評分88

數學家集體回應 OpenAI 解出百餘道開放問題

OpenAI 10 月 6 日宣布解決 100 多道數學開放問題後,社群網站 Proofs and Prompts 彙集了 100 多條數學家署名的反應,並持續更新至 10 月 9 日。反應中提到的結果包括 Thompson 群 F 非順從、Eilenberg–Ganea 猜想為假、Boone–Higman 猜想被完全解決,以及 Borel 猜想在四維失效、粗 Baum-Connes 猜想失效。

TechCrunch AIAI 評分64

LibreOffice 宣布預設安裝不加入任何 AI 功能

LibreOffice 背後的非營利組織 Document Foundation 表示,在可預見的未來不會把 AI 加入這款開源辦公軟體。8 月底發布的最新版已重申軟體不含任何生成式 AI 功能,這是刻意設計,以確保使用者文件不被上傳伺服器處理、軟體不依賴網路連線即可執行。該組織稱目前沒有能滿足其全部要求的 AI 整合方案,希望使用 AI 的使用者可自行安裝擴充套件,連線本地 AI 模型。

Hacker News front pageAI 評分71

Anthropic 用 Lean 自動形式化費馬大定理,11 天生成 1300 萬行

數學形式化正從人工轉錄轉為 AI 自動形式化:Anthropic 於 2026 年 9 月 4 日宣布完成費馬大定理的自動形式化,11 天生成 1300 萬行 Lean 程式碼;OpenAI 9 月 8 日公布 Navier-Stokes 強制爆破定理時也附帶了 Lean 形式化。此前 Math Inc. 在 24 維球填充問題上生成約 50 萬行程式碼,Meta 的 ATLAS 專案則自動形式化了 26 本教科書的大部分內容。

X @AIatMetaAI 評分43

@AIatMeta: 4️⃣ Optimization: When can you replace a hard math problem with a simpler one without losing anythi…

Meta AI 在社交平台介紹了一項最佳化領域的新研究:研究者與 Muse Spark 合作,證明了一條明確規則,用於判斷某個簡化在什麼條件下能精確還原原始數學問題、在什麼條件下會留下差距。該結果針對的是用更簡單問題替換困難數學問題的場景,論文連結已隨帖文給出。

Hacker News front pageAI 評分45

密碼學家 Matthew Green 擔憂 AI 數學能力威脅公鑰密碼

約翰斯·霍普金斯大學密碼學家 Matthew Green 發文稱,人類有可能失去公鑰密碼學。他的理由是:機器已在人類攻關多年的數學問題上超越人類,因此沒有理由相信 Module-LWE、ECDLP 以及本就呈次指數複雜度的因數分解,已被人類的分析徹底釘死。他認為,在涉及全球網際網路安全時,押注人類這次同樣判斷無誤是一種過於主觀的賭注,並不安全。