AISpot

搜尋

找到 16 筆

Hacker News front page10/5 20:22AI 評分45

數學家 Jeremy Avigad 談 AI 衝擊下的數學研究

數學家 Jeremy Avigad 在客座文章中寫道,過去幾個月 AI 已能輕鬆生成一年前足以發表的數學成果,數學家日常工作流程中相當一部分必然改變。他給出三個應對方向,前兩個是解更難的問題、想更大的思想,並指出目前 AI 攻克的開放問題多是把現有技術拼接而成,靠強化學習訓練的系統長於超人式機敏,卻可能缺少創造力與更高層的戰略思考。

Hacker News front page10/4 08:53AI 評分41

Wolfram 撰文討論 AI 時代純數學研究的未來

Wolfram 於 2026 年 9 月 28 日發文,回應 AI 不斷解出數學題後“是否還需要人類做數學研究”的討論。他認為現代 AI 的最大價值在於挖掘人類數學知識庫並建立連線,但純數學的核心是引導提問的人類想像力;計算則能通過計算不可約性不斷生成全新結果。他以 1988 年 Mathematica 問世時類似的擔憂作類比,指出工具只是提升了可做的數學層次。

量子位● 精選10/6 08:59AI 評分75

陶哲軒轉向 AI 減速派,呼籲模型公司放慢數學研究

數學家陶哲軒在 SAIR 演講中公開呼籲模型公司放慢數學研究節奏,稱 AI 無休止加速卻對後果一無所知,並稱之為 Proof Indigestion(證明消化不良):AI 只在生成解答與 Lean 驗證上狂飆,理解、評審、寫入教科書幾乎停滯。此前他與 25 位菲爾茲獎得主聯名發表公開信,批評把數學當 benchmark 刷分。OpenAI 隨後回應,宣布在普林斯頓高等研究院設立數學與人工智慧顧問小組,但宣告寫明該小組不就數學上的內部進展提供建議。

The Verge AI10/5 20:28AI 評分52

OpenAI 等實驗室攻克數學難題引發學界反彈

過去一年,OpenAI、Anthropic 等實驗室宣布解決了多個長期懸而未決的數學問題,其中甚至包括一道千禧年大獎難題,進展超出研究人員預期。但這些實驗室以矽谷式的高速推進,本應被慶祝的成果反而招致學界反彈,有數學家要求 OpenAI 證明未使用其工作成果,也有批評指向其行事方式。實驗室表示正在從早期的失誤中學習,承諾能否兌現尚待觀察。

Hacker News front page10/6 01:00AI 評分75

兩年隨機試驗:Khanmigo 輔導數學成績提升有限

田納西州 18 所中學的兩年叢集隨機試驗顯示,在日常補救數學課中使用 Khan Academy 的 AI 導師 Khanmigo(配置為引導而非直接給答案),學生每學期數學成績提升 1.3 個國家百分位排名,一學年約 0.06 至 0.08 個標準差,全年積極參與的隱含效應為 0.14 個標準差,與沒有 AI 輔助的 Khan Academy 練習效果相近。

Hacker News front page● 精選10/6 23:17AI 評分86

OpenAI 公開內部前沿模型數學成果與 Lean 形式化證明

OpenAI 於 2026 年 10 月 6 日發布由內部前沿模型產出的多項數學結果,以 GitHub 倉庫形式公開,併為其中許多證明提供 Lean 形式化驗證。倉庫同時給出 10 份模型推理摘要、以 ChatGPT Pro 用量折算的算力估算,以及嘗試題目數量的統計,平均每個結果約消耗相當於 3 小時 ChatGPT Pro 思考的算力。

X @OpenAI● 精選10/6 23:19AI 評分83

OpenAI 發布內部前沿模型產出的新數學成果

OpenAI 宣布公開一批由其內部前沿模型產出的數學結果,範圍較廣。OpenAI 表示,發布前諮詢了高等研究院(Institute for Advanced Study)的數學與人工智慧獨立諮詢組,並參考其建議與公開推薦來決定發布方式。公告未披露模型名稱、成果數量與具體內容,僅附一個連結。

X @AIatMeta10/2 20:11AI 評分43

@AIatMeta: 4️⃣ Optimization: When can you replace a hard math problem with a simpler one without losing anythi…

Meta AI 在社交平台介紹了一項最佳化領域的新研究:研究者與 Muse Spark 合作,證明了一條明確規則,用於判斷某個簡化在什麼條件下能精確還原原始數學問題、在什麼條件下會留下差距。該結果針對的是用更簡單問題替換困難數學問題的場景,論文連結已隨帖文給出。

Hacker News front page10/6 13:53AI 評分66

Erdős 問題網站因 AI 生成證明氾濫宣布改版

Erdős 問題網站 erdosproblems.com 的建立者 Thomas Bloom 於 2026 年 10 月 6 日宣布改版,因為站內公開互動已被大量無解釋的 AI 生成證明佔據。該站 2023 年 5 月上線,現收錄 1221 個問題、9000 多條評論、近 2000 名註冊使用者,日獨立訪客約 1 萬至 2.5 萬。Bloom 稱 2025 年 8 月加入評論功能後社群一度活躍,隨後討論明顯減少,不少數學家因無法與 AI 競爭而不再思考這些問題。

r/ClaudeAI top of the day10/3 21:56AI 評分18

用 Claude 寫程式碼生成 106 張 OLED 桌布

一位 Reddit 使用者在 r/ClaudeAI 分享,用 Claude 生成程式碼、基於真實科學資料與物理數學方程繪製出 106 張 4K 桌布,畫面以黑色為主,適配 OLED 螢幕關閉畫素省電的特性。作者強調影像並非 AI 生成,AI 只用於寫程式碼,作品發布在 alistair-roberts.co.uk。

Hacker News front page● 精選10/5 16:38AI 評分87

OpenAI 公布歐盟文字溯源方案,API 可選用文字水印

OpenAI 公布應對歐盟 AI 法案的文字溯源方案:全球 API 客戶即日起可為部分模型選擇開啟文字水印(預設關閉),未來幾週將在歐盟的 ChatGPT 與 Codex 文字輸出中加入不可見水印,檢測器僅向獲批研究者與專家組織開放申請。其自研 textGrain 通過統計訊號標記用詞,在 1% 誤報率下對 200 token 段落檢出約 80%、400 token 約 95%,數學等用詞受限內容明顯更低;

量子位● 精選10/2 08:27AI 評分78

丘成桐新論文致謝 GPT 6 Astra 和 Claude Pro

丘成桐參與的最新論文在致謝中感謝 GPT 6 Astra 和 Claude Pro,稱其幫助探索了部分證明思路和計算。論文處理的是七維空間 27 種「怪球」能否具有嚴格正截面曲率的問題,該問題 1982 年被丘成桐列入自己的問題清單,懸置約 70 年。論文還附帶 SageMath 驗證程式碼,並宣告人工驗證與寫作由作者負責。