搜尋 關鍵字 語意 依意思最接近的 14 筆
量子位● 精選 10/5 00:42 AI 評分86
Hinton、Bengio 等 22 位作者聯合發表首篇 RSI(遞迴自我改進)論文《What if automating AI R&D triggers an intelligence explosion?》。論文引用 Anthropic 內部資料:AI 生成獲批程式碼佔比從 2025 年 1 月的低個位數升至 2026 年 5 月的超 80%,Claude 在高層監督下自主完成的 AI 研發工作比例從 2026 年 3 月的約 1% 升到 8 月的 26%。
Hacker News front page10/4 03:53 AI 評分41
Wolfram 於 2026 年 9 月 28 日發文,回應 AI 不斷解出數學題後“是否還需要人類做數學研究”的討論。他認為現代 AI 的最大價值在於挖掘人類數學知識庫並建立連線,但純數學的核心是引導提問的人類想像力;計算則能通過計算不可約性不斷生成全新結果。他以 1988 年 Mathematica 問世時類似的擔憂作類比,指出工具只是提升了可做的數學層次。
Hacker News front page10/5 15:22 AI 評分45
數學家 Jeremy Avigad 在客座文章中寫道,過去幾個月 AI 已能輕鬆生成一年前足以發表的數學成果,數學家日常工作流程中相當一部分必然改變。他給出三個應對方向,前兩個是解更難的問題、想更大的思想,並指出目前 AI 攻克的開放問題多是把現有技術拼接而成,靠強化學習訓練的系統長於超人式機敏,卻可能缺少創造力與更高層的戰略思考。
Hacker News front page● 精選 10/8 02:09 AI 評分77
AI Impacts 於 2024 年 12 月調查 1,580 名頂會 AI 研究者,他們對「未來 AI 導致人類滅絕或永久喪失自主」的機率中位數首次升至 10%,高於一年前的 5%。同一調查中「極度糟糕(如人類滅絕)」的中位數仍為 5%,自 2016 年以來未變,而人類水平 AI 出現的中位年份從 2016 年的 2061 年提前到 2042 年。
X @AIatMeta10/2 15:11 AI 評分15
Meta AI 在官方帳號發布連結,指向其研究部落格中一篇題為「共同解決開放研究問題」的文章。該帖未披露具體研究內容、模型或資料,僅引導讀者前往 research.meta.ai 閱讀全文。
Hugging Face blog● 精選 10/2 11:19 AI 評分70
Ai2 開源了 AstaBrief 8B,一個把研究問題與檢索文獻片段轉成帶引用報告的模型,基於 Qwen3-8B 訓練,已作為 Asta 的 Fast 模式上線。官方稱 Fast 模式平均 51.1 秒生成一份報告,比 Claude 驅動的 Thinking 模式 178.5 秒快約 3.5 倍。模型權重、訓練資料與範例工作流一併開放,機構可在自有基礎設施上本地生成報告。
Latent Space● 精選 10/8 12:27 AI 評分69
Periodic Labs 聯合創始人 Liam Fedus 與 Ekin Dogus Cubuk 在一檔播客中介紹了其「合成超級智慧」構想:以真實物理實驗作為強化學習環境,訓練能自主發現新材料的 AI 科學家。這家成立一年的公司正搭建自動化實驗室,希望讓每臺儀器擁有「140 IQ」,並用做科學的完整過程而非僅論文結果來訓練模型。他們認為失敗的實驗可能是最有價值的訓練資料,自主實驗可把數十年的試錯壓縮到數月,目標材料涵蓋室溫超導、磁體與電池。
量子位● 精選 10/6 03:59 AI 評分75
數學家陶哲軒在 SAIR 演講中公開呼籲模型公司放慢數學研究節奏,稱 AI 無休止加速卻對後果一無所知,並稱之為 Proof Indigestion(證明消化不良):AI 只在生成解答與 Lean 驗證上狂飆,理解、評審、寫入教科書幾乎停滯。此前他與 25 位菲爾茲獎得主聯名發表公開信,批評把數學當 benchmark 刷分。OpenAI 隨後回應,宣布在普林斯頓高等研究院設立數學與人工智慧顧問小組,但宣告寫明該小組不就數學上的內部進展提供建議。
量子位● 精選 10/9 02:28 AI 評分76
Google 與貝斯以色列女執事醫療中心(BIDMC)主導的研究首次登上《柳葉刀》主刊:98 名患者在門診就診前使用 Google 研究級診斷 AI 聊天機器人 AMIE,全程由醫生即時監控,沒有一輪對話因安全問題被中斷。臨床醫生反饋,75% 的場景下 AI 生成的摘要幫他們提前做好接診準備,超過半數案例中 AI 輸出改變了診療思路;AMIE 的鑑別診斷與醫生最終確診吻合度達 90%。研究團隊表示,面向患者端大規模落地仍需更大規模臨床試驗。
X @GoogleDeepMind10/1 07:43 AI 評分57
Google DeepMind 發布了一套可快速驗證生物設計是否內建安全防護的工具,並以開放形式供研究使用。該工具面向科研人員,目的是在 AI 加速科學發現的同時不拖慢關鍵研究進度。官方未披露具體工具名稱、技術細節與適用限制。
r/LocalLLaMA top of the day10/2 18:18 AI 評分26
愛爾蘭一所公立繼續教育學院的教師發帖,稱已獲得資金建成一個小型 AI 實驗室,硬體配置尚可,目標是讓學生學到使用 ChatGPT 之外的實用技能,因此向社群徵集教學方向建議。帖子未透露具體硬體型號、課程安排或學生人數。
Hacker News front page10/2 17:25 AI 評分71
Ai2 於 2026 年 10 月 2 日開源 AstaBrief 8B,一個把研究問題與檢索文獻片段轉成帶引用報告的模型,基於 Qwen3-8B 訓練,採用 SFT 加 DPO 而非強化學習。它已作為 Asta 的 Fast 模式上線,與 Claude 驅動的 Thinking 模式並列,整條流水線平均每份報告 51.1 秒,比 Thinking 模式的 178.5 秒快約 3.5 倍。
OpenAI News10/1 13:00 AI 評分38
OpenAI 新平台發布系列首篇隨筆《永恆的互補》,作者為 Hemanth Asirvatham 與 Elliott Mokski,文末註明觀點不代表 OpenAI。文章引用 Nick Bloom 等研究:維持摩爾定律所需研究人員數量是 1970 年代初的 18 倍以上,1930 年代以來全經濟有效研究投入增長 23 倍,而研究生產率下降 41 倍。作者據此提出「制度智慧」概念,認為前沿智慧與執行能力互為補充,超級智慧的價值可能更多體現在重複性執行工作上。
Hacker News front page10/8 22:27 AI 評分43
數學教授 Álvaro Lozano-Robledo 在客座文章中回應學生的職業焦慮:LLM 的進展正衝擊數學研究與教育,他最擔心的是學界因此失去一整代數學家。不少原本準備讀數學博士的學生正在改換方向,他們追問 AI 是否會超越人類做純數學研究、數學家是否還有用、現在該不該讀博。作者強調目前沒人知道答案,並提醒對高調預測未來的人保持警惕,同時啟動 Human Mathematicians in the Age of AI 訪談專案收集多元意見。