AISpot

搜尋

依意思最接近的 19 筆

OpenAI News10/1 18:00AI 評分38

OpenAI 平台發文:超級智慧最大價值或在枯燥工作

OpenAI 新平台發布系列首篇隨筆《永恆的互補》,作者為 Hemanth Asirvatham 與 Elliott Mokski,文末註明觀點不代表 OpenAI。文章引用 Nick Bloom 等研究:維持摩爾定律所需研究人員數量是 1970 年代初的 18 倍以上,1930 年代以來全經濟有效研究投入增長 23 倍,而研究生產率下降 41 倍。作者據此提出「制度智慧」概念,認為前沿智慧與執行能力互為補充,超級智慧的價值可能更多體現在重複性執行工作上。

量子位● 精選10/5 05:42AI 評分86

Hinton、Bengio 等 22 位作者發首篇 RSI 論文,討論智慧爆炸

Hinton、Bengio 等 22 位作者聯合發表首篇 RSI(遞迴自我改進)論文《What if automating AI R&D triggers an intelligence explosion?》。論文引用 Anthropic 內部資料:AI 生成獲批程式碼佔比從 2025 年 1 月的低個位數升至 2026 年 5 月的超 80%,Claude 在高層監督下自主完成的 AI 研發工作比例從 2026 年 3 月的約 1% 升到 8 月的 26%。

The Verge AI10/3 17:49AI 評分47

Capcom 稱正為與 AI 共同開發遊戲的未來做準備

在 Capcom Open Conference RE: 2026 上,程式設計師 Satoshi Ishida 以「REX 專案的前景與未來」為題演講,稱制作《生化危機》級別遊戲時連簡單任務都極其耗時,解決方案是把 AI 技術成功整合進開發流程。他表示為「與 AI 共同創造遊戲的未來」做準備。Capcom 此前曾稱不會使用 AI。

機器之心10/4 12:31AI 評分50

OpenAI 預告 Astra 6.1,主打刪減屎山程式碼

OpenAI 產品負責人 Tibo Sottiaux 發帖預告未來模型會更擅長刪除和簡化程式碼,並在評論中確認 Astra 6.1「coming soon」。負責 coding post-training 的研究員 Rajan Agarwal 轉發該帖,並公開徵集使用者遇到的 sloppy code 與程式碼品質問題。《華爾街日報》此前報導,Astra 6.1 原計劃 10 月發布,因內部安全測試中在權限邊界上表現不穩而被臨時叫停。

NVIDIA blog10/5 14:00AI 評分47

NVIDIA Inception 初創用 AI 補乳腺癌篩查與治療缺口

輝達 Inception 計劃的多家初創公司正用 AI 補乳腺癌篩查、風險評估與治療規劃的缺口。iSono Health 的 FDA 許可 ATUSA 可穿戴自動 3D 超聲每側乳房約 2 分鐘完成成像,傳統手持超聲最長需 45 分鐘,其敏感度稱高出 28%,已在加州、德州等地診所商用,並啟動 3200 人臨床研究。Whiterabbit.ai 的 FDA 許可 WRDensity 軟體自動評估乳腺密度,已用於數十萬患者;

Latent Space● 精選10/2 15:04AI 評分75

Airbnb 稱 60% 程式碼由 AI 編寫,半數客服工單由 AI 解決

Airbnb CTO Ahmad Al-Dahle 披露,公司目前 60% 的程式碼由 AI 生成,功能交付量同比增加近 80%,工程師人均 PR 吞吐量提升約 1.6 倍;約一半客服工單已完全由 AI 處理,與 Q2 財報中近 45% 的數字一致。內部上下文圖譜 Everest 幫助雜貨配送服務在 8 至 9 個月內上線,機場接送僅用約 6 周。Airbnb 採用多模型策略,至少部署 10 個定製模型,主要在開源模型上做後訓練和強化學習。

量子位● 精選10/6 08:59AI 評分75

陶哲軒轉向 AI 減速派,呼籲模型公司放慢數學研究

數學家陶哲軒在 SAIR 演講中公開呼籲模型公司放慢數學研究節奏,稱 AI 無休止加速卻對後果一無所知,並稱之為 Proof Indigestion(證明消化不良):AI 只在生成解答與 Lean 驗證上狂飆,理解、評審、寫入教科書幾乎停滯。此前他與 25 位菲爾茲獎得主聯名發表公開信,批評把數學當 benchmark 刷分。OpenAI 隨後回應,宣布在普林斯頓高等研究院設立數學與人工智慧顧問小組,但宣告寫明該小組不就數學上的內部進展提供建議。

TechCrunch AI10/6 15:00AI 評分30

TechCrunch Disrupt 2026 公布分論壇議程,Anthropic 員工分享 Claude 智慧體工作流

TechCrunch Disrupt 2026 將於 10 月 13 至 15 日在舊金山 Moscone West 舉行,官方公布了全部 breakout 分論壇議程。每場分論壇 50 分鐘,專家分享後設觀眾問答,座位有限、先到先得。AI 相關議題包括 Anthropic 技術成員演示並行執行多個 Claude 智慧體、委派真實工程任務並在出錯後恢復,以及物理 AI 的定義、AI 從訓練轉向推理後的價值歸屬、可信 AI 的評估方式。

Hacker News front page10/4 18:21AI 評分47

歐洲首屆前沿 AI 與法律研討會在英舉辦

ML4Good 與 EquiStamp 於 2026 年 9 月在英國東薩塞克斯舉辦了首屆歐洲前沿 AI 與法律研討會,為期五天,面向來自 12 個司法管轄區的 19 名資深法律、治理與風險專業人士。課程覆蓋從訓練、評估到 agent 與防護措施的前沿 AI 全流程,並對應採購、風險評估及供應商安全宣告失效等實際工作場景。參與者包括律所與內部律師、隱私合規人員、風險與金融顧問、法律學者及司法和公共部門代表。

The Verge AI10/5 20:28AI 評分52

OpenAI 等實驗室攻克數學難題引發學界反彈

過去一年,OpenAI、Anthropic 等實驗室宣布解決了多個長期懸而未決的數學問題,其中甚至包括一道千禧年大獎難題,進展超出研究人員預期。但這些實驗室以矽谷式的高速推進,本應被慶祝的成果反而招致學界反彈,有數學家要求 OpenAI 證明未使用其工作成果,也有批評指向其行事方式。實驗室表示正在從早期的失誤中學習,承諾能否兌現尚待觀察。

量子位10/4 01:53AI 評分58

Meshy 不到兩年 ARR 從 100 萬增至 1 億美元

AI 3D 生成公司 Meshy 披露,其 ARR 從 100 萬美元增長至 1 億美元,用時不到兩年,比 HeyGen 的 29 個月更快。Meshy 7 在自建幾何對齊基準中造型比例、空間分佈、表面細節三項指標領先受測模型,7.1 將幾何生成解析度從 2048³ 提升至 4096³。三七互娛已將其接入生產流程,基礎模型階段雕刻工作量減少 30% 至 40%。

Hacker News front page10/5 20:22AI 評分45

數學家 Jeremy Avigad 談 AI 衝擊下的數學研究

數學家 Jeremy Avigad 在客座文章中寫道,過去幾個月 AI 已能輕鬆生成一年前足以發表的數學成果,數學家日常工作流程中相當一部分必然改變。他給出三個應對方向,前兩個是解更難的問題、想更大的思想,並指出目前 AI 攻克的開放問題多是把現有技術拼接而成,靠強化學習訓練的系統長於超人式機敏,卻可能缺少創造力與更高層的戰略思考。

The Verge AI10/5 11:00AI 評分42

The Verge 刊文:人類心智難以應對 AI

The Verge 發表評論文章,認為人類的心智並不適合應對 AI,AI 行業把大腦等同於計算機的流行比喻過於簡化了人。文章引用控制論奠基人 Norbert Wiener 的「每個時代的思想都映照在其技術中」,並點名 Google 的 Demis Hassabis 稱大腦是圖靈機的生物近似、Elon Musk 稱應把大腦視為生物計算機。作者反駁這類說法,指出人類的複雜性遠超多數 AI 從業者的認知,而 AI 產品仍在不斷推進。完整內容見 The Verge。