搜尋 關鍵字 語意 依意思最接近的 5 筆
Hacker News front page● 精選 10/9 22:14 AI 評分82
新評測 InnovationEval 顯示,前沿模型無法獨立復現人類研究者近期做出的機器學習演算法創新:在端到端任務中,它們耗費數千美元 GPU 算力,仍未達到人類論文(on-policy self-distillation,SDPO)的水平。測試要求 AI 自主提出一種新的後訓練方法,在短答題與程式碼任務上後訓練 Qwen3-8B,並超過 GRPO 基線。主要結果來自 Claude Fable 5 與 GPT-5.6 Sol;
OpenAI News10/1 17:00 AI 評分38
OpenAI 新平台發布系列首篇隨筆《永恆的互補》,作者為 Hemanth Asirvatham 與 Elliott Mokski,文末註明觀點不代表 OpenAI。文章引用 Nick Bloom 等研究:維持摩爾定律所需研究人員數量是 1970 年代初的 18 倍以上,1930 年代以來全經濟有效研究投入增長 23 倍,而研究生產率下降 41 倍。作者據此提出「制度智慧」概念,認為前沿智慧與執行能力互為補充,超級智慧的價值可能更多體現在重複性執行工作上。
Latent Space● 精選 10/8 16:27 AI 評分69
Periodic Labs 聯合創始人 Liam Fedus 與 Ekin Dogus Cubuk 在一檔播客中介紹了其「合成超級智慧」構想:以真實物理實驗作為強化學習環境,訓練能自主發現新材料的 AI 科學家。這家成立一年的公司正搭建自動化實驗室,希望讓每臺儀器擁有「140 IQ」,並用做科學的完整過程而非僅論文結果來訓練模型。他們認為失敗的實驗可能是最有價值的訓練資料,自主實驗可把數十年的試錯壓縮到數月,目標材料涵蓋室溫超導、磁體與電池。
X @GoogleDeepMind● 精選 10/7 14:03 AI 評分85
Google DeepMind 宣布 SynthID Detector 現已向所有人開放,可用來判斷網上內容是否由 AI 生成。該工具除 Google AI 外,還支援檢測 OpenAI、NVIDIA、Kakao 等行業夥伴工具生成的內容,Apple 即將加入。使用者可通過 synthid.com 試用。
TechCrunch AI10/5 15:00 AI 評分21
TechCrunch Disrupt 2026 將於 10 月 13 至 15 日在舊金山舉行,四場討論聚焦 AI 創業公司的模型選型:開放權重還是前沿 API。