搜尋 關鍵字 語意 依意思最接近的 30 筆
量子位● 精選 10/5 00:42 AI 評分86
Hinton、Bengio 等 22 位作者聯合發表首篇 RSI(遞迴自我改進)論文《What if automating AI R&D triggers an intelligence explosion?》。論文引用 Anthropic 內部資料:AI 生成獲批程式碼佔比從 2025 年 1 月的低個位數升至 2026 年 5 月的超 80%,Claude 在高層監督下自主完成的 AI 研發工作比例從 2026 年 3 月的約 1% 升到 8 月的 26%。
Hacker News front page10/5 09:22 AI 評分46
企業一度鼓勵員工儘可能多地使用 AI,即所謂的 #tokenmaxxing,隨後賬單隨之而來。報導援引一項針對近 400 家企業的調查稱,其中只有 11% 能準確預測自己的 AI 支出。AI 使用量以 token 計量,而企業發現 token 很難統計,這讓 AI 預算幾乎無法編制。
TechCrunch AI10/5 11:00 AI 評分21
TechCrunch Disrupt 2026 將於 10 月 13 至 15 日在舊金山舉行,四場討論聚焦 AI 創業公司的模型選型:開放權重還是前沿 API。
機器之心10/4 07:31 AI 評分50
OpenAI 產品負責人 Tibo Sottiaux 發帖預告未來模型會更擅長刪除和簡化程式碼,並在評論中確認 Astra 6.1「coming soon」。負責 coding post-training 的研究員 Rajan Agarwal 轉發該帖,並公開徵集使用者遇到的 sloppy code 與程式碼品質問題。《華爾街日報》此前報導,Astra 6.1 原計劃 10 月發布,因內部安全測試中在權限邊界上表現不穩而被臨時叫停。
Hacker News front page10/4 11:29 AI 評分35
Jagex 已下架《Dragon Slayer 2》預告片並緊急調查,因片中角色出現六根手指等生成式 AI 痕跡。該預告片由外部合作方製作,對方曾明確確認不會使用 GenAI。Jagex 表示不會用 GenAI 製作遊戲、美術或創意素材,也不會知情允許他人代做,並將在 RuneFest 後整改稽核流程,同時與社群創作者合作重製該預告。
TechCrunch AI10/7 10:15 AI 評分25
TechCrunch Disrupt 2026 將於 10 月 13 至 15 日在舊金山 Moscone West 舉行,預計有 1 萬多名創始人、投資人、運營者與科技領袖參加。官方公布了全部互動圓桌議程,分佈在兩個專門的圓桌空間,主題包括物理 AI 的資料挑戰、AI 暴露企業軟體與 SaaS 的碎片化、AI 輔助的 IPO 財務準備、後訓練專用資料、量子計算投資、醫療生成式 AI 以及 agentic 商務等。目前註冊通行證可省最多 100 美元,第二張半價。
X @awnihannun10/2 11:10 AI 評分12
Apple 研究員 awnihannun 在社交平台發布一首短詩,稱因「未來會 foom」而上調自己的 P(doom),即 AI 導致人類滅絕的主觀機率。詩中還提到中文房間、shoggoth 與死神之眼等 AI 圈內梗,未給出具體數值或論證。
Hugging Face blog● 精選 10/2 11:19 AI 評分70
Ai2 開源了 AstaBrief 8B,一個把研究問題與檢索文獻片段轉成帶引用報告的模型,基於 Qwen3-8B 訓練,已作為 Asta 的 Fast 模式上線。官方稱 Fast 模式平均 51.1 秒生成一份報告,比 Claude 驅動的 Thinking 模式 178.5 秒快約 3.5 倍。模型權重、訓練資料與範例工作流一併開放,機構可在自有基礎設施上本地生成報告。
X @GoogleDeepMind10/1 07:43 AI 評分57
Google DeepMind 發布了一套可快速驗證生物設計是否內建安全防護的工具,並以開放形式供研究使用。該工具面向科研人員,目的是在 AI 加速科學發現的同時不拖慢關鍵研究進度。官方未披露具體工具名稱、技術細節與適用限制。
Hacker News front page● 精選 10/6 18:17 AI 評分86
OpenAI 於 2026 年 10 月 6 日發布由內部前沿模型產出的多項數學結果,以 GitHub 倉庫形式公開,併為其中許多證明提供 Lean 形式化驗證。倉庫同時給出 10 份模型推理摘要、以 ChatGPT Pro 用量折算的算力估算,以及嘗試題目數量的統計,平均每個結果約消耗相當於 3 小時 ChatGPT Pro 思考的算力。
量子位● 精選 10/6 03:59 AI 評分75
數學家陶哲軒在 SAIR 演講中公開呼籲模型公司放慢數學研究節奏,稱 AI 無休止加速卻對後果一無所知,並稱之為 Proof Indigestion(證明消化不良):AI 只在生成解答與 Lean 驗證上狂飆,理解、評審、寫入教科書幾乎停滯。此前他與 25 位菲爾茲獎得主聯名發表公開信,批評把數學當 benchmark 刷分。OpenAI 隨後回應,宣布在普林斯頓高等研究院設立數學與人工智慧顧問小組,但宣告寫明該小組不就數學上的內部進展提供建議。
Hacker News front page10/2 17:25 AI 評分71
Ai2 於 2026 年 10 月 2 日開源 AstaBrief 8B,一個把研究問題與檢索文獻片段轉成帶引用報告的模型,基於 Qwen3-8B 訓練,採用 SFT 加 DPO 而非強化學習。它已作為 Asta 的 Fast 模式上線,與 Claude 驅動的 Thinking 模式並列,整條流水線平均每份報告 51.1 秒,比 Thinking 模式的 178.5 秒快約 3.5 倍。
The Verge AI● 精選 10/6 19:26 AI 評分83
OpenAI 公開了由一款尚未發布的前沿模型產出的 722 篇論文手稿,稱其中解答了數百個長期懸而未決的數學問題。這批手稿覆蓋 372 個結果族,把相關論文歸入同一組,結果已預期數週才公布。新成立的獨立數學家顧問組 AGMAI 負責對外溝通這些成果。此前數學界對這些突破既感震動也存在爭議,並引發了關於研究倫理與學術規範的討論。
TechCrunch AI10/6 10:00 AI 評分30
TechCrunch Disrupt 2026 將於 10 月 13 至 15 日在舊金山 Moscone West 舉行,官方公布了全部 breakout 分論壇議程。每場分論壇 50 分鐘,專家分享後設觀眾問答,座位有限、先到先得。AI 相關議題包括 Anthropic 技術成員演示並行執行多個 Claude 智慧體、委派真實工程任務並在出錯後恢復,以及物理 AI 的定義、AI 從訓練轉向推理後的價值歸屬、可信 AI 的評估方式。
Latent Space● 精選 10/7 00:55 AI 評分90
OpenAI 在公開 GitHub 倉庫發布 722 篇數學手稿,稱其來自一個未發布的內部前沿模型。這批結果出自約 4000 道研究問題的評估,分成 372 個結果族,平均每個結果消耗約 3 小時 ChatGPT Pro 算力,發布內容含論文、證明產物與部分推理摘要,模型本身不公開。OpenAI 稱發布方式諮詢過高等研究院的數學與 AI 獨立顧問組,Sam Altman 稱之為“發現的新紀元”。
X @AIatMeta10/2 15:11 AI 評分15
Meta AI 在官方帳號發布連結,指向其研究部落格中一篇題為「共同解決開放研究問題」的文章。該帖未披露具體研究內容、模型或資料,僅引導讀者前往 research.meta.ai 閱讀全文。
X @sama10/1 15:18 AI 評分25
OpenAI CEO Sam Altman 在 2026 年 10 月 1 日發帖表示,使用者應當能夠在任何需要的地方使用自己的 AI 訂閱。該表態未說明具體產品、實施方式或時間表,也未提及是否涉及跨平台或第三方應用。
The Verge AI10/3 12:49 AI 評分47
在 Capcom Open Conference RE: 2026 上,程式設計師 Satoshi Ishida 以「REX 專案的前景與未來」為題演講,稱制作《生化危機》級別遊戲時連簡單任務都極其耗時,解決方案是把 AI 技術成功整合進開發流程。他表示為「與 AI 共同創造遊戲的未來」做準備。Capcom 此前曾稱不會使用 AI。
X @OpenAI10/6 18:19 AI 評分30
OpenAI 在官方帳號發布連結,指向官網頁面 sharing-ai-progress-in-mathematics,主題是分享數學方向上的 AI 進展。該資料本身只有這一條連結,未披露涉及的具體模型、基準成績、發布時間或使用方式,因此除官方就數學進展對外發聲這一點外,暫無更多可確認的細節。
X @GoogleDeepMind10/1 13:11 AI 評分43
Google DeepMind 發布一期播客,討論 AI 生成內容日益逼真後如何驗證內容來自人類、機器還是自然。節目介紹內容溯源的作用,並講解不可感知水印如何保護數字媒體與生物設計,時間軸涵蓋水印概念、SynthID、影像與影片、SynthID Bio 及未來韌性等章節。
X @GoogleDeepMind● 精選 10/7 10:03 AI 評分85
Google DeepMind 宣布 SynthID Detector 現已向所有人開放,可用來判斷網上內容是否由 AI 生成。該工具除 Google AI 外,還支援檢測 OpenAI、NVIDIA、Kakao 等行業夥伴工具生成的內容,Apple 即將加入。使用者可通過 synthid.com 試用。
X @sama10/6 20:06 AI 評分32
OpenAI CEO Sam Altman 在 X 發帖稱「我們正進入發現的新紀元」,並附上 OpenAI 官網一則題為 Sharing AI progress in mathematics 的頁面連結。推文字身沒有給出更多說明,未披露涉及的具體模型、數學成果或時間表,資訊集中在所連結的頁面上。發帖時間為 2026 年 10 月 7 日。
TechCrunch AI10/5 10:35 AI 評分57
獨立研究者 10 月 5 日發布初步發現,追蹤到一批並行的 AI agent,疑似執行在騰訊的基礎設施上,目標指向阿里巴巴的高德地圖服務,查詢內容為公園、動物園、醫院等公共場所不同入口的路線。研究者拒絕使用 swarm 一詞,稱應叫 agent fleet:多個 agent 執行同類任務,彼此之間沒有通訊跡象。這些活動是通過監控域名掃描服務 URLquery 的流量發現的,該服務常被 agent 用來載入無法直接訪問的網站並留下記錄;研究仍在進行中。
X @OpenAI● 精選 10/6 18:19 AI 評分83
OpenAI 宣布公開一批由其內部前沿模型產出的數學結果,範圍較廣。OpenAI 表示,發布前諮詢了高等研究院(Institute for Advanced Study)的數學與人工智慧獨立諮詢組,並參考其建議與公開推薦來決定發布方式。公告未披露模型名稱、成果數量與具體內容,僅附一個連結。
r/LocalLLaMA top of the day10/2 18:18 AI 評分26
愛爾蘭一所公立繼續教育學院的教師發帖,稱已獲得資金建成一個小型 AI 實驗室,硬體配置尚可,目標是讓學生學到使用 ChatGPT 之外的實用技能,因此向社群徵集教學方向建議。帖子未透露具體硬體型號、課程安排或學生人數。
TechCrunch AI10/7 16:48 AI 評分69
Nous Research 確認以 15 億美元估值完成 9000 萬美元 B 輪融資,由 Robot Ventures 領投,輝達、三星、Union Square Ventures、Menlo Ventures 等參投,這家成立三年的公司累計融資達 1.58 億美元。公司同時推出面向企業的 Hermes for Businesses,讓企業部署可處理多步驟工作流的定製 AI Agent,並保證資料私有安全。
TechCrunch AI10/7 10:30 AI 評分36
OpenAI 發布常駐型個人 AI agent Dots 數日後,其產品負責人 Alexander Embiricos 將於 10 月 13 至 15 日出席在舊金山 Moscone West 舉行的 TechCrunch Disrupt 2026,在 AI Stage 參與名為 What Comes After the Chatbot? 的對話。Dots 不侷限於回答提示,它擁有自己的雲端計算機,可連線人們日常使用的應用,並能在後臺持續朝某個目標推進。
r/ClaudeAI top of the day10/3 13:49 AI 評分63
一位使用者僅向 Opus 5.5 提供創意、工作資料夾和音樂檔案,模型便自主完成了從調研到成片的全流程。它檢索了四年 AI 發展資料與素材,擷取文章和介面截圖,編寫 HTML 與動畫程式碼,用 Playwright 渲染畫面、FFmpeg 合成並加入音效,最終輸出完整影片。
Hacker News front page10/7 14:08 AI 評分26
技術部落格 magicnumbers.io 於 2026 年 10 月 6 日發布題為 AI Model Groupthink 的文章,指向 AI 模型的群體思維/趨同現象。該文被提交到 Hacker News 後,截至收錄時獲得 9 分、1 條評論。條目本身只提供標題與連結,沒有正文摘要、作者結論或涉及的具體模型資訊。
Hacker News front page10/4 13:21 AI 評分47
ML4Good 與 EquiStamp 於 2026 年 9 月在英國東薩塞克斯舉辦了首屆歐洲前沿 AI 與法律研討會,為期五天,面向來自 12 個司法管轄區的 19 名資深法律、治理與風險專業人士。課程覆蓋從訓練、評估到 agent 與防護措施的前沿 AI 全流程,並對應採購、風險評估及供應商安全宣告失效等實際工作場景。參與者包括律所與內部律師、隱私合規人員、風險與金融顧問、法律學者及司法和公共部門代表。