搜尋 關鍵字 語意 依意思最接近的 15 筆
量子位● 精選 10/5 05:42 AI 評分86
Hinton、Bengio 等 22 位作者聯合發表首篇 RSI(遞迴自我改進)論文《What if automating AI R&D triggers an intelligence explosion?》。論文引用 Anthropic 內部資料:AI 生成獲批程式碼佔比從 2025 年 1 月的低個位數升至 2026 年 5 月的超 80%,Claude 在高層監督下自主完成的 AI 研發工作比例從 2026 年 3 月的約 1% 升到 8 月的 26%。
TechCrunch AI10/5 13:00 AI 評分64
Safeworld 結束隱身,宣布超 1200 萬美元種子輪,由 Shine Capital 與 a16z Speedrun 領投,Box Group、CMU Endowment、Innovation Endeavors、SV Angel 參投。
Hugging Face blog10/2 05:01 AI 評分58
ServiceNow CoreAI 團隊發布 AutoSynthData,用目標模型的失敗案例和更強教師模型的成功軌跡定位能力缺口,再自動生成並驗證新任務用於後訓練。任務由系統規範、使用者提示和驗證器三部分組成,需滿足可行性、真實性與難度要求,驗證器則要求一致、可靠且不繫結單一參考軌跡。團隊在 EnterpriseOps Gym 資料集上演示了該流程,模型提升後課程會轉向仍難完成的任務。
X @sama10/1 20:18 AI 評分25
OpenAI CEO Sam Altman 在 2026 年 10 月 1 日發帖表示,使用者應當能夠在任何需要的地方使用自己的 AI 訂閱。該表態未說明具體產品、實施方式或時間表,也未提及是否涉及跨平台或第三方應用。
Hacker News front page10/7 09:00 AI 評分45
在 Criteo 任職的初級工程師 Elise Baturone 認為,AI 不會讓軟體工程師消失,真正的風險是資深工程師消失、所有人永遠停在 Junior 階段。她把自己的 agent 調教成導師,用蘇格拉底式提問做理解檢查,並把「提問」和「review」當成需要自己練的技能:追問 agent 解釋設計選擇、引用來源、論證可疑方案,常能讓它自己發現錯誤。她承認這更費 token,但先弄懂再上線更省事;
X @sama10/3 15:18 AI 評分30
OpenAI CEO Sam Altman 在 2026 年 10 月 3 日發帖表示,人們對 AI 模型賦予宗教式力量或放棄人類判斷力的做法令他非常不安,並認為這是一個真實的安全問題。該表態未點名具體模型或產品,也未給出應對措施。
Hacker News front page10/2 22:06 AI 評分35
Shrivu Shankar 在 8 月 24 日的文章中提出,每家 SaaS 公司最終都會變成圍繞模型搭建的 harness,即包裹無狀態 LLM 的基礎設施、介面、上下文與狀態。他給出五階段演進路徑:傳統 SaaS、工程師與 agent 結對、個人執行 harness、個人編排 harness、harness 編排個人,屆時核心任務由 agent 完成,人類只負責提供品味與判斷。
TechCrunch AI10/2 22:09 AI 評分71
Napster 聯合創始人 Sean Parker 正把 Stability AI 重塑為面向音樂專業人士的 AI 工具公司。兩年前他參與 8000 萬美元救助這家瀕臨崩潰的影像生成初創公司,如今與 CEO Prem Akkaraju 公布新方向。8 月底公司宣布獲得 7600 萬美元融資,投資方包括索尼、華納和環球,三家還授權曲庫用於訓練。
The Verge AI10/3 16:00 AI 評分23
Splice CEO Kakul Srivastava 認為 AI 生成的郵件正在扼殺對話。她曾任職於 Flickr、Yahoo、GitHub 和 Adobe,目前執掌為音樂製作人提供取樣素材的 Splice,該平台的取樣曾出現在 Lisa 的《Money》和 Sabrina Carpenter 的《Espresso》等熱門歌曲中。她還主導了 Splice 收購 Spitfire Audio 並推動平台向新領域拓展。
NVIDIA blog10/5 14:00 AI 評分47
輝達 Inception 計劃的多家初創公司正用 AI 補乳腺癌篩查、風險評估與治療規劃的缺口。iSono Health 的 FDA 許可 ATUSA 可穿戴自動 3D 超聲每側乳房約 2 分鐘完成成像,傳統手持超聲最長需 45 分鐘,其敏感度稱高出 28%,已在加州、德州等地診所商用,並啟動 3200 人臨床研究。Whiterabbit.ai 的 FDA 許可 WRDensity 軟體自動評估乳腺密度,已用於數十萬患者;
The Verge AI10/3 17:49 AI 評分47
在 Capcom Open Conference RE: 2026 上,程式設計師 Satoshi Ishida 以「REX 專案的前景與未來」為題演講,稱制作《生化危機》級別遊戲時連簡單任務都極其耗時,解決方案是把 AI 技術成功整合進開發流程。他表示為「與 AI 共同創造遊戲的未來」做準備。Capcom 此前曾稱不會使用 AI。
The Verge AI10/5 15:30 AI 評分59
加州民主黨參議員 Adam Schiff 在 Decoder 播客中稱,白宮讓多家 AI 公司簽署的自願安全承諾遠遠不夠,他支援設立新的專門機構來監管 AI。他提到,這些公司私下都公開呼籲監管,只是在總統面前不願得罪人;最高法院推翻 Chevron 先例後,法院取代機構專家解釋模糊法律,新規很容易立刻陷入訴訟。
Hacker News front page10/4 16:29 AI 評分35
Jagex 已下架《Dragon Slayer 2》預告片並緊急調查,因片中角色出現六根手指等生成式 AI 痕跡。該預告片由外部合作方製作,對方曾明確確認不會使用 GenAI。Jagex 表示不會用 GenAI 製作遊戲、美術或創意素材,也不會知情允許他人代做,並將在 RuneFest 後整改稽核流程,同時與社群創作者合作重製該預告。
機器之心● 精選 10/6 12:53 AI 評分76
Google 等提出 RRSI,用正則化約束 Agent Harness 的遞迴自我改進(RSI):不鎖死自我修改能力,而是限制每輪同時修改的機制數量、保留進化歷史,並在篩選階段剔除 benchmark-specific 改動和落在噪聲範圍內的漲分。
TechCrunch AI10/5 17:43 AI 評分67
HackerRank 的 AI 面試 agent Chakra 結束約六個月 beta,週一起正式向企業客戶開放,測試期間已完成逾 50 萬場面試,Snowflake、Snorkel、Capgemini 等公司參與試用。候選人要在帶 AI 助手的畫布上處理真實程式碼倉庫任務,Chakra 會依據其操作追問思路,評估批判性思維、判斷力與「AI fluency」,即如何向 AI 描述問題、判斷其輸出並引匯出解法。