搜尋 關鍵字 語意 依意思最接近的 9 筆
llama.cpp releases● 精選 10/3 01:28 AI 評分68
llama.cpp 合併 PR #29570,在 Metal 後端為 F16 KV 快取加入基於張量 API 的 flash attention 核心。該核心覆蓋 DK=DV=512、DK=576/DV=512、DK=192/DV=128 等配置,並支援 attention sinks、ALiBi 與 logit softcap。改動隨 b11362 建置發布,覆蓋 macOS Apple Silicon、iOS 及 Linux、Windows、Android 等多平台建置。
llama.cpp releases10/5 05:35 AI 評分37
llama.cpp 發布 b11402 版本,CUDA 後端改為優先採用整塊(whole-tile)FlashAttention 排程,以提升兩階段核心效率。
r/LocalLLaMA top of the day10/2 18:47 AI 評分68
Percepta 公布新架構 Spotlight,用可讀寫記憶取代注意力機制,宣稱是首個實現記憶無限增長而不增加訪問成本的架構。每個 token 只讀寫少量記憶單元,稀疏度可任意調節,不像 MoE 那樣固定啟用比例。該架構把負責計算的智慧模組與存放知識、流程和狀態的記憶分離,模型權重不隨記憶增長而改變,可自行決定載入與覆寫,從而無需重訓練即可獲得新能力。
Hacker News front page10/3 10:13 AI 評分58
Google 將停止 Gemini Flash 和 Pro 模型的免費使用,使用者需付費訂閱才能繼續使用。此舉在 r/GeminiAI 社群引發大量討論,使用者對 Flash 被納入付費範圍尤為不滿,認為 Flash-Lite 能力不足。部分使用者表示將轉向 ChatGPT、Claude 或 DeepSeek 等替代方案。
量子位● 精選 10/5 05:42 AI 評分86
Hinton、Bengio 等 22 位作者聯合發表首篇 RSI(遞迴自我改進)論文《What if automating AI R&D triggers an intelligence explosion?》。論文引用 Anthropic 內部資料:AI 生成獲批程式碼佔比從 2025 年 1 月的低個位數升至 2026 年 5 月的超 80%,Claude 在高層監督下自主完成的 AI 研發工作比例從 2026 年 3 月的約 1% 升到 8 月的 26%。
llama.cpp releases10/5 12:46 AI 評分36
llama.cpp 發布建置 b11414,本版列出的程式碼改動是 Vulkan 後端修復 prealloc_y 在 flash attention 與 soft_max 之間複用時殘留舊資料的問題(PR #29591),提交標註 Assisted-by: Claude。
Hacker News front page10/4 09:41 AI 評分35
Stripe 設計負責人 Katie Dill 在 2026 年 9 月 10 日舊金山 Lenny and Friends Summit 的演講中提出,AI 讓建置產品更容易,但產品容易淪為通用的殭屍 UI。她認為好設計仍取決於清晰的觀點、對使用者的理解和對細節的用心,並分享瞭如何把標準寫進 AI 工具、在初稿之外繼續編輯、用 AI 做出更原創的產品。該影片由 Lenny's Podcast 於 9 月 25 日發布,時長 21 分 47 秒。
X @awnihannun10/2 16:10 AI 評分12
Apple 研究員 awnihannun 在社交平台發布一首短詩,稱因「未來會 foom」而上調自己的 P(doom),即 AI 導致人類滅絕的主觀機率。詩中還提到中文房間、shoggoth 與死神之眼等 AI 圈內梗,未給出具體數值或論證。
Hacker News front page● 精選 10/5 13:56 AI 評分80
OpenAI CEO Sam Altman 在 Politico 播客採訪中表示,世界應接受 AI 帶來的一些壞事,以換取技術的好處,並主張輕觸式監管。他提到的例子包括駭客攻擊、詐騙等,並稱不會接受「零重大駭客攻擊、零濫用」這樣的交易。此番言論引發佛州州長 Ron DeSantis 與紐約大學教授 Gary Marcus 批評;