AISpot

搜尋

依意思最接近的 6 筆

r/LocalLLaMA top of the day10/3 19:24AI 評分65

專精推理引擎興起,放棄通用性換極致效能

一批極窄用途的推理執行時正在出現,包括 Strata、ninfer、DwarfStar、Splash、llamAmpere、gufo 等。它們刻意放棄 llama.cpp 和 vLLM 擅長的通用性,只針對少數模型、有時甚至只針對一個硬體家族(如 Strix Halo)做最佳化。作者認為未來通用執行時負責相容性、一次性專精執行時負責最大效能將成為常態,這也有助於智慧的民主化與去中心化,並壓榨現有硬體的更多產出。

The Verge AI10/3 17:49AI 評分38

Capcom 稱將把 AI 整合進遊戲開發流程

Capcom 在 RE: 2026 開放會議上表示,正為“與 AI 共同製作遊戲的未來”做準備,計劃把 AI 技術整合進開發工作流。程式設計師 Satoshi Ishida 在演講中稱,製作《生化危機》這一量級的遊戲時,連簡單任務都極其耗時,AI 是應對方案。但 Capcom 此前曾表示不會使用 AI。

X @awnihannun10/2 16:10AI 評分5

@awnihannun: I'm upping my P(doom) 'cause the future goes foom

Apple 研究員 awnihannun 在 2026 年 10 月 2 日發帖稱自己上調了 P(doom),即對 AI 帶來災難性後果的主觀機率估計,理由是“未來會 foom”,即智慧爆炸式增長。帖子以四行押韻短詩寫成,還提到中文房間、shoggoth 與死神之眼等 AI 圈梗,但沒有給出具體數字、時間表或技術依據。

r/LocalLLaMA top of the day10/3 02:33AI 評分30

MegaCapybara 發布:RTX5090 上跑 Qwen3.8 27B 的推理引擎

MegaCapybara 是專為 RTX5090 打造的推理引擎,聚焦 Qwen3.8 27B,解碼速度約為此前 SOTA 引擎 Ninfer 的兩倍:單路編碼可達 500+ t/s,12 個 agent 併發、800k 上下文時可達 2000+ t/s。它自帶權重格式與後設資料,載入前會展示各量化設定相對 BF16 的 KL 與 top-1% 損失,並支援智慧 VRAM-RAM-DISC 快取、Loop Guard 與圖形介面。採用 MIT 許可,原始碼與權重建置器稍後發布。