搜尋
依意思最接近的 4 筆
r/LocalLLaMA top of the day10/3 08:08AI 評分12
一位使用者為給 Qwen3.8 27B 搭建 RAG 搜尋節點,在 AliExpress 買了一臺標稱 Intel N150 的迷你主機,收到的卻是 2018 年的 Core i3-7020U(2 核 4 執行緒)加 DDR3 1600MHz 記憶體。賣家把 New_N150 寫進 BIOS 版本字串(HSHW_M6_DDR3_EC_Intel_Com_New_N150_K001)來偽裝型號,導致系統識別為假規格,連索引文字檔案都吃力,更別說跑向量檢索。該使用者已發起信用卡拒付。
r/LocalLLaMA top of the day10/3 02:58AI 評分32
r/LocalLLaMA 使用者 pmarsh 發帖稱自己已接近本地推理硬體投入的中間水平,評論區隨即給出多種低成本方案:2014 至 2018 年的 2 至 4 路 DDR3 CPU 伺服器可跑 qwen 3.8 flash 超 15 tok/s;雙 7900XTX 不到 2000 美元可跑 27B Q8 超 220k 上下文;CMP 170HX 視訊記憶體超頻可達 2TB/s,單流解碼約 60 tok/s。
The Verge AI10/2 22:08AI 評分46
Meta 開源了讓使用者自己動手製作 Muse 硬體裝置的程式碼,這些裝置執行 Meta 新的 AI 智慧體 Muse。官方稱可用現成的 ESP32 開發板,或用 Raspberry Pi 搭配其 SDK,再連線螢幕、按鈕、感測器、執行器等外設。Meta 舉例的玩法包括:用彩色電子墨水屏顯示提醒、把 Muse 裝進 HDMI 棒投到大屏、或裝在小觸屏上做出類似 DIY Muse Charm 的裝置。
NVIDIA blog10/1 14:00AI 評分22
NVIDIA 提出衡量 AI 工廠投資回報的三個變數:產能(每兆瓦吞吐與每 token 成本)、使用壽命和需求。它援引 SemiAnalysis AgentX 資料稱,Vera Rubin NVL72 每兆瓦吞吐量比 GB300 NVL72 高 30 倍以上,在 DeepSeek V4 Pro 上每百萬 token 成本最多低 45 倍;每兆瓦 AI 工廠造價約 6000 萬美元。