搜尋
找到 4 筆
llama.cpp releases● 精選10/2 14:11AI 評分60
llama.cpp 構建 b11345 為 Hexagon NPU 後端新增 q2_k 和 q3_k 量化型別支援(#29717),並統一了 src1_row_size 的分配。該版本產物覆蓋 macOS Apple Silicon、Linux、Android、Windows 等平台,其中 macOS Apple Silicon 的 KleidiAI 版本為 DISABLED。
MLX releases● 精選8/25 11:58AI 評分70
MLX v0.32.2 發布:NAX 裝置新增 head_dim 256 的融合全注意力路徑,量化 MOE matmul 跳過多餘的 simdgroup 計算。同時修復 divmod 浮點商截斷、median 丟棄 NaN、量化切片陣列等問題,並限制 GGUF 後設資料讀取邊界。
MLX releases● 精選9/29 01:37AI 評分70
MLX 發布 v0.32.3,以 bug 修復和 Metal/CUDA 核心最佳化為主。新增 M5 Ultra 非量化 matmul 調優與 Metal gated delta net 核心,並改善 SDPA D256/D512 的 Metal 視訊記憶體佔用。同時修復整數除零崩潰、GGUF 張量維度校驗等問題。
MLX LM releases● 精選4/7 23:15AI 評分75
MLX 發布 v0.31.2,帶來 Gemma 4 支援(含 tool call parser 與量化逐層載入修復)和 Nemotron-H 支援。此版本還加入不可裁剪快取的系統提示與使用者訊息快取,並重構了批次生成。