llama.cpp b11352 最佳化 qwen4exp 掩碼構建
llama.cpp 發布 b11352 版本,主要改動是最佳化 qwen4exp 的掩碼(mask)構建(#29824),並將同一改動應用到 GLM5-next。該版本繼續提供 macOS Apple Silicon(arm64)、iOS、Linux、Windows、Android 等平台構建,涵蓋 CUDA 12/13、Vulkan、ROCm 10.0、OpenVINO、SYCL 與 Snapdragon 後端。
你正打算用 Mac Studio 本地跑開源模型,這版仍提供 Apple Silicon arm64 構建,但 KleidiAI 加速版被停用,升級前需留意效能差異。
原標題:b11352
閱讀原文
| 評分 | 65 / 65(平均 65,門檻 60) |
|---|---|
| 狀態 | 精選 |