llama.cpp 新增 Prism Bonsai 2 27B 執行時支援
llama.cpp 建置版本 b11556 新增對 Prism Bonsai 2 27B 的執行時支援,改動以 PR #29600 合入,共同署名者包括專案作者 Georgi Gerganov。該 PR 還包含把 Hadamard 張量移入方法、定義摺疊權重、修復 load_* Hadamard 載入,以及轉換器介面整理和程式碼清理,其中多處提交標註由 Claude Code 協助完成。
llama.cpp 新增對 Prism Bonsai 2 27B 的執行時支援,並同步修復 Hadamard 權重載入與轉換流程,對在本地用 llama.cpp 跑新模型的人最直接。
原標題:b11556
閱讀原文
| 評分 | 60 / 65(平均 62,門檻 60) |
|---|---|
| 狀態 | 精選 |
全文翻譯
由 AI 翻譯,以原文為準。
原文
相關報導
llama.cpp 發布 b11392 建置,CI 預設權限調整
llama.cpp 發布 b11392 版本,主要變更是 CI 設定預設權限(#29945)。該版本提供覆蓋 macOS、iOS、Linux、Android、Windows 與 openEuler 的預編譯產物,包括 Apple Silicon arm64、CUDA 12/13、ROCm 10.0、Vulkan、OpenVINO、SYCL 等後端;
llama.cpp 發布 b11396 版本,Windows LLVM 建置需 Ninja 多配置
llama.cpp 發布 b11396 版本,主要變更是 Windows 平台的 LLVM 建置需要 Ninja 多配置(#29959)。該版本提供覆蓋 macOS、Linux、Windows、Android 和 openEuler 的預編譯產物,包括 Apple Silicon、CUDA 12/13、ROCm 10.0、Vulkan、SYCL、OpenVINO 等後端,其中 macOS Apple Silicon 的 KleidiAI 啟用版和 openEuler 被標記為…
llama.cpp 發布 b11384 版本,覆蓋多平台預編譯包
llama.cpp 發布 b11384 版本,官網為 llama.app,並附 GitHub 建置證明。該版本提供 macOS、iOS、Linux、Android、Windows 及 openEuler 的預編譯包,涵蓋 Apple Silicon、CUDA 12/13、ROCm 10.0、Vulkan、SYCL、OpenVINO 與 Snapdragon 的 CPU、Adreno GPU、Hexagon NPU 等後端。
llama.cpp 新增 nimble 決策模型支援
llama.cpp 發布 b11364 版本,新增對 nimble 決策模型的支援(PR #29844)。該版本覆蓋 macOS、iOS、Linux、Android、Windows 與 openEuler 平台,提供 CPU、CUDA 12/13、Vulkan、ROCm 10.0、OpenVINO、SYCL、Snapdragon 的 Adreno GPU 與 Hexagon NPU 等後端建置;
llama.cpp 發布 b11461,修復 AMD 核顯 Vulkan 檢查點讀取慢
llama.cpp 發布 b11461,主要改動是修復 AMD 整合顯示卡在 Vulkan 後端下檢查點(checkpoint)讀取過慢的問題,對應 PR #30049。該版本同時更新了 macOS/iOS、Linux、Android、Windows、openEuler 的預編譯包,覆蓋 Vulkan、CUDA 12/13、ROCm 10.0、OpenVINO、SYCL,以及 Snapdragon 的 CPU、Adreno GPU 與 Hexagon NPU 後端。