llama.cpp 更新 cpp-httplib 至 0.59.0
llama.cpp 發布 b11380 版本,將依賴庫 cpp-httplib 升級到 0.59.0。該版本繼續為 macOS Apple Silicon(arm64)、Linux、Windows、Android 等平台提供預編譯建置,其中 macOS Apple Silicon 的 KleidiAI 加速版本被標記為 DISABLED。
原標題:b11380
閱讀原文
| 評分 | 68 / 20(平均 44,門檻 60) |
|---|---|
| 狀態 | 未入選 |
原文
相關報導
llama.cpp 新增 nimble 決策模型支援
llama.cpp 合併 PR #29844,新增對 nimble 決策模型的支援。該版本覆蓋 macOS Apple Silicon(arm64)、Ubuntu、Windows、Android 等多平台建置,其中 macOS Apple Silicon 的 KleidiAI 加速版本被標記為 DISABLED。官方發布頁為 llama.app,建置證明見 GitHub attestations。
llama.cpp 新增 /v1/systemone API,支援 laya 等 5 個模型
llama.cpp 發布 b11361,在 server 中新增 /v1/systemone API,支援 laya、julia-1、lev、openjev、kev 五個模型,並附帶模型轉換指令碼。該版本加入了共享 prompt 字首與視覺輸入支援,新增用於測試的小模型 openjev tiny,文件中明確說明不支援 date_facts。macOS Apple Silicon(arm64)建置正常,但啟用 KleidiAI 的 arm64 版本被標記為 DISABLED;
llama.cpp 新增 common_is_tty() 並修復 Windows 棄用警告
llama.cpp 合併 PR #29860,新增 common_is_tty() 輔助函式並修復 Windows 上的棄用警告,作者為 Hugging Face 的 Adrien Gallouët。該提交同時更新了各平台預編譯產物,macOS Apple Silicon(arm64)正常提供,但啟用 KleidiAI 的 arm64 版本被標記為 DISABLED,openEuler 也處於 DISABLED 狀態。
llama.cpp b11352 最佳化 qwen4exp 掩碼建置
llama.cpp 發布 b11352 版本,主要改動是最佳化 qwen4exp 的掩碼(mask)建置(#29824),並將同一改動應用到 GLM5-next。該版本繼續提供 macOS Apple Silicon(arm64)、iOS、Linux、Windows、Android 等平台建置,涵蓋 CUDA 12/13、Vulkan、ROCm 10.0、OpenVINO、SYCL 與 Snapdragon 後端。
llama.cpp 新增 clef 決策模型支援(純文字)
llama.cpp 合併 PR #29831,為 clef 決策模型加入純文字推理支援,並更新 gguf-py 常量。該版本覆蓋 macOS Apple Silicon、Linux、Windows、Android 等平台,其中 Apple Silicon 的 KleidiAI 加速建置被停用。