llama.cpp releases10/3 16:54AI 評分53
llama.cpp 修復 server 崩潰:限制 n_batch 不超過 n_ubatch
llama.cpp 合併 PR #29903,通過把 n_batch 限制在 n_ubatch 以內,修復了 server 的 laya abort 崩潰(#29902)。該修復由 Claude 輔助完成,並移除了相關測試與 embeddings 條件。
找到 2 筆;也可以試試 語意搜尋
llama.cpp 合併 PR #29903,通過把 n_batch 限制在 n_ubatch 以內,修復了 server 的 laya abort 崩潰(#29902)。該修復由 Claude 輔助完成,並移除了相關測試與 embeddings 條件。
llama.cpp 合併 PR #27096,修復 ggml-cpu 中 GGML_OP_SOFT_MAX_BACK 在 dst 與 src1(y)別名時輸出靜默錯誤的問題。原因是原實現先覆蓋 y 再讀取,改為單次融合迴圈先讀兩個源再寫,並新增迴歸測試強制觸發該別名。CUDA 核心因先完成歸約再寫入,不受影響。