llama.cpp releases10/5 14:09AI 評分33
b11422: cuda: use the vector lightning indexer kernel on MUSA (#29990)
llama.cpp 合併 PR #29990,在 MUSA 後端改用向量版 lightning indexer kernel。原因是 MUSA 架構 21 與 22 的靜態共享記憶體上限為 28 KB,而 tile kernel 需要 33 KB,所以 tile kernel 不用於 MUSA;CUDA 與 ROCm 仍執行合併後的原 kernel,沒有變化。