AISpot

搜尋

找到 1 筆;也可以試試 語意搜尋

llama.cpp releases10/5 14:09AI 評分33

b11422: cuda: use the vector lightning indexer kernel on MUSA (#29990)

llama.cpp 合併 PR #29990,在 MUSA 後端改用向量版 lightning indexer kernel。原因是 MUSA 架構 21 與 22 的靜態共享記憶體上限為 28 KB,而 tile kernel 需要 33 KB,所以 tile kernel 不用於 MUSA;CUDA 與 ROCm 仍執行合併後的原 kernel,沒有變化。