兩個 ARM64 專用編譯器最佳化 bug 同時擊中 curl
curl 作者 Daniel Stenberg 在 Mastodon 上報告,curl 遇到兩個 ARM64 專用的編譯器最佳化 bug,分別來自 GCC 15/16 和 Rust。問題只在 ARM64 平台由編譯器最佳化觸發,訊息以連結形式發布,Hacker News 上的討論帖目前還沒有評論,尚未給出影響範圍與修復進展。
原標題:Two ARM64-specific compiler optimization bugs, in GCC 15/16 and Rust, hit curl
閱讀原文
| 評分 | 45 / 35(平均 40,門檻 76) |
|---|---|
| 狀態 | 未入選 |
相關報導
llama.cpp 發布 b11451,修復 Adreno xmem GEMM 越界讀取
llama.cpp 發布 b11451 建置,主要變更是修復 OpenCL 後端在 Adreno GPU 上 xmem GEMM 的越界讀取(OOB read)問題,對應 PR #30041。
llama.cpp 發布 b11390,修復 CUDA MMQ 記憶體錯誤
llama.cpp 發布建置版本 b11390,主要修復了 CUDA 後端在 n_expert 遠大於 n_ubatch 時的 MMQ 記憶體故障(#29941)。
llama.cpp 修復 Vulkan 後端 RDNA4 矩陣向量調優
llama.cpp 發布 b11389 版本,修復了 Vulkan 後端在 RDNA4 架構上的矩陣向量運算調優問題(PR #29934)。該版本繼續提供覆蓋 macOS、Linux、Windows、Android 等平台的預編譯二進位制,包括 Vulkan、CUDA、ROCm、SYCL 等後端,其中 macOS Apple Silicon 的 KleidiAI 啟用版和 openEuler 建置被停用。
llama.cpp 發布 b11384 版本,覆蓋多平台預編譯包
llama.cpp 發布 b11384 版本,官網為 llama.app,並附 GitHub 建置證明。該版本提供 macOS、iOS、Linux、Android、Windows 及 openEuler 的預編譯包,涵蓋 Apple Silicon、CUDA 12/13、ROCm 10.0、Vulkan、SYCL、OpenVINO 與 Snapdragon 的 CPU、Adreno GPU、Hexagon NPU 等後端。
llama.cpp 版本號升至 0.6.0,多平台建置產物同步更新
llama.cpp 將版本號提升到 0.6.0(PR #29997),並更新了 scripts 的 summary prompt。隨版本給出的建置產物覆蓋 macOS(Apple Silicon arm64、Intel x64)、iOS XCFramework、Linux(Ubuntu x64/arm64/s390x,含 CUDA 12、CUDA 13、ROCm 10.0、Vulkan、OpenVINO、SYCL)、Android arm64、Windows(x64/arm6…