MLX releases● 精選8/25 11:58AI 評分70
v0.32.2
MLX v0.32.2 發布:NAX 裝置新增 head_dim 256 的融合全注意力路徑,量化 MOE matmul 跳過多餘的 simdgroup 計算。同時修復 divmod 浮點商截斷、median 丟棄 NaN、量化切片陣列等問題,並限制 GGUF 後設資料讀取邊界。
找到 2 筆
MLX v0.32.2 發布:NAX 裝置新增 head_dim 256 的融合全注意力路徑,量化 MOE matmul 跳過多餘的 simdgroup 計算。同時修復 divmod 浮點商截斷、median 丟棄 NaN、量化切片陣列等問題,並限制 GGUF 後設資料讀取邊界。
MLX 發布 v0.32.1,以 Metal、CUDA 的修復和效能改進為主,並補齊大量 API 文件。新增統一記憶體零複製匯入 mx.array(host_buffer, copy=False)、Metal gemv_wide 小行數 fp16/bf16 矩陣乘,以及 Metal full attention 的 head dimension 96 支援。