MLX LM releases● 精選3/7 03:59AI 評分78
v0.31.0 發布:新增 JoyAI LLM Flash 與 Qwen 3.5 張量並行
v0.31.0 發布,從 v0.30.7 升級而來,新增 JoyAI LLM Flash 模型支援,併為 Qwen 3.5 加入張量並行;同時允許共享模型,修復 CacheList 儲存與載入、MLA 模型混合量化判斷、Qwen3.5 轉 fp32 與 sanitize、MiniMax M2.5 分片 RMS norm。
找到 2 筆
v0.31.0 發布,從 v0.30.7 升級而來,新增 JoyAI LLM Flash 模型支援,併為 Qwen 3.5 加入張量並行;同時允許共享模型,修復 CacheList 儲存與載入、MLA 模型混合量化判斷、Qwen3.5 轉 fp32 與 sanitize、MiniMax M2.5 分片 RMS norm。
MLX 在 2026-04-22 發布補丁版 v0.31.3,以大量 bug 修復為主,並新增執行緒本地生成流(thread local generation stream),配合 MLX v0.31.2。修復覆蓋 BatchKVCache、BatchRotatingKVCache 與 ArraysCache 的 batch 維度不匹配,以及服務端並行工具呼叫、MiniMax M2 並行工具呼叫和 Mistral 空 tool_call_end 導致的工具呼叫中斷。