v0.31.0 發布:新增 JoyAI LLM Flash 與 Qwen 3.5 張量並行
v0.31.0 發布,從 v0.30.7 升級而來,新增 JoyAI LLM Flash 模型支援,併為 Qwen 3.5 加入張量並行;同時允許共享模型,修復 CacheList 儲存與載入、MLA 模型混合量化判斷、Qwen3.5 轉 fp32 與 sanitize、MiniMax M2.5 分片 RMS norm。
你正用 coding agent 並準備買 Mac Studio 本地跑開源模型,這次更新涉及 Qwen 3.5、MiniMax M2.5、快取與記憶體最佳化,適合升級測試本地推理效能。
原標題:v0.31.0
閱讀原文
| 評分 | 78 / 78(平均 78,門檻 60) |
|---|---|
| 狀態 | 精選(舊聞,已歸檔) |