MLX LM releases● 精選4/7 23:15AI 評分75
MLX 發布 v0.31.2,新增 Gemma 4 與 Nemotron-H 支援
MLX 發布 v0.31.2,帶來 Gemma 4 支援(含 tool call parser 與量化逐層載入修復)和 Nemotron-H 支援。此版本還加入不可裁剪快取的系統提示與使用者訊息快取,並重構了批次生成。
找到 5 筆
MLX 發布 v0.31.2,帶來 Gemma 4 支援(含 tool call parser 與量化逐層載入修復)和 Nemotron-H 支援。此版本還加入不可裁剪快取的系統提示與使用者訊息快取,並重構了批次生成。
Google Antigravity SDK 現可通過 LiteRT 在本地離線執行 Gemma 4 26B A4B 等模型。它同時支援 Ollama、vLLM 等 OpenAI 相容推理服務,可讓雲端模型做規劃,本地模型在裝置上處理程式碼審計與修補。
Meta 推出 30B 開源模型 Muse Glimmer,Apache 2.0 許可,今日起可在 LM Studio Bionic 下載並本地執行,支援工具呼叫和影像輸入。在該平台 BionicBench v0.1 評測中,它完成 83.3% 的任務,高於 Gemma 4 31B 和 Qwen 3.6 27B 的 77.7%。
MLX 發布 v0.31.3,以大量 bugfix 為主,並新增配合 MLX v0.31.2 的執行緒區域性生成流。修掉了 BatchKVCache、BatchRotatingKVCache 與 ArraysCache 的 extend() 批次維度不匹配,以及 server 並行呼叫、MiniMax M2 並行工具呼叫、Gemma 4 工具解析等問題。
v0.34.4 已發布。思考模型的結構化輸出改為單次通過,更快更可靠,並修復本地大模型庫間歇性報 model not found 及 macOS 應用檢查 ChatGPT、Codex 時卡死的問題。Qwen 3.8 在 Apple Silicon 上提示處理更快,Gemma 4 會按圖選最佳解析度以保留更多細節。