Meta 發布 30B 開源模型 Muse Glimmer,LM Studio 可本地執行
Meta 推出 30B 開源模型 Muse Glimmer,Apache 2.0 許可,今日起可在 LM Studio Bionic 下載並本地執行,支援工具呼叫和影像輸入。在該平台 BionicBench v0.1 評測中,它完成 83.3% 的任務,高於 Gemma 4 31B 和 Qwen 3.6 27B 的 77.7%。
找到 5 筆
Meta 推出 30B 開源模型 Muse Glimmer,Apache 2.0 許可,今日起可在 LM Studio Bionic 下載並本地執行,支援工具呼叫和影像輸入。在該平台 BionicBench v0.1 評測中,它完成 83.3% 的任務,高於 Gemma 4 31B 和 Qwen 3.6 27B 的 77.7%。
Bionic 現在能讀取和檢索過去的會話記錄,並可在輸入框用 @ 直接引用其他會話,跨專案同樣適用。這套名為 Introspection 的工具讓 agent 在被壓縮的長會話中找回此前丟失的細節,讀取自身轉錄無需批准,讀取其他會話需授權。
Inco AI 開源了面向 Apple Silicon 的推理引擎 Splash,專門最佳化 Qwen3.6-35B-A3B 與 Qwen3.8-27B。在 48 GB M5 Pro 上,Qwen3.8-27B 短提示解碼 74 tokens/s、32K 上下文 54 tokens/s,約為實測次快引擎的 2 倍,四路併發合計 170 tokens/s。
Kimi K2.6 已開源,可通過 Kimi.ai、Kimi App、API 與 Kimi Code 使用。它在長程編碼任務上明顯優於 K2.5:在 Mac 上本地部署 Qwen3.5-0.8B 並用 Zig 重寫推理,經 12 小時、4000+ 次工具呼叫後吞吐從約 15 提升到約 193 tokens/秒,比 LM Studio 快約 20%。
v0.34.4 已發布。思考模型的結構化輸出改為單次通過,更快更可靠,並修復本地大模型庫間歇性報 model not found 及 macOS 應用檢查 ChatGPT、Codex 時卡死的問題。Qwen 3.8 在 Apple Silicon 上提示處理更快,Gemma 4 會按圖選最佳解析度以保留更多細節。