Ollama 支援作為閘道器接入 Claude Desktop
Ollama 現在可作為第三方閘道器接入 Claude Desktop,開發者在 Ollama 中開啟 Claude 開關即可自動完成配置。連線後可選任意 Ollama 模型,包括本地執行的開放模型與 Ollama 雲端模型,也能隨時切回 Anthropic 模型;在 Ollama 裡關閉 Claude 即恢復原有設定。
所有通過初篩的資料,依發布時間排序,時間為倫敦時間。有橘色圓點的是精選。
Ollama 現在可作為第三方閘道器接入 Claude Desktop,開發者在 Ollama 中開啟 Claude 開關即可自動完成配置。連線後可選任意 Ollama 模型,包括本地執行的開放模型與 Ollama 雲端模型,也能隨時切回 Anthropic 模型;在 Ollama 裡關閉 Claude 即恢復原有設定。
OpenRouter 在 2026 年 8 月 21 日推出 Visual Image Benchmarks,可對比它提供的全部 39 個影像模型(截至 2026 年 8 月)。提示詞分七類:不可能場景、計數、文字、空間關係、否定、編輯、一致性,例如把酒杯倒滿至杯沿、沒有條紋的斑馬。結果以網格展示,可按價格和生成時間排序,提示詞設計成肉眼就能判斷優劣。評測後還能通過 OpenRouter 的影像生成 API 或 Chat 用自己的提示詞試模型,官方稱影片與音訊基準也將推出。
Apple 的 MLX 框架發布 v0.32.1,集中修復 Metal 與 CUDA 後端的推理、量化與文件問題,並加入多項效能最佳化。Metal 側新增 gemv_wide 加速 fp16/bf16 少行矩陣乘,全注意力支援 head dimension 96,統一記憶體上可用 mx.array(host_buffer, copy=False) 零複製匯入。
LM Studio 的 Bionic 現已支援按 Agent Skills 標準(SKILL.md 檔案)使用、安裝和建立技能。在對話裡輸入 @ 可調出技能選擇器,Bionic 會讀取技能檔案再決定如何執行;也可以給一個網址讓它安裝,或把現成的 SKILL.md 放進 Settings > Skills。它還能複用你在 Codex、Claude Code 等應用裡已有的技能,在 Settings > Skills > Skills from other apps 中逐條開關。
NVIDIA 的 30B 總引數(3B 啟用)開源模型 Nemotron 3.5 Lightning 已上線 Ollama,可完全在本地裝置執行。它採用混合 MoE 架構,支援最長 1M token 上下文,並用多 token 預測、DFlash 或 DSpark 投機解碼,吞吐達同類開源模型 4 倍、任務完成時間快 30%,面向呼叫工具、跑測試、檢索程式碼庫等長時 agent 任務。
Muse Glimmer 現已在 Ollama 上線,這是 Meta Superintelligence Labs 發布的首個開放模型。它是 30B 多模態模型,專為本地執行的 agent 工作負載設計,上下文 128K 以上,採用 Apache 2.0 許可,可直接驅動 Claude Code、Codex、Pi、OpenClaw 等。
Meta 發布 30B 開源模型 Muse Glimmer,Apache 2.0 許可,即日起可在 LM Studio Bionic 本地執行,Mac 與 PC 均可。它支援多步 agent 任務、工具呼叫與影像輸入,在 LM Studio 內部評測 BionicBench v0.1 的 18 項任務中完成率 83.3%,高於 Gemma 4 31B 和 Qwen 3.6 27B 的 77.7%。
Apple 的 MLX 發布 v0.32.0,包含大量修復與改進。iOS 上 Metal 後端預設啟用;CUDA kernel 新增 JIT 編譯快取,qmm_naive 也改為 JIT 編譯;mlx.core.linalg 新增 determinant 與 sign-log-determinant,mx.asarray 增加 copy 關鍵字,finfo 增加 bits 與 smallest_normal。
Claude Code 從 2026 年 6 月 18 日起支援 artifacts,能把會話進展生成為可即時更新、可分享的互動式網頁,如 PR 走查、儀表盤和發布清單。它基於程式碼庫、聯結器和對話上下文建置,同一連結自動發布新版本並保留版本歷史。該功能目前以 beta 形式面向 Claude Team 和 Enterprise 組織,可通過 CLI 和桌面應用使用,頁面預設僅作者可見,且只能組織內認證成員檢視。
MLX 在 2026-04-22 發布補丁版 v0.31.3,以大量 bug 修復為主,並新增執行緒本地生成流(thread local generation stream),配合 MLX v0.31.2。修復覆蓋 BatchKVCache、BatchRotatingKVCache 與 ArraysCache 的 batch 維度不匹配,以及服務端並行工具呼叫、MiniMax M2 並行工具呼叫和 Mistral 空 tool_call_end 導致的工具呼叫中斷。
MLX 發布 v0.31.2,把 CUDA 後端的量化矩陣乘擴充套件到了 3/5/6-bit、int4 與浮點量化(qmm_naive、qmm_sm80),並新增 GatherQMM 和 CUDA FFT。框架現在支援多執行緒執行獨立計算:CommandEncoder、ThreadLocalStream 改為執行緒本地,Scheduler::enqueue 執行緒安全,JACCL 拆分為獨立庫。
MLX 生態的 mlx_lm 發布 v0.31.2(上一版為 v0.31.0),重點是新增 Gemma 4 支援,包括工具呼叫解析器、多 token 的 think 與工具起止標記,並修復其量化逐層投影載入。此次還重構了 BatchGenerator、為非裁剪型快取快取系統提示與使用者訊息,批處理生成器恢復 max-kv-size 引數,伺服器新增 --allowed-origins 選項,並加入 Nemotron super 支援。
v0.31.0 發布,從 v0.30.7 升級而來,新增 JoyAI LLM Flash 模型支援,併為 Qwen 3.5 加入張量並行;同時允許共享模型,修復 CacheList 儲存與載入、MLA 模型混合量化判斷、Qwen3.5 轉 fp32 與 sanitize、MiniMax M2.5 分片 RMS norm。
2026 年 2 月 12 日發布的 v0.30.7 修復了 Kimi Linear 與 DeepSeek V3.2 的 indexer 和權重載入問題,並加快 DSV32 生成速度。這一版新增 GLM5、不含視覺能力的 Qwen3.5 系列與 LongCat MLA 支援,LFM2 模型可用 Pythonic 方式呼叫工具,另加入 Mistral 工具解析器。訓練流程中的驗證集改為可選,還有一項為下一版本提號的版本號變更。
MLX LM 發布 v0.30.6,新增 Kimi-K2.5、LongCat Flash/Lite 和 Step 3.5 Flash 等模型支援,並引入 Transformers v5。服務端加入分散式推理,支援 chat_template_kwargs、top_logprobs 與載入自訂模型,同時新增 CLI。