Ollama 新增 Claude Desktop 支援,可一鍵切換本地與雲端模型
Ollama 發布 Claude Desktop 整合:在 Ollama 內開啟 Claude 即自動配置第三方閘道器,可在 Anthropic 模型、本地模型與 Ollama 雲端模型間自由切換。關閉 Claude 即恢復原有設定;Ollama 預設停用遙測並實行零資料保留。
找到 10 筆
Ollama 發布 Claude Desktop 整合:在 Ollama 內開啟 Claude 即自動配置第三方閘道器,可在 Anthropic 模型、本地模型與 Ollama 雲端模型間自由切換。關閉 Claude 即恢復原有設定;Ollama 預設停用遙測並實行零資料保留。
Ollama 發布 v0.40.0,在 Apple Silicon 裝置上,MLX 執行時支援的模型架構會自動改用 MLX 執行。示例命令為 ollama pull qwen3.8 與 ollama run qwen3.8。預發布階段還會繼續測試並啟用更多模型。
Ollama 0.35 通過新的 /v1/systemone 端點支援基於 TypeSafe Jev API 的決策模型,新增 nimble 9B、tev1 4B、tev1:0.8b 三個模型。本地執行無額外費用、延遲更低,nimble 9B 在 M5 Max 上平均每次決策 91ms。後續更新將帶來 MLX 加速與更多決策模型。
Muse Glimmer 是 Meta Superintelligence Labs 的首個開源模型,30B 多模態、Apache 2.0 許可、128K+ 上下文,現已在 Ollama 上線。Apple Silicon 上可通過 Ollama 的 MLX 引擎執行,DFlash 帶來 1.5–1.8 倍提速,並新增影像輸入支援。
Ollama 於 8 月 31 日把 Pro、Max、Team 計劃改為按 token 透明計費。Pro 每月 20 美元含 60 美元用量,Max 100 美元含 300 美元,Team 500 美元含 1000 美元共享用量、不限使用者。新套餐無服務費與 5 小時或每週限額,支援 Claude Code、Codex,零資料保留。
Ollama v0.35.1 通過 /v1/systemone 接入 Cloudflare 開源的決策模型 Clef(27B)與 Clef Flash(9B),兩者均為多模態,請求可同時帶圖片和文字狀態。本次更新還把聯網搜尋上限從每次回答 3 次提升到 10 次,並更新了 llama.cpp 與 MLX 引擎。
Ollama v0.35.0 支援決策模型,經 /v1/systemone 呼叫,返回選擇、機率和分數而非文字。首批可用模型為 Bespoke Labs 的 Nimble 和 Together AI 的 Tev1。支援 choice、noul、score 三種問題型別,適用於工單分類、模型路由和內容分類。
NVIDIA 的 30B 開源模型 Nemotron 3.5 Lightning 已在 Ollama 上線,可完全在本地裝置執行,每 token 僅啟用 3B 引數。它支援最長 1M token 上下文,靠推測解碼實現最高 4 倍吞吐。用 ollama launch 即可接入 Claude Code、OpenCode,Apple Silicon 對應 30b-mlx 版本。
Google Antigravity SDK 現可通過 LiteRT 在本地離線執行 Gemma 4 26B A4B 等模型。它同時支援 Ollama、vLLM 等 OpenAI 相容推理服務,可讓雲端模型做規劃,本地模型在裝置上處理程式碼審計與修補。
v0.35.1-rc0 允許在 Modelfile 中宣告 CAPABILITY,並在 create 請求中增加 capabilities 欄位。這些宣告會在 GGUF、safetensors 的建立、繼承與 Modelfile 匯出中保留。排程 System One 請求前須先判定 capability,不再依賴 Qwen 架構與渲染器後設資料匹配;評分仍限 GGUF,MLX 執行時改動另行處理。