Ollama 於 2026 年 10 月 8 日發布 v0.40.2 預發布版(Pre-release),距同日更早的 v0.40.2-rc0 只有 1 個 commit。該版本包含兩項改動:伺服器端不再在列表輸出中顯示舊版 GGUF 的重複副本與降級保護條目(#18874,由 dhiltgen 提交);README… 看完整事件
v0.40.2
Ollama 發布 v0.40.2 預發布版(Pre-release),兩項改動:伺服器端在列表裡隱藏重複條目與降級提示,README 把 oxi 列為社群整合。該版本自 v0.40.2-rc0 起只有 1 個 commit,伺服器改動由 dhiltgen 提交,maziluiosif 首次貢獻 oxi 整合,完整變更日誌為 v0.40.1...v0.40.2-rc0。
原標題:v0.40.2
閱讀原文
| 評分 | 35 / 38(平均 36,門檻 60) |
|---|---|
| 狀態 | 未入選 |
原文
相關報導
v0.40.1
Ollama 發布 v0.40.1,服務端新增代理雲端用量與餘額 API,客戶端可藉此讀取帳戶用量與餘額。該版本還把帳號步驟從 CLI 新手引導中移除,修復 Windows 上 llama 讀取超過 2GiB 的 clef head 問題,並讓 manifest 在 Windows 上避免使用符號連結。MLX 方面刪除了已進入上游的 Metal residency 補丁,文件修復了 README 社群整合列表中的 6 個失效連結和應用 README 的下載連結。
Ollama v0.40.0:Apple Silicon 預設用 MLX 執行模型
Ollama 發布 v0.40.0,在 Apple Silicon 裝置上,MLX 執行時支援的模型架構會自動改用 MLX 執行。官方範例為 ollama pull qwen3.8 與 ollama run qwen3.8,其他可用模型還包括 gemma4、qwen3.6 和 qwen3.5;決策模型 Nimble、tev1、clef、clef-flash 也已支援 MLX,並新增嵌入模型 embeddinggemma-2 支援。官方表示會繼續測試並啟用更多模型。
Ollama v0.40.0-rc6 在 MLX 上加入多模態嵌入
Ollama 發布 v0.40.0-rc6,在 MLX runner 上實現 EmbeddingGemma2Model 架構,使本地嵌入支援多模態輸入。/api/embed 介面現在可通過 input dict 為每個條目單獨傳入媒體。該模型為 24 層雙向文字編碼器,帶 PLE,共享 gemma4 的視覺與音訊塔,輸出經 mean-pool 與 L2 歸一化。該標籤由 pdevine 於 10 月 6 日打上,對應提交 #18820,仍屬 rc 預發布版本。
Ollama v0.35.1 支援 Cloudflare 決策模型 Clef
Ollama 發布 v0.35.1,通過 /v1/systemone 介面支援 Cloudflare 新開源的決策模型 Clef(27B)與 Clef Flash(9B),兩者均為多模態,請求可在文字 state 之外附帶圖片,所有問題共享該狀態並聯合打分。同一版本把聯網搜尋上限從每次回應 3 次提高到 10 次,Modelfile 新增 CAPABILITY 宣告,並更新了 llama.cpp 與 MLX 引擎。
Ollama 預告接入 Reflection AI 新開源模型
Ollama 官方帳號表示期待 Reflection AI 的新開源模型,並稱將有更多美國模型進入 Ollama。該帖未給出模型名稱、引數規模、發布時間與具體接入方式。