v0.40.2-rc0 預發布:伺服器列表隱藏重複與降級提示
v0.40.2-rc0 已於 10 月 8 日以預發布形式放出,主要改動是伺服器端在列表中隱藏重複與降級提示,README 同時把 oxi 加入社群整合列表,完整變更記錄為 v0.40.1...v0.40.2-rc0。本次提交來自 dhiltgen 與 maziluiosif,後者為首次貢獻者,發布頁附帶 19 個資原始檔。
原標題:v0.40.2
閱讀原文
| 評分 | 30 / 15(平均 22,門檻 60) |
|---|---|
| 狀態 | 未入選 |
原文
相關報導
v0.40.1
Ollama 發布 v0.40.1,服務端新增代理雲端用量與餘額 API,客戶端可藉此讀取帳戶用量與餘額。該版本還把帳號步驟從 CLI 新手引導中移除,修復 Windows 上 llama 讀取超過 2GiB 的 clef head 問題,並讓 manifest 在 Windows 上避免使用符號連結。MLX 方面刪除了已進入上游的 Metal residency 補丁,文件修復了 README 社群整合列表中的 6 個失效連結和應用 README 的下載連結。
MLX v0.40.0-rc1 對齊發布方 tokenizer 語義
MLX 發布 v0.40.0-rc1,核心改動是讓本地 tokenizer 與模型發布方的語義保持一致,涵蓋預分詞階段順序、切分行為、Unicode 邊界、added token 歸一化和 BPE 合併排序,並統一處理空 added token 與空 Metaspace 輸入。同時新增 Go/Python 共享參考用例,直接拉取缺失模型並在出錯時失敗,另加配置優先順序、位元組回退與並行編碼的迴歸測試。
OpenAI Codex 發布 0.160.1 修復遠端 MCP 環境變數
OpenAI 的 Codex 倉庫發布 0.160.1,這是面向 0.160 分支的補丁版本。修復內容為:在用顯式配置的遠端環境變數啟動遠端 stdio MCP 伺服器時,保留 SYSTEMROOT、TEMP 和 TMP,使 Unix 主機能夠沿用 Windows 執行器的啟動環境。該改動以 #51121 回移植到 0.160 分支,發布時 main 分支已比此版本多出 287 次提交。
Ollama v0.40.0:Apple Silicon 預設用 MLX 執行模型
Ollama 發布 v0.40.0,在 Apple Silicon 裝置上,MLX 執行時支援的模型架構會自動改用 MLX 執行。官方範例為 ollama pull qwen3.8 與 ollama run qwen3.8,其他可用模型還包括 gemma4、qwen3.6 和 qwen3.5;決策模型 Nimble、tev1、clef、clef-flash 也已支援 MLX,並新增嵌入模型 embeddinggemma-2 支援。官方表示會繼續測試並啟用更多模型。
llama.cpp 修復 Vulkan 後端 RDNA4 矩陣向量調優
llama.cpp 發布 b11389 版本,修復了 Vulkan 後端在 RDNA4 架構上的矩陣向量運算調優問題(PR #29934)。該版本繼續提供覆蓋 macOS、Linux、Windows、Android 等平台的預編譯二進位制,包括 Vulkan、CUDA、ROCm、SYCL 等後端,其中 macOS Apple Silicon 的 KleidiAI 啟用版和 openEuler 建置被停用。