AISpot
所屬事件:Ollama v0.40.0:Apple Silicon 預設用 MLX 跑模型(1 個來源 · 3 則報導)

Ollama 於 2026 年 10 月 4 日發布 v0.40.0,核心變更是:在 Apple Silicon 裝置上,MLX 執行時支援的模型架構將自動改用 MLX 執行,官方給出的範例命令為 ollama pull qwen3.8 與 ollama run qwen3.8。同日稍晚與 10 月 6 日的兩次更新對… 看完整事件

Ollama v0.40.0 在 Apple Silicon 上預設用 MLX 執行模型

Ollama releases10/6 02:53版本更新地端推論開源開發工具

Ollama 發布 v0.40.0:在 Apple Silicon 裝置上,MLX 執行時支援的模型架構會自動改用 MLX 執行。本次納入 MLX 的模型包括 qwen3.8、gemma4、qwen3.6、qwen3.5,決策模型 Nimble、tev1、clef、clef-flash 也已支援。可用 ollama pull / run qwen3.8 拉取與執行,官方稱將繼續啟用更多模型。

Ollama v0.40.0 把 Apple Silicon 上的預設推理路徑切到 MLX,並給出 qwen3.8、gemma4、qwen3.5 等已支援型號與決策模型名單,對在 Mac 本地跑模型的人是有明確清單的一次後端預設變更。

原標題:v0.40.0
閱讀原文

同一事件共有 3 則報導(1 個來源),看事件全貌

評分78 / 80(平均 79,門檻 60)
狀態精選

全文翻譯

有哪些變更 在 Apple Silicon 上,模型預設通過 MLX 執行 在此版本中,在 Apple Silicon 裝置上,MLX 執行時支援的模型架構將自動通過 MLX 執行。 ollama pull qwen3.8 ollama run qwen3.8 其他模型包括 gemma4、qwen3.6 和 qwen3.5 決策模型現在也可在 MLX 上使用:Nimble tev1 clef clef-flash 我們將繼續測試並啟用更多模型。 完整變更日誌:v0.34.4...v0.40.0-rc3

由 AI 翻譯,以原文為準。

原文
What's Changed Models run on MLX on Apple Silicon by default In this release, on Apple Silicon devices, model architectures supported by the MLX runtime will automatically run on MLX. ollama pull qwen3.8 ollama run qwen3.8 Additional models include gemma4 , qwen3.6 and qwen3.5 Decision models are now available on MLX as well: Nimble tev1 clef clef-flash We will continue testing and enabling additional models. Full Changelog : v0.34.4...v0.40.0-rc3

相關報導

Ollama releases● 精選10/2 19:28AI 評分72

Ollama v0.35.1 支援 Cloudflare 決策模型 Clef

Ollama 發布 v0.35.1,通過 /v1/systemone 介面支援 Cloudflare 新開源的決策模型 Clef(27B)與 Clef Flash(9B),兩者均為多模態,請求可在文字 state 之外附帶圖片,所有問題共享該狀態並聯合打分。同一版本把聯網搜尋上限從每次回應 3 次提高到 10 次,Modelfile 新增 CAPABILITY 宣告,並更新了 llama.cpp 與 MLX 引擎。

llama.cpp releases● 精選10/3 12:54AI 評分70

llama.cpp 的 OpenVINO 後端更新至 2026.4.1 並大幅最佳化 MoE 效能

ggml-openvino 後端更新到 2026.4.1,重點最佳化 Qwen3.5 MoE 推理效能,並新增推理效能分析、預設使用遠端輸出張量、磁碟快取模型直載(cache_only)等能力。在 Arc B390 上以 q4_asym64_all 重量化執行 gemma-4-26B-A4B,pp512 從 66.16 t/s 提升到 1608.73 t/s,tg128 從 25.94 提升到 26.46 t/s,困惑度基本不變。

llama.cpp releases10/2 23:23AI 評分37

llama.cpp 發布 b11352 版本,最佳化 Qwen4 掩碼構造

llama.cpp 發布 b11352 建置版本,主要變更為最佳化 Qwen4 的掩碼構造(#29824),並將相同改動應用到 GLM5-next。該版本覆蓋 macOS、iOS、Linux、Android、Windows 與 openEuler 平台,提供 CPU、Vulkan、CUDA 12/13、ROCm 10.0、OpenVINO、SYCL 等多種後端建置,其中 macOS Apple Silicon 的 KleidiAI 建置被標記為 DISABLED。