AISpot
所屬事件:Ollama v0.40.0:Apple Silicon 預設改用 MLX 執行模型(1 個來源 · 2 則報導)

2026 年 10 月 4 日,Ollama 發布 v0.40.0,在 Apple Silicon 裝置上,凡是被 MLX 執行時支援的模型架構,將自動改用 MLX 執行,無需使用者手動切換。當天 16:37 UTC 的首份發布說明給出的範例命令為 ollama pull qwen3.8 與 ollama run qw… 看完整事件

Ollama v0.40.0:Apple Silicon 預設用 MLX 跑模型

Ollama releases10/5 00:54版本更新地端推論開發工具

Ollama 發布 v0.40.0,在 Apple Silicon 裝置上,MLX 執行時支援的模型架構將自動改用 MLX 執行。可用模型包括 qwen3.8、gemma4、qwen3.6、qwen3.5,決策模型 Nimble、tev1、clef、clef-flash 也已登陸 MLX;官方表示會繼續測試並啟用更多模型。

官方確認 Apple Silicon 上預設切換到 MLX,並列出已支援的具體模型清單,對在 Mac 本地跑模型的人有直接參考價值。

原標題:v0.40.0
閱讀原文

同一事件共有 2 則報導(1 個來源),看事件全貌

評分78 / 82(平均 80,門檻 60)
狀態精選

全文翻譯

有哪些變更 在 Apple Silicon 上,模型預設通過 MLX 執行 在此版本中,在 Apple Silicon 裝置上,MLX 執行時支援的模型架構將自動通過 MLX 執行。 ollama pull qwen3.8 ollama run qwen3.8 其他模型包括 gemma4、qwen3.6 和 qwen3.5 決策模型現在也可在 MLX 上使用:Nimble tev1 clef clef-flash 我們將繼續測試並啟用更多模型。 完整變更日誌:v0.34.4...v0.40.0-rc2

由 AI 翻譯,以原文為準。

原文
What's Changed Models run on MLX on Apple Silicon by default In this release, on Apple Silicon devices, model architectures supported by the MLX runtime will automatically run on MLX. ollama pull qwen3.8 ollama run qwen3.8 Additional models include gemma4 , qwen3.6 and qwen3.5 Decision models are now available on MLX as well: Nimble tev1 clef clef-flash We will continue testing and enabling additional models. Full Changelog : v0.34.4...v0.40.0-rc2

相關報導

Ollama releases● 精選10/2 19:28AI 評分72

Ollama v0.35.1 支援 Cloudflare 決策模型 Clef

Ollama 發布 v0.35.1,通過 /v1/systemone 介面支援 Cloudflare 新開源的決策模型 Clef(27B)與 Clef Flash(9B),兩者均為多模態,請求可在文字 state 之外附帶圖片,所有問題共享該狀態並聯合打分。同一版本把聯網搜尋上限從每次回應 3 次提高到 10 次,Modelfile 新增 CAPABILITY 宣告,並更新了 llama.cpp 與 MLX 引擎。

llama.cpp releases● 精選10/3 12:54AI 評分70

llama.cpp 的 OpenVINO 後端更新至 2026.4.1 並大幅最佳化 MoE 效能

ggml-openvino 後端更新到 2026.4.1,重點最佳化 Qwen3.5 MoE 推理效能,並新增推理效能分析、預設使用遠端輸出張量、磁碟快取模型直載(cache_only)等能力。在 Arc B390 上以 q4_asym64_all 重量化執行 gemma-4-26B-A4B,pp512 從 66.16 t/s 提升到 1608.73 t/s,tg128 從 25.94 提升到 26.46 t/s,困惑度基本不變。

llama.cpp releases10/2 23:23AI 評分37

llama.cpp 發布 b11352 版本,最佳化 Qwen4 掩碼構造

llama.cpp 發布 b11352 建置版本,主要變更為最佳化 Qwen4 的掩碼構造(#29824),並將相同改動應用到 GLM5-next。該版本覆蓋 macOS、iOS、Linux、Android、Windows 與 openEuler 平台,提供 CPU、Vulkan、CUDA 12/13、ROCm 10.0、OpenVINO、SYCL 等多種後端建置,其中 macOS Apple Silicon 的 KleidiAI 建置被標記為 DISABLED。