AISpot
所屬事件:Ollama v0.40.0:Apple Silicon 預設改用 MLX 執行模型(1 個來源 · 2 則報導)

2026 年 10 月 4 日,Ollama 發布 v0.40.0,在 Apple Silicon 裝置上,凡是被 MLX 執行時支援的模型架構,將自動改用 MLX 執行,無需使用者手動切換。當天 16:37 UTC 的首份發布說明給出的範例命令為 ollama pull qwen3.8 與 ollama run qw… 看完整事件

Ollama v0.40.0:Apple Silicon 預設用 MLX 跑模型

Ollama releases10/4 17:37版本更新地端推論開發工具

Ollama 發布 v0.40.0,在 Apple Silicon 裝置上,MLX 執行時支援的模型架構將自動改用 MLX 執行。官方範例為 ollama pull qwen3.8 與 ollama run qwen3.8;預發布期間會繼續測試並啟用更多模型。

官方確認 Apple Silicon 上預設切換到 MLX 推理,並給出可直接拉取執行的 qwen3.8 範例,對在 Mac 本地跑模型的人有直接影響。

原標題:v0.40.0
閱讀原文

同一事件共有 2 則報導(1 個來源),看事件全貌

評分78 / 82(平均 80,門檻 60)
狀態精選

全文翻譯

變更內容 在 Apple Silicon 上,模型預設通過 MLX 執行 在此版本中,在 Apple Silicon 裝置上,MLX 執行時支援的模型架構將自動通過 MLX 執行。 ollama pull qwen3.8 ollama run qwen3.8 在預發布期間,我們將測試並啟用更多模型。 完整變更日誌:v0.34.4...v0.40.0-rc0

由 AI 翻譯,以原文為準。

原文
What's Changed Models run on MLX on Apple Silicon by default In this release, on Apple Silicon devices, model architectures supported by the MLX runtime will automatically run on MLX. ollama pull qwen3.8 ollama run qwen3.8 During the pre-release we will be testing and enabling additional models. Full Changelog : v0.34.4...v0.40.0-rc0

相關報導

Ollama releases● 精選10/2 19:28AI 評分72

Ollama v0.35.1 支援 Cloudflare 決策模型 Clef

Ollama 發布 v0.35.1,通過 /v1/systemone 介面支援 Cloudflare 新開源的決策模型 Clef(27B)與 Clef Flash(9B),兩者均為多模態,請求可在文字 state 之外附帶圖片,所有問題共享該狀態並聯合打分。同一版本把聯網搜尋上限從每次回應 3 次提高到 10 次,Modelfile 新增 CAPABILITY 宣告,並更新了 llama.cpp 與 MLX 引擎。

llama.cpp releases● 精選10/3 12:54AI 評分70

llama.cpp 的 OpenVINO 後端更新至 2026.4.1 並大幅最佳化 MoE 效能

ggml-openvino 後端更新到 2026.4.1,重點最佳化 Qwen3.5 MoE 推理效能,並新增推理效能分析、預設使用遠端輸出張量、磁碟快取模型直載(cache_only)等能力。在 Arc B390 上以 q4_asym64_all 重量化執行 gemma-4-26B-A4B,pp512 從 66.16 t/s 提升到 1608.73 t/s,tg128 從 25.94 提升到 26.46 t/s,困惑度基本不變。