AISpot
所屬事件:Ollama v0.40.0:Apple Silicon 預設用 MLX 跑模型(1 個來源 · 4 則報導)

Ollama 自 2026 年 10 月 4 日起陸續發布 v0.40.0 的說明,宣布在 Apple Silicon 裝置上,MLX 執行時支援的模型架構將自動改用 MLX 執行,無需手動切換。官方給出的範例是 ollama pull qwen3.8 與 ollama run qwen3.8。隨後幾天的說明逐步補充了… 看完整事件

Ollama v0.40.0:Apple Silicon 預設用 MLX 執行模型

Ollama releases10/6 19:47版本更新地端推論開源開發工具

Ollama 發布 v0.40.0,在 Apple Silicon 裝置上,MLX 執行時支援的模型架構會自動改用 MLX 執行。官方範例為 ollama pull qwen3.8 與 ollama run qwen3.8,其他可用模型還包括 gemma4、qwen3.6 和 qwen3.5;決策模型 Nimble、tev1、clef、clef-flash 也已支援 MLX,並新增嵌入模型 embeddinggemma-2 支援。官方表示會繼續測試並啟用更多模型。

Ollama 把 Apple Silicon 上受 MLX 支援的模型預設切到 MLX 執行,並給出 qwen3.8、gemma4 等可用模型清單與新增嵌入模型支援,對在 Mac 本地跑模型的人最有用。

原標題:v0.40.0
閱讀原文

同一事件共有 4 則報導(1 個來源),看事件全貌

評分82 / 82(平均 82,門檻 60)
狀態精選

全文翻譯

變更內容 在 Apple Silicon 上,模型預設在 MLX 上執行 在此版本中,在 Apple Silicon 裝置上,MLX 執行時支援的模型架構將自動在 MLX 上執行。 ollama pull qwen3.8 ollama run qwen3.8 其他模型包括 gemma4、qwen3.6 和 qwen3.5 決策模型現在也可在 MLX 上使用:Nimble tev1 clef clef-flash MLX 現在支援一種嵌入模型:embeddinggemma-2 我們將繼續測試並啟用更多模型。 完整變更日誌:v0.35.1...v0.40.0

由 AI 翻譯,以原文為準。

原文
What's Changed Models run on MLX on Apple Silicon by default In this release, on Apple Silicon devices, model architectures supported by the MLX runtime will automatically run on MLX. ollama pull qwen3.8 ollama run qwen3.8 Additional models include gemma4 , qwen3.6 and qwen3.5 Decision models are now available on MLX as well: Nimble tev1 clef clef-flash MLX now has support for an embedding model: embeddinggemma-2 We will continue testing and enabling additional models. Full Changelog : v0.35.1...v0.40.0

相關報導

Ollama releases● 精選10/6 16:08AI 評分76

Ollama v0.40.0-rc6 在 MLX 上加入多模態嵌入

Ollama 發布 v0.40.0-rc6,在 MLX runner 上實現 EmbeddingGemma2Model 架構,使本地嵌入支援多模態輸入。/api/embed 介面現在可通過 input dict 為每個條目單獨傳入媒體。該模型為 24 層雙向文字編碼器,帶 PLE,共享 gemma4 的視覺與音訊塔,輸出經 mean-pool 與 L2 歸一化。該標籤由 pdevine 於 10 月 6 日打上,對應提交 #18820,仍屬 rc 預發布版本。

Ollama releases● 精選10/2 19:28AI 評分72

Ollama v0.35.1 支援 Cloudflare 決策模型 Clef

Ollama 發布 v0.35.1,通過 /v1/systemone 介面支援 Cloudflare 新開源的決策模型 Clef(27B)與 Clef Flash(9B),兩者均為多模態,請求可在文字 state 之外附帶圖片,所有問題共享該狀態並聯合打分。同一版本把聯網搜尋上限從每次回應 3 次提高到 10 次,Modelfile 新增 CAPABILITY 宣告,並更新了 llama.cpp 與 MLX 引擎。

llama.cpp releases10/6 19:16AI 評分40

llama.cpp b11447 發布:新增 pplx-decider 模型支援

llama.cpp 發布 b11447 建置版本,本次列出的功能變更是新增對 pplx-decider 模型的支援(PR #30044)。該版本一次性放出 macOS/iOS、Linux、Android、Windows、openEuler 五個平台的預編譯產物,計算後端覆蓋 CPU、CUDA 12.8 與 13.4、Vulkan、ROCm 10.0、OpenVINO、SYCL,以及驍龍平台的 Adreno GPU 與 Hexagon NPU;