AISpot

Inco AI 開源 Splash 引擎,Apple Silicon 跑 Qwen3.8 提速約 2 倍

LM Studio blog9/18 01:00官方公告地端推論開源

Inco AI 開源了面向 Apple Silicon 的推理引擎 Splash,專門最佳化 Qwen3.6-35B-A3B 與 Qwen3.8-27B。在 48 GB M5 Pro 上,Qwen3.8-27B 短提示解碼 74 tokens/s、32K 上下文 54 tokens/s,約為實測次快引擎的 2 倍,四路併發合計 170 tokens/s。

你正打算買 Mac Studio 本地跑開源模型,這是 Apple Silicon 上 Qwen3.8 的又一個專用推理後端,可直接在 LM Studio 裡裝來對比你自己的 MLX / llama.cpp 實測吞吐(注意需 M3+ 與 36 GB 起記憶體)。

原標題:Splash Engine - the fastest local Qwen3.8 on Apple Silicon
閱讀原文

評分80 / 84(平均 82,門檻 60)
狀態精選(舊聞,已歸檔)