X @Alibaba_Qwen● 精選9/30 12:18AI 評分65
Qwen3.8-27B 現已上線 Nebius 平台
阿里 Qwen 宣布 Qwen3.8-27B 已可通過 Nebius 訪問。這是一個 27B 稠密模型,官方稱適用於建置 agent 與深度研究等多步驟工作流。原文未給出定價、上下文長度或部署方式等細節。
找到 3 筆
阿里 Qwen 宣布 Qwen3.8-27B 已可通過 Nebius 訪問。這是一個 27B 稠密模型,官方稱適用於建置 agent 與深度研究等多步驟工作流。原文未給出定價、上下文長度或部署方式等細節。
LM Studio 與 inco_ai 合作,在發布當天(day 0)就把 Splash 推理引擎接入 LM Studio。官方給出的資料是:在 M5 Max 上執行 Qwen3.8-27B,速度最高可達 144 tok/sec。想試的話可通過 LM Studio 官方部落格的連結直接跑起來。
Inco AI 發布開源推理引擎 Splash,專為在 Apple Silicon 上本地執行 Qwen3.6-35B-A3B 與 Qwen3.8-27B 最佳化,已整合進 LM Studio Bionic 1.1.5 及以上版本。在 48GB M5 Pro 測試中,Qwen3.8-27B 短提示解碼約 74 tokens/s、32K 上下文 54 tokens/s,約為次快引擎的兩倍;四個併發請求合計吞吐 170 tokens/s,是次快引擎的 3.9 倍。