10 月 6 日,Mistral AI 開啟 Mistral Large 4(代號 Le Chonk)公開預覽,預覽 API 當日即在 Mistral Studio 可用,開放權重版本定於 10 月底放出。據官方推文,模型總引數 1T、啟用 49B,原生多模態;Mistral 模型頁面則寫作 1.05T 總引數、49B… 看完整事件
Mistral 發布 Mistral Large 4 預覽,權重月底開放
Mistral 於 10 月 6 日開啟 Mistral Large 4 公開預覽,可在 Mistral Studio 呼叫 API,權重本月底放出。模型為 1 萬億引數原生多模態、49B 啟用引數,在歐洲自有資料中心用 3800 張 NVIDIA Grace Blackwell GPU 從零訓練。官方稱其在 Artificial Analysis Cyber Index 位列全球前五,漏洞復現並修補測試得 82% 為所有模型最高,Cybench 解決 93%;
給出 1T 引數開放權重模型的具體評測數字,包括 82% 漏洞修補得分和超過 DeepSeek、Qwen 的編碼成績,並說明權重與自部署安排,對關注開源權重與本地部署的開發者最有用。
原標題:Mistral Large 4: "Le Chonk"
閱讀原文
| 評分 | 92 / 92(平均 92,門檻 76) |
|---|---|
| 狀態 | 精選 |
相關報導
Aleph Alpha 發布開源主權模型 Kolibri,78B 引數 Apache 2.0
德國 Aleph Alpha 於 2026 年 10 月 3 日發布開源權重模型 Kolibri,Apache 2.0 許可,權重已上 Hugging Face。它採用 MoE 架構,總引數 78.1B,每 token 僅啟用 3.46B,支援德語和英語,原生上下文 262,144 token,知識截止 2026 年 6 月 18 日。模型在德國和芬蘭基礎設施上從零訓練,使用 768 塊 NVIDIA B200,訓練約 24 萬億 token,其中德語佔比超五分之一。
Reflection 發布 501B-A23B 開源 MoE 模型 Beam,權重本月以 Apache 2.0 放出
美國初創公司 Reflection 發布開源權重模型 Beam:501B 總引數、23B 啟用的文字 MoE,面向 coding、agentic 與科研任務,Apache 2.0 全權重本月放出。官方稱預訓練用了 23.8T token,在約 10500 張 GB300 上各跑四周預訓練與 RL,SWE-bench Verified 得分 80.9,推理效率為 GLM 5.2 的 3 到 4 倍。
Ollama v0.40.0:Apple Silicon 預設用 MLX 跑模型
Ollama 發布 v0.40.0,在 Apple Silicon 裝置上,MLX 執行時支援的模型架構將自動改用 MLX 執行。可用模型包括 qwen3.8、gemma4、qwen3.6、qwen3.5,決策模型 Nimble、tev1、clef、clef-flash 也已登陸 MLX,官方稱會繼續測試並啟用更多模型。
兩臺 128GB Strix Halo 迷你主機各跑一個 300B 級 MoE 模型
Kyojin 引擎基於 ExLlamaV3 為 AMD Strix Halo(gfx1151、ROCm)打造,讓 GLM-5.3-Flash 與 MiMo-V2.6-Flash 兩個 300B 級 MoE 模型分別裝進單臺 128GB 迷你主機。實測在 Ryzen AI Max+ 395 上,GLM 預填充 580 tok/s、解碼 26-30 tok/s,MiMo 解碼最高 44 tok/s(程式碼場景)。
llama.cpp 為 Metal 加入少行 MMA 矩陣乘核心
llama.cpp 合併 PR #29869,為 Metal 後端新增支援 2 到 16 行 src1 的 mat-mul 核心,用於加速投機解碼中的少行矩陣乘。此前 Metal 在無 tensor API 時用 mat-vec 核心處理這些運算,耗時隨 src1 行數增長,導致 M3 Ultra 上 DFlash2 解碼慢於序列解碼。