AISpot
所屬事件:Mistral 發布 Mistral Large 4 預覽,權重月底開放(1 個來源 · 3 則報導)

10 月 6 日,Mistral AI 開啟 Mistral Large 4(代號 Le Chonk)公開預覽,預覽 API 當日即在 Mistral Studio 可用,開放權重版本定於 10 月底放出。據官方推文,模型總引數 1T、啟用 49B,原生多模態;Mistral 模型頁面則寫作 1.05T 總引數、49B… 看完整事件

Mistral Large 4 發布:1.05T 引數開放權重多模態模型

Hacker News front page10/6 14:15官方公告模型產品與方案開源

Mistral 於 10 月 6 日公開預覽 Mistral Large 4:開放權重、通用多模態模型,採用細粒度 MoE 架構,49B 啟用引數、1.05T 總引數,配 1.6B 視覺編碼器,上下文 1M。定價為輸入每百萬 tokens 0.68 美元、快取輸入 0.07 美元、輸出 2.09 美元,頁面同時列出 1.36、0.14、4.18 的對照價格。功能含結構化輸出、函式呼叫、文件問答、字首補全、Chat Completions、批處理與 Agents 內建工具。

官方一次給出 1.05T 總引數、49B 啟用的開放權重多模態規格與 1M 上下文、每百萬 tokens 美元級定價,便於對比開源模型與 API 成本。

原標題:Mistral Large 4
閱讀原文

同一事件共有 3 則報導(1 個來源),看事件全貌

評分93 / 90(平均 91,門檻 76)
狀態精選

相關報導

llama.cpp releases● 精選10/3 12:54AI 評分70

llama.cpp 的 OpenVINO 後端更新至 2026.4.1 並大幅最佳化 MoE 效能

ggml-openvino 後端更新到 2026.4.1,重點最佳化 Qwen3.5 MoE 推理效能,並新增推理效能分析、預設使用遠端輸出張量、磁碟快取模型直載(cache_only)等能力。在 Arc B390 上以 q4_asym64_all 重量化執行 gemma-4-26B-A4B,pp512 從 66.16 t/s 提升到 1608.73 t/s,tg128 從 25.94 提升到 26.46 t/s,困惑度基本不變。

Hacker News front page● 精選10/3 11:43AI 評分85

Aleph Alpha 發布開源主權模型 Kolibri,78B 引數 Apache 2.0

德國 Aleph Alpha 於 2026 年 10 月 3 日發布開源權重模型 Kolibri,Apache 2.0 許可,權重已上 Hugging Face。它採用 MoE 架構,總引數 78.1B,每 token 僅啟用 3.46B,支援德語和英語,原生上下文 262,144 token,知識截止 2026 年 6 月 18 日。模型在德國和芬蘭基礎設施上從零訓練,使用 768 塊 NVIDIA B200,訓練約 24 萬億 token,其中德語佔比超五分之一。

Latent Space● 精選10/6 07:28AI 評分90

Reflection 發布 501B-A23B 開源 MoE 模型 Beam,權重本月以 Apache 2.0 放出

美國初創公司 Reflection 發布開源權重模型 Beam:501B 總引數、23B 啟用的文字 MoE,面向 coding、agentic 與科研任務,Apache 2.0 全權重本月放出。官方稱預訓練用了 23.8T token,在約 10500 張 GB300 上各跑四周預訓練與 RL,SWE-bench Verified 得分 80.9,推理效率為 GLM 5.2 的 3 到 4 倍。

Ollama releases● 精選10/6 02:53AI 評分79

Ollama v0.40.0 在 Apple Silicon 上預設用 MLX 執行模型

Ollama 發布 v0.40.0:在 Apple Silicon 裝置上,MLX 執行時支援的模型架構會自動改用 MLX 執行。本次納入 MLX 的模型包括 qwen3.8、gemma4、qwen3.6、qwen3.5,決策模型 Nimble、tev1、clef、clef-flash 也已支援。可用 ollama pull / run qwen3.8 拉取與執行,官方稱將繼續啟用更多模型。