AISpot
所屬事件:Mistral 發布 Large 4:1T 引數多模態,API 上線權重月底開放(3 個來源 · 6 則報導)

10 月 6 日,Mistral AI 開啟 Mistral Large 4(代號 Le Chonk)公開預覽,API 即日向所有人開放,開放權重版本定於 10 月底發布。該模型為原生多模態,官方稱總引數 1T、啟用 49B;Hacker News 引述的模型頁面則寫為 1.05T 總引數、49B 啟用,並稱採用細粒度… 看完整事件

Mistral 發布 Large 4:1T 引數原生多模態,API 已上線

X @MistralAI10/6 14:06官方公告模型開源開發工具產品與方案

Mistral 推出 Mistral Large 4(代號 Le Chonk),1T 總引數、49B 啟用,原生多模態,即日起通過 API 向所有人開放。官方稱其是美國和歐洲聚合基準上表現最好的開放權重模型,在網路防禦、製造與金融等關鍵負載上達到 SOTA,視覺 grounding 超過閉源前沿模型。模型在歐洲端到端打造,可通過 Mistral Cloud 在歐洲部署,正與網路安全夥伴私下合作;開放權重將於 10 月底發布。

給出了 1T 引數、49B 啟用的開放權重多模態模型這一具體規格,並確認 API 當日可用、權重 10 月底開源,對關注開源模型能力上限與歐洲本地部署方案的人有直接參考價值。

原標題:@MistralAI: Meet Mistral Large 4, aka Le Chonk.
閱讀原文

同一事件共有 6 則報導(3 個來源),看事件全貌

評分91 / 92(平均 91,門檻 60)
狀態精選

相關報導

Hacker News front page● 精選10/5 20:16AI 評分88

Reflection 發布首個開放權重模型 Beam:501B 總引數、23B 啟用

Reflection 發布首個開放權重模型 Beam:稀疏 MoE,總引數 501B、啟用 23B,面向程式設計、推理與 agentic 負載。預訓練使用 23.8 萬億 token,RL 階段動用 10.5K 塊 NVIDIA GB300 訓練 4 周、生成超 1 億條 rollout、約 13 億個沙箱,官方稱是開放實驗室中規模最大的 RL 訓練之一。評測中其與 GLM 5.2 相當但推理算力少 3–4 倍,接近 Qwen 3.8-Max,原始能力仍落後 Kimi K3;

Hacker News front page● 精選10/3 11:43AI 評分85

Aleph Alpha 發布開源主權模型 Kolibri,78B 引數 Apache 2.0

德國 Aleph Alpha 於 2026 年 10 月 3 日發布開源權重模型 Kolibri,Apache 2.0 許可,權重已上 Hugging Face。它採用 MoE 架構,總引數 78.1B,每 token 僅啟用 3.46B,支援德語和英語,原生上下文 262,144 token,知識截止 2026 年 6 月 18 日。模型在德國和芬蘭基礎設施上從零訓練,使用 768 塊 NVIDIA B200,訓練約 24 萬億 token,其中德語佔比超五分之一。

Ollama releases● 精選10/5 00:54AI 評分75

Ollama v0.40.0:Apple Silicon 預設用 MLX 跑模型

Ollama 發布 v0.40.0,在 Apple Silicon 裝置上,MLX 執行時支援的模型架構將自動改用 MLX 執行。可用模型包括 qwen3.8、gemma4、qwen3.6、qwen3.5,決策模型 Nimble、tev1、clef、clef-flash 也已登陸 MLX,官方稱會繼續測試並啟用更多模型。