2026 年 10 月 6 日,法國 Mistral AI 發布 Mistral Large 4(代號 Le Chonk)公開預覽版,即日起通過 Mistral API 開放,官方稱開放權重版本將於 10 月底發布。據官方與模型頁面,該模型為細粒度 MoE 架構,總引數 1T(頁面標註 1.05T)、啟用 49B,原生… 看完整事件
Mistral 發布 1T 引數多模態模型 Mistral Large 4
法國 AI 實驗室 Mistral 於週二發布 1 萬億引數多模態模型 Mistral Large 4(ML4),暱稱 Le Chonk。它暫不是開放權重模型,只能通過公開的 guardrail 端點訪問,Mistral 計劃三週內完成安全測試後放出權重。該模型全程用自家算力訓練,僅 4000 塊 Nvidia GPU,官方稱比中國競爭對手少兩到三倍。基準結果未公布,最佳化場景包括網路安全、金融和晶片設計;三星上月以 210 億歐元估值領投其 D 輪。
Mistral 用 4000 塊 GPU 訓出 1T 引數模型,並給出三週後開放權重的明確時間表,對關注開放權重路線與歐洲前沿模型進展的人有參考價值。
原標題:Mistral’s new 1T model aims to leapfrog closed and open rivals
閱讀原文
| 評分 | 90 / 90(平均 90,門檻 76) |
|---|---|
| 狀態 | 精選 |
相關報導
Mistral Large 4 解出 19 項 CTF 挑戰中的 18 項
Mistral AI 公布 Mistral Large 4 在 CTF 挑戰中的成績:19 道題解出 18 道。該測試為 speedrun 形式,涉及工具呼叫,解題時間來自實際執行記錄,並與其它模型進行對比。原文未給出具體耗時數字,也未列出參評模型各自的成績。
Aleph Alpha 發布 Kolibri-1:78B 引數 MoE 開源模型,Apache 2.0
德國 Aleph Alpha 在 Hugging Face 發布 Kolibri-1,總引數 78B、啟用 3.46B,支援最高 100 萬 token 上下文,採用 Apache 2.0 許可。模型基於 20T token 的英德雙語語料訓練(約 62.5% 英語、23.9% 德語、13.6% 程式碼),在 768 張 B300 叢集上訓練約 4 周。社群討論認為其基準表現接近 Qwen 3.5 35B,適合 96GB 視訊記憶體本地部署,但目前尚無量化版本。