AISpot
所屬事件:Aleph Alpha 發布 78B MoE 開源模型 Kolibri(2 個來源 · 3 則報導)

2026 年 10 月 3 日,德國 Aleph Alpha 發布開源權重模型 Kolibri,權重以 Apache 2.0 許可在 Hugging Face 開放下載。這是一個英德雙語 MoE Transformer,總引數 78B、每 token 啟用約 3B,官方稱其面向公共管理、工業與航空航天等受監管領域,針對… 看完整事件

Aleph Alpha 發布 Kolibri:78B 總參 3B 啟用開源權重模型

Hacker News front page10/3 10:36官方公告模型開源研究

德國 Aleph Alpha 於 2026 年 10 月 3 日發布 Kolibri,一個英德雙語 MoE Transformer,總引數 78B、啟用 3B,支援最長 1M token 上下文,權重已在 Hugging Face 以 Apache 2.0 許可開放下載。它面向公共管理、工業與航空航天等受監管領域,針對德語、推理、數學與 agentic 行為做了專門最佳化,官方稱其品質與服務成本處於帕累托前沿,數學、程式碼、長上下文等基準可對標啟用引數最多四倍於己的模型。

Apache 2.0 權重加 3B 啟用的 MoE 結構,正好適合你在 Mac Studio 上用 MLX 或 llama.cpp 本地跑,1M 上下文與 agentic 能力也貼合 coding agent 場景。

原標題:Kolibri Has Landed: A Sovereign Open-Weight Model
閱讀原文

同一事件共有 3 則報導(2 個來源),看事件全貌

評分72 / 72(平均 72,門檻 76)
狀態未入選

相關報導

r/LocalLLaMA top of the day10/2 22:49AI 評分27

開發者開源二戰主題小模型 Peacebell,291M 與 148M 兩版

開發者 Wayne Workman 用 11 個月業餘時間從零訓練了專注二戰資訊的小語言模型 Peacebell,已開源權重與訓練材料,含 291M 和 148M 兩個引數版本。148M 版是為參加 HuggingFace 限制 150M 以內模型規模的榜單而做,同時發布了 WWII 主題基準 ww2bench,題目不公開以防進入訓練資料。模型可在 CPU 上執行,作者提供了定製 vLLM fork,並稱其長上下文表現較差,下一版預計 2027 年發布。

Cloudflare blog (AI)10/1 14:04AI 評分63

Workers AI 上線 EuroLLM 與 Apertus 兩款歐洲開源模型

Cloudflare 在 Workers AI 上線兩款由歐洲公共機構訓練的開源模型:覆蓋全部 24 種歐盟官方語言的 EuroLLM,以及瑞士 ETH Zurich、EPFL 等打造的 Apertus,今天即可申請訪問。Apertus 用逾 15 萬億 token、1500 多種語言訓練,40% 訓練資料非英語,架構、權重、資料與方法全部公開,並按 EU AI Act 與 GDPR 處理訓練退出與個人資料。

llama.cpp releases10/3 12:54AI 評分42

llama.cpp 的 OpenVINO 後端更新,MoE 推理大幅提速

ggml-openvino 後端更新至 2026.4.1,新增 MoE 路由融合與 GDN 歸一化融合,並預設在 GPU 上啟用 MoE 融合。在 Arc B390 上跑 gemma-4-26B-A4B,配合 q4_asym64 重新量化,pp512 從 66.16 t/s 提升到 1608.73 t/s,困惑度基本不變。同時修復了 stateful 執行下 rank-3 軸處理導致的 MoE 崩潰,並改進裝置列舉與記憶體上報。