2026 年 10 月 3 日,德國 Aleph Alpha 發布開源權重模型 Kolibri,權重以 Apache 2.0 許可在 Hugging Face 開放下載。這是一個英德雙語 MoE Transformer,總引數 78B、每 token 啟用約 3B,官方稱其面向公共管理、工業與航空航天等受監管領域,針對… 看完整事件
Aleph Alpha 發布開源模型 Kolibri,Apache 2.0 權重
德國 Aleph Alpha 於 2026 年 10 月 3 日發布開源權重模型 Kolibri,Apache 2.0 許可,權重已上 Hugging Face。它是 78.1B 引數的 MoE 模型,每 token 僅啟用 3.46B,支援德語和英語,原生上下文 262,144 token,FP8 權重約 78 GB,知識截止 2026 年 6 月 18 日。
你在倫敦用 coding agent 並準備用 Mac Studio 跑本地模型,可以關注它的 Apache 2.0 權重、德語 tokenizer 效率與 78 GB FP8 記憶體需求,判斷是否適合本地部署。
原標題:Show HN: Germany's new sovereign AI model Kolibri
閱讀原文
| 評分 | 76 / 72(平均 74,門檻 76) |
|---|---|
| 狀態 | 未入選 |
相關報導
開發者開源二戰主題小模型 Peacebell,291M 與 148M 兩版
開發者 Wayne Workman 用 11 個月業餘時間從零訓練了專注二戰資訊的小語言模型 Peacebell,已開源權重與訓練材料,含 291M 和 148M 兩個引數版本。148M 版是為參加 HuggingFace 限制 150M 以內模型規模的榜單而做,同時發布了 WWII 主題基準 ww2bench,題目不公開以防進入訓練資料。模型可在 CPU 上執行,作者提供了定製 vLLM fork,並稱其長上下文表現較差,下一版預計 2027 年發布。
Workers AI 上線 EuroLLM 與 Apertus 兩款歐洲開源模型
Cloudflare 在 Workers AI 上線兩款由歐洲公共機構訓練的開源模型:覆蓋全部 24 種歐盟官方語言的 EuroLLM,以及瑞士 ETH Zurich、EPFL 等打造的 Apertus,今天即可申請訪問。Apertus 用逾 15 萬億 token、1500 多種語言訓練,40% 訓練資料非英語,架構、權重、資料與方法全部公開,並按 EU AI Act 與 GDPR 處理訓練退出與個人資料。
Kolibri 技術報告發布,聚焦高效推理
Kolibri 技術報告已發布,主題為高效推理。報告以 PDF 形式公開,發布時間為 2026 年 10 月 3 日。目前公開內容僅為 PDF 檔案本身,未提供更多關於模型規模、效能資料或使用方式的細節。
llama.cpp 上線 Decision 模型與 /v1/systemone 端點
llama.cpp 最新建置已支援 Decision 模型,新增 /v1/systemone 端點,可在本地高效、私密地做 Jev 風格推理。該端點支援多個開源模型,後續還會增加。
Kyojin 引擎讓兩臺 300B MoE 模型各跑在單臺 128GB Strix Halo 上
基於 ExLlamaV3 的 Kyojin 引擎在 AMD Strix Halo(gfx1151、ROCm)上讓兩個 300B 級 MoE 模型各裝進一臺 128GB 迷你主機:GLM-5.3-Flash 佔 99.7GB,3.5K 上下文預填充 580 tok/s,解碼 26 到 30 tok/s;MiMo-V2.6-Flash 佔 105GB,解碼最高 44 tok/s(程式碼場景)。