Aleph Alpha 發布 78B MoE 開源模型 Kolibri
先了解這件事AI 綜述
2026 年 10 月 3 日,德國 Aleph Alpha 發布開源權重模型 Kolibri,權重以 Apache 2.0 許可在 Hugging Face 開放下載。這是一個英德雙語 MoE Transformer,總引數 78B、每 token 啟用約 3B,官方稱其面向公共管理、工業與航空航天等受監管領域,針對德語、推理、數學與 agentic 行為做了最佳化,並稱品質與服務成本處於帕累托前沿,數學、程式碼、長上下文基準可對標啟用引數最多四倍於己的模型。據 Hacker News 上的介紹文章,該模型為 78.1B 引數、每 token 啟用 3.46B,FP8 權重約 78 GB,知識截止 2026 年 6 月 18 日,在德國和芬蘭的基礎設施上從零訓練,設計時即考慮 EU AI Act,189 頁技術報告與模型卡已公開。r/LocalLLaMA 的帖子補充:訓練使用 768 張 B300、耗時 4 周、20T token,語料約 62.5% 英文、23.9% 德文、13.6% 程式碼。上下文長度各來源說法不一:官方發布與 Hugging Face 頁面稱最高 1M token,而上述介紹文章稱原生上下文為 262,144 token;啟用引數也有 3B 與 3.46B 兩種表述。此外其前身 Kolibri Origin 為 30B 總參、3B 啟用、65k 上下文。對本地推理而言,目前尚無量化版本,llama.cpp 是否支援該架構未知,社群評測認為其效能接近 Qwen 3.5 35B。
AI 根據 3 則報導生成 · 10/3 15:40 更新
報導時間線
沿著報導,了解事件的不同側面;點標題看單篇報導的摘要與原文連結。
沒有符合條件的報導。
本事件熱度走勢
為什麼熱
過去 48 小時,有 2 個獨立來源報導,最近 6 小時新增 0 個。熱度 1.1,熱門榜第 6 名。
熱度以 48 小時內的獨立來源計,同一來源只算一次,每 24 小時權重減半。
事件紀錄
- 最早報導
- 10/3 10:36
- 最近更新
- 10/3 12:44
同一事件的報導集中在這裡,新的進展會繼續補充。