AISpot
所屬事件:Reflection 發布首個開放權重模型 Beam,501B-A23B(3 個來源 · 3 則報導)

10 月 5 日,美國初創公司 Reflection 發布其首個開放權重模型 Beam,並稱將於本月放出權重、技術報告、模型卡與開發者工件。Beam 是純文字稀疏 MoE 模型,總引數 5010 億、啟用 230 億,面向程式設計、推理與 agentic 負載,上下文視窗 100 萬 token。預訓練使用 23.8… 看完整事件

Reflection 發布 501B-A23B 開源 MoE 模型 Beam,權重本月以 Apache 2.0 放出

Latent Space10/6 07:28新聞報導模型產品與方案開發工具開源訂閱動態

美國初創公司 Reflection 發布開源權重模型 Beam:501B 總引數、23B 啟用的文字 MoE,面向 coding、agentic 與科研任務,Apache 2.0 全權重本月放出。官方稱預訓練用了 23.8T token,在約 10500 張 GB300 上各跑四周預訓練與 RL,SWE-bench Verified 得分 80.9,推理效率為 GLM 5.2 的 3 到 4 倍。

Reflection 從零訓練並開源的 501B 級 MoE,公開了 10K GB300 訓練規模與 80.9 SWE-bench 成績,便於關注開源權重與本地推理的人判斷其真實水平。

原標題:[AINews] Reflection Beam - 501B-A23B American Open Model
閱讀原文

同一事件共有 3 則報導(3 個來源),看事件全貌

評分88 / 92(平均 90,門檻 65)
狀態精選

相關報導

Hacker News front page● 精選10/3 11:43AI 評分85

Aleph Alpha 發布開源主權模型 Kolibri,78B 引數 Apache 2.0

德國 Aleph Alpha 於 2026 年 10 月 3 日發布開源權重模型 Kolibri,Apache 2.0 許可,權重已上 Hugging Face。它採用 MoE 架構,總引數 78.1B,每 token 僅啟用 3.46B,支援德語和英語,原生上下文 262,144 token,知識截止 2026 年 6 月 18 日。模型在德國和芬蘭基礎設施上從零訓練,使用 768 塊 NVIDIA B200,訓練約 24 萬億 token,其中德語佔比超五分之一。

llama.cpp releases● 精選10/3 12:54AI 評分70

llama.cpp 的 OpenVINO 後端更新至 2026.4.1 並大幅最佳化 MoE 效能

ggml-openvino 後端更新到 2026.4.1,重點最佳化 Qwen3.5 MoE 推理效能,並新增推理效能分析、預設使用遠端輸出張量、磁碟快取模型直載(cache_only)等能力。在 Arc B390 上以 q4_asym64_all 重量化執行 gemma-4-26B-A4B,pp512 從 66.16 t/s 提升到 1608.73 t/s,tg128 從 25.94 提升到 26.46 t/s,困惑度基本不變。

r/LocalLLaMA top of the day10/2 22:49AI 評分43

Peacebell:個人從零訓練的二戰專用小模型開源

開發者用 11 個月業餘時間從零訓練了二戰主題小語言模型 Peacebell,並開源訓練材料與權重,提供 291M 和 148M 兩個引數版本。訓練資料全部為自建合成資料,基於維基百科等許可材料,作者稱大部分精力花在資料整理與平衡上。291M 版本可在 HuggingFace 免費試用,無需 GPU 即可本地執行,但作者提醒這是初版,長上下文表現較差。同時發布了 WWII 主題基準與排行榜,下一版預計 2027 年發布。