10 月 5 日,美國初創公司 Reflection 發布其首個開放權重模型 Beam,並稱將於本月放出權重、技術報告、模型卡與開發者工件。Beam 是純文字稀疏 MoE 模型,總引數 5010 億、啟用 230 億,面向程式設計、推理與 agentic 負載,上下文視窗 100 萬 token。預訓練使用 23.8… 看完整事件
Reflection 發布開源權重模型 Beam,對標中國開源模型
美國初創公司 Reflection AI 發布首個前沿開源權重模型 Beam,稱其在高階推理基準上以更低推理成本對標中國領先開源模型。Beam 是純文字混合專家模型,總引數 5010 億、啟用 230 億,預訓練用了 23.8 萬億 token,上下文視窗 100 萬 token;對比 Z.ai 的 GLM-5.2 總引數約 7440 億、啟用 400 億。
給出 5010 億總引數、230 億啟用、100 萬上下文等具體規格,並宣稱推理算力省 3-4 倍,為關注開源權重模型與本地推理成本的人提供可對照的新基準。
原標題:Reflection debuts Beam, an open-weight AI model to rival Chinese models at lower compute cost
閱讀原文
| 評分 | 86 / 86(平均 86,門檻 76) |
|---|---|
| 狀態 | 精選 |
相關報導
Ollama 預告接入 Reflection AI 新開源模型
Ollama 官方帳號表示期待 Reflection AI 的新開源模型,並稱將有更多美國模型進入 Ollama。該帖未給出模型名稱、引數規模、發布時間與具體接入方式。
Aleph Alpha 發布開源主權模型 Kolibri,78B 引數 Apache 2.0
德國 Aleph Alpha 於 2026 年 10 月 3 日發布開源權重模型 Kolibri,Apache 2.0 許可,權重已上 Hugging Face。它採用 MoE 架構,總引數 78.1B,每 token 僅啟用 3.46B,支援德語和英語,原生上下文 262,144 token,知識截止 2026 年 6 月 18 日。模型在德國和芬蘭基礎設施上從零訓練,使用 768 塊 NVIDIA B200,訓練約 24 萬億 token,其中德語佔比超五分之一。
Mirror Particle 要用世界模型預測人類行為
舊金山成立兩年的 Mirror Particle 認為用 LLM 角色扮演目標人群來預測人類行為的方法行不通,改為從零訓練模擬人類動因、並追蹤其隨時間變化的世界模型。它結合客戶資料、時事、流行文化與社交媒體建模人群,重點看真實發生的「已顯現行為」而非問卷自述。公司已完成天使輪、接近敲定首輪風投,將參加 TechCrunch Disrupt 2026 的 Startup Battlefield 200。初期面向市場研究與品牌產品策略;
OpenAI 公開內部前沿模型數學成果與 Lean 形式化證明
OpenAI 於 2026 年 10 月 6 日發布由內部前沿模型產出的多項數學結果,以 GitHub 倉庫形式公開,併為其中許多證明提供 Lean 形式化驗證。倉庫同時給出 10 份模型推理摘要、以 ChatGPT Pro 用量折算的算力估算,以及嘗試題目數量的統計,平均每個結果約消耗相當於 3 小時 ChatGPT Pro 思考的算力。
Peacebell:個人從零訓練的二戰專用小模型開源
開發者用 11 個月業餘時間從零訓練了二戰主題小語言模型 Peacebell,並開源訓練材料與權重,提供 291M 和 148M 兩個引數版本。訓練資料全部為自建合成資料,基於維基百科等許可材料,作者稱大部分精力花在資料整理與平衡上。291M 版本可在 HuggingFace 免費試用,無需 GPU 即可本地執行,但作者提醒這是初版,長上下文表現較差。同時發布了 WWII 主題基準與排行榜,下一版預計 2027 年發布。