Ollama blog● 精選8/11 01:00AI 評分84
NVIDIA Nemotron 3.5 Lightning 上線 Ollama,30B 總引數僅 3B 啟用
NVIDIA 於 2026 年 8 月 11 日發布 Nemotron 3.5 Lightning,並已上線 Ollama,可完全在本地裝置執行。該模型為 30B 總引數、每 token 僅 3B 啟用的開放模型,採用混合 MoE 架構,支援最高 1M token 上下文,面向持續執行的 agent 任務。
找到 4 筆;也可以試試 語意搜尋
NVIDIA 於 2026 年 8 月 11 日發布 Nemotron 3.5 Lightning,並已上線 Ollama,可完全在本地裝置執行。該模型為 30B 總引數、每 token 僅 3B 啟用的開放模型,採用混合 MoE 架構,支援最高 1M token 上下文,面向持續執行的 agent 任務。
NVIDIA 以監督微調、強化學習和反饋式推理專門化 Nemotron 3,在 IOI 2026 與 IMO 2026 雙雙達到金牌水平。IOI 2026 的 Nemotron-3-Ultra-CC 在與人相同的時限和提交限制下取得 535.4/600,高於 361.12 的金牌線和人類最高分 498.27,但屬非官方、無監督基準,未計入官方排名。
輝達《State of AI in Telecommunications》報告顯示,89% 受訪者認為開源模型與軟體對公司 AI 戰略重要。運營商看重開源模型的可信任、可控與可定製,用於自主網路、客服等關鍵負載,並把閉源模型留給價值最高的場景;輝達同時發布 300 億引數的 Nemotron 3 Large Telco Model(由 AdaptKey 在開源電信資料集上微調),並提供基於 NeMo 的端到端微調流程。
MLX 發布 v0.31.2,新增 Gemma 4 模型支援及其工具呼叫解析器,並加入 Nemotron super 支援。本次更新為非可裁剪快取引入系統提示與使用者訊息快取,重構批次生成器,修復推測解碼輸出損壞、GatedDeltaNet 快取記憶體洩漏等問題,同時新增伺服器 --allowed-origins 引數。