ggerganov 分享微軟 WinML 官方部落格連結
ggerganov 在 X 上發帖,指向微軟開發者部落格中一篇關於 WinML 的文章(連結路徑為 foundry-on-windows/build-on-winml-oct-7-26),並稱該部落格裡有更多資訊。推文字身沒有展開文章內容,只給出了連結,部落格位於 devblogs.microsoft.com,日期標註為 10 月 7 日。
依意思最接近的 10 筆
ggerganov 在 X 上發帖,指向微軟開發者部落格中一篇關於 WinML 的文章(連結路徑為 foundry-on-windows/build-on-winml-oct-7-26),並稱該部落格裡有更多資訊。推文字身沒有展開文章內容,只給出了連結,部落格位於 devblogs.microsoft.com,日期標註為 10 月 7 日。
OpenWAM 是一個面向世界-動作模型的開放框架,讓影片預測與動作生成按不同順序組合,也能把獨立訓練的影片預測器、逆動力學模型(IDM)與前向動力學模型(FDM)在推理時拼接。它基於 Wan2.2-5B 適配機器人影片,在約 334 萬條軌跡、14640 小時影片上預訓練,用 32 張 NVIDIA B200 訓練 14 天,再以 5B 影片專家加 2B 動作專家組成 MoT 架構加入控制。
Ollama 發布 v0.40.0,在 Apple Silicon 裝置上,MLX 執行時支援的模型架構將自動改用 MLX 執行。可用模型包括 qwen3.8、gemma4、qwen3.6、qwen3.5,決策模型 Nimble、tev1、clef、clef-flash 也已登陸 MLX,官方稱會繼續測試並啟用更多模型。
Ollama 發布 v0.40.0,在 Apple Silicon 裝置上,MLX 執行時支援的模型架構會自動改用 MLX 執行。官方範例為 ollama pull qwen3.8 與 ollama run qwen3.8,其他可用模型還包括 gemma4、qwen3.6 和 qwen3.5;決策模型 Nimble、tev1、clef、clef-flash 也已支援 MLX,並新增嵌入模型 embeddinggemma-2 支援。官方表示會繼續測試並啟用更多模型。
Ollama 發布 v0.40.0,在 Apple Silicon 裝置上,MLX 執行時支援的模型架構將自動改用 MLX 執行。官方範例為 ollama pull qwen3.8 與 ollama run qwen3.8;預發布期間會繼續測試並啟用更多模型。
作者搭建了魔獸世界私服 jankcraft.xyz,並開發瀏覽器客戶端,PC 和手機均可免費遊玩。隨後用自訂 MCP 與 agent harness 通過 websocket 控制客戶端,讓 LLM 自動玩遊戲,agent 頁面已上線。本地模型需服務端開啟 CORS,作者自託管的幾個模型可能因用量增長下線;24GB 記憶體可跑 Qwen3.8-27B-GPTQ-W4A16,16GB 記憶體可用 vLLM 跑 Gemma4-e4b-coder。
Ollama 發布 v0.40.0:在 Apple Silicon 裝置上,MLX 執行時支援的模型架構會自動改用 MLX 執行。本次納入 MLX 的模型包括 qwen3.8、gemma4、qwen3.6、qwen3.5,決策模型 Nimble、tev1、clef、clef-flash 也已支援。可用 ollama pull / run qwen3.8 拉取與執行,官方稱將繼續啟用更多模型。
llama.cpp 發布建置 b11459,唯一列出的程式碼改動是 ggml-webgpu 在 WASI 上不再啟用 Dawn 原生特性。該建置的預編譯產物覆蓋 macOS Apple Silicon(arm64)與 Intel(x64)、iOS XCFramework、Linux、Android、Windows 以及 openEuler。後端包括 CPU、Vulkan、CUDA 12、CUDA 13、ROCm 10.0、OpenVINO 與 SYCL;
輝達與微軟在舊金山 Windows AI 活動上宣布,為 Windows PC 共同設計可常駐執行 AI agent 的軟硬體。RTX Spark 筆記本當日開啟預售、10 月 16 日發售,緊湊桌上型電腦 11 月上市,最高 128GB 統一記憶體與 1 petaFLOP FP4 算力,可在本地不限量執行 125B 的 Qwen 3.8 Flash Next 等模型。系統級容器 MXC 正式可用,讓 agent 在 Windows 中安全後臺常駐;
開發者用 11 個月業餘時間從零訓練了二戰主題小語言模型 Peacebell,並開源訓練材料與權重,提供 291M 和 148M 兩個引數版本。訓練資料全部為自建合成資料,基於維基百科等許可材料,作者稱大部分精力花在資料整理與平衡上。291M 版本可在 HuggingFace 免費試用,無需 GPU 即可本地執行,但作者提醒這是初版,長上下文表現較差。同時發布了 WWII 主題基準與排行榜,下一版預計 2027 年發布。