Mistral 與 Mozilla 合作,Firefox AI 助手改用 Mistral 模型
Mozilla 的 AI 瀏覽助手 Firefox Smart Window(beta)現由 Mistral 模型驅動,首批面向法國和北美使用者,英國與德國預計今年晚些時候跟進。Smart Window 可處理複雜搜尋、找回此前點選過的內容,並基於瀏覽器標籤頁整理資訊。雙方稱對話預設不儲存在 Mozilla 伺服器上,Mistral 同意零資料保留,模型還針對地區語言和方言做了微調。
Mozilla 的 AI 瀏覽助手 Firefox Smart Window(beta)現由 Mistral 模型驅動,首批面向法國和北美使用者,英國與德國預計今年晚些時候跟進。Smart Window 可處理複雜搜尋、找回此前點選過的內容,並基於瀏覽器標籤頁整理資訊。雙方稱對話預設不儲存在 Mozilla 伺服器上,Mistral 同意零資料保留,模型還針對地區語言和方言做了微調。
Anthropic 宣布自 2026 年 9 月 16 日起,Claude Cowork 與聊天合併為同一個 Claude,任務不再需要使用者選擇入口。同時新增 Claude Docs 與 Claude Slides,Claude Design 也可直接在對話中使用,三者均處於 beta 階段。該功能未來幾週先向 Pro 和 Max 訂閱方案推送,Team 與 Free 方案隨後跟進,Enterprise 管理員將在變更前至少 30 天收到通知。
Anthropic 於 2026 年 9 月 15 日為 Claude for Small Business 推出 43 個工作流和 27 個新整合,接入 Shopify、Salesforce、TikTok、Zoom、Xero、Stripe、Zapier 等工具,並配套免費線下工作坊與合作伙伴網路研討會。該產品 5 月上線以來安裝量已超 90 萬次,此次更新側重獲客、回覆諮詢、撰寫提案與日常報表。
DeepSeek 於 2026 年 9 月 10 日 04:00 UTC 起啟用 V4.1-Flash 的新 API 價格,官方稱其架構更高效,能以更低成本服務更多使用者並把節省讓利給使用者。定價繼續區分高峰與非高峰時段,非高峰費率為高峰的 50%,彈性任務可安排到非高峰時段以節省成本。
DeepSeek 在 API 上線 V4.1-Flash,原生支援多模態,呼叫時把模型設為 deepseek-flash 即可。V4-Flash 與 V4-Flash-Vision-Exp 已退役,舊模型名暫時路由到 V4.1-Flash 以保持相容。多方測試顯示 V4.1-Flash 在效能、成本、速度和總執行時間上均優於 V4-Pro,V4-Pro 正被淘汰;
DeepSeek 公布 V4.1-Flash 的 KV cache 相比上一代只需 1/4 的 HBM 和 1/8 的 SSD 儲存。官方指出快取命中費用常佔 agent 成本很大比例,壓縮快取可顯著降低這部分開銷。
Mistral 與 Cloudera 於 2026 年 9 月 10 日宣布合作,將 Mistral 模型整合進 Cloudera 混合資料平台,支援企業在私有云、公有云、本地及完全氣隙環境中部署推理,並保留完整控制權。企業還可在受控環境內用自有資料訓練定製模型,資料與模型所有權歸企業。Cloudera 平台承載 30 EB 客戶自管資料,雙方瞄準金融、製造、電信等受監管行業的主權 AI 需求。
Kimi Work 現已支援遠端控制:在電腦上保持 Kimi Work 執行,即可用手機繼續推進任務。官方稱可在任意時間、任意地點使用 Kimi Work 辦公。目前未公布支援的具體平台、連線方式或價格資訊。
OpenRouter 於 2026 年 9 月 9 日上線美國 In-Region Routing,此前 2025 年 10 月已推出歐盟版本。使用者把請求發往 us.openrouter.ai 或 eu.openrouter.ai,請求在該區域內解密並只路由到同區域的服務商端點,API key、模型 ID 和帳戶設定均不變。若區域內沒有服務商能提供該模型,請求會返回 404 而不會繞道區域外。
Mistral 為一家歐洲能源運營商將 4 萬行 Fortran 77 編寫的油藏模擬器遷移到 C++,該程式碼庫沒有測試套件和集中文件。做法是先建置數值一致性校驗框架,再用 Vibe CLI 排程上百個 agent 逐節點生成文件並提交 PR,由審查 agent 定時複核。首次嘗試讓 agent 完全自主翻譯,結果只是把 Fortran 按 C++ 語法重寫,COMMON 塊和 GOTO 控制流原樣保留,未實現真正的現代化重構。
Mistral AI 發文稱,其開放權重模型、產品與基礎設施讓組織可以自主選擇 AI 的執行方式和部署位置,而不只是獲得模型訪問權。該公司強調這能帶來前沿效能,同時避免供應商鎖定。完整內容發布在 Mistral 官網新聞頁。
OpenRouter 發布 openrouter:shell 伺服器工具和 Files API,任何模型都能在託管 Linux 容器中執行命令並讀寫檔案,兩項功能均處於 beta 階段。沙箱按每秒 0.0001 美元計費並計入請求費用,容器空閒 5 分鐘後休眠,網路預設關閉且策略啟動後不可更改。
智譜 GLM Coding Plan 迎來上線一週年,官方宣布向所有現有訂閱者贈送一張 Reset Card,可用於重置每週額度和 5 小時額度。該福利覆蓋個人版與團隊版訂閱使用者,官方未說明領取截止時間或使用期限。
Ollama 於 2026 年 8 月 31 日宣布 Pro、Max、Team 計劃改用按 token 的透明定價,每個計劃含每月重新整理的用量額度:Pro 每月 20 美元含 60 美元用量,Max 每月 100 美元含 300 美元,Team 每月 500 美元含 1000 美元共享用量且不限席位。免費計劃也提供少量入門模型額度,可充值按量付費使用全部模型。
Bionic 新增名為 Auto Review 的 shell 命令審批模式,先由確定性的 Shell Judge 做 AST 解析、能力提取與命令匹配,判定安全即直接執行,否則交給 Shell Reviewer 子代理結合會話記錄複核。Shell Judge 支援 sh、bash、zsh 與 PowerShell,官方稱當前版本可自動批准其代理執行命令中的 82%,且不呼叫 LLM。Bionic 預設零資料保留,範例命令來自內部測試裝置。
Anthropic 為桌面版 Claude Cowork 加入內建瀏覽器,Claude 可在側邊面板中自行開啟網頁、閱讀內容、點選和輸入,無需安裝擴充套件或做任何設定。該瀏覽器與使用者自己的瀏覽器相互獨立,看不到使用者的標籤頁、書籤和密碼,登入資訊可按站點從 Chrome、Edge 或 Firefox 匯入,銀行、信箱和單點登入站點預設排除。本週起向桌面端 Pro、Max、Team 套餐推送並預設開啟,Enterprise 管理員即日起可在組織設定中啟用。
Anthropic 於 2026 年 8 月 26 日宣布 Claude in Chrome 正式可用,覆蓋所有付費 Claude 方案。該擴充套件可讀取當前頁面、點選連結、跨標籤頁導航、填寫表單,並使用已有登入資訊,還能在瀏覽器中自主執行操作而無需逐次批准,由安全分類器在執行前校驗動作。它面向內部儀表盤、遺留系統和供應商門戶等未接入 Claude 的工具。
2026 年 8 月 25 日起,開發者可在 Ollama 中開啟 Claude 開關,自動把 Ollama 配置為 Claude Desktop 的第三方閘道器,從而在 Claude 裡使用 Ollama 的本地模型或雲端模型。關閉該開關即可恢復原有 Claude 配置,也可繼續切換回 Anthropic 模型。Ollama 表示預設關閉遙測,並對所有模型與服務執行零資料保留政策,提示與資料不會傳送給 Anthropic 或 Ollama。
OpenRouter 上線 Visual Image Benchmarks,用於橫向評估其平台上的 39 個影像模型(截至 2026 年 8 月)。測試提示詞分為七類:不可能場景、計數、文字、空間關係、否定、編輯與一致性,結果以網格展示並可按價格和生成時間排序。該工具旨在彌補輸出樣本經過挑選、LLM 評審難以捕捉細節、競技場分數只反映偏好而非能力的問題,後續還將擴充套件到影片與音訊等模態。
月之暗面 Kimi 官方帳號發布 Kimi Work 系列第二篇教程,面向金融分析師演示三類投資研究任務:搭建即時投資者儀表盤、在電子表格中更新財務模型、批次處理並生成報告。官方表示後續還會發布更多 Kimi Work 工作流。
LM Studio 的 Bionic 代理現已支援使用、安裝和建立 agent skills,採用 Agent Skills 標準(SKILL.md 檔案)。使用者可讓 Bionic 從剛完成的任務或對話中生成 skill,用 @ 語法呼叫,還能在設定中匯入 Codex、Claude Code 等應用已有的 skills,或直接給 URL 讓代理安裝。
月之暗面旗下 Kimi K3 模型已在 Databricks 平台上線,使用者可通過該平台呼叫這一模型。該訊息由 Kimi 官方帳號於 2026 年 8 月 11 日發布,正文未披露定價、上下文長度或具體可用區域等細節。
Meta 發布 30B 開源模型 Muse Glimmer,採用 Apache 2.0 許可,發布當天即可在 LM Studio Bionic 中下載並本地執行。該模型面向本地 agent 工作流,支援多步任務、工具呼叫與影像輸入,可在 Mac 和 PC 上執行。在 LM Studio 內部評測 BionicBench v0.1 的 18 項任務中完成率 83.3%,高於 Gemma 4 31B 與 Qwen 3.6 27B 的 77.7%。
Anthropic 於 2026 年 6 月 18 日宣布 Claude Code 支援 artifacts,能把會話中的工作進度轉成可即時更新、可分享的互動式網頁,如 PR 講解、系統說明、儀表盤和發布清單。artifacts 基於會話完整上下文建置,涵蓋程式碼庫、聯結器和對話本身,無需自行接入資料來源或搭建基礎設施;頁面原地重新整理,同一連結發布新版本並保留版本歷史。