OpenAI DevDay 發布 GPT-6.1 Sol、Dots 與 Agents API
OpenAI 在 DevDay 上發布 GPT-6.1 Sol、個人助理產品 Dots,以及內建 Computer Use 的 Agents API,開發者可基於與 Codex、ChatGPT 相同的 Computer Use 建置應用。Ari Weinstein 稱 GPT-6.1 Sol 成本是 Astra 的五分之一,用在 Computer Use 上只需七分之一。
OpenAI 在 DevDay 上發布 GPT-6.1 Sol、個人助理產品 Dots,以及內建 Computer Use 的 Agents API,開發者可基於與 Codex、ChatGPT 相同的 Computer Use 建置應用。Ari Weinstein 稱 GPT-6.1 Sol 成本是 Astra 的五分之一,用在 Computer Use 上只需七分之一。
Google 於 2026 年 9 月 30 日發布新前沿模型 Gemini 4 Argon,先通過 Fairwind Program 向受信任的網路安全防禦方開放,之後再逐步提供給開發者、企業和消費者。它的輸出上限從 64K 提升到業界領先的 1M token,介紹價輸入每百萬 token 2 美元、輸出 10 美元,快取輸入享 95% 折扣。
Claude Code 發布 v2.1.286,本次更新幾乎全是修復與小幅改進。權限請求堆疊時提示框會顯示類似 2 of 5 的計數;全屏模式下列表的 N more 行支援滑鼠點選跳轉,並帶懸停與按下狀態。
OpenAI 發布新報告,介紹小企業如何用 AI agent 完成獲客、產品開發和財務管理等工作。同時 OpenAI 與美國小企業發展中心(ASBDC)建立合作,為更多企業主提供實操 AI 培訓和本地指導。
阿里 Qwen 宣布 Qwen3.8-27B 已可通過 Nebius 訪問。官方稱這是一個 27B 稠密模型,適用於建置 agent 或做深度研究等多步工作流場景。目前公布的資訊僅限接入渠道與模型規格,未提及價格、上下文長度或開放區域。
Ollama v0.35.0 新增決策模型支援,通過 /v1/systemone 端點呼叫,基於 TypeSafe 的 Jev API。這類模型不返回文字,而是返回選擇、機率和分數,適合工單分流、模型路由和內容分類;目前可用 Bespoke Labs 的 Nimble 和 Together AI 的 Tev1,用 ollama pull nimble 拉取。
Simon Willison 點評了 OpenAI 在 DevDay 2026 發布的 GPT-6.1 Sol:智慧接近 Astra,價格只有其五分之一。他當天在直播 DevDay 主題演講,因此發帖稍晚,並附上該模型的 pelican-riding-a-bicycle 生成圖。但這些圖和 GPT-6 家族的同類測試圖相比沒有明顯差別。
OpenAI 宣布 Ultrafast 即日起在 Codex、ChatGPT Work 和 API 中面向 GPT-6 Astra 開放,GPT-6.1 Sol 稍後支援。同時推出新訂閱方案 Pro 500,用量上限為 Plus 的 25 倍,是當前最高額度,並可訪問 Ultrafast。Codex 與 ChatGPT Work 使用者需通過該方案使用。
OpenAI 宣布重新開放 Pro 200 訂閱,訂閱者可繼續使用 Astra 等前沿模型,並新增 GPT-6.1 Sol 模型,官方稱其具備接近 Astra 的日常使用能力。OpenAI 同時承諾不會重新引入 5 小時使用限制,使用者可自行安排每週額度。
OpenAI 宣布 Codex Security Cloud 迎來重大升級,預設通過 Daybreak Blue 提供具備網路安全能力的模型。該服務可掃描整個 GitHub 倉庫、持續審查新提交、調查並去重發現的問題,並生成待審閱的修復方案,即使本地裝置關閉也能執行。目前以外掛形式在 Codex 桌面端和網頁端提供。
Anthropic 於 9 月 29 日至 10 月 6 日通過 Anthropic Interviewer 發起新研究,收集使用者對 AI 的使用體驗、期望角色及對開發公司的訴求。參與者可選擇公開回答,供任何人查閱,結果將影響 Anthropic Institute 的研究與公司決策。Claude 和 Claude Code 的 Free、Pro、Max 使用者均可參加。去年 12 月的同類研究有 81,000 人參與。
GPT-6.1 Sol 現已在 Codex 和 ChatGPT Work 中提供,官方稱其複雜工作的表現接近 Astra,但成本低於 Astra。它適合程式碼、應用和文件類可重複、長時間執行的任務,呼叫模型名為 gpt-6.1-sol。可用性取決於你的套餐、客戶端和工作區設定,具體支援情況需查閱 Models 文件來對比與選擇模型。
Ollama 0.35 起支援基於 TypeSafe Jev API 的決策模型:通過新的 /v1/systemone 端點,把文字作為 state、配上一組命名問題,本機模型在一次請求裡全部作答,且無額外費用。首批三個模型為 Bespoke Labs 的 9B nimble,以及 Together AI 的實驗性 4B tev1 和 0.8B tev1:0.8b,用 ollama pull 即可下載,可通過 curl 或 TypeSafe 官方 Python SDK 呼叫。
Anthropic API 新增 Claude Sonnet 5.5(claude-sonnet-5-5),併成為預設 Sonnet 模型:1M 上下文,輸入 $2、輸出 $10 每百萬 token,快取讀取 $0.20 每百萬 token。
Anthropic 發布 Claude Sonnet 5.5,已在 Claude API、Amazon Bedrock、AWS 上的 Claude Platform、Google Cloud 和 Microsoft Foundry 上線。
OpenRouter 上線 Security Center,所有套餐型別均可用,入口在 Settings > Security,用於集中檢視並批次處理帳號下所有 API key。
Google 於 9 月 24 日發布 Gemini 3.8 Live with Live Avatar,把近即時影片生成與語音結合,為企業的對話 AI 加上唇形同步、表情與流暢輪替的視覺形象,即日起在 Gemini Enterprise 提供。它支援非同步工具呼叫,可在對話不中斷的情況下後臺取數;原生語音到語音同步可跨 97 種語言切換,且不降低影片品質、不產生畫面漂移。
v0.34.4 發布,更新了 llama.cpp、MLX 和 XGrammar,Qwen 3.8 的提示處理在 Apple Silicon 上更快,Gemma 4 會為每張圖片自動選擇最佳解析度以保留更多高畫質細節。思考模型的結構化輸出改為單次推理完成,速度更快也更可靠;同時修復了本地模型庫很大時偶發的 model not found 報錯,以及 macOS 應用在檢測 ChatGPT 或 Codex 是否執行時無回應的問題。
Anthropic 自 2026-09-24 起,對在任何輸出前被拒、且 stop_details.category 為 bio、frontier_llm、reasoning_extraction 的請求恢復計費,按執行該請求的模型費率收取,所有平台適用;其他類別的輸出前拒答仍不計費,fallback credit 不變。流式輸出中途的拒答此前已在計費。
Google Beam 正式擴充套件到美國、加拿大、英國、法國、德國和日本六國,由 18 家渠道夥伴負責部署與支援。硬體由 HP 以 HP Dimension with Google Beam 的形式交付,相容 Google Meet 與 Zoom。Google 為期八週的內部研究顯示,使用 Beam 的團隊連線感提升 50%、反饋被清楚理解的把握高 33%、需要額外跟進會議的情況減少 21%。
LM Studio 宣布其 Bionic 功能新增內建互動式畫布,可建立 Excalidraw 圖表,人和 Bionic 都能檢視並編輯。使用者可用它協作繪製原型圖、系統設計與流程圖,並要求 Bionic 將其實現。
Google 在 2026 年 9 月 23 日宣布為 Private AI Compute 平台加入伺服器端持久記憶:加密資料存在雲端專用儲存,解密金鑰只儲存在使用者裝置上,模型需要時通過端到端加密通道在 secure enclave 內臨時解密處理。此前該平台是無狀態的,任務一結束就清除全部上下文。Google 同時發布伺服器軟體的防篡改公開記錄,供裝置在傳送資料前驗證,並給出由一家網路安全公司完成的獨立審計結果。
Google 推出 Gemini 3.8 Flash TTS 與 Gemini 3.8 Flash-Lite TTS 兩款文字轉語音模型,是 Gemini 迄今最有表現力的音訊生成模型,已在 Google AI Studio、Gemini API、Gemini Enterprise、Gemini Notebook 和 Google Vids 上線。
Claude API 的快取診斷已結束 beta,正式可用,不再需要 cache-diagnosis-2026-04-07 這個 beta header。開發者只要在 Messages 請求里加上 diagnostics 物件即可啟用;仍傳送舊 header 的請求行為保持不變。POST /v1/messages 的回應現在總會包含 diagnostics 欄位,請求未帶 diagnostics 物件時該欄位為 null。
ChatGPT iOS 版 1.2026.258 重設了主介面,並在橫屏下新增 iPad 分屏檢視,把任務列表與當前開啟的任務並排顯示。該版本還新增瀏覽巢狀 Git 倉庫內改動的支援,側邊對話會沿用附件、選中文字與評審評論,新任務會保留所選計算機並更好識別專案檢出與 worktree。修復項包括排隊提示開始時回覆顯示空白或不完整、裝置時鐘錯誤導致的配對失敗,以及 Mac 與 Linux 上的 SSH 連線問題。
Kimi WebBridge 正式更名為 Kimi 瀏覽器擴充套件,使用者可在瀏覽器側邊欄與 Kimi 對話,讓它瀏覽網站、填寫表單並完成任務。針對重複性操作,可錄製一次步驟並儲存為技能,之後由 Kimi 自動執行。該擴充套件已在官網和 Chrome 應用商店上線。
月之暗面的 Kimi K3 已在 Amazon Bedrock 上線,可用於編碼、文件分析和長流程 agent 工作流,並支援顯式 prompt caching。使用者可沿用 Bedrock 的訪問、加密與審計控制,通過 AWS 官方模型卡文件開始接入。
Anthropic 發布 Claude Opus 5.5,面向長時間執行的 agentic coding 與知識工作,預設 1M token 上下文、128k 最大輸出,每百萬 token 輸入 $4、輸出 $20(Opus 5 為 $5/$25),已上線 Claude API、Amazon Bedrock、AWS、Google Cloud 與 Microsoft Foundry。
OpenRouter 上線 Batch API:把大量請求打包提交,由供應商在 24 小時視窗內自行選擇完成時間,換取通常為按 token 正常價 50%(有時更低)的折扣,現支援 70 多個模型。兩週 beta 期內 23 萬多個批次的中位完成時間是 7 分鐘,90% 在一小時內,太平洋時間 5 點到中午提交明顯更慢。支援 chat completions、responses、messages 和 embeddings,結果逐條獨立返回,輸入與結果保留 30 天;
GPT-6 Sol 與 GPT-6 Luna 正陸續推送至 Codex 與 ChatGPT Work,token 價格低於上一代 GPT-5.6。Sol 適合複雜編碼與 agentic 工作流,Luna 面向高頻、聚焦型任務;Plus、Pro、Business、Enterprise、Edu 使用者均可使用,Free 與 Go 使用者可在桌面端使用 Luna。在 ChatGPT 中兩個模型只在 Work 和 Codex 提供、Chat 裡不可用,需在模型選擇器中選擇;
2026 年 9 月 22 日起,Google AI 訂閱使用者在 Colab 中獲得高階權益:優先使用更快的加速器和更強的機器;Google AI Ultra 訂閱者還解鎖後臺不間斷執行和 Premium GPU 訪問,長時間訓練不必一直開著瀏覽器標籤。已有 Colab 訂閱內容不變,Google AI 訂閱權益可以疊加。
LM Studio 上線名為 Splash 的實驗性推理後端,使用者可在 Settings > Runtime > Experimental backends 中啟用。官方建議配置為 M3 或更新的 Mac、macOS 26.4 及 36GB 以上記憶體,支援的模型可在應用內搜尋 "incoai" 下載。
LM Studio 宣布與 inco_ai 合作,在發布首日(day 0)接入其 Splash 推理引擎,用於在本地執行 Qwen3.8-27B。官方給出的實測資料是在 M5 Max 上最高可達 144 tok/s。使用者可通過 LM Studio 官方部落格的連結獲取並立即執行。
Google 的 Envisioning Studio 在 Google Labs 支援下,與設計師 Jane Wade 和 Sergio Hudson 用 AI 創作工具 Google Flow 各開發了一款定製工具,成果已在 2026 年紐約時裝週秀場上使用。Jane 的 Styling Suite 能在數字模特上挑選髮型、妝容、配飾、鞋履與服裝,先做虛擬造型再決定是否打樣,省下原本長達三天的線下選角與試裝。
Gemini API 在 2026 年 9 月 18 日的更新中把 Gemini 2.5 系列模型的存取權限限制為過去曾實際使用過它們的使用者。2.5 並未被棄用,仍會繼續通過 API 提供服務,直至另行通知。新專案官方建議改用最新的 3.5 Flash-Lite 或 3.8 Flash,官方稱這是為了給舊工作流和新應用都保留足夠容量。
ChatGPT 面向 iOS 發布 1.2026.251 版,新增在檔案選擇器中直接建立資料夾,並支援寫作塊(writing blocks),帶草稿候選與複製操作。任務側改進包括:每個專案會記住 worktree 模式與配置環境,排隊中的長提示詞改為緊湊預覽、點選展開,並修復重開後排隊提示詞丟失或顯示過期、worktree 任務卡片在配置完成後打不開等問題。
LM Studio 發布部落格,介紹 Bionic 中的 Introspection(內省)與 Session References(會話引用)兩項功能。官方給出部落格連結,供使用者瞭解詳情,但未在推文中說明具體能力、適用平台或版本要求。
Anthropic 於 2026 年 9 月 17 日推出生命科學驗證計劃(LSVP),讓通過驗證的生命科學團隊在 Mythos、Opus、Sonnet 模型上獲得對生物學工作更寬鬆的防護設定,覆蓋藥物發現、研究生物學、臨床開發與製造等目前通用模型中被攔截的任務。計劃先以 beta 面向團隊和機構開放申請,個人 Pro 與 Max 方案後續再擴。
LM Studio 的 Bionic 現在可以引用並內省(Introspection)過往會話,在輸入框用 @ 提及即可引用其他會話,跨專案也支援。內省是一組寫在內建 SKILL 裡的漸進披露工具,採用分層設計與截斷策略以節省上下文,能讀取持久化的會話記錄,找回 compaction 時被丟棄的設計決策、環境資訊等細節,因此在耗時數小時的長任務中更能遵守原定計劃。讀取其他會話需經權限彈窗批准,以避免跨會話汙染;讀取當前會話自身的 transcript 則無需批准。
Mistral AI 於 2026 年 9 月 16 日宣布與 Mozilla 建立合作伙伴關係,目標是為使用 AI 瀏覽網頁的使用者提供隱私、控制與選擇權。雙方在公告中強調這一合作圍繞線上瀏覽場景中的 AI 使用展開,但未披露具體產品形態、上線時間或技術細節。