ChatGPT iOS 相機新增掃描,多頁自動合成 PDF
ChatGPT 手機端相機現在支援掃描筆記和文件:連續拍攝多頁後,ChatGPT 會自動把它們合併成一個 PDF,可直接上傳到對話中。入口在 ChatGPT 相機內的三點選單裡,選擇 Scan 即可使用,目前正在 iOS 上逐步推送。
ChatGPT 手機端相機現在支援掃描筆記和文件:連續拍攝多頁後,ChatGPT 會自動把它們合併成一個 PDF,可直接上傳到對話中。入口在 ChatGPT 相機內的三點選單裡,選擇 Scan 即可使用,目前正在 iOS 上逐步推送。
巴克萊銀行宣布擴大與 Anthropic 的戰略合作,在全行範圍部署 Claude,目標是 2026 年底 Claude Code 覆蓋其 50% 的開發者,2027 年覆蓋多數軟體工程師。已落地的應用包括:基於 RAG 的 Colleague Knowledge Assistant 自 2025 年上線,已有超 1.6 萬名員工使用、處理超 100 萬次搜尋;全球市場業務用 Claude 每天處理約 12 萬封客戶郵件,進行分類、資訊補全和路由判斷。
ChatGPT 在移動端和網頁版新增虛擬試穿與商品收藏功能。服裝和配飾的商品列表會出現 Try on 按鈕,點選後拍攝或上傳自拍,即可用 ChatGPT Images 生成試穿效果,參考照片會儲存供後續使用,可在 Settings → Personalization → Reference photos 中更改或刪除。商品還能存入 Favorites,或在 ChatGPT Library 中建資料夾整理。
新論文 RLTL;DR 提出一種自我改進方法:模型每次嘗試失敗後,把驗證器輸出展示給它,讓它自己寫一條 TL;DR 式反饋,下一次 rollout 以這條反饋為條件。它針對 RLVR 的侷限——RLVR 要求多次嘗試並只向成功樣本最佳化,當任務難到成功率接近零、又沒有教師模型或範例解可蒸餾時就失效。論文發布於 2026-10-01,原文摘要未給出基準或具體數字。
The Den 藉助 ChatGPT Work,把撥款申請從 3 天壓縮到 2 小時,酒牌材料從 4 天壓縮到 3 小時,每週釋放 10 到 15 小時。這家社交俱樂部正在開設新門店,省下的時間用於業務擴張。
Google 於 2026 年 9 月 30 日發布新前沿模型 Gemini 4 Argon,先通過 Fairwind Program 向受信任的網路安全防禦方開放,之後再逐步提供給開發者、企業和消費者。它的輸出上限從 64K 提升到業界領先的 1M token,介紹價輸入每百萬 token 2 美元、輸出 10 美元,快取輸入享 95% 折扣。
OpenAI 發布了一份關於小企業如何使用 AI 智慧體的新報告,並宣布與 ASBDC 建立新合作,為小企業主提供實操 AI 培訓和本地指導。報告覆蓋小團隊用 AI 尋找客戶、建置產品和管理財務等場景,合作旨在幫助更多企業主上手 AI。
輝達第 26 屆研究生獎學金專案開始全球接受申請,面向研究 AI、機器學習、自動駕駛、計算機圖形、機器人、醫療與高效能運算等方向的博士生,每人獎金最高 6 萬美元,並配導師與技術支援。申請者須在申請時已完成至少一年博士階段學習,截止日期為 2026 年 10 月 30 日;獲獎前還必須在 NVIDIA 研究辦公室完成 2027 年夏季的線下實習。該專案自 2002 年啟動以來已發放 220 多筆資助,總額約 800 萬美元。
SynthID Bio 是一項把水印嵌入生物程式碼的概念驗證技術:水印不僅能在數字模型上驗證,也能在合成出的實體蛋白質上驗證,且實驗室測試顯示不損害其生物功能。它按資料型別調整策略——微調蛋白質序列的胺基酸選擇、調整預測 3D 結構的原子座標,並通過微調 AlphaFold 3 擴散網路把水印寫進模型權重。
Ollama 官方宣布三款模型已上架,可在 /v1/systemone 下使用:Nimble、Tev1 4b 和 Tev1 0.8b。三款模型均提供 ollama.com/library 頁面,使用者可通過 Ollama 拉取後在本地執行。官方未公布模型引數規模以外的細節與授權資訊。
Anthropic 宣布棄用 Claude Sonnet 4.5(模型 ID claude-sonnet-4-5-20250929),其在 Claude API 上的退役日期為 2026 年 11 月 30 日。官方建議遷移到 Claude Sonnet 5.5,詳情見 Model deprecations 文件。
Hugging Face 於 2026 年 9 月 30 日上線 Open TTS Leaderboard,用客觀指標評測開源與多語言 TTS 模型,單次評測從收集投票的數週縮短到數小時。指標包括 WER/CER(用 Qwen3 ASR 轉寫)、H200 批次離線推理的 RTFx、H200 與 CPU 上的流式首音訊延遲 TTFA,以及 WavLM 說話人嵌入的餘弦相似度 SIM。
OpenAI 宣布 Ultrafast 即日起在 Codex、ChatGPT Work 和 API 中面向 GPT-6 Astra 開放,GPT-6.1 Sol 稍後支援。同時推出 Pro 500 新方案,用量上限為 Plus 的 25 倍,是獲取 Ultrafast 的入口。
OpenAI 發布付費高速檔 Ultrafast,在 Codex 中 token 生成速度最高提升 8 倍,達到每秒 300 tokens,API 中最高提升 6 倍。該檔位定位為 premium speed tier,具體價格、可用地區和上線時間原文未說明。
OpenAI 重新開放 Pro 200 訂閱,使用者可繼續使用 Astra 等前沿模型,並新增 GPT-6.1 Sol,官方稱其具備接近 Astra 的能力且適合日常使用。OpenAI 同時承諾不再恢復 5 小時使用限制,使用者可按自己的節奏用完每週額度。
OpenAI 宣布 Codex Security Cloud 迎來重大升級,預設通過 Daybreak Blue 提供具備網路安全能力的模型。該服務可掃描整個 GitHub 倉庫、持續審查新提交、調查並去重發現的問題,並生成待稽核的修復方案,即使你的筆記本合上也能執行。它以外掛形式在 Codex 桌面端和網頁端提供。
NVIDIA 發布 Kumo Tabular,一個面向表格分類與迴歸的開源基礎模型,權重已上線 Hugging Face,程式碼開源於 GitHub。給定一張帶標籤行的表格,它在單次前向傳播中直接輸出新行的類別機率或數值預測,無需訓練、調參和特徵工程;模型僅用人工合成表格預訓練,提供 28M 到 215M 三種引數規模,採用 OpenMDW-1.1 許可證,可商用。
MultiverseComputingCAI 發表論文提出 ProvenanceGuard:一個接在黑盒 MCP agent 之後的後生成驗證層,專門抓事實為真但歸屬錯誤的跨來源混淆,這類斷言可能被 RAGAS、MiniCheck 等只看合併證據的檢查器放過。它保留 MCP trace 中的 source ID,依次做斷言拆解、來源路由、支援度校驗與歸屬比對,輸出逐條來源判定和答案級的放行或攔截。
ChatGPT 上線 Pages,可把對話轉成頁面、套用模板或直接在 Space 裡寫作,並讓多人用各自的 ChatGPT 共同編輯和評論。頁面支援讓 ChatGPT 改寫文字、新增圖表或生成互動內容,權限跟隨 Space 的可用性與分享設定。分享頁面不會開放你的私人對話或記憶,但頁面內新增的資訊對可檢視者可見。
Anthropic 於 2026 年 9 月 29 日啟動新研究,用 Anthropic Interviewer 訪談使用者對 AI 的真實體驗與期待,參與者可自願將完整訪談公開。訪談問題包括最有意義的正面與負面經歷、希望 AI 改變的工作教育醫療政府等領域、以及對 AI 公司的要求;公開版本只附國家,不含 Claude 帳號姓名與信箱,但官方明確警告他人仍可能通過年齡、職業、城市等細節重新識別身份,且一旦公開無法刪除已被他人儲存的內容。
GPT-6.1 Sol 現已在 Codex 和 ChatGPT Work 中提供,官方稱其複雜工作的表現接近 Astra,但成本低於 Astra。它適合程式碼、應用和文件類可重複、長時間執行的任務,呼叫模型名為 gpt-6.1-sol。可用性取決於你的套餐、客戶端和工作區設定,具體支援情況需查閱 Models 文件來對比與選擇模型。
Ollama 0.35 起支援基於 TypeSafe Jev API 的決策模型:通過新的 /v1/systemone 端點,把文字作為 state、配上一組命名問題,本機模型在一次請求裡全部作答,且無額外費用。首批三個模型為 Bespoke Labs 的 9B nimble,以及 Together AI 的實驗性 4B tev1 和 0.8B tev1:0.8b,用 ollama pull 即可下載,可通過 curl 或 TypeSafe 官方 Python SDK 呼叫。
智譜 AI(海外稱 Z.ai)的 GLM-5.3 具備自主建置端到端網路漏洞利用的能力,且發布時未設有效防護,Anthropic 測試顯示攻擊者用簡單技巧即可在 64% 到 100% 的情況下繞過其防護。在 ExploitBench 上,GLM-5.3 於 410 次嘗試中成功開發出 50 次端到端利用,接近 Claude Mythos Preview 的 56 次;在內部二進位制利用基準中取得 4% 的完整控制流劫持,Claude Mythos Preview 為 6%。
ChatGPT 推出 Pro 500,月費 500 美元,是 Pro 系列中包含用量最高的方案,並在 ChatGPT Work 與 Codex 中提供 Astra Ultrafast。Ultrafast 是 GPT-6 Astra 的更快服務層,在模型選擇器中選用,先扣套餐內額度、用完再扣積分餘額;Pro 系列中只有 Pro 500 能用,Pro 100 與 Pro 200 即便買積分也不解鎖,上線時僅可通過網頁版 ChatGPT 訂閱。
Mistral 於 2026 年 9 月 28 日在慕尼黑開設德國中心,內設 Physics AI 與 Industrial AI 研究團隊及直接服務企業客戶的應用工程師,並已在當地招聘。合作方包括 BMW(碰撞模擬與工程 AI)、Siemens Energy(工業 AI),以及與慕尼黑工業大學(TUM)用其風洞設施開發汽車空氣動力學數字孿生。
Anthropic 發布 Claude Sonnet 5.5,已在 Claude API、Amazon Bedrock、AWS 上的 Claude Platform、Google Cloud 和 Microsoft Foundry 上線。
OpenRouter 上線 Security Center,所有套餐型別均可用,入口在 Settings > Security,用於集中檢視並批次處理帳號下所有 API key。
Apple 發布 macOS 安全更新 26.924,修復編號 CVE-2026-100754 的漏洞,對應版本號為 macOS 26.924.20706。公告將這次修復致謝給 Objective-See Foundation 的 Patrick Wardle。除上述內容外,原文未披露漏洞型別、嚴重程度、影響範圍,也未說明是否需要重啟或有哪些臨時緩解措施,發布時間為 2026 年 9 月 25 日。
Google 於 9 月 24 日發布 Gemini 3.8 Live with Live Avatar,把近即時影片生成與語音結合,為企業的對話 AI 加上唇形同步、表情與流暢輪替的視覺形象,即日起在 Gemini Enterprise 提供。它支援非同步工具呼叫,可在對話不中斷的情況下後臺取數;原生語音到語音同步可跨 97 種語言切換,且不降低影片品質、不產生畫面漂移。
Anthropic 自 2026-09-24 起,對在任何輸出前被拒、且 stop_details.category 為 bio、frontier_llm、reasoning_extraction 的請求恢復計費,按執行該請求的模型費率收取,所有平台適用;其他類別的輸出前拒答仍不計費,fallback credit 不變。流式輸出中途的拒答此前已在計費。
Google Beam 正式擴充套件到美國、加拿大、英國、法國、德國和日本六國,由 18 家渠道夥伴負責部署與支援。硬體由 HP 以 HP Dimension with Google Beam 的形式交付,相容 Google Meet 與 Zoom。Google 為期八週的內部研究顯示,使用 Beam 的團隊連線感提升 50%、反饋被清楚理解的把握高 33%、需要額外跟進會議的情況減少 21%。
Google 在 2026 年 9 月 23 日宣布為 Private AI Compute 平台加入伺服器端持久記憶:加密資料存在雲端專用儲存,解密金鑰只儲存在使用者裝置上,模型需要時通過端到端加密通道在 secure enclave 內臨時解密處理。此前該平台是無狀態的,任務一結束就清除全部上下文。Google 同時發布伺服器軟體的防篡改公開記錄,供裝置在傳送資料前驗證,並給出由一家網路安全公司完成的獨立審計結果。
Google 推出 Gemini 3.8 Flash TTS 與 Gemini 3.8 Flash-Lite TTS 兩款文字轉語音模型,是 Gemini 迄今最有表現力的音訊生成模型,已在 Google AI Studio、Gemini API、Gemini Enterprise、Gemini Notebook 和 Google Vids 上線。
阿里 Qwen 官方帳號發布了 Mobile Planner Agent 的效能資訊,但正文只給出標題,未列出任何具體指標、測試環境或對比資料。目前無法判斷其能力水平、適用場景與開放方式。
Anthropic 於 2026 年 9 月 23 日宣布成立生命科學研究組與實驗室,並公布早期成果:Claude 在僅接受高層級指令的情況下,自主發現了一個與 DNA 重複序列相關的新型酶系統,命名為 array-associated reverse transcriptases(ART)。約 950 個 agent 用 210 million tokens 搜尋 21 小時,從噬菌體中找到該 RT 系統,其定義特徵此前未被識別。
Kimi WebBridge 正式更名為 Kimi 瀏覽器擴充套件,使用者可在瀏覽器側邊欄與 Kimi 對話,讓它瀏覽網站、填寫表單並完成任務。針對重複性操作,可錄製一次步驟並儲存為技能,之後由 Kimi 自動執行。該擴充套件已在官網和 Chrome 應用商店上線。
月之暗面的 Kimi K3 已在 Amazon Bedrock 上線,可用於編碼、文件分析和長流程 agent 工作流,並支援顯式 prompt caching。使用者可沿用 Bedrock 的訪問、加密與審計控制,通過 AWS 官方模型卡文件開始接入。
Google 在 2026 年 9 月 22 日的 Gemini API 更新中,將 Gemini 3.8 Flash TTS 與 Gemini 3.8 Flash-Lite TTS 兩款文字轉語音模型正式 GA,並新增 /v1beta/voices 端點。旗艦款 gemini-3.8-flash-tts 主打錄音棚級音質、細膩表演、地區口音與長時多輪穩定;
Anthropic 發布 Claude Opus 5.5,面向長時間執行的 agentic coding 與知識工作,預設 1M token 上下文、128k 最大輸出,每百萬 token 輸入 $4、輸出 $20(Opus 5 為 $5/$25),已上線 Claude API、Amazon Bedrock、AWS、Google Cloud 與 Microsoft Foundry。
OpenRouter 上線 Batch API:把大量請求打包提交,由供應商在 24 小時視窗內自行選擇完成時間,換取通常為按 token 正常價 50%(有時更低)的折扣,現支援 70 多個模型。兩週 beta 期內 23 萬多個批次的中位完成時間是 7 分鐘,90% 在一小時內,太平洋時間 5 點到中午提交明顯更慢。支援 chat completions、responses、messages 和 embeddings,結果逐條獨立返回,輸入與結果保留 30 天;