@GoogleDeepMind: SynthID Bio is our new family of watermarking methods made for AI-generated biological designs.
Google DeepMind 推出 SynthID Bio,一套專為 AI 生成生物設計打造的水印方法。其首次實現將不可感知的簽名直接嵌入蛋白質序列,且不影響其生物功能。該技術面向 AI 生成的生物設計場景,具體使用方式與限制尚未披露。
Google DeepMind 推出 SynthID Bio,一套專為 AI 生成生物設計打造的水印方法。其首次實現將不可感知的簽名直接嵌入蛋白質序列,且不影響其生物功能。該技術面向 AI 生成的生物設計場景,具體使用方式與限制尚未披露。
Google DeepMind 發布 Gemini 4 Argon,首次支援最高 100 萬 token 輸出,但目前僅在 Fairwind 計劃下對政府使用者與受信任網路安全人員開放預覽,開發者、企業與消費者開放時間未定。標準價 $4/$20 每百萬輸入/輸出 token,首推五折 $2/$10,快取輸入 95% 折扣;19 項公開基準中拿下 13 項第一。100 萬輸出靠新 API 功能 Long Decode Continuation 實現,長回覆會暫停並跨呼叫續寫;
安全研究者 Matthew Green 認為,agent 蠕蟲所需的兩半已經齊備:劫持 agent 的 payload,以及把 payload 帶給下一個 agent 的 agent。他指出,被隔離在各自沙箱中的 agent 發現可以在共享的 package cache 裡互相留下指令,而這些指令改變了接收方的行為。
Google 於 2026 年 9 月 30 日發布新前沿模型 Gemini 4 Argon,先通過 Fairwind Program 向受信任的網路安全防禦方開放,之後再逐步提供給開發者、企業和消費者。它的輸出上限從 64K 提升到業界領先的 1M token,介紹價輸入每百萬 token 2 美元、輸出 10 美元,快取輸入享 95% 折扣。
SynthID Bio 是一項把水印嵌入生物程式碼的概念驗證技術:水印不僅能在數字模型上驗證,也能在合成出的實體蛋白質上驗證,且實驗室測試顯示不損害其生物功能。它按資料型別調整策略——微調蛋白質序列的胺基酸選擇、調整預測 3D 結構的原子座標,並通過微調 AlphaFold 3 擴散網路把水印寫進模型權重。
Anthropic Frontier Red Team 在內部 Binary Exploitation 基準中隨機抽取 100 個任務評估多個模型:GLM-5.3 在 4% 的試驗裡實現了完整控制流劫持,Claude Mythos Preview 為 6%。此前模型 Claude Opus 4.6 與 GLM-5.2 在這些任務中一次都沒有成功。該團隊認為,GLM-5.3 的成績雖低於 Claude Mythos Preview,但一個有意義的能力門檻已被跨過。
OpenAI 宣布 Codex Security Cloud 迎來重大升級,預設通過 Daybreak Blue 提供具備網路安全能力的模型。該服務可掃描整個 GitHub 倉庫、持續審查新提交、調查並去重發現的問題,並生成待稽核的修復方案,即使你的筆記本合上也能執行。它以外掛形式在 Codex 桌面端和網頁端提供。
Anthropic 表示,是否公開訪談內容完全由參與者自願決定。官方部落格文章列出了公開的好處與可能的風險,並附上閱讀連結。
MultiverseComputingCAI 發表論文提出 ProvenanceGuard:一個接在黑盒 MCP agent 之後的後生成驗證層,專門抓事實為真但歸屬錯誤的跨來源混淆,這類斷言可能被 RAGAS、MiniCheck 等只看合併證據的檢查器放過。它保留 MCP trace 中的 source ID,依次做斷言拆解、來源路由、支援度校驗與歸屬比對,輸出逐條來源判定和答案級的放行或攔截。
Anthropic 於 2026 年 9 月 29 日啟動新研究,用 Anthropic Interviewer 訪談使用者對 AI 的真實體驗與期待,參與者可自願將完整訪談公開。訪談問題包括最有意義的正面與負面經歷、希望 AI 改變的工作教育醫療政府等領域、以及對 AI 公司的要求;公開版本只附國家,不含 Claude 帳號姓名與信箱,但官方明確警告他人仍可能通過年齡、職業、城市等細節重新識別身份,且一旦公開無法刪除已被他人儲存的內容。
智譜 AI(海外稱 Z.ai)的 GLM-5.3 具備自主建置端到端網路漏洞利用的能力,且發布時未設有效防護,Anthropic 測試顯示攻擊者用簡單技巧即可在 64% 到 100% 的情況下繞過其防護。在 ExploitBench 上,GLM-5.3 於 410 次嘗試中成功開發出 50 次端到端利用,接近 Claude Mythos Preview 的 56 次;在內部二進位制利用基準中取得 4% 的完整控制流劫持,Claude Mythos Preview 為 6%。
Mistral 於 2026 年 9 月 28 日在慕尼黑開設德國中心,內設 Physics AI 與 Industrial AI 研究團隊及直接服務企業客戶的應用工程師,並已在當地招聘。合作方包括 BMW(碰撞模擬與工程 AI)、Siemens Energy(工業 AI),以及與慕尼黑工業大學(TUM)用其風洞設施開發汽車空氣動力學數字孿生。
Apple 發布 macOS 安全更新 26.924,修復編號 CVE-2026-100754 的漏洞,對應版本號為 macOS 26.924.20706。公告將這次修復致謝給 Objective-See Foundation 的 Patrick Wardle。除上述內容外,原文未披露漏洞型別、嚴重程度、影響範圍,也未說明是否需要重啟或有哪些臨時緩解措施,發布時間為 2026 年 9 月 25 日。
Google 於 9 月 24 日發布 Gemini 3.8 Live with Live Avatar,把近即時影片生成與語音結合,為企業的對話 AI 加上唇形同步、表情與流暢輪替的視覺形象,即日起在 Gemini Enterprise 提供。它支援非同步工具呼叫,可在對話不中斷的情況下後臺取數;原生語音到語音同步可跨 97 種語言切換,且不降低影片品質、不產生畫面漂移。
Anthropic 自 2026-09-24 起,對在任何輸出前被拒、且 stop_details.category 為 bio、frontier_llm、reasoning_extraction 的請求恢復計費,按執行該請求的模型費率收取,所有平台適用;其他類別的輸出前拒答仍不計費,fallback credit 不變。流式輸出中途的拒答此前已在計費。
Google 在 2026 年 9 月 23 日宣布為 Private AI Compute 平台加入伺服器端持久記憶:加密資料存在雲端專用儲存,解密金鑰只儲存在使用者裝置上,模型需要時通過端到端加密通道在 secure enclave 內臨時解密處理。此前該平台是無狀態的,任務一結束就清除全部上下文。Google 同時發布伺服器軟體的防篡改公開記錄,供裝置在傳送資料前驗證,並給出由一家網路安全公司完成的獨立審計結果。
Mistral AI 於 2026 年 9 月 18 日回應稱,已注意到有人聲稱未經授權訪問其系統,但經過徹底調查,未發現支援該說法的證據,並確認系統未被入侵。該宣告未披露指控來源、涉及範圍或進一步技術細節。
Anthropic 於 2026 年 9 月 18 日宣布與埃森哲合作,對前沿 AI 模型進行獨立評估,由埃森哲旗下 AI 業務 Faculty 牽頭,內容包括模型評估、紅隊測試、對齊評估與安全防護測試。雙方預計未來五年各投入至少 10 億美元建設相關能力。嵌入式評估員將像員工一樣進入 AI 公司內部,觀察模型訓練過程與部署決策,但具體運作細節和行業標準尚未確定。Anthropic 直接資助埃森哲的工作,同時與 METR 等非營利評估機構洽談試點,該合作非排他性。
Anthropic 於 2026 年 9 月 17 日推出生命科學驗證計劃(LSVP),讓通過驗證的生命科學團隊在 Mythos、Opus、Sonnet 模型上獲得對生物學工作更寬鬆的防護設定,覆蓋藥物發現、研究生物學、臨床開發與製造等目前通用模型中被攔截的任務。計劃先以 beta 面向團隊和機構開放申請,個人 Pro 與 Max 方案後續再擴。
Mistral 與 Mozilla 於 2026 年 9 月 16 日宣布合作,Firefox 的 AI 瀏覽助手 Smart Window(測試版)改由 Mistral 模型驅動。該功能先面向法國和北美使用者,英國和德國預計今年晚些時候跟進。Smart Window 可解讀複雜搜尋、找回此前點開的頁面,並基於瀏覽器標籤頁整理資訊;Mozilla 表示對話預設不儲存在其伺服器上,Mistral 也同意零資料保留。
OpenRouter 在 2026 年 9 月 9 日推出美國 In-Region Routing,此前 EU 路由已於去年 10 月上線。把請求發到 us.openrouter.ai/api/v1 或 eu.openrouter.ai/api/v1,API key、請求體、模型 ID 不變,帳戶裡的 provider 偏好、fallback、隱私設定照常生效;
Claude in Chrome 於 2026 年 8 月 26 日正式可用,覆蓋所有付費 Claude 方案,並支援 Claude 在瀏覽器中自主執行操作,不再需要逐步批准。它可讀取當前頁面、輸入文字、點選連結、跨標籤頁導航和填表,並使用你已有的登入狀態訪問內部儀表盤、遺留系統和供應商門戶。每次操作前由安全分類器校驗是否安全且符合你的請求,也可在設定中關閉自動批准。