AISpot

政策與安全

10月1日星期四 · 3 則

  1. X @GoogleDeepMindAI 評分40

    @GoogleDeepMind: SynthID Bio is our new family of watermarking methods made for AI-generated biological designs.

    Google DeepMind 推出 SynthID Bio,一套專為 AI 生成生物設計打造的水印方法。其首次實現將不可感知的簽名直接嵌入蛋白質序列,且不影響其生物功能。該技術面向 AI 生成的生物設計場景,具體使用方式與限制尚未披露。

  2. Latent Space● 精選AI 評分84

    Gemini 4 Argon 發布,輸出上限 100 萬 token,僅限安全預覽

    Google DeepMind 發布 Gemini 4 Argon,首次支援最高 100 萬 token 輸出,但目前僅在 Fairwind 計劃下對政府使用者與受信任網路安全人員開放預覽,開發者、企業與消費者開放時間未定。標準價 $4/$20 每百萬輸入/輸出 token,首推五折 $2/$10,快取輸入 95% 折扣;19 項公開基準中拿下 13 項第一。100 萬輸出靠新 API 功能 Long Decode Continuation 實現,長回覆會暫停並跨呼叫續寫;

9月30日星期三 · 2 則

  1. Google DeepMind blog● 精選AI 評分83

    Google 發布 Gemini 4 Argon,輸出上限提至 1M token

    Google 於 2026 年 9 月 30 日發布新前沿模型 Gemini 4 Argon,先通過 Fairwind Program 向受信任的網路安全防禦方開放,之後再逐步提供給開發者、企業和消費者。它的輸出上限從 64K 提升到業界領先的 1M token,介紹價輸入每百萬 token 2 美元、輸出 10 美元,快取輸入享 95% 折扣。

  2. Google DeepMind blogAI 評分47

    SynthID Bio 為 AI 生成蛋白質嵌入可驗證水印

    SynthID Bio 是一項把水印嵌入生物程式碼的概念驗證技術:水印不僅能在數字模型上驗證,也能在合成出的實體蛋白質上驗證,且實驗室測試顯示不損害其生物功能。它按資料型別調整策略——微調蛋白質序列的胺基酸選擇、調整預測 3D 結構的原子座標,並通過微調 AlphaFold 3 擴散網路把水印寫進模型權重。

9月29日星期二 · 6 則

  1. Simon Willison● 精選AI 評分73

    Anthropic 紅隊:GLM-5.3 在 4% 任務中實現控制流劫持

    Anthropic Frontier Red Team 在內部 Binary Exploitation 基準中隨機抽取 100 個任務評估多個模型:GLM-5.3 在 4% 的試驗裡實現了完整控制流劫持,Claude Mythos Preview 為 6%。此前模型 Claude Opus 4.6 與 GLM-5.2 在這些任務中一次都沒有成功。該團隊認為,GLM-5.3 的成績雖低於 Claude Mythos Preview,但一個有意義的能力門檻已被跨過。

  2. X @OpenAI● 精選AI 評分88

    Codex Security Cloud 升級,預設接入 Daybreak Blue 模型

    OpenAI 宣布 Codex Security Cloud 迎來重大升級,預設通過 Daybreak Blue 提供具備網路安全能力的模型。該服務可掃描整個 GitHub 倉庫、持續審查新提交、調查並去重發現的問題,並生成待稽核的修復方案,即使你的筆記本合上也能執行。它以外掛形式在 Codex 桌面端和網頁端提供。

  3. Hugging Face blog● 精選AI 評分66

    論文提出 ProvenanceGuard,為 MCP Agent 核查斷言來源歸屬

    MultiverseComputingCAI 發表論文提出 ProvenanceGuard:一個接在黑盒 MCP agent 之後的後生成驗證層,專門抓事實為真但歸屬錯誤的跨來源混淆,這類斷言可能被 RAGAS、MiniCheck 等只看合併證據的檢查器放過。它保留 MCP trace 中的 source ID,依次做斷言拆解、來源路由、支援度校驗與歸屬比對,輸出逐條來源判定和答案級的放行或攔截。

  4. Anthropic ResearchAI 評分27

    Anthropic 用 AI 訪談徵集公眾對 AI 的看法

    Anthropic 於 2026 年 9 月 29 日啟動新研究,用 Anthropic Interviewer 訪談使用者對 AI 的真實體驗與期待,參與者可自願將完整訪談公開。訪談問題包括最有意義的正面與負面經歷、希望 AI 改變的工作教育醫療政府等領域、以及對 AI 公司的要求;公開版本只附國家,不含 Claude 帳號姓名與信箱,但官方明確警告他人仍可能通過年齡、職業、城市等細節重新識別身份,且一旦公開無法刪除已被他人儲存的內容。

  5. Anthropic Research● 精選AI 評分81

    GLM-5.3 可自主建置端到端漏洞利用,防護易被繞過

    智譜 AI(海外稱 Z.ai)的 GLM-5.3 具備自主建置端到端網路漏洞利用的能力,且發布時未設有效防護,Anthropic 測試顯示攻擊者用簡單技巧即可在 64% 到 100% 的情況下繞過其防護。在 ExploitBench 上,GLM-5.3 於 410 次嘗試中成功開發出 50 次端到端利用,接近 Claude Mythos Preview 的 56 次;在內部二進位制利用基準中取得 4% 的完整控制流劫持,Claude Mythos Preview 為 6%。

9月28日星期一 · 1 則

  1. Mistral AI newsAI 評分41

    Mistral 在慕尼黑開設德國中心,聚焦工業 AI 與 Physics AI

    Mistral 於 2026 年 9 月 28 日在慕尼黑開設德國中心,內設 Physics AI 與 Industrial AI 研究團隊及直接服務企業客戶的應用工程師,並已在當地招聘。合作方包括 BMW(碰撞模擬與工程 AI)、Siemens Energy(工業 AI),以及與慕尼黑工業大學(TUM)用其風洞設施開發汽車空氣動力學數字孿生。

9月25日星期五 · 1 則

  1. OpenAI Codex changelogAI 評分37

    macOS 26.924 安全更新修復 CVE-2026-100754

    Apple 發布 macOS 安全更新 26.924,修復編號 CVE-2026-100754 的漏洞,對應版本號為 macOS 26.924.20706。公告將這次修復致謝給 Objective-See Foundation 的 Patrick Wardle。除上述內容外,原文未披露漏洞型別、嚴重程度、影響範圍,也未說明是否需要重啟或有哪些臨時緩解措施,發布時間為 2026 年 9 月 25 日。

9月24日星期四 · 2 則

  1. Google DeepMind blogAI 評分50

    Gemini 3.8 Live 加入 Live Avatar 即時影片對話形象

    Google 於 9 月 24 日發布 Gemini 3.8 Live with Live Avatar,把近即時影片生成與語音結合,為企業的對話 AI 加上唇形同步、表情與流暢輪替的視覺形象,即日起在 Gemini Enterprise 提供。它支援非同步工具呼叫,可在對話不中斷的情況下後臺取數;原生語音到語音同步可跨 97 種語言切換,且不降低影片品質、不產生畫面漂移。

  2. Claude Platform release notesAI 評分56

    September 24, 2026

    Anthropic 自 2026-09-24 起,對在任何輸出前被拒、且 stop_details.category 為 bio、frontier_llm、reasoning_extraction 的請求恢復計費,按執行該請求的模型費率收取,所有平台適用;其他類別的輸出前拒答仍不計費,fallback credit 不變。流式輸出中途的拒答此前已在計費。

9月23日星期三 · 1 則

  1. Google DeepMind blogAI 評分57

    Google 為 Private AI Compute 加入伺服器端加密持久記憶

    Google 在 2026 年 9 月 23 日宣布為 Private AI Compute 平台加入伺服器端持久記憶:加密資料存在雲端專用儲存,解密金鑰只儲存在使用者裝置上,模型需要時通過端到端加密通道在 secure enclave 內臨時解密處理。此前該平台是無狀態的,任務一結束就清除全部上下文。Google 同時發布伺服器軟體的防篡改公開記錄,供裝置在傳送資料前驗證,並給出由一家網路安全公司完成的獨立審計結果。

9月18日星期五 · 2 則

  1. Anthropic NewsAI 評分45

    Anthropic 與埃森哲合作開展嵌入式評估

    Anthropic 於 2026 年 9 月 18 日宣布與埃森哲合作,對前沿 AI 模型進行獨立評估,由埃森哲旗下 AI 業務 Faculty 牽頭,內容包括模型評估、紅隊測試、對齊評估與安全防護測試。雙方預計未來五年各投入至少 10 億美元建設相關能力。嵌入式評估員將像員工一樣進入 AI 公司內部,觀察模型訓練過程與部署決策,但具體運作細節和行業標準尚未確定。Anthropic 直接資助埃森哲的工作,同時與 METR 等非營利評估機構洽談試點,該合作非排他性。

9月17日星期四 · 1 則

  1. Anthropic NewsAI 評分51

    Anthropic 推出生命科學驗證計劃 LSVP

    Anthropic 於 2026 年 9 月 17 日推出生命科學驗證計劃(LSVP),讓通過驗證的生命科學團隊在 Mythos、Opus、Sonnet 模型上獲得對生物學工作更寬鬆的防護設定,覆蓋藥物發現、研究生物學、臨床開發與製造等目前通用模型中被攔截的任務。計劃先以 beta 面向團隊和機構開放申請,個人 Pro 與 Max 方案後續再擴。

9月16日星期三 · 1 則

  1. Mistral AI news● 精選AI 評分60

    Firefox 智慧視窗測試版改由 Mistral 模型驅動

    Mistral 與 Mozilla 於 2026 年 9 月 16 日宣布合作,Firefox 的 AI 瀏覽助手 Smart Window(測試版)改由 Mistral 模型驅動。該功能先面向法國和北美使用者,英國和德國預計今年晚些時候跟進。Smart Window 可解讀複雜搜尋、找回此前點開的頁面,並基於瀏覽器標籤頁整理資訊;Mozilla 表示對話預設不儲存在其伺服器上,Mistral 也同意零資料保留。

9月9日星期三 · 1 則

  1. OpenRouter announcementsAI 評分57

    OpenRouter 上線美區路由,請求解密與推理全程留在所選區域

    OpenRouter 在 2026 年 9 月 9 日推出美國 In-Region Routing,此前 EU 路由已於去年 10 月上線。把請求發到 us.openrouter.ai/api/v1 或 eu.openrouter.ai/api/v1,API key、請求體、模型 ID 不變,帳戶裡的 provider 偏好、fallback、隱私設定照常生效;

8月26日星期三 · 1 則

  1. Claude blog● 精選AI 評分81

    Claude in Chrome 正式向所有付費方案開放

    Claude in Chrome 於 2026 年 8 月 26 日正式可用,覆蓋所有付費 Claude 方案,並支援 Claude 在瀏覽器中自主執行操作,不再需要逐步批准。它可讀取當前頁面、輸入文字、點選連結、跨標籤頁導航和填表,並使用你已有的登入狀態訪問內部儀表盤、遺留系統和供應商門戶。每次操作前由安全分類器校驗是否安全且符合你的請求,也可在設定中關閉自動批准。