OpenAI 公布歐盟文字溯源方案,API 可選用文字水印
OpenAI 公布應對歐盟 AI 法案的文字溯源方案:全球 API 客戶即日起可為部分模型選擇開啟文字水印(預設關閉),未來幾週將在歐盟的 ChatGPT 與 Codex 文字輸出中加入不可見水印,檢測器僅向獲批研究者與專家組織開放申請。其自研 textGrain 通過統計訊號標記用詞,在 1% 誤報率下對 200 token 段落檢出約 80%、400 token 約 95%,數學等用詞受限內容明顯更低;
依意思最接近的 7 筆
OpenAI 公布應對歐盟 AI 法案的文字溯源方案:全球 API 客戶即日起可為部分模型選擇開啟文字水印(預設關閉),未來幾週將在歐盟的 ChatGPT 與 Codex 文字輸出中加入不可見水印,檢測器僅向獲批研究者與專家組織開放申請。其自研 textGrain 通過統計訊號標記用詞,在 1% 誤報率下對 200 token 段落檢出約 80%、400 token 約 95%,數學等用詞受限內容明顯更低;
OpenAI 開始在 ChatGPT 和 Codex 的文字輸出中加入不可見、機器可讀的水印,初期只面向歐盟使用者。OpenAI 稱自研的 textGrain 水印與 Google DeepMind 的 SynthID for text 等方法相比持平或更優,後者也是 Anthropic 8 月宣布的水印基礎;兩家公司都是為了滿足歐盟 AI Act 的要求。OpenAI 還給出 AI 基準分數,顯示加水印與未加水印文字表現相近,但表示 textGrain 並不保證……
OpenAI 表示文字水印存在明顯侷限:在短文字中往往無法檢測,改寫或翻譯就能徹底去除水印。因此目前只有經過批准的研究者才能使用其水印檢測器,用於評估和改進這項技術。OpenAI 將文字水印視為一個持續研究的方向,會繼續測試和改進,並收集使用者、開發者、政策制定者和研究者的反饋。
OpenAI 表示,文字水印用於回答一個問題:這段文字是否很可能由其模型生成。水印在生成時嵌入不可見的統計訊號,檢測器可據此識別,不會新增可見標記或特殊字元。它無法說明原作者或版權歸屬,也不能識別個人、組織、帳號、對話或提示詞。OpenAI 稱測試中水印未影響模型能力、速度以及回答的閱讀感受。
為滿足歐盟 AI 法案的監管要求,OpenAI 將內容溯源範圍從影像、音訊擴充套件到文字,未來幾週內在歐盟開始對 ChatGPT 和 Codex 的合規文字加水印。其 API 客戶即日起可在全球範圍內為部分模型開啟文字水印。OpenAI 同時承認,當前文字水印技術存在明顯侷限。
Google DeepMind 發布一期播客,討論 AI 生成內容日益逼真後如何驗證內容來自人類、機器還是自然。節目介紹內容溯源的作用,並講解不可感知水印如何保護數字媒體與生物設計,時間軸涵蓋水印概念、SynthID、影像與影片、SynthID Bio 及未來韌性等章節。
Google DeepMind 發布 SynthID Bio,一套面向 AI 生成生物設計的水印方法。官方稱這是全球首次能在不影響生物功能的前提下,把不可感知的簽名直接嵌入蛋白質序列。該技術屬於 SynthID 水印體系的新分支,具體覆蓋範圍、檢測方式與可用時間尚未公布。