AI 影視公司 Utopai 影片模型盲測排名第二
Artificial Analysis 最新文生影片榜單中,影視公司 Utopai Studios 的模型 Utopai X 以 1150 分位列第二,與第一名阿里 Wan 3.0 僅差 7 分,據福布斯估算其估值約 10 億美元。該榜單由評審在不知道模型名字的情況下盲投產生;Utopai X 以 MiniMax 開源的影片模型 H3 為底子做後訓練,10 項能力中有 7 項比基座更接近頂尖水平,音訊同步、運鏡控制與物理提升最明顯。
依意思最接近的 20 筆
Artificial Analysis 最新文生影片榜單中,影視公司 Utopai Studios 的模型 Utopai X 以 1150 分位列第二,與第一名阿里 Wan 3.0 僅差 7 分,據福布斯估算其估值約 10 億美元。該榜單由評審在不知道模型名字的情況下盲投產生;Utopai X 以 MiniMax 開源的影片模型 H3 為底子做後訓練,10 項能力中有 7 項比基座更接近頂尖水平,音訊同步、運鏡控制與物理提升最明顯。
Google DeepMind 宣布 SynthID Detector 現已向所有人開放,可用來判斷網上內容是否由 AI 生成。該工具除 Google AI 外,還支援檢測 OpenAI、NVIDIA、Kakao 等行業夥伴工具生成的內容,Apple 即將加入。使用者可通過 synthid.com 試用。
Google 週二上線 SynthID 驗證網站,任何人可上傳圖片、影片或音訊,檢查是否為 AI 生成。該工具此前只向部分記者、媒體從業者和研究人員開放測試,現已全面開放,支援 JPG、PNG、HEIC、MP4、MP3、WAV 等十餘種格式。SynthID 自 2023 年推出,Google 的 Nano Banana、Veo、Lyria 模型以及 Gemini、Flow、Vids 等生成工具都會為產出加水印,OpenAI、Nvidia、Kakao 也已支援。
OpenAI 表示,文字水印用於回答一個問題:這段文字是否很可能由其模型生成。水印在生成時嵌入不可見的統計訊號,檢測器可據此識別,不會新增可見標記或特殊字元。它無法說明原作者或版權歸屬,也不能識別個人、組織、帳號、對話或提示詞。OpenAI 稱測試中水印未影響模型能力、速度以及回答的閱讀感受。
Google DeepMind 發布 SynthID Bio,一套面向 AI 生成生物設計的水印方法。官方稱這是全球首次能在不影響生物功能的前提下,把不可感知的簽名直接嵌入蛋白質序列。該技術屬於 SynthID 水印體系的新分支,具體覆蓋範圍、檢測方式與可用時間尚未公布。
Google 發布新一代生圖模型 Nano Banana 2.1,可 4K 直出,並升級蒙版編輯、背景替換與主體一致性。據 Arena 評測,其文生圖、多圖編輯與單圖編輯三項功能平均提升約 61.7 分,文生圖排名第四,僅次於 GPT。API 價格上,1K、2K 圖片生成價格減半,4K 降價約 25%;已上線 Gemini App、Google AI Studio,每天贈送 50 積分,開發者可用 gemini-nano-banana-2.1 接入付費 API。
OpenAI 宣布將在歐盟自動為 ChatGPT 生成的文字加水印,其他地區也提供該功能,但預設關閉。這是為遵守 8 月生效的歐盟 AI Act,該法要求 AI 生成內容可被其他工具檢測。OpenAI 的水印方法名為 textGrain,屬專有技術並已發布技術論文:它在用詞中埋入人類難以察覺、也不影響輸出品質的模式,持有金鑰者可用專用檢測器識別。檢測器初期只向有限的研究者與機構開放,其他方需經申請審批逐步加入。
阿里發布 Qwen-Image-2.1-Turbo,這是基於 Qwen-Image-2.1 的加速 checkpoint,只需 8 步去噪即可生成和編輯影像,權重已在 ModelScope 與 Hugging Face 開放。它沿用同一 7B 視覺生成架構,官方稱步數減少不犧牲品質,仍可從文字生成 2K 影像,並支援用自然語言繼續編輯,例如新增配飾或更換場景。Diffusers 中載入 QwenImage21Pipeline 即可使用推薦的 8 步取樣;
Google DeepMind 發布一期播客,討論 AI 生成內容日益逼真後如何驗證內容來自人類、機器還是自然。節目介紹內容溯源的作用,並講解不可感知水印如何保護數字媒體與生物設計,時間軸涵蓋水印概念、SynthID、影像與影片、SynthID Bio 及未來韌性等章節。
OpenAI 開始在 ChatGPT 和 Codex 的文字輸出中加入不可見、機器可讀的水印,初期只面向歐盟使用者。OpenAI 稱自研的 textGrain 水印與 Google DeepMind 的 SynthID for text 等方法相比持平或更優,後者也是 Anthropic 8 月宣布的水印基礎;兩家公司都是為了滿足歐盟 AI Act 的要求。OpenAI 還給出 AI 基準分數,顯示加水印與未加水印文字表現相近,但表示 textGrain 並不保證……
OpenAI 公布應對歐盟 AI 法案的文字溯源方案:全球 API 客戶即日起可為部分模型選擇開啟文字水印(預設關閉),未來幾週將在歐盟的 ChatGPT 與 Codex 文字輸出中加入不可見水印,檢測器僅向獲批研究者與專家組織開放申請。其自研 textGrain 通過統計訊號標記用詞,在 1% 誤報率下對 200 token 段落檢出約 80%、400 token 約 95%,數學等用詞受限內容明顯更低;
OpenAI 宣布正式啟用文字水印:即日起全球 API 客戶可為部分模型自行開啟,預設關閉;未來幾週歐盟地區符合條件的 ChatGPT 與 Codex 文字輸出將被加上肉眼不可見的水印,覆蓋所有付費檔位,檢測器僅向稽核過的研究者和專業機構開放。配套技術報告 textGrain 由今年考普斯會長獎得主蘇煒傑擔任通訊作者,用可調的「熵預算」控制水印強度。
OpenAI 表示文字水印存在明顯侷限:在短文字中往往無法檢測,改寫或翻譯就能徹底去除水印。因此目前只有經過批准的研究者才能使用其水印檢測器,用於評估和改進這項技術。OpenAI 將文字水印視為一個持續研究的方向,會繼續測試和改進,並收集使用者、開發者、政策制定者和研究者的反饋。
ChatGPT 生成的仿《紐約客》風格漫畫,會署上真實漫畫家的簽名。記者在 Reddit 等論壇與自測中記錄到 15 位以上《紐約客》漫畫家的簽名被 OpenAI 影像生成器未經許可使用,包括 Brendan Loper、Emily Flake 等;一張署有 Loper 筆名 BLOPER 的 AI 漫畫 8 月底在社交平台獲 2.5 萬點贊。
OpenAI 官方帳號發布推文,稱用視覺化內容把概念呈現出來,可以加深使用者對某個主題的理解。推文只有這一句話,未說明對應哪款產品或功能,也沒有給出上線時間和具體用法。
阿里 Qwen 官方 X 帳號在 2026 年 10 月 9 日發布動態,正文只有「Pics:」一詞,隨附圖片,沒有任何文字說明。公開可見的文字裡沒有出現模型名稱、版本號、功能或發布時間,因此無法確認圖片指向哪款產品或更新。要了解具體內容只能檢視原帖圖片,後續說明有待官方補充。
為滿足歐盟 AI 法案的監管要求,OpenAI 將內容溯源範圍從影像、音訊擴充套件到文字,未來幾週內在歐盟開始對 ChatGPT 和 Codex 的合規文字加水印。其 API 客戶即日起可在全球範圍內為部分模型開啟文字水印。OpenAI 同時承認,當前文字水印技術存在明顯侷限。
面向藝術家的開源創作工具 ArtCraft 上線,提供 macOS、Windows 與瀏覽器版本,全部程式碼在 GitHub 開源,無需訂閱。它把生成與合成放在同一畫布:Image to Location 可把虛擬角色放進實拍環境並保持單一地點一致性,Image to 3D Mesh、Character Posing、背景移除、2D/3D 合成與混合素材用於精確排布鏡頭,頁面還列出 Seedance 2.5、Nano Banana 2 等模型。
OpenAI 宣布將在歐盟為 ChatGPT 和 Codex 生成的文字加入隱形水印,以符合 8 月 2 日生效的 EU AI Act 透明度規則。水印將在未來幾週內推送給歐盟所有套餐的合格使用者;全球 API 開發者即日起可為部分模型開啟,預設關閉,暫不設為全球預設。該方法名為 textGrain,通過微呼叫詞留下可被檢測器識別的模式,隨複製貼上保留,OpenAI 稱不影響模型表現。
OpenAI 將於本月晚些時候在美國開始測試新的視覺廣告,在 ChatGPT 生成圖片時展示贊助商品的圖片。廣告與生成的圖片分開顯示,OpenAI 稱不會影響 ChatGPT 給出的回答。OpenAI 今年 2 月首次在 ChatGPT 投放廣告,此前廣告只顯示公司名、logo 和產品連結,位於對話下方的 sponsored 區域。訂閱 Plus、Pro 等方案的使用者不會看到廣告。