9 月底,獨立評測機構 Artificial Analysis 公布最新文生影片排行榜 Video Arena,影視公司 Utopai Studios 的定製模型 Utopai X 以 1150 的 Elo 評分位列全球第二、全美第一,與榜首阿里 Wan 3.0 僅差 7 分(據量子位報導)。該榜採用雙盲機制,測試影片… 看完整事件
AI 影視公司 Utopai 影片模型盲測排名第二
Artificial Analysis 最新文生影片榜單中,影視公司 Utopai Studios 的模型 Utopai X 以 1150 分位列第二,與第一名阿里 Wan 3.0 僅差 7 分,據福布斯估算其估值約 10 億美元。該榜單由評審在不知道模型名字的情況下盲投產生;Utopai X 以 MiniMax 開源的影片模型 H3 為底子做後訓練,10 項能力中有 7 項比基座更接近頂尖水平,音訊同步、運鏡控制與物理提升最明顯。
給出了影視公司自研影片模型在第三方盲投榜單中排第二、與基座 MiniMax H3 的逐項對照資料,以及 PAI 製片平台的落地案例,對關注影片模型與 AI 製片流程的人有參考價值。
原標題:《怪物史莱克》编剧也来了!这家AI影视公司,视频模型全球第二!
閱讀原文
| 評分 | 58 / 68(平均 63,門檻 65) |
|---|---|
| 狀態 | 未入選 |
相關報導
Opus 5.5 全自動製作四年 AI 回顧影片
一位使用者僅向 Opus 5.5 提供創意、工作資料夾和音樂檔案,模型便自主完成了從調研到成片的全流程。它檢索了四年 AI 發展資料與素材,擷取文章和介面截圖,編寫 HTML 與動畫程式碼,用 Playwright 渲染畫面、FFmpeg 合成並加入音效,最終輸出完整影片。
開發者用 Claude Code 與 Remotion 生成 Mac 應用宣傳片,帶來首批 10 位客戶
一名獨立開發者用 Claude Opus 智慧體(Claude Code)配合 Remotion 製作了 Mac 應用 Tack+ 的發布影片,全部內容由程式碼生成,未使用 After Effects、素材庫或授權音樂。影片時長 45 秒、60 fps,輸出 1080p 與 4K,含法語和英語版本;MacBook 用 CSS 3D 搭建,卡片為應用真實渲染,配樂也逐音符合成。
Oscilloscope Diffusion 發布,可對現有影片做擴散重繪
Oscilloscope Diffusion 是一種通過擴散模型干預現有影片的新方法,以影片的運動與形態為起點,重新詮釋其紋理、材質與視覺語言。該工具由作者圍繞其在 TouchDesigner 中製作的音訊反應幾何系統開發,演示素材來自其 Oscilloscopes, everywhere 合集(已更新至 v1.2),也可輸入任意影片源。使用者可選擇源影片、描述處理方式,並通過提示詞、精選 LoRA 與可編輯時間線控制結果與原始影片的貼合程度。
新基準 VA-Bench 測 12 個多模態模型,完整任務成功率約一半
VA-Bench 用 14 類機器人操作任務、280 個物理驗證場景測試 12 個主流多模態模型,發現目標識別與定位可達 100%、操作語義理解接近 100%,但完整任務成功率最高的 Qwen3.8-max、Opus-5、GPT-5.6-sol 分別只有 53.93%、52.86%、51.55%。測試中模型先觀看成功示範影片,但拿不到物體座標與專家軌跡,需自行決定是否消耗步數切換視角,並直接給出移動距離、旋轉角度與夾爪開合時機。
OpenAI 公布歐盟文字溯源方案,API 可選用文字水印
OpenAI 公布應對歐盟 AI 法案的文字溯源方案:全球 API 客戶即日起可為部分模型選擇開啟文字水印(預設關閉),未來幾週將在歐盟的 ChatGPT 與 Codex 文字輸出中加入不可見水印,檢測器僅向獲批研究者與專家組織開放申請。其自研 textGrain 通過統計訊號標記用詞,在 1% 誤報率下對 200 token 段落檢出約 80%、400 token 約 95%,數學等用詞受限內容明顯更低;