AISpot

搜尋

依意思最接近的 30 筆

機器之心● 精選10/8 22:40AI 評分78

8B 智慧體自主呼叫工具做影片生成,VABench 從 56.5 升到 86.1

VideoGen-Agent 用 Qwen3-VL-8B-Instruct 做基座,在多輪互動中呼叫檢索、生成與驗證工具,先以 16K 教師軌跡監督微調,再用 8K 提示做多工強化學習。在 600 條提示的 VABench 上,Toolset 1 配置得 75.6 分,比基礎生成器 56.5 分高出 19.1 分;智慧體策略不變、僅升級生成工具後達 86.1 分,人類評估中 84.3% 的判斷偏好該配置。

r/ClaudeAI top of the day10/3 13:49AI 評分63

Opus 5.5 全自動製作四年 AI 回顧影片

一位使用者僅向 Opus 5.5 提供創意、工作資料夾和音樂檔案,模型便自主完成了從調研到成片的全流程。它檢索了四年 AI 發展資料與素材,擷取文章和介面截圖,編寫 HTML 與動畫程式碼,用 Playwright 渲染畫面、FFmpeg 合成並加入音效,最終輸出完整影片。

量子位10/7 07:34AI 評分63

AI 影視公司 Utopai 影片模型盲測排名第二

Artificial Analysis 最新文生影片榜單中,影視公司 Utopai Studios 的模型 Utopai X 以 1150 分位列第二,與第一名阿里 Wan 3.0 僅差 7 分,據福布斯估算其估值約 10 億美元。該榜單由評審在不知道模型名字的情況下盲投產生;Utopai X 以 MiniMax 開源的影片模型 H3 為底子做後訓練,10 項能力中有 7 項比基座更接近頂尖水平,音訊同步、運鏡控制與物理提升最明顯。

OpenAI News10/8 08:00AI 評分30

Pollo AI 發布 Pollo Agent,用 GPT-6 Astra 生成影片廣告

Pollo AI 推出影片創作 Agent,呼叫 OpenAI 的 GPT-5.6、GPT-6 Astra 與 GPT-Image-2.5 完成從創意到成片的全流程。系統用 GPT-5.6 做任務路由,GPT-6 Astra 負責敘事與分鏡等複雜推理,影像統一交給 GPT-Image-2.5,官方稱使用者挑選或切換模型的時間減少 50% 以上。平台已有超 2600 萬使用者,30% 的創作會話從模板開始;

TechCrunch AI● 精選10/7 10:00AI 評分83

Google 上線 SynthID 網站,任何人都能驗證 AI 生成內容

Google 週二上線 SynthID 驗證網站,任何人可上傳圖片、影片或音訊,檢查是否為 AI 生成。該工具此前只向部分記者、媒體從業者和研究人員開放測試,現已全面開放,支援 JPG、PNG、HEIC、MP4、MP3、WAV 等十餘種格式。SynthID 自 2023 年推出,Google 的 Nano Banana、Veo、Lyria 模型以及 Gemini、Flow、Vids 等生成工具都會為產出加水印,OpenAI、Nvidia、Kakao 也已支援。

r/ClaudeAI top of the day10/3 06:52AI 評分55

開發者用 Claude Code 與 Remotion 生成 Mac 應用宣傳片,帶來首批 10 位客戶

一名獨立開發者用 Claude Opus 智慧體(Claude Code)配合 Remotion 製作了 Mac 應用 Tack+ 的發布影片,全部內容由程式碼生成,未使用 After Effects、素材庫或授權音樂。影片時長 45 秒、60 fps,輸出 1080p 與 4K,含法語和英語版本;MacBook 用 CSS 3D 搭建,卡片為應用真實渲染,配樂也逐音符合成。

The Verge AI10/9 14:06AI 評分46

尼康顯微影片大賽冠軍因使用生成式 AI 被取消資格

尼康取消 Small World in Motion 顯微影片大賽原第一名作品的資格,理由是該影片違反賽事關於生成式 AI 的規則。該作品由 Dr. Ning Xu 提交,原稱展示 PCD 患兒氣道中纖毛的運動,網上質疑其真實性後,尼康上週表示正在核查。Xu 隨後在 LinkedIn 評論中承認使用無監督神經網路方法進行 AI 輔助後期處理,用於分辨和視覺化相關結構。

X @GoogleDeepMind● 精選10/7 10:03AI 評分85

SynthID Detector 向所有人開放,可檢測多家 AI 生成內容

Google DeepMind 宣布 SynthID Detector 現已向所有人開放,可用來判斷網上內容是否由 AI 生成。該工具除 Google AI 外,還支援檢測 OpenAI、NVIDIA、Kakao 等行業夥伴工具生成的內容,Apple 即將加入。使用者可通過 synthid.com 試用。

機器之心10/6 08:12AI 評分48

影視公司 Utopai 的定製模型 Utopai X 登 Video Arena 全球第二

Artificial Analysis 的 Video Arena 文生影片排行榜上,影視公司 Utopai 的定製模型 Utopai X 以 1150 的 Elo 評分位列全球第二、全美第一,這是該榜採用雙盲投票以來首次有影視公司定製模型進入前列。Utopai X 基於 MiniMax H3 架構做深度定製後訓練,在評測的 10 項細分能力中 7 項超越基座模型,音訊同步與物理規律排名第一,光照與材質、鏡頭控制排名第二。

機器之心10/8 09:30AI 評分51

Vidu Q4 Preview 發布:0.09 元/秒起,支援 15 張參考圖

生數科技推出影片模型 Vidu Q4 Preview,是其面向創作者的首個預覽版本,首發價格 0.09 元/秒起,同樣預算最高可生成 5 倍內容。該版本主打人物演繹、鏡頭語言與複雜視效,支援最多 15 張參考圖、3 段參考音訊輸入,以及 2K、4K 畫質輸出。官方資料顯示其圖生影片速度約為同類模型的 2 倍,5 秒影片最快約 110 秒完成,正式版上線時間尚未公布。

X @GoogleDeepMind10/1 13:11AI 評分43

@GoogleDeepMind: When AI-generated content has become so realistic, how do we verify what's made by human, machine, …

Google DeepMind 發布一期播客,討論 AI 生成內容日益逼真後如何驗證內容來自人類、機器還是自然。節目介紹內容溯源的作用,並講解不可感知水印如何保護數字媒體與生物設計,時間軸涵蓋水印概念、SynthID、影像與影片、SynthID Bio 及未來韌性等章節。

TechCrunch AI10/8 14:20AI 評分37

Ben Affleck 講解 AI 技術走紅,談微調開源影片模型

Ben Affleck 本週因多段訪談影片走紅,他在其中講解神經網路、transformer、張量等概念,並稱自己會寫點 Python。他透露做法是拿開源模型微調:解凍權重、只訓練最後一層「電影感」層,讓劇組達到製片標準,該技術已用於其電影《Animals》後期。他創立的 AI 影視公司今年被 Netflix 收購,報導金額 5.87 億美元,他本人稱這個數字不準確。他還表示不擔心 AI 接管影視業,更擔心學生的習得性無助與大學 A 成績三年上升 30%。

r/ClaudeAI top of the day10/3 15:08AI 評分42

創作者用 Claude 加 Magnific 完成 AI 動畫短片

創作者 Marcello Costa 發布 AI 動畫短片 Monkey Business,整個流程幾乎都在 Claude 內完成。他通過 Seedance 2.5 skill 把自然語言提示轉成 Magnific 內 Seedance 2.5 工具的詳細視覺提示,99% 的過程發生在 Claude 中。首個提示設定專案規則後,僅用專案內術語即可協作,從開始到完成約 50 天,期間仍需大量迭代和後期製作。

TechCrunch AI10/6 18:34AI 評分60

前 Ramp 工程師創辦的 Melius 融資 2500 萬美元

AI 創意平台 Melius 宣布累計融資 2500 萬美元,其中 CRV 領投 2000 萬美元 A 輪,General Catalyst 領投 500 萬美元種子輪。這家紐約公司由三名前 Ramp 工程師創辦,最初做廣告投放管理最佳化工具,做了半年多後認定方向走不通,推翻並重寫全部程式碼,轉向生成廣告創意素材與營銷活動的 agents lab。公司稱 7 月結束隱身狀態後兩個月內年化收入已超 100 萬美元,同賽道還有 Higgsfield、Krea、Flora AI。

Ars Technica AI10/7 13:57AI 評分65

美國男子用 AI 歌曲和上萬機器人刷流媒體獲刑 18 個月

美國北卡羅萊納州 54 歲的 Michael Smith 用 AI 生成歌曲並配合上萬機器人刷量,從音樂流媒體平台竊取數百萬美元,被判 18 個月監禁。美國司法部稱,他是首位因 AI 輔助流媒體欺詐被刑事起訴的美國人。該騙局在 2024 年首次被起訴前已執行七年未被發現,Smith 已認罪。

Hugging Face blog● 精選10/2 11:19AI 評分70

Ai2 開源 AstaBrief 8B 科學報告生成模型

Ai2 開源了 AstaBrief 8B,一個把研究問題與檢索文獻片段轉成帶引用報告的模型,基於 Qwen3-8B 訓練,已作為 Asta 的 Fast 模式上線。官方稱 Fast 模式平均 51.1 秒生成一份報告,比 Claude 驅動的 Thinking 模式 178.5 秒快約 3.5 倍。模型權重、訓練資料與範例工作流一併開放,機構可在自有基礎設施上本地生成報告。

Hacker News front page10/3 09:34AI 評分73

美法院因 AI 受害者影片撤銷路怒殺人犯刑期

美國亞利桑那州一名路怒殺人犯的 10 年刑期被上訴法院撤銷,原因是量刑時播放了受害者家屬用 AI 生成的受害者影片。2021 年 Gabriel Paul Horcasitas 在紅燈口槍殺 37 歲的 Christopher Pelkey,其家人用語音、影片和照片合成 AI 版 Pelkey 在法庭上發言。上訴法院認為該 AI 影片呈現的是受害者妹妹的想像,而非記錄真實事件,因此越界,55 歲的 Horcasitas 須重新量刑。

Hacker News front page10/2 17:25AI 評分71

Ai2 開源 AstaBrief 8B 科學報告生成模型

Ai2 於 2026 年 10 月 2 日開源 AstaBrief 8B,一個把研究問題與檢索文獻片段轉成帶引用報告的模型,基於 Qwen3-8B 訓練,採用 SFT 加 DPO 而非強化學習。它已作為 Asta 的 Fast 模式上線,與 Claude 驅動的 Thinking 模式並列,整條流水線平均每份報告 51.1 秒,比 Thinking 模式的 178.5 秒快約 3.5 倍。

The Verge AI10/3 12:49AI 評分47

Capcom 稱正為與 AI 共同開發遊戲的未來做準備

在 Capcom Open Conference RE: 2026 上,程式設計師 Satoshi Ishida 以「REX 專案的前景與未來」為題演講,稱制作《生化危機》級別遊戲時連簡單任務都極其耗時,解決方案是把 AI 技術成功整合進開發流程。他表示為「與 AI 共同創造遊戲的未來」做準備。Capcom 此前曾稱不會使用 AI。

X @GoogleDeepMind● 精選10/1 07:43AI 評分80

@GoogleDeepMind: SynthID Bio is our new family of watermarking methods made for AI-generated biological designs.

Google DeepMind 發布 SynthID Bio,一套面向 AI 生成生物設計的水印方法。官方稱這是全球首次能在不影響生物功能的前提下,把不可感知的簽名直接嵌入蛋白質序列。該技術屬於 SynthID 水印體系的新分支,具體覆蓋範圍、檢測方式與可用時間尚未公布。

The Verge AI● 精選10/5 09:09AI 評分77

OpenAI 開始在 ChatGPT 圖片生成中測試視覺廣告

OpenAI 將於本月晚些時候在美國開始測試新的視覺廣告,在 ChatGPT 生成圖片時展示贊助商品的圖片。廣告與生成的圖片分開顯示,OpenAI 稱不會影響 ChatGPT 給出的回答。OpenAI 今年 2 月首次在 ChatGPT 投放廣告,此前廣告只顯示公司名、logo 和產品連結,位於對話下方的 sponsored 區域。訂閱 Plus、Pro 等方案的使用者不會看到廣告。

Hacker News front page10/4 11:29AI 評分35

Jagex 下架疑似 AI 生成 RuneScape 預告片

Jagex 已下架《Dragon Slayer 2》預告片並緊急調查,因片中角色出現六根手指等生成式 AI 痕跡。該預告片由外部合作方製作,對方曾明確確認不會使用 GenAI。Jagex 表示不會用 GenAI 製作遊戲、美術或創意素材,也不會知情允許他人代做,並將在 RuneFest 後整改稽核流程,同時與社群創作者合作重製該預告。

TechCrunch AI10/7 10:36AI 評分71

Google Labs 推出 AI 遊戲創作平台 Playground

Google Labs 推出 AI 遊戲創作平台 Playground,用文字提示就能生成可在瀏覽器執行的遊戲,無需程式設計能力。使用者可選擇問答、競速等型別,指定 2D 或 3D、單人或多人玩法,還能上傳圖片讓 AI 轉成符合美術風格的遊戲資產;成品支援手機與電腦遊玩、連結分享或發布到 Explore 畫廊,並可持續修改。

OpenAI News● 精選10/5 06:00AI 評分85

ChatGPT 推出視覺廣告格式,先在影像生成中測試

OpenAI 宣布在 ChatGPT 推出新的視覺廣告格式,並擴充套件廣告測量工具與合作伙伴。該格式初期在影像生成過程中測試,廣告會明確標註且與生成的圖片分開,不影響 ChatGPT 給出的回答,本月晚些時候在美國面向首批廣告主開始。ChatGPT 每週觸達 12 億人。OpenAI 同時接入 Hightouch、Tealium、LiveRamp 的轉化資料整合,與 AppsFlyer、Adjust 等歸因夥伴合作,並與 DoubleVerify、IAS 試點品牌適配性評估。

Hacker News front page● 精選10/9 10:14AI 評分78

法官採信 AI 生成的受害者諒解影片,上訴法院撤銷原判

亞利桑那州上訴法院 10 月 4 日撤銷了 Gabriel Paul Horcasitas 的過失殺人刑期,認定量刑法官採納一段 AI 生成的受害者影片構成「根本性錯誤」,下令重新量刑。該影片由受害者 Christopher Pelkey 的姐姐製作,2025 年量刑時在庭上播放,AI 還原的 Pelkey 在片中表示寬恕兇手;主審法官 Todd Lang 稱自己「很喜歡那個 AI」,並認為這份寬恕是真誠的。原判 10 年半已是最高刑期,上訴法院認為 AI 影片對被告造成偏見,使量刑程式不公。

量子位10/3 20:53AI 評分58

Meshy 不到兩年 ARR 從 100 萬增至 1 億美元

AI 3D 生成公司 Meshy 披露,其 ARR 從 100 萬美元增長至 1 億美元,用時不到兩年,比 HeyGen 的 29 個月更快。Meshy 7 在自建幾何對齊基準中造型比例、空間分佈、表面細節三項指標領先受測模型,7.1 將幾何生成解析度從 2048³ 提升至 4096³。三七互娛已將其接入生產流程,基礎模型階段雕刻工作量減少 30% 至 40%。

The Verge AI10/3 11:00AI 評分23

Splice CEO 稱 AI 郵件正在扼殺對話

Splice CEO Kakul Srivastava 認為 AI 生成的郵件正在扼殺對話。她曾任職於 Flickr、Yahoo、GitHub 和 Adobe,目前執掌為音樂製作人提供取樣素材的 Splice,該平台的取樣曾出現在 Lisa 的《Money》和 Sabrina Carpenter 的《Espresso》等熱門歌曲中。她還主導了 Splice 收購 Spitfire Audio 並推動平台向新領域拓展。

Hacker News front page10/4 04:41AI 評分35

Stripe 設計負責人談用 AI 避免殭屍 UI

Stripe 設計負責人 Katie Dill 在 2026 年 9 月 10 日舊金山 Lenny and Friends Summit 的演講中提出,AI 讓建置產品更容易,但產品容易淪為通用的殭屍 UI。她認為好設計仍取決於清晰的觀點、對使用者的理解和對細節的用心,並分享瞭如何把標準寫進 AI 工具、在初稿之外繼續編輯、用 AI 做出更原創的產品。該影片由 Lenny's Podcast 於 9 月 25 日發布,時長 21 分 47 秒。

r/OpenAI top of the day10/3 11:48AI 評分42

Oscilloscope Diffusion 發布,可對現有影片做擴散重繪

Oscilloscope Diffusion 是一種通過擴散模型干預現有影片的新方法,以影片的運動與形態為起點,重新詮釋其紋理、材質與視覺語言。該工具由作者圍繞其在 TouchDesigner 中製作的音訊反應幾何系統開發,演示素材來自其 Oscilloscopes, everywhere 合集(已更新至 v1.2),也可輸入任意影片源。使用者可選擇源影片、描述處理方式,並通過提示詞、精選 LoRA 與可編輯時間線控制結果與原始影片的貼合程度。