AISpot

搜尋

依意思最接近的 24 筆

r/ClaudeAI top of the day10/3 13:49AI 評分63

Opus 5.5 全自動製作四年 AI 回顧影片

一位使用者僅向 Opus 5.5 提供創意、工作資料夾和音樂檔案,模型便自主完成了從調研到成片的全流程。它檢索了四年 AI 發展資料與素材,擷取文章和介面截圖,編寫 HTML 與動畫程式碼,用 Playwright 渲染畫面、FFmpeg 合成並加入音效,最終輸出完整影片。

r/ClaudeAI top of the day10/3 06:52AI 評分55

開發者用 Claude Code 與 Remotion 生成 Mac 應用宣傳片,帶來首批 10 位客戶

一名獨立開發者用 Claude Opus 智慧體(Claude Code)配合 Remotion 製作了 Mac 應用 Tack+ 的發布影片,全部內容由程式碼生成,未使用 After Effects、素材庫或授權音樂。影片時長 45 秒、60 fps,輸出 1080p 與 4K,含法語和英語版本;MacBook 用 CSS 3D 搭建,卡片為應用真實渲染,配樂也逐音符合成。

X @GoogleDeepMind10/1 13:11AI 評分43

@GoogleDeepMind: When AI-generated content has become so realistic, how do we verify what's made by human, machine, …

Google DeepMind 發布一期播客,討論 AI 生成內容日益逼真後如何驗證內容來自人類、機器還是自然。節目介紹內容溯源的作用,並講解不可感知水印如何保護數字媒體與生物設計,時間軸涵蓋水印概念、SynthID、影像與影片、SynthID Bio 及未來韌性等章節。

TechCrunch AI● 精選10/7 10:00AI 評分83

Google 上線 SynthID 網站,任何人都能驗證 AI 生成內容

Google 週二上線 SynthID 驗證網站,任何人可上傳圖片、影片或音訊,檢查是否為 AI 生成。該工具此前只向部分記者、媒體從業者和研究人員開放測試,現已全面開放,支援 JPG、PNG、HEIC、MP4、MP3、WAV 等十餘種格式。SynthID 自 2023 年推出,Google 的 Nano Banana、Veo、Lyria 模型以及 Gemini、Flow、Vids 等生成工具都會為產出加水印,OpenAI、Nvidia、Kakao 也已支援。

量子位10/7 07:34AI 評分63

AI 影視公司 Utopai 影片模型盲測排名第二

Artificial Analysis 最新文生影片榜單中,影視公司 Utopai Studios 的模型 Utopai X 以 1150 分位列第二,與第一名阿里 Wan 3.0 僅差 7 分,據福布斯估算其估值約 10 億美元。該榜單由評審在不知道模型名字的情況下盲投產生;Utopai X 以 MiniMax 開源的影片模型 H3 為底子做後訓練,10 項能力中有 7 項比基座更接近頂尖水平,音訊同步、運鏡控制與物理提升最明顯。

X @GoogleDeepMind● 精選10/7 10:03AI 評分85

SynthID Detector 向所有人開放,可檢測多家 AI 生成內容

Google DeepMind 宣布 SynthID Detector 現已向所有人開放,可用來判斷網上內容是否由 AI 生成。該工具除 Google AI 外,還支援檢測 OpenAI、NVIDIA、Kakao 等行業夥伴工具生成的內容,Apple 即將加入。使用者可通過 synthid.com 試用。

r/ClaudeAI top of the day10/3 15:08AI 評分42

創作者用 Claude 加 Magnific 完成 AI 動畫短片

創作者 Marcello Costa 發布 AI 動畫短片 Monkey Business,整個流程幾乎都在 Claude 內完成。他通過 Seedance 2.5 skill 把自然語言提示轉成 Magnific 內 Seedance 2.5 工具的詳細視覺提示,99% 的過程發生在 Claude 中。首個提示設定專案規則後,僅用專案內術語即可協作,從開始到完成約 50 天,期間仍需大量迭代和後期製作。

機器之心10/6 08:12AI 評分48

影視公司 Utopai 的定製模型 Utopai X 登 Video Arena 全球第二

Artificial Analysis 的 Video Arena 文生影片排行榜上,影視公司 Utopai 的定製模型 Utopai X 以 1150 的 Elo 評分位列全球第二、全美第一,這是該榜採用雙盲投票以來首次有影視公司定製模型進入前列。Utopai X 基於 MiniMax H3 架構做深度定製後訓練,在評測的 10 項細分能力中 7 項超越基座模型,音訊同步與物理規律排名第一,光照與材質、鏡頭控制排名第二。

r/ClaudeAI top of the day10/2 17:41AI 評分56

使用者用 Claude 將 100 分鐘遊戲錄影剪成 50 分鐘成片

一位業餘創作者在 Opus 5.5 發布後嘗試用 Claude 做影片剪輯,把 100 分鐘的多視角遊戲錄影剪成 50 分鐘的 YouTube 成片,全程未使用 DaVinci 或 Premiere。Claude 自動同步了音畫不同步的素材、生成轉錄並據此刪減冗餘、消除停頓、平衡音量,還製作了動畫片頭、箭頭與縮放等效果,並把錄影中的實體遊戲板重做成螢幕版。整個過程不到一天,作者只給了很少的指導。

r/LocalLLaMA top of the day10/3 00:10AI 評分43

mlsubgen 本地生成 45 種語言字幕,僅支援 Linux 與 NVIDIA

開源工具 mlsubgen 可在本機為影片生成 45 種語言字幕,僅支援 Linux 與 NVIDIA 顯示卡。它按每段語音檢測語言而非整檔案,同時執行兩個語音識別器並用本地 LLM 調和,且優先使用內嵌字幕軌(含藍光 PGS 點陣圖 OCR),無字幕時才聽音訊。模型佔用 30–65 GB 儲存,需 16–32 GB 記憶體,作者在 24 GB RTX A5000 上實測,純聽音訊時約每個目標語言耗時接近即時。

Hugging Face blog● 精選10/2 11:19AI 評分70

Ai2 開源 AstaBrief 8B 科學報告生成模型

Ai2 開源了 AstaBrief 8B,一個把研究問題與檢索文獻片段轉成帶引用報告的模型,基於 Qwen3-8B 訓練,已作為 Asta 的 Fast 模式上線。官方稱 Fast 模式平均 51.1 秒生成一份報告,比 Claude 驅動的 Thinking 模式 178.5 秒快約 3.5 倍。模型權重、訓練資料與範例工作流一併開放,機構可在自有基礎設施上本地生成報告。

Hacker News front page10/2 17:25AI 評分71

Ai2 開源 AstaBrief 8B 科學報告生成模型

Ai2 於 2026 年 10 月 2 日開源 AstaBrief 8B,一個把研究問題與檢索文獻片段轉成帶引用報告的模型,基於 Qwen3-8B 訓練,採用 SFT 加 DPO 而非強化學習。它已作為 Asta 的 Fast 模式上線,與 Claude 驅動的 Thinking 模式並列,整條流水線平均每份報告 51.1 秒,比 Thinking 模式的 178.5 秒快約 3.5 倍。

X @GoogleDeepMind● 精選10/1 07:43AI 評分80

@GoogleDeepMind: SynthID Bio is our new family of watermarking methods made for AI-generated biological designs.

Google DeepMind 發布 SynthID Bio,一套面向 AI 生成生物設計的水印方法。官方稱這是全球首次能在不影響生物功能的前提下,把不可感知的簽名直接嵌入蛋白質序列。該技術屬於 SynthID 水印體系的新分支,具體覆蓋範圍、檢測方式與可用時間尚未公布。

Ars Technica AI10/7 13:57AI 評分65

美國男子用 AI 歌曲和上萬機器人刷流媒體獲刑 18 個月

美國北卡羅萊納州 54 歲的 Michael Smith 用 AI 生成歌曲並配合上萬機器人刷量,從音樂流媒體平台竊取數百萬美元,被判 18 個月監禁。美國司法部稱,他是首位因 AI 輔助流媒體欺詐被刑事起訴的美國人。該騙局在 2024 年首次被起訴前已執行七年未被發現,Smith 已認罪。

X @OpenAI● 精選10/5 13:42AI 評分63

OpenAI 說明文字水印:僅判斷是否由其模型生成

OpenAI 表示,文字水印用於回答一個問題:這段文字是否很可能由其模型生成。水印在生成時嵌入不可見的統計訊號,檢測器可據此識別,不會新增可見標記或特殊字元。它無法說明原作者或版權歸屬,也不能識別個人、組織、帳號、對話或提示詞。OpenAI 稱測試中水印未影響模型能力、速度以及回答的閱讀感受。

TechCrunch AI10/7 10:36AI 評分71

Google Labs 推出 AI 遊戲創作平台 Playground

Google Labs 推出 AI 遊戲創作平台 Playground,用文字提示就能生成可在瀏覽器執行的遊戲,無需程式設計能力。使用者可選擇問答、競速等型別,指定 2D 或 3D、單人或多人玩法,還能上傳圖片讓 AI 轉成符合美術風格的遊戲資產;成品支援手機與電腦遊玩、連結分享或發布到 Explore 畫廊,並可持續修改。

The Verge AI10/3 12:49AI 評分47

Capcom 稱正為與 AI 共同開發遊戲的未來做準備

在 Capcom Open Conference RE: 2026 上,程式設計師 Satoshi Ishida 以「REX 專案的前景與未來」為題演講,稱制作《生化危機》級別遊戲時連簡單任務都極其耗時,解決方案是把 AI 技術成功整合進開發流程。他表示為「與 AI 共同創造遊戲的未來」做準備。Capcom 此前曾稱不會使用 AI。

TechCrunch AI10/6 18:34AI 評分60

前 Ramp 工程師創辦的 Melius 融資 2500 萬美元

AI 創意平台 Melius 宣布累計融資 2500 萬美元,其中 CRV 領投 2000 萬美元 A 輪,General Catalyst 領投 500 萬美元種子輪。這家紐約公司由三名前 Ramp 工程師創辦,最初做廣告投放管理最佳化工具,做了半年多後認定方向走不通,推翻並重寫全部程式碼,轉向生成廣告創意素材與營銷活動的 agents lab。公司稱 7 月結束隱身狀態後兩個月內年化收入已超 100 萬美元,同賽道還有 Higgsfield、Krea、Flora AI。

Hugging Face blog10/2 00:01AI 評分58

ServiceNow 發布 AutoSynthData,為企業 agent 自動生成訓練資料

ServiceNow CoreAI 團隊發布 AutoSynthData,用目標模型的失敗案例和更強教師模型的成功軌跡定位能力缺口,再自動生成並驗證新任務用於後訓練。任務由系統規範、使用者提示和驗證器三部分組成,需滿足可行性、真實性與難度要求,驗證器則要求一致、可靠且不繫結單一參考軌跡。團隊在 EnterpriseOps Gym 資料集上演示了該流程,模型提升後課程會轉向仍難完成的任務。

Hacker News front page10/4 11:29AI 評分35

Jagex 下架疑似 AI 生成 RuneScape 預告片

Jagex 已下架《Dragon Slayer 2》預告片並緊急調查,因片中角色出現六根手指等生成式 AI 痕跡。該預告片由外部合作方製作,對方曾明確確認不會使用 GenAI。Jagex 表示不會用 GenAI 製作遊戲、美術或創意素材,也不會知情允許他人代做,並將在 RuneFest 後整改稽核流程,同時與社群創作者合作重製該預告。

量子位10/3 20:53AI 評分58

Meshy 不到兩年 ARR 從 100 萬增至 1 億美元

AI 3D 生成公司 Meshy 披露,其 ARR 從 100 萬美元增長至 1 億美元,用時不到兩年,比 HeyGen 的 29 個月更快。Meshy 7 在自建幾何對齊基準中造型比例、空間分佈、表面細節三項指標領先受測模型,7.1 將幾何生成解析度從 2048³ 提升至 4096³。三七互娛已將其接入生產流程,基礎模型階段雕刻工作量減少 30% 至 40%。

The Verge AI10/3 11:00AI 評分23

Splice CEO 稱 AI 郵件正在扼殺對話

Splice CEO Kakul Srivastava 認為 AI 生成的郵件正在扼殺對話。她曾任職於 Flickr、Yahoo、GitHub 和 Adobe,目前執掌為音樂製作人提供取樣素材的 Splice,該平台的取樣曾出現在 Lisa 的《Money》和 Sabrina Carpenter 的《Espresso》等熱門歌曲中。她還主導了 Splice 收購 Spitfire Audio 並推動平台向新領域拓展。

r/OpenAI top of the day10/3 11:48AI 評分42

Oscilloscope Diffusion 發布,可對現有影片做擴散重繪

Oscilloscope Diffusion 是一種通過擴散模型干預現有影片的新方法,以影片的運動與形態為起點,重新詮釋其紋理、材質與視覺語言。該工具由作者圍繞其在 TouchDesigner 中製作的音訊反應幾何系統開發,演示素材來自其 Oscilloscopes, everywhere 合集(已更新至 v1.2),也可輸入任意影片源。使用者可選擇源影片、描述處理方式,並通過提示詞、精選 LoRA 與可編輯時間線控制結果與原始影片的貼合程度。