AISpot

搜尋

依意思最接近的 30 筆

機器之心● 精選10/7 22:29AI 評分71

VisInteract 讓文字到視覺化多輪追問意圖,入選 NeurIPS 2026 Spotlight

香港理工大學與字節跳動團隊的 VisInteract 被 NeurIPS 2026 接收為 Spotlight(292/30709),它把文字到視覺化(Text-to-Vis)當作從不完美查詢中多輪追問、找回真實意圖的過程。團隊同時發布首個動態互動式 Text-to-Vis 基準 VisInteract-Bench:1098 條樣本、11 個資料庫、75 張表,約 61% 查詢帶歧義、69% 帶事實錯誤;

Hacker News front page● 精選10/5 11:38AI 評分87

OpenAI 公布歐盟文字溯源方案,API 可選用文字水印

OpenAI 公布應對歐盟 AI 法案的文字溯源方案:全球 API 客戶即日起可為部分模型選擇開啟文字水印(預設關閉),未來幾週將在歐盟的 ChatGPT 與 Codex 文字輸出中加入不可見水印,檢測器僅向獲批研究者與專家組織開放申請。其自研 textGrain 通過統計訊號標記用詞,在 1% 誤報率下對 200 token 段落檢出約 80%、400 token 約 95%,數學等用詞受限內容明顯更低;

Ars Technica AI● 精選10/6 16:50AI 評分82

OpenAI 將在歐盟預設給 ChatGPT 輸出加水印

OpenAI 宣布將在歐盟自動為 ChatGPT 生成的文字加水印,其他地區也提供該功能,但預設關閉。這是為遵守 8 月生效的歐盟 AI Act,該法要求 AI 生成內容可被其他工具檢測。OpenAI 的水印方法名為 textGrain,屬專有技術並已發布技術論文:它在用詞中埋入人類難以察覺、也不影響輸出品質的模式,持有金鑰者可用專用檢測器識別。檢測器初期只向有限的研究者與機構開放,其他方需經申請審批逐步加入。

X @OpenAI● 精選10/5 13:42AI 評分66

OpenAI:文字水印有侷限,檢測器暫只開放給獲批研究者

OpenAI 表示文字水印存在明顯侷限:在短文字中往往無法檢測,改寫或翻譯就能徹底去除水印。因此目前只有經過批准的研究者才能使用其水印檢測器,用於評估和改進這項技術。OpenAI 將文字水印視為一個持續研究的方向,會繼續測試和改進,並收集使用者、開發者、政策制定者和研究者的反饋。

The Verge AI● 精選10/5 14:08AI 評分80

OpenAI 在 ChatGPT 和 Codex 推出文字水印,首批僅限歐盟

OpenAI 開始在 ChatGPT 和 Codex 的文字輸出中加入不可見、機器可讀的水印,初期只面向歐盟使用者。OpenAI 稱自研的 textGrain 水印與 Google DeepMind 的 SynthID for text 等方法相比持平或更優,後者也是 Anthropic 8 月宣布的水印基礎;兩家公司都是為了滿足歐盟 AI Act 的要求。OpenAI 還給出 AI 基準分數,顯示加水印與未加水印文字表現相近,但表示 textGrain 並不保證……

機器之心● 精選10/6 08:32AI 評分88

OpenAI 啟用文字水印,歐盟 ChatGPT 與 Codex 輸出將被標記

OpenAI 宣布正式啟用文字水印:即日起全球 API 客戶可為部分模型自行開啟,預設關閉;未來幾週歐盟地區符合條件的 ChatGPT 與 Codex 文字輸出將被加上肉眼不可見的水印,覆蓋所有付費檔位,檢測器僅向稽核過的研究者和專業機構開放。配套技術報告 textGrain 由今年考普斯會長獎得主蘇煒傑擔任通訊作者,用可調的「熵預算」控制水印強度。

X @GoogleDeepMind● 精選10/7 10:03AI 評分85

SynthID Detector 向所有人開放,可檢測多家 AI 生成內容

Google DeepMind 宣布 SynthID Detector 現已向所有人開放,可用來判斷網上內容是否由 AI 生成。該工具除 Google AI 外,還支援檢測 OpenAI、NVIDIA、Kakao 等行業夥伴工具生成的內容,Apple 即將加入。使用者可通過 synthid.com 試用。

TechCrunch AI● 精選10/5 16:36AI 評分86

OpenAI 將在歐盟為 ChatGPT 文字加隱形水印

OpenAI 宣布將在歐盟為 ChatGPT 和 Codex 生成的文字加入隱形水印,以符合 8 月 2 日生效的 EU AI Act 透明度規則。水印將在未來幾週內推送給歐盟所有套餐的合格使用者;全球 API 開發者即日起可為部分模型開啟,預設關閉,暫不設為全球預設。該方法名為 textGrain,通過微呼叫詞留下可被檢測器識別的模式,隨複製貼上保留,OpenAI 稱不影響模型表現。

X @OpenAI● 精選10/5 13:42AI 評分63

OpenAI 說明文字水印:僅判斷是否由其模型生成

OpenAI 表示,文字水印用於回答一個問題:這段文字是否很可能由其模型生成。水印在生成時嵌入不可見的統計訊號,檢測器可據此識別,不會新增可見標記或特殊字元。它無法說明原作者或版權歸屬,也不能識別個人、組織、帳號、對話或提示詞。OpenAI 稱測試中水印未影響模型能力、速度以及回答的閱讀感受。

X @OpenAI● 精選10/5 13:42AI 評分84

OpenAI 將在歐盟為 ChatGPT 與 Codex 文字加水印

為滿足歐盟 AI 法案的監管要求,OpenAI 將內容溯源範圍從影像、音訊擴充套件到文字,未來幾週內在歐盟開始對 ChatGPT 和 Codex 的合規文字加水印。其 API 客戶即日起可在全球範圍內為部分模型開啟文字水印。OpenAI 同時承認,當前文字水印技術存在明顯侷限。

量子位10/7 07:34AI 評分63

AI 影視公司 Utopai 影片模型盲測排名第二

Artificial Analysis 最新文生影片榜單中,影視公司 Utopai Studios 的模型 Utopai X 以 1150 分位列第二,與第一名阿里 Wan 3.0 僅差 7 分,據福布斯估算其估值約 10 億美元。該榜單由評審在不知道模型名字的情況下盲投產生;Utopai X 以 MiniMax 開源的影片模型 H3 為底子做後訓練,10 項能力中有 7 項比基座更接近頂尖水平,音訊同步、運鏡控制與物理提升最明顯。

OpenAI News● 精選10/5 06:00AI 評分85

ChatGPT 推出視覺廣告格式,先在影像生成中測試

OpenAI 宣布在 ChatGPT 推出新的視覺廣告格式,並擴充套件廣告測量工具與合作伙伴。該格式初期在影像生成過程中測試,廣告會明確標註且與生成的圖片分開,不影響 ChatGPT 給出的回答,本月晚些時候在美國面向首批廣告主開始。ChatGPT 每週觸達 12 億人。OpenAI 同時接入 Hightouch、Tealium、LiveRamp 的轉化資料整合,與 AppsFlyer、Adjust 等歸因夥伴合作,並與 DoubleVerify、IAS 試點品牌適配性評估。

The Verge AI● 精選10/7 15:10AI 評分94

ChatGPT 推出 Intelligent UI,回答可含圖表與互動按鈕

OpenAI 隨 GPT-6 向所有使用者推出 ChatGPT 的 Intelligent UI,讓回答在文字之外還能包含示意圖、圖表、表單和可點選按鈕等互動視覺元素。OpenAI 表示,GPT-6 經過訓練,會判斷何時該生成互動視覺而非純文字,並學會在回答中排版這些元素。官方範例顯示,詢問七速腳踏車設計時,ChatGPT 會給出示意圖,並配有高亮不同部件的互動按鈕。

TechCrunch AI● 精選10/7 10:00AI 評分83

Google 上線 SynthID 網站,任何人都能驗證 AI 生成內容

Google 週二上線 SynthID 驗證網站,任何人可上傳圖片、影片或音訊,檢查是否為 AI 生成。該工具此前只向部分記者、媒體從業者和研究人員開放測試,現已全面開放,支援 JPG、PNG、HEIC、MP4、MP3、WAV 等十餘種格式。SynthID 自 2023 年推出,Google 的 Nano Banana、Veo、Lyria 模型以及 Gemini、Flow、Vids 等生成工具都會為產出加水印,OpenAI、Nvidia、Kakao 也已支援。

TechCrunch AI● 精選10/7 14:00AI 評分94

ChatGPT 上線 Intelligent UI,隨 GPT-6 引入可互動視覺介面

OpenAI 隨新 GPT-6 模型推出名為 Intelligent UI 的新介面,週三起面向 Pro、Plus、Business、Enterprise 使用者全球上線,免費與低價 Go 檔使用者週四可用。ChatGPT 回覆中將大量加入可點選按鈕、任務定製計算器、互動式圖表、可編輯圖形等元素,官方稱目標是讓複雜主題更易學習。使用者可像調整其他個性化設定一樣,減少回覆中的視覺內容。

X @OpenAI● 精選10/7 14:05AI 評分92

OpenAI 宣布 GPT-6 支援 Intelligent UI,回覆可含圖表與互動元素

OpenAI 官方帳號宣布,GPT-6 新增 Intelligent UI,可在回覆中組合文字、視覺內容與互動元素,並按使用者提問自行決定三者的組合方式。回覆因此能包含幫助解釋概念的圖形和圖表,也能嵌入可點選按鈕、表單等互動體驗,使用者可直接在對話中使用它們。OpenAI 未在該推文中說明該功能的上線時間、適用套餐、地區限制或是否需要額外設定。

X @GoogleDeepMind10/1 13:11AI 評分43

@GoogleDeepMind: When AI-generated content has become so realistic, how do we verify what's made by human, machine, …

Google DeepMind 發布一期播客,討論 AI 生成內容日益逼真後如何驗證內容來自人類、機器還是自然。節目介紹內容溯源的作用,並講解不可感知水印如何保護數字媒體與生物設計,時間軸涵蓋水印概念、SynthID、影像與影片、SynthID Bio 及未來韌性等章節。

r/ClaudeAI top of the day10/3 13:49AI 評分63

Opus 5.5 全自動製作四年 AI 回顧影片

一位使用者僅向 Opus 5.5 提供創意、工作資料夾和音樂檔案,模型便自主完成了從調研到成片的全流程。它檢索了四年 AI 發展資料與素材,擷取文章和介面截圖,編寫 HTML 與動畫程式碼,用 Playwright 渲染畫面、FFmpeg 合成並加入音效,最終輸出完整影片。

Hugging Face blog● 精選10/2 11:19AI 評分70

Ai2 開源 AstaBrief 8B 科學報告生成模型

Ai2 開源了 AstaBrief 8B,一個把研究問題與檢索文獻片段轉成帶引用報告的模型,基於 Qwen3-8B 訓練,已作為 Asta 的 Fast 模式上線。官方稱 Fast 模式平均 51.1 秒生成一份報告,比 Claude 驅動的 Thinking 模式 178.5 秒快約 3.5 倍。模型權重、訓練資料與範例工作流一併開放,機構可在自有基礎設施上本地生成報告。

r/ClaudeAI top of the day10/3 15:08AI 評分42

創作者用 Claude 加 Magnific 完成 AI 動畫短片

創作者 Marcello Costa 發布 AI 動畫短片 Monkey Business,整個流程幾乎都在 Claude 內完成。他通過 Seedance 2.5 skill 把自然語言提示轉成 Magnific 內 Seedance 2.5 工具的詳細視覺提示,99% 的過程發生在 Claude 中。首個提示設定專案規則後,僅用專案內術語即可協作,從開始到完成約 50 天,期間仍需大量迭代和後期製作。

r/ClaudeAI top of the day10/2 17:23AI 評分40

用草圖代替文字提示,Claude 在 Blender 建模效率提升

一位使用者在 Blender 中使用 Claude Opus 5.5 時發現,直接畫出空間意圖比用文字描述形狀更高效。文字擅長說明物體是什麼,卻難以表達位置、大小和數量,因此他改為提供草圖或空間參考。整個專案共消耗 3300 萬 token,API 成本 16.07 美元,執行 48.5 分鐘。

The Verge AI● 精選10/5 09:09AI 評分77

OpenAI 開始在 ChatGPT 圖片生成中測試視覺廣告

OpenAI 將於本月晚些時候在美國開始測試新的視覺廣告,在 ChatGPT 生成圖片時展示贊助商品的圖片。廣告與生成的圖片分開顯示,OpenAI 稱不會影響 ChatGPT 給出的回答。OpenAI 今年 2 月首次在 ChatGPT 投放廣告,此前廣告只顯示公司名、logo 和產品連結,位於對話下方的 sponsored 區域。訂閱 Plus、Pro 等方案的使用者不會看到廣告。

TechCrunch AI● 精選10/5 11:14AI 評分81

OpenAI 在 ChatGPT 影像生成結果旁上線視覺廣告

OpenAI 正在為 ChatGPT 增加視覺展示廣告,廣告會出現在使用者要求生成的影像旁邊,本月晚些時候先在美國上線,僅面向初始測試廣告主,且廣告有明確標註、不影響 ChatGPT 給出的回答。同時 OpenAI 擴充套件廣告衡量工具與合作生態,納入 AppsFlyer、Adjust、Branch 等點選歸因夥伴,並與 DoubleVerify、Integral Ad Science 開展品牌適配性評估試點。

OpenRouter announcements● 精選10/6 20:00AI 評分74

ElevenLabs 上線 OpenRouter,帶來 9 個語音合成與 2 個轉錄模型

ElevenLabs 正式上線 OpenRouter,提供 9 個文字轉語音模型和 2 個語音轉文字模型。已通過 OpenRouter 呼叫語言模型的應用,用同一個 OpenRouter API key 呼叫 POST /api/v1/audio/speech 與 POST /api/v1/audio/transcriptions 即可獲得語音能力,無需另購 ElevenLabs 套餐。