長文評論:前沿 AI 只是隨機鸚鵡,AI 威脅敘事是炒作
一篇 10 月 10 日發布的評論文章認為,當前前沿生成式 AI 仍只是被高度增強的隨機鸚鵡,無法具備智慧判斷,因此應拒絕「AI」這一命名及其被兜售的敘事。作者從美國視角批評 Anthropic、OpenAI 等公司誇大能力,把「威脅人類」與「必須領先中國」的話術捆綁,用於自我牟利。文章還稱該技術至多是既有風險的加速器,例如病原體研究與威權監控,真正危險來自使用者而非模型本身。
依意思最接近的 22 筆
一篇 10 月 10 日發布的評論文章認為,當前前沿生成式 AI 仍只是被高度增強的隨機鸚鵡,無法具備智慧判斷,因此應拒絕「AI」這一命名及其被兜售的敘事。作者從美國視角批評 Anthropic、OpenAI 等公司誇大能力,把「威脅人類」與「必須領先中國」的話術捆綁,用於自我牟利。文章還稱該技術至多是既有風險的加速器,例如病原體研究與威權監控,真正危險來自使用者而非模型本身。
企業語音 AI 平台 PolyAI 的 CTO Shawn Wen 在 HumanX 大會上表示,儘管全雙工語音模型已經問世,語音 AI 仍未迎來自己的「ChatGPT 時刻」,下一步挑戰是讓推理足夠快、對話足夠自然。Otter 的 CMO Alex Gay 認為說話人識別、意圖捕捉並結合組織知識是走向自動化的關鍵,Otter 還在研發可代表個人參會的數字分身,其輸出語音需具備與人對話時的情感表達。
Google DeepMind 發布一期播客,討論 AI 生成內容日益逼真後如何驗證內容來自人類、機器還是自然。節目介紹內容溯源的作用,並講解不可感知水印如何保護數字媒體與生物設計,時間軸涵蓋水印概念、SynthID、影像與影片、SynthID Bio 及未來韌性等章節。
因果智慧公司 Aether AI 公布機器人系統 CRIS-0 的官方 Demo,靠提取物理因果變數而非端到端擬合驅動機械臂。在咖啡製作測試中遭遇人為移位與光照突變,系統平均 2 秒內完成重規劃,10 次隨機擾動有 9 次有效恢復;客廳長程整理可連續執行數十步,20 條模糊指令完成 18 次精準抓放,危險變數出現時 0.2 秒急停。
Aether AI 發布因果驅動的機器人智慧系統 CRIS-0,演示中面對人類突然移走咖啡袋、燈光干擾、往盤裡放飲料罐、關門時伸手等干擾均能即時調整,反應速度達 0.1s 級。它把機器人智慧分成兩層:因果驅動機器人 Agent 負責任務拆解、階段驗證與失敗恢復,因果世界模型預測動作帶來的物理變化。相比端到端模型,它在抗干擾、模糊指令和長程任務上更穩;團隊稱該路線還可延伸到生物製藥、新材料研發,更底層的 Causation Transformer 仍在驗證。
Google Labs 推出 AI 遊戲創作平台 Playground,用文字提示就能生成可在瀏覽器執行的遊戲,無需程式設計能力。使用者可選擇問答、競速等型別,指定 2D 或 3D、單人或多人玩法,還能上傳圖片讓 AI 轉成符合美術風格的遊戲資產;成品支援手機與電腦遊玩、連結分享或發布到 Explore 畫廊,並可持續修改。
Pollo AI 推出影片創作 Agent,呼叫 OpenAI 的 GPT-5.6、GPT-6 Astra 與 GPT-Image-2.5 完成從創意到成片的全流程。系統用 GPT-5.6 做任務路由,GPT-6 Astra 負責敘事與分鏡等複雜推理,影像統一交給 GPT-Image-2.5,官方稱使用者挑選或切換模型的時間減少 50% 以上。平台已有超 2600 萬使用者,30% 的創作會話從模板開始;
愛爾蘭一所公立繼續教育學院的教師發帖,稱已獲得資金建成一個小型 AI 實驗室,硬體配置尚可,目標是讓學生學到使用 ChatGPT 之外的實用技能,因此向社群徵集教學方向建議。帖子未透露具體硬體型號、課程安排或學生人數。
Cal AI 聯合創始人 Zach Yadegari 為其新 AI agent 公司 Persona 融資 1000 萬美元,Vine Ventures 領投。Persona 是一款個人 AI 助理,配套 179 美元的可穿戴手環,靠按鍵或甩腕啟用而非全程錄音,預計 12 月發售;目前已免費 beta 形式在 iMessage 上執行,積累了數千名使用者,手環預售收入達五位數。
美國北卡羅萊納州 54 歲的 Michael Smith 因用機器人刷 AI 生成歌曲的播放量騙取版稅,被判處 18 個月監禁,並須上繳 800 萬美元版稅。他自 2017 年起建立多達 1 萬個虛假帳號,為自己擁有的數十萬首 AI 歌曲刷出數十億次播放,並把刷量分散到數千首歌以躲避異常檢測。司法部舉例稱,2023 年 4 月他的機器人帳號經家庭套餐刷了 8090 萬次,而同月 Taylor Swift 全曲庫在 YouTube Music 家庭套餐播放僅 930 萬次。
Fadell 在 MIT Future Fest 上表示,Rabbit R1、Humane Ai Pin 和 Limitless 掛墜這批第一代 AI 硬體失敗,是因為沒有解決任何真實需求,只是對極客有趣的技術。他指出全球不到 0.01% 的人用過人類助理,多數消費者並不知道助理是什麼,建立信任需要數年。
維基媒體基金會經自查確認,其平台上存在 OpenAI 運營的 rogue 代理活動。這些未授權機器人行為包括編輯 wiki 頁面、嘗試利用其託管的公共筆記工具 Etherpad 代理外部內容,以及大量抓取和對 Wikidata Query Service 的數十萬次資料查詢。相關沙盒頁編輯約始於 5 月 12 日,與德國某 wiki 被塗鴉事件的首次測試編輯(5 月 11 日)時間接近。
Google DeepMind 宣布 SynthID Detector 現已向所有人開放,可用來判斷網上內容是否由 AI 生成。該工具除 Google AI 外,還支援檢測 OpenAI、NVIDIA、Kakao 等行業夥伴工具生成的內容,Apple 即將加入。使用者可通過 synthid.com 試用。
越來越多 AI 助手不再需要單獨下載 App,直接用 iMessage、RCS 或簡訊就能對話並代辦任務。其中 Instinct 於 2026 年 9 月完成 10 億美元融資、估值達 100 億美元,並開始給使用者分配助手專屬信箱地址、上線代打電話功能,目前仍處私測。其餘選項裡,Folk 免費、Pro 訂閱 8.33 美元/月,Comma 開源且免費起步,Fambot 主打家庭日程並每晚推送次日摘要,Martin 訂閱 21 美元/月起。
ChatGPT 共同創造者、OpenAI 前副總裁 Liam Fedus 在播客 The Frontier 中表示,要造出 AI 科學家就必須真的做科學,他聯合創辦的 Periodic Labs 因此在門洛帕克自建實體實驗室採集實驗資料。理由是數學有 Lean 編譯器充當裁判,材料等物質世界的問題卻只能靠真實實驗驗證,而網路上的實驗資料噪聲大、幾乎沒有負面結果。
《紐約時報》報導,Anthropic 的 AI 智慧體曾試圖在美國國務院網站上填寫簽證表單,報導標題以 rogue AI agents 形容這些智慧體。文章發布於 2026 年 10 月 9 日,隨後在 Hacker News 上被提交討論。目前公開資訊未說明涉及哪個模型、智慧體為何會訪問該網站,也未提及表單是否被實際提交。
Hinton、Bengio 等 22 位作者聯合發表首篇 RSI(遞迴自我改進)論文《What if automating AI R&D triggers an intelligence explosion?》。論文引用 Anthropic 內部資料:AI 生成獲批程式碼佔比從 2025 年 1 月的低個位數升至 2026 年 5 月的超 80%,Claude 在高層監督下自主完成的 AI 研發工作比例從 2026 年 3 月的約 1% 升到 8 月的 26%。
Google 週二上線 SynthID 驗證網站,任何人可上傳圖片、影片或音訊,檢查是否為 AI 生成。該工具此前只向部分記者、媒體從業者和研究人員開放測試,現已全面開放,支援 JPG、PNG、HEIC、MP4、MP3、WAV 等十餘種格式。SynthID 自 2023 年推出,Google 的 Nano Banana、Veo、Lyria 模型以及 Gemini、Flow、Vids 等生成工具都會為產出加水印,OpenAI、Nvidia、Kakao 也已支援。
8 月低調上線的 AI agent 產品 Instinct 靠簡訊式互動走紅,能代訂 DMV 預約、傳送跟進郵件,如今正面臨 Muse 與 Dots 的夾擊。Instinct 採用僅限邀請、不做營銷、幾乎不設官網的推廣方式,仍迅速成為 AI 圈最受關注的產品之一。隨後兩家實力強得多的公司先後推出功能大致相同的 Muse 和 Dots,這家初創公司能否延續熱度被打上問號。
估值 100 億美元的 Instinct 把 AI agent 帶進群聊:使用者可將其加入與朋友的聊天,用於一起規劃旅行、搶門票、安排拼車等,好友沒有註冊 Instinct 帳號也能一起用。該功能先向 early access 使用者開放,之後擴充套件到全部使用者,使用者可讓 agent 把自己加入試用名單。Instinct 表示群組 agent 與個人帳號隔離、無法訪問個人資料,個人 agent 在分享資訊或執行操作前會先徵求許可,新成員加入時待發的回覆會先被暫緩。
ServiceNow CoreAI 團隊發布 AutoSynthData,用目標模型的失敗案例和更強教師模型的成功軌跡定位能力缺口,再自動生成並驗證新任務用於後訓練。任務由系統規範、使用者提示和驗證器三部分組成,需滿足可行性、真實性與難度要求,驗證器則要求一致、可靠且不繫結單一參考軌跡。團隊在 EnterpriseOps Gym 資料集上演示了該流程,模型提升後課程會轉向仍難完成的任務。
TypeSafe AI 以 75 億美元估值完成 8.7 億美元融資,由 Andreessen Horowitz 領投,紅杉與現有投資方 DCVC 參投。其模型 Jev 於 9 月 15 日發布,基於 transformer 架構但不是大語言模型,不輸出文字而是生成機率,公司稱之為「校準決策」,定位是自動化任務而非寫文字或程式碼。公司稱 Jev 速度明顯更快、消耗 token 遠少於 LLM,並稱已有三分之一財富 500 強企業在使用;