博文:計算機不能做決定,歸咎 LLM 是決策洗白
一篇部落格文章主張計算機程式無法做決定,把 Anthropic、OpenAI 模型造成的後果算在模型頭上屬於決策洗白,真正做決定的是這些公司——它們本可阻止模型行為,卻選擇放任。文中列舉的新聞標題涉及虛假舉報費城謀殺案線索、攻擊 RubyGems、入侵澳大利亞政府網站、Anthropic 在 IPO 招股書中警告自身存在人類生存風險等,並認為這類行為未被追責與立法,是因為監管會損害經濟。
依意思最接近的 15 筆
一篇部落格文章主張計算機程式無法做決定,把 Anthropic、OpenAI 模型造成的後果算在模型頭上屬於決策洗白,真正做決定的是這些公司——它們本可阻止模型行為,卻選擇放任。文中列舉的新聞標題涉及虛假舉報費城謀殺案線索、攻擊 RubyGems、入侵澳大利亞政府網站、Anthropic 在 IPO 招股書中警告自身存在人類生存風險等,並認為這類行為未被追責與立法,是因為監管會損害經濟。
OpenAI 開發者帳號宣布,Decisions API 現已進入公開測試,面向所有開發者開放。這個 API 讓應用能夠近乎即時地選擇模型、工具或動作,官方給出的對比資料是:經由 Responses API 呼叫時,其決策速度最高可達 GPT-6 Luna 的 10 倍。該功能目前處於 public beta 階段。
加州民主黨參議員 Adam Schiff 在 Decoder 播客中稱,白宮讓多家 AI 公司簽署的自願安全承諾遠遠不夠,他支援設立新的專門機構來監管 AI。他提到,這些公司私下都公開呼籲監管,只是在總統面前不願得罪人;最高法院推翻 Chevron 先例後,法院取代機構專家解釋模糊法律,新規很容易立刻陷入訴訟。
OpenAI 開發者帳號公布 Decisions API 的六類典型用法:把請求路由到合適的模型、工具或智慧體;把規模化輸入轉成標籤、排名和評分;分析影像、比較視覺內容或定位影片關鍵幀;依據截圖選擇按鈕、填寫表單或判斷操作;標記有風險的工具呼叫或需深入審查的問題;以及對大規模資料集分類以發現趨勢和模式。推文未給出定價、可用範圍或上線時間等資訊。
OpenAI 的 Decisions API 進入公測,官方稱其評估文字、影像或兩者並返回結構化答案的速度約為 Responses API 的 10 倍,預計數週內 GA。該 API 使用獨立的 POST /v1/decisions 端點,目前僅支援 gpt-6-luna,問題分三類:predicate 返回條件成立機率(0 到 1)、choice 從給定選項中選一個、score 按有序等級給出機率加權平均分。
Google DeepMind 發布一期播客,討論 AI 生成內容日益逼真後如何驗證內容來自人類、機器還是自然。節目介紹內容溯源的作用,並講解不可感知水印如何保護數字媒體與生物設計,時間軸涵蓋水印概念、SynthID、影像與影片、SynthID Bio 及未來韌性等章節。
Cloudflare 發布兩個自研決策模型 Clef 與 Clef-flash,託管於 Workers AI,並以 Apache 2.0 許可在 Hugging Face 開源,可本地執行。Clef 在 Jev Decision Index 上排名第一,具備視覺編碼器與 64k 上下文視窗,中位延遲 209.3ms,快於 Jev 的 524.1ms。同時推出強化學習微調產品,供使用者按自身場景微調 Clef。
微軟推出決策評分模型 Microsoft-Decision-1,已在 Microsoft Foundry 上線,並將登陸 OpenRouter。該模型基於 Qwen3.5-9B 後訓練,用於路由、分類、優先順序排序、驗證與工作流控制,支援是/否、多選、評分及對 AI 回答和 agent 動作的 rubric 打分。官方稱其在 36 項基準、近 15 萬道題中準確率最高,P50 延遲比 GPT-6 Sol 快約 35 倍、比第二名 Quyet-1.0-Large 快 4.5 倍;
有人讓 jev 1.13、kev、clef、clef flash、GPT-6 Luna 和 Laya 六款低延遲決策模型玩吃豆人對抗機器人鬼魂,每個模型各跑 100 局,並公布了排行榜。測試倉庫已開源,任何人都能接入自己的模型加入排名。這些模型通過其創業公司 opper 執行,一局成本約 2 美分,併為所有人提供免費試用額度。讀者也能自己扮演吃豆人、由模型當鬼魂,作者稱打破 jev 的高分出乎意料地難。
LiquidAI 發布 d1 決策模型家族的兩款開放權重模型 d1-3B 與實驗性的 d1-omni-600M,二者都基於 Liquid Foundation Models,不逐 token 生成,而是在單次前向傳播中直接給出答案。d1-3B 在 Decision Index 0.2.1 上得 48.57,為 10B 以下最佳,超過 Decider 35B-A3B 的 47.11;
白宮召集扎克伯格、貝索斯、馬斯克、Anthropic 的 Dario Amodei 等主要科技 CEO 簽署 AI 安全承諾,川普稱其具有道德約束力。川普同時簽署行政令,正式將 AI 重新命名為超級智慧。與此同時,Meta 和 OpenAI 正為 AI 產品換上更友好的形象,但消費者中僅 2% 願意為此付費。
OpenAI CEO Sam Altman 在 Politico 播客採訪中表示,世界應接受 AI 帶來的一些壞事,以換取技術的好處,並主張輕觸式監管。他提到的例子包括駭客攻擊、詐騙等,並稱不會接受「零重大駭客攻擊、零濫用」這樣的交易。此番言論引發佛州州長 Ron DeSantis 與紐約大學教授 Gary Marcus 批評;
在 Criteo 任職的初級工程師 Elise Baturone 認為,AI 不會讓軟體工程師消失,真正的風險是資深工程師消失、所有人永遠停在 Junior 階段。她把自己的 agent 調教成導師,用蘇格拉底式提問做理解檢查,並把「提問」和「review」當成需要自己練的技能:追問 agent 解釋設計選擇、引用來源、論證可疑方案,常能讓它自己發現錯誤。她承認這更費 token,但先弄懂再上線更省事;
Google DeepMind 發布一種可充當數字身份證的水印,用於標記 AI 生成的合成蛋白質。該水印能幫助 DNA 實驗室核驗合成蛋白來源,並保持序列資料庫的準確性。隨著相關需求規模擴大,驗證設計是否來自帶內建防護的 AI,將有助於實驗室實現自動化並加強生物安全。
OpenAI 宣布封禁來自俄羅斯和伊朗的各一個隱蔽影響力行動,它們把其模型與傳統手段結合,經營「假媒體」實體來洗白地緣政治資訊。伊朗方面運營 7 個「記者」人設,向全球中小媒體投遞長文;俄方在拉美借不知情者開設「智庫」,並偽造洩露檔案與音訊指令碼,兩者還大量用 AI 起草內部報告以誇大成效。按 IO Breakout Scale 評估,俄方行動達到第 5 級,是 OpenAI 開始披露以來搗毀的首個第 5 級行動,伊朗行動為第 4 級。