調查:僅 11% 企業能準確預測 AI 支出
企業一度鼓勵員工儘可能多地使用 AI,即所謂的 #tokenmaxxing,隨後賬單隨之而來。報導援引一項針對近 400 家企業的調查稱,其中只有 11% 能準確預測自己的 AI 支出。AI 使用量以 token 計量,而企業發現 token 很難統計,這讓 AI 預算幾乎無法編制。
找到 37 筆
企業一度鼓勵員工儘可能多地使用 AI,即所謂的 #tokenmaxxing,隨後賬單隨之而來。報導援引一項針對近 400 家企業的調查稱,其中只有 11% 能準確預測自己的 AI 支出。AI 使用量以 token 計量,而企業發現 token 很難統計,這讓 AI 預算幾乎無法編制。
LibreOffice 背後的非營利組織 Document Foundation 表示,在可預見的未來不會把 AI 加入這款開源辦公軟體。8 月底發布的最新版已重申軟體不含任何生成式 AI 功能,這是刻意設計,以確保使用者文件不被上傳伺服器處理、軟體不依賴網路連線即可執行。該組織稱目前沒有能滿足其全部要求的 AI 整合方案,希望使用 AI 的使用者可自行安裝擴充套件,連線本地 AI 模型。
2026 年 9 月 22 日起,Google AI 訂閱使用者可獲 Colab 高階權益,包括優先使用更快的加速器和更強機器;Google AI Ultra 訂閱者額外解鎖後臺不間斷執行與 Premium GPU 訪問,長時間訓練無需保持瀏覽器標籤頁開啟。權益將在未來幾週內向 Colab 支援國家的 Google AI 訂閱者推送,已單獨訂閱 Colab 的使用者不受影響,兩項訂閱權益可疊加。
Anthropic 於 2026 年 9 月 29 日啟動新一輪公眾研究,用 Anthropic Interviewer 訪談使用者對 AI 的真實體驗與期待,參與者可自行決定是否公開完整訪談。公開內容只含訪談全文與所在國家,不含 Claude 帳號資訊,但 Anthropic 提示年齡、職業、城市等細節可能讓人被識別,且公開後無法撤回他人已儲存的副本。上一輪同類研究於 2025 年 12 月進行,共 81,000 人參與,僅公布高層結論和少量引語。
Erdős 問題網站 erdosproblems.com 的建立者 Thomas Bloom 於 2026 年 10 月 6 日宣布改版,因為站內公開互動已被大量無解釋的 AI 生成證明佔據。該站 2023 年 5 月上線,現收錄 1221 個問題、9000 多條評論、近 2000 名註冊使用者,日獨立訪客約 1 萬至 2.5 萬。Bloom 稱 2025 年 8 月加入評論功能後社群一度活躍,隨後討論明顯減少,不少數學家因無法與 AI 競爭而不再思考這些問題。
美國聯邦法官 Amit Mehta 駁回 Chegg 和 Penske Media 對 Google 的反壟斷訴訟,認定 Google 在 AI overviews 等產品中的行為不違反反壟斷法。兩家公司 2025 年起訴,稱 Google 抓取內容用於 Gemini 並導致網站流量下降,Penske 還主張網站無法選擇退出 AI 答案。法官認為網站對獲得搜尋流量的期待不構成法律協議。
猶他州推出全美首個由 AI 獨立完成問診與開藥的試點專案,無需醫生直接監督。患者訂閱 Nolla Health 每月 4.99 美元的應用並掃描面部,AI 結合病史與個人資訊給出痤瘡嚴重度評分,從八種獲批外用藥物中推薦方案。試點為期一年,僅限輕中度痤瘡:前 100 張處方由醫生稽核,隨後 400 張改由 AI 直接提交藥房、醫生每週回溯,最終階段每月抽查至少 10% 的處方。
美國總統川普本週召集扎克伯格、貝索斯、馬斯克、Dario Amodei 等 AI 高管,簽署《前沿責任聯合承諾》,並以行政令方式將官方用語從「人工智慧」改為「超級智慧」。該承諾完全自願、不具法律約束力,川普稱其「道德上有約束力」,協議文字還把 United States 拼錯。播客嘉賓認為這更像一次 AI 的重新包裝,而非實質監管。
越來越多 AI 助手無需下載 App,直接通過 iMessage、RCS、SMS、WhatsApp 等簡訊渠道使用,可記憶上下文、連線已有應用並代為完成任務。Instinct 在 2026 年 9 月完成 10 億美元融資、估值達 100 億美元,仍處私測;Caddy 自 2026 年 4 月起公測;Fambot 2026 年 9 月初推出測試版並獲 350 萬美元 pre-seed 融資,測試期免費,未來擬收約一份 Netflix 訂閱的費用;
亞馬遜開始遮蔽 Meta 的 Muse 等個人 AI agent,使其無法瀏覽商品目錄和下單;Walmart、Delta、United、Yelp、eBay 等也被使用者反映出現類似攔截,其中 Walmart 稱並非有意,而是人機驗證按鈕中斷導致 agent 被踢出。Meta、Walmart、Stripe、Sierra、Genesys 等已著手製定面向電商的 agent-to-agent 開放標準,用於區分代表使用者的良性 bot 與惡意爬蟲。
數學家陶哲軒在 SAIR 演講中公開呼籲模型公司放慢數學研究節奏,稱 AI 無休止加速卻對後果一無所知,並稱之為 Proof Indigestion(證明消化不良):AI 只在生成解答與 Lean 驗證上狂飆,理解、評審、寫入教科書幾乎停滯。此前他與 25 位菲爾茲獎得主聯名發表公開信,批評把數學當 benchmark 刷分。OpenAI 隨後回應,宣布在普林斯頓高等研究院設立數學與人工智慧顧問小組,但宣告寫明該小組不就數學上的內部進展提供建議。
OpenAI 在官方帳號發布連結,指向官網頁面 sharing-ai-progress-in-mathematics,主題是分享數學方向上的 AI 進展。該資料本身只有這一條連結,未披露涉及的具體模型、基準成績、發布時間或使用方式,因此除官方就數學進展對外發聲這一點外,暫無更多可確認的細節。
Google 自 10 月 1 日起暫停其開源軟體漏洞賞金計劃,原因是自動化提交數量大幅上升,其中絕大多數無效。公司稱工程師與開源維護者被大量無效或含幻覺的報告淹沒,承諾 2027 年第一季度給出更新,並建議參與者轉向其他賞金專案。
Google 公布 Private AI Compute 新架構,將在雲端加入持久化記憶層,實現跨裝置連續 AI 助手體驗,同時保持端側級別的隱私標準。資料加密存放在雲端專用儲存中,解密金鑰僅保留在使用者裝置上,Google 自身也無法讀取;模型需要呼叫時通過端到端加密通道進入硬體隔離的安全飛地,臨時解密、寫入新上下文後立即重新加密。此前該平台及業界同類方案均為無狀態,任務結束即清除上下文。
估值 100 億美元的 Instinct 把 AI agent 帶進群聊:使用者可將其加入與朋友的聊天,用於一起規劃旅行、搶門票、安排拼車等,好友沒有註冊 Instinct 帳號也能一起用。該功能先向 early access 使用者開放,之後擴充套件到全部使用者,使用者可讓 agent 把自己加入試用名單。Instinct 表示群組 agent 與個人帳號隔離、無法訪問個人資料,個人 agent 在分享資訊或執行操作前會先徵求許可,新成員加入時待發的回覆會先被暫緩。
SCM(Screen Memories)是一款 macOS 本地優先的 AI 搜尋工具,可對任意資料夾中的照片和影片逐幀進行語義搜尋,無需帳號、雲端或上傳,推理全部在本機完成。它提供 Files、Scenes、OCR、Dialogue 和可選的本地 LLM 聊天五種搜尋模式,支援按鏡頭時間碼跳轉、Whisper 臺詞精確檢索以及 Tesseract 多語言文字識別。預設 CLIP 模型權重約 435MB,首次下載後完全離線;
獨立研究者 10 月 5 日發布初步發現,追蹤到一批並行的 AI agent,疑似執行在騰訊的基礎設施上,目標指向阿里巴巴的高德地圖服務,查詢內容為公園、動物園、醫院等公共場所不同入口的路線。研究者拒絕使用 swarm 一詞,稱應叫 agent fleet:多個 agent 執行同類任務,彼此之間沒有通訊跡象。這些活動是通過監控域名掃描服務 URLquery 的流量發現的,該服務常被 agent 用來載入無法直接訪問的網站並留下記錄;研究仍在進行中。
Mistral AI 官方稱 Mistral Large 4 是全球網路安全能力最強的 AI 模型之一。這一表述發布於 2026 年 10 月 6 日,僅來自其官方社交帳號,沒有附帶基準測試成績、具體安全任務範圍、發布時間、定價或開放方式。因此目前無法判斷它與同類模型在網路安全場景中的實際差距。
Cloudflare 宣布已選出首批 30 家非營利與公共利益組織,向其提供總額超過 750 萬美元的開發者服務額度,每家最高 25 萬美元。這些組織用 Cloudflare 的 Workers AI、AI Gateway 等服務建置自動化工具,涵蓋心理健康、地方新聞、人權等領域。Cloudflare 稱其無伺服器架構和 AI Gateway 可降低執行成本並控制模型呼叫費用。
網頁版圖片編輯器 Photopea 的開發者稱,GitHub 上存在數十個由 AI 提取其 JavaScript 程式碼、去除廣告後重新發布的倉庫,他於 2026 年 9 月 4 日提交 DMCA 下架通知,一個月後收到回覆稱無法確認違反 17 U.S. Code §1201,拒絕下架。作者表示這些第三方版本已導致使用者誤向他本人投訴,損害 Photopea 聲譽,並懷疑該回復是自動生成、無人真正稽核,正在考慮找律師走線下途徑。
微軟聯合 Hugging Face 推出 ThinkingBox 基準,通過 Hugging Face 提供,不看 agent 的回覆文字和工具呼叫,只檢查它留在後端資料庫裡的最終狀態與副作用,每個任務重複跑 20 次。在 507 個有狀態業務流程、12 個模型、121,680 次有效試驗中,79,853 次未通過可執行檢查,其中 67.24% 仍乾淨收尾且無工具報錯。
Musubi 於週二發布輕量級決策模型 PolicyLM-1.7B,開放權重,專為即時內容稽核設計,可在 50 毫秒內把用自然語言寫成的社群政策套用到訊息上。其成本與速度接近多數社交平台現用的 AI 分類器,但無需專門訓練即可執行復雜政策,政策變更時也不必重新訓練,模型只輸出內容是否屬於某類別的二元判斷。聯合創始人兼首席 AI 官 Filip Jankovic 稱這讓平台管理者能主動、可擴充套件地標註內容;
r/LocalLLaMA 使用者發帖討論歐盟兒童法案等立法是否可能被用作打擊開源 AI 權重的藉口。評論提到歐盟年齡驗證將於 2027 年 1 月大規模推行,Discord 已面臨壓力但拒絕啟用,Palantir 將從中獲利。有評論引用官方提案內容,包括限制無限滾動、預設私密資料、強制年齡驗證等。
Mistral AI 發文稱,其開放權重模型、產品與基礎設施讓組織可以自主選擇 AI 的執行方式和部署位置,而不只是獲得模型訪問權。該公司強調這能帶來前沿效能,同時避免供應商鎖定。完整內容發布在 Mistral 官網新聞頁。
Google Cloud API Gateway 現在可作為原生遠端 MCP 伺服器,無需自建中介軟體即可把 REST API 暴露給 AI agent。開發者在現有 OpenAPI 3.x 規範中新增 x-google-api-management.mcp 等註解,就能把標準 REST 操作轉為可被 agent 發現的工具;閘道器會自動將 MCP JSON-RPC 請求轉碼為 REST 呼叫,現有認證、配額與日誌策略繼續生效,無需新增基礎設施。
一篇題為《有效利他主義如何征服世界(並可能終結它)》的文章在 Hacker News 上被分享,討論該運動的發展及其潛在影響。原文連結通過 archive.ph 存檔,HN 帖子獲得 8 分、暫無評論。
NVIDIA 已收購 Hugging Face。llama.cpp 作者 Georgi Gerganov 表示,NVIDIA 工程師已參與該專案程式碼庫一年多,並提供開發測試硬體;今後 llama.cpp/ggml 將繼續堅持硬體無關原則,所有後端的開發與支援仍由社群驅動,對所有人開放。他認為有 NVIDIA 和 Hugging Face 團隊支援,專案長期目標更易實現。
Shrivu Shankar 在 8 月 24 日的文章中提出,每家 SaaS 公司最終都會變成圍繞模型搭建的 harness,即包裹無狀態 LLM 的基礎設施、介面、上下文與狀態。他給出五階段演進路徑:傳統 SaaS、工程師與 agent 結對、個人執行 harness、個人編排 harness、harness 編排個人,屆時核心任務由 agent 完成,人類只負責提供品味與判斷。
Anthropic Frontier Red Team 從內部二進位制漏洞利用基準中隨機抽取 100 個任務評測多個模型,GLM-5.3 在 4% 的試驗中實現了完整控制流劫持,Claude Mythos Preview 為 6%。此前模型如 Claude Opus 4.6 和 GLM-5.2 在這些任務中無一成功,說明能力門檻已被跨過。
Anthropic 科學部落格稱,Claude 在單條提示下於 Claude Science 中基本無人監督執行數天,完成了平面 N=4 超楊-米爾斯模型中九圈散射振幅計算,總花費數千美元。此前該簡化模型的紀錄是八圈,由 SLAC 的 Lance Dixon 及合作者保持;Dixon 獨立驗證了這次結果。
JetBrains AI 團隊發文介紹其語義程式碼搜尋平台 Air Context 的 RAG 流水線,已投入生產環境。首篇聚焦解析、分塊與向量化:固定行數分塊會把 import 與函式體等無關程式碼混在一起,導致檢索錯誤,因此需按原始碼結構(如 Java 的 import、類定義、欄位與方法)劃分語義完整的塊。
Ollama 0.35 新增基於 TypeSafe Jev API 的決策模型支援,通過 /v1/systemone 端點一次請求回答多個命名問題,無額外費用。首批三個模型為 Bespoke Labs 的 9B nimble、Together AI 的 4B tev1 與 0.8B tev1:0.8b,可用於工單分流、模型路由與內容稽核。官方稱 nimble 在 M5 Max 本地執行平均每次決策 91ms,後續將加入 MLX 加速與雲端模型。
OpenAI 表示文字水印存在明顯侷限:在短文字中往往無法檢測,改寫或翻譯就能徹底去除水印。因此目前只有經過批准的研究者才能使用其水印檢測器,用於評估和改進這項技術。OpenAI 將文字水印視為一個持續研究的方向,會繼續測試和改進,並收集使用者、開發者、政策制定者和研究者的反饋。
美國多名民主黨、共和黨與無黨派議員分別提出法案,擬大幅限制聯邦機構使用 Flock 自動車牌識別(ALPR)攝像頭,並引用 404 Media 的報導作為依據。Sanders、Ocasio-Cortez 與 Merkley 的 Ban Flock Act 將禁止聯邦機構使用 ALPR,切斷對使用該類攝像頭的州與地方政府的聯邦撥款,並允許民眾起訴聯邦政府侵犯權利。
OpenAI 表示,文字水印用於回答一個問題:這段文字是否很可能由其模型生成。水印在生成時嵌入不可見的統計訊號,檢測器可據此識別,不會新增可見標記或特殊字元。它無法說明原作者或版權歸屬,也不能識別個人、組織、帳號、對話或提示詞。OpenAI 稱測試中水印未影響模型能力、速度以及回答的閱讀感受。
AWS CEO Matt Garman 在部落格中表示,公司已不再在與政府機構合作建設資料中心時使用保密協議(NDA)。他同時反駁資料中心耗水過多、推高電價、汙染嚴重、無益社群四點說法,稱資料中心直接用水僅佔美國工業用水 0.5%,備用發電機 99.9% 時間閒置。目前全美有 100 多個資料中心禁令正在審議,紐約已宣布暫停大型資料中心許可一年。
佛羅里達州一名女子因把 Claude 當日記使用、寫下要襲擊警長辦公室的內容,被 Claude 安全系統標記並經人工審查後上報警方,現面臨二級重罪指控。事發於 9 月 26 日,她事後稱自己只是把 Anthropic 的聊天機器人當日記用,執法人員上門後將其無衝突拘留。Anthropic 表示,在認為披露資訊對防止死亡或嚴重人身傷害確有必要時,可能在有限的緊急情況下共享使用者資訊。