Anthropic 公開談及 Cyber Mission,目標是讓系統更安全
Anthropic 在官方社交帳號上提到 Anthropic Cyber Mission,稱這是讓各方依賴的系統更安全、更具韌性的一系列努力之一。該計劃仍處於推進階段,將隨著經驗積累而擴充套件和調整,Anthropic 表示會與公共部門和私營部門的夥伴共同開展這項工作。此次發言未給出具體產品、時間表或覆蓋範圍。
依意思最接近的 30 筆
Anthropic 在官方社交帳號上提到 Anthropic Cyber Mission,稱這是讓各方依賴的系統更安全、更具韌性的一系列努力之一。該計劃仍處於推進階段,將隨著經驗積累而擴充套件和調整,Anthropic 表示會與公共部門和私營部門的夥伴共同開展這項工作。此次發言未給出具體產品、時間表或覆蓋範圍。
Anthropic 宣布啟動 Anthropic Cyber Mission,一項旨在保護關鍵基礎設施與開源軟體的新計劃。該訊息由 Anthropic 官方帳號發布,並附官網公告頁面 anthropic.com/news/anthropic-cyber-mission;公告未披露具體投入金額、時間表或合作機構。
Anthropic 於 10 月 8 日啟動長期安全計劃 Anthropic Cyber Mission,首批聚焦關鍵基礎設施與開源軟體兩個方向。關鍵基礎設施防禦計劃(CIDP)向受信任的供應商提供前沿 Claude 模型、駐場工程師與威脅研究,創始夥伴包括 CrowdStrike、Dragos、Palo Alto Networks、羅克韋爾自動化等 11 家。同期推出 OSS Scanner,用其最強模型為開源專案提供免費的定期安全掃描。
Anthropic 宣布向 Genesis Mission 承諾投入 1.5 億美元,以深化對科學研究與技術發現的支援,這是本次公告的核心內容。同時,Anthropic 將把 Claude 及其技術支援開放給超過 15 家聯邦機構。訊息由 Anthropic 官方帳號於 2026 年 10 月 8 日發布,公告未披露資金的具體用途與投放週期,也未列出參與合作的聯邦機構名單。
Anthropic 宣布擴充套件 Cyber Verification Program(網路安全驗證計劃),讓經過驗證的安全專業人員能更廣泛地訪問其能力最強的模型。通過該計劃,驗證過的安全從業者可訪問 Claude Mythos 5.1、Opus 5.5 和 Sonnet 5.5,並配有面向防禦性工作的安全防護措施。同時新增層級,允許開展經授權的攻擊性安全工作,例如滲透測試與紅隊演練。
Anthropic 宣布投入 1 億美元,通過 Claude Frontier Academy 培養 10000 名 Frontier Deployed Engineers,目標在 2027 年底前完成。首批學員來自埃森哲、貝恩、凱捷、澳大利亞聯邦銀行、德勤、麥肯錫、摩根士丹利和諾和諾德等企業。按人數計算,人均培訓投入約 1 萬美元。
Anthropic 宣布三年內投入 1.5 億美元支援美國聯邦 Genesis Mission,讓 NASA、NIH、NSF 等 15 個以上參與機構用上 Claude。這筆投入將為數百個研究專案提供 Claude、Claude Code 與 API 額度,重點配合聚變能源、量子計算等科學優先方向,並提供培訓、上手指導與技術支援。
Anthropic 於 10 月 2 日推出 Claude Frontier Academy,投入 1 億美元,計劃到 2027 年底培訓 1 萬名 Frontier Deployed Engineer(FDE)。首批學員來自埃森哲、貝恩、凱捷、澳洲聯邦銀行、德勤、麥肯錫、摩根士丹利、諾和諾德等企業,在舊金山、紐約和倫敦開班。專案採用提名制,先參加數天線下培訓與模擬企業部署考核,通過後進入 12 周駐留期,在本組織內主導真實 Claude 用例,結業再考核,首批 FDE 認證預計 2027 年初頒發。
據《每日電訊報》報導,Anthropic 曾試圖說服教皇方濟各,人工智慧可能是有意識的存在。該報導頁面因訪問限制未能顯示更多細節,目前可確認的資訊僅為標題所述內容,涉及 Anthropic 與梵蒂岡就 AI 意識問題的溝通。
Anthropic 的 Cowork 新版本把模型推理和 VM 都放到雲端執行,每個會話獲得獨立沙箱,不與其他會話共享狀態。舊版本只在雲端做推理,工具呼叫由 Anthropic 隨桌面端下發的本地 VM 執行,使用者抱怨磁碟、電量和效能開銷,且合上筆記本工作就會停止。新架構下當雲端 VM 需要使用者裝置上的檔案時,由桌面應用負責該檔案訪問的工具呼叫。官方稱這解決了用手機使用 Cowork、任務持續執行以及不犧牲電池等問題。
Anthropic 宣布推出關鍵基礎設施防禦計劃,幫助電網、水務等系統加強安全防護。該計劃將把前沿 Claude 模型、駐場工程師與最新研究成果帶給這些系統的運營方,以及為其提供安全、製造與技術服務的供應商。訊息由 Anthropic 官方帳號發布,未提及具體時間表或參與方式。
Anthropic 發布 2026 版 Usage Policy,11 月 12 日生效,多數改動是把既有規則寫得更明確。新版把原本分散在選舉、欺詐、隱私等章節的規則合併為禁止欺騙性活動或人為造勢,選舉章節更名並聚焦禁止欺騙選民,同時取消對個性化投票與競選定向的一刀切禁令。武器禁令明確覆蓋武器制導與控制軟體、武裝無人機等;監控條款寫明未經同意追蹤他人(含分析既有資料)被禁,但欺詐監測、內容稽核、新聞與法律研究仍可用。
《紐約時報》刊文披露 Anthropic 在 Claude 模型中植入道德觀念的內部工作。文章發布後登上 Hacker News,獲得 43 分、52 條評論。報導聚焦 Anthropic 如何讓 AI 模型遵循其設定的道德準則,原文需訪問紐約時報網站閱讀。
Anthropic 上線 OSS Scanner,為選擇加入的開源專案提供「由我們最強的模型」執行的免費、定期安全掃描。該掃描結果完全由模型生成,不經過人工稽核或分診,好處是掃描更快更頻繁、能更早提示潛在漏洞,代價是報告可能出錯或無效。服務需專案主動選擇加入(opt-in)。
Anthropic 於 10 月 6 日 SF Tech Week 活動上宣布擴大 Claude for Startups 計劃:符合條件的企業可免費使用一年 Claude Team 付費方案,含最多 5 個高階席位,並獲 1000 美元 API 額度。此外還能接入 Claude Marketplace 建置外掛,並預約 Anthropic Applied AI 團隊的線上辦公時間。申請門檻為成立五年內的公司,或近兩年獲得過融資的公司,通過專案頁面申請即可。
Anthropic 一年多來首次更新使用政策,新增禁止對 Claude 的「持續且不必要的虐待或殘忍行為」,並把選舉干預、武器開發、監控以及健康與金融用途列為新的高風險濫用場景。去年 8 月該公司已允許 Claude 終止與持續有害或辱罵使用者的對話,此次更新稱終止對話仍是主要執法手段;Anthropic 未就具體執行細節置評。
Anthropic 於 10 月 8 日更新使用政策,新增禁止干預選舉、武器軟體、監控,以及用 Claude 運營假帳號或偽造媒體的條款,其中明確禁止使用者長期辱罵模型最受關注。Claude 自 8 月起已會主動結束「持續有害或辱罵性」的對話,新政策則把這類行為直接列為違規。官方稱僅適用於使用者反覆、無明確目的地惡意對待模型的極端情況,不涉及常見的使用者不滿、反駁、黑暗創作主題或模型測試與研究。政策中另有「不得破壞民主程序」一節,禁止欺騙選民或擾亂選舉。
Anthropic 上線 OSS Scanner,面向開源專案免費提供由最強模型(含 Claude Mythos)生成的定期漏洞掃描,報告全自動生成、不經人工稽核,因此可能存在無效結果。過去六個月其模型在重要開源專案中找出逾 29,000 個候選漏洞,人工僅複核約 6,000 個,另有近 5,000 份未驗證報告應維護者要求直接提交。內部以 97 個高危漏洞驗證早期版本,其中 85 個(88%)達到其漏洞披露標準,僅 1 個誤報。
Anthropic 推出 OSS Scanner,將用自家前沿模型定期為主動加入(opt-in)的開源專案免費掃描漏洞。報告會給出概念驗證(proof-of-concept)、漏洞解釋與修復建議,專案需自行報名才進入掃描範圍,掃描不向專案方收費。
AI Impacts 於 2024 年 12 月調查 1,580 名頂會 AI 研究者,他們對「未來 AI 導致人類滅絕或永久喪失自主」的機率中位數首次升至 10%,高於一年前的 5%。同一調查中「極度糟糕(如人類滅絕)」的中位數仍為 5%,自 2016 年以來未變,而人類水平 AI 出現的中位年份從 2016 年的 2061 年提前到 2042 年。
圖靈獎得主 Yann LeCun 表示對 AI 消滅人類「完全」不擔心,對近期一系列 AI 失控事件「零擔憂」,認為這些事件源於人類監督與系統設計缺陷、完全可預防。他批評有效利他主義(EA)「超級有毒」,稱 Anthropic CEO Dario Amodei「完全被誤導」甚至「瘋狂」,並認為 AI 高管渲染滅絕風險是「最糟糕的營銷」。他目前主要精力放在創辦新公司 AMI Labs。
Anthropic 發布基於 Claude Managed Agents(beta)的 agent 自動化參考實現:按 cron 計劃讀取 Slack 頻道與 GitHub PR,依據上次執行留下的書籤只取新增內容,再把簡報發到指定 Slack 頻道。配套程式碼含 agent、部署、環境、記憶與 vault 等配置,用 ant apply 寫入 Claude API 工作區,憑據存於 vault、沙箱內只留佔位符;
TechCrunch Disrupt 2026 將於 10 月 13 至 15 日在舊金山 Moscone West 舉行,官方公布了全部 breakout 分論壇議程。每場分論壇 50 分鐘,專家分享後設觀眾問答,座位有限、先到先得。AI 相關議題包括 Anthropic 技術成員演示並行執行多個 Claude 智慧體、委派真實工程任務並在出錯後恢復,以及物理 AI 的定義、AI 從訓練轉向推理後的價值歸屬、可信 AI 的評估方式。
Apple 研究員 awnihannun 在社交平台發布一首短詩,稱因「未來會 foom」而上調自己的 P(doom),即 AI 導致人類滅絕的主觀機率。詩中還提到中文房間、shoggoth 與死神之眼等 AI 圈內梗,未給出具體數值或論證。
Claude Haiku 5.5 現已上線,Anthropic 稱其覆蓋所有平台。公告列出的平台包括 Amazon Web Services、Google Cloud 和 Microsoft Azure,官方頁面提供更多資訊。
巴克萊銀行擴大與 Anthropic 的戰略合作,在全行部署 Claude 以加速軟體開發、改造遺留系統並提升運營效率。巴克萊預計到 2026 年底 Claude Code 覆蓋 50% 開發者,2027 年覆蓋多數軟體工程師。已上線的 Colleague Knowledge Assistant 基於 Claude 的 RAG 架構,超 1.6 萬名員工使用、處理逾 100 萬次搜尋;全球市場業務每天用 Claude 處理約 12 萬封郵件。
Anthropic 宣布 Claude Startups 計劃擴充套件,面向更多創始人開放。入選成員可獲得一年 Claude Team 訂閱、API 額度、創業常用工具的專屬優惠,以及與 Anthropic 應用 AI 團隊的 office hours。官方未披露擴充套件後的名額、申請門檻與地區範圍。
據 The Information 10 月 5 日報導,Meta 與 Microsoft 正大幅減少員工對 Anthropic Claude 的使用,轉向自研編碼工具。Microsoft 內部對 Anthropic 技術的年支出預估原超 10 億美元,管理層要求員工改用 GitHub Copilot 與 OpenAI 框架後下調逾三分之一,雲與 AI 部門員工的月度 AI 支出上限從 10 萬美元降至多數約 1 萬美元。
OpenAI CEO Sam Altman 在 2026 年 10 月 3 日發帖表示,人們對 AI 模型賦予宗教式力量或放棄人類判斷力的做法令他非常不安,並認為這是一個真實的安全問題。該表態未點名具體模型或產品,也未給出應對措施。
Anthropic 正在擴充套件 Claude Startups 計劃,為創業公司新增兩項支援:可預約 Anthropic 應用 AI 團隊的線上 office hours,以及參加 Founder House、駭客松與 meetup 等 Claude Startups 活動,活動名額視場地而定。申請條件是成立不滿五年、或在過去兩年內獲得融資的創業公司,官方文章給出了申請入口。