Anthropic 於 2026 年 10 月 8 日發布 2026 版使用政策,11 月 12 日生效,稱多數改動是把既有規則寫得更明確,並針對過去一年觀察到的影響行動、武器研發與監控濫用補充範例,還澄清健康、金融等高風險用途要求,新增 Claude 自主採取物理行動的控制條款。新版把原本分散在選舉、欺詐、隱私等章節… 看完整事件
Anthropic 更新使用政策,禁止辱罵模型與干預選舉
Anthropic 於 10 月 8 日更新使用政策,新增禁止干預選舉、武器軟體、監控,以及用 Claude 運營假帳號或偽造媒體的條款,其中明確禁止使用者長期辱罵模型最受關注。Claude 自 8 月起已會主動結束「持續有害或辱罵性」的對話,新政策則把這類行為直接列為違規。官方稱僅適用於使用者反覆、無明確目的地惡意對待模型的極端情況,不涉及常見的使用者不滿、反駁、黑暗創作主題或模型測試與研究。政策中另有「不得破壞民主程序」一節,禁止欺騙選民或擾亂選舉。
把「長期辱罵模型」正式寫進使用政策並劃出極端案例與測試研究的邊界,是模型行為規範上的新動作,對 Claude 使用者和關注 AI 政策的人都有參考價值。
原標題:Anthropic changes usage policy to ban model abuse and election interference
閱讀原文
| 評分 | 65 / 68(平均 66,門檻 76) |
|---|---|
| 狀態 | 未入選 |
相關報導
紐約時報報導 Anthropic 為 Claude 模型注入道德觀
《紐約時報》刊文披露 Anthropic 在 Claude 模型中植入道德觀念的內部工作。文章發布後登上 Hacker News,獲得 43 分、52 條評論。報導聚焦 Anthropic 如何讓 AI 模型遵循其設定的道德準則,原文需訪問紐約時報網站閱讀。
Anthropic 擴大初創扶持:送一年 Claude Team 與 1000 美元額度
Anthropic 於 10 月 6 日 SF Tech Week 活動上宣布擴大 Claude for Startups 計劃:符合條件的企業可免費使用一年 Claude Team 付費方案,含最多 5 個高階席位,並獲 1000 美元 API 額度。此外還能接入 Claude Marketplace 建置外掛,並預約 Anthropic Applied AI 團隊的線上辦公時間。申請門檻為成立五年內的公司,或近兩年獲得過融資的公司,通過專案頁面申請即可。
@AnthropicAI: We’re expanding our Cyber Verification Program to give security professionals broader access to our…
Anthropic 宣布擴充套件 Cyber Verification Program(網路安全驗證計劃),讓經過驗證的安全專業人員能更廣泛地訪問其能力最強的模型。通過該計劃,驗證過的安全從業者可訪問 Claude Mythos 5.1、Opus 5.5 和 Sonnet 5.5,並配有面向防禦性工作的安全防護措施。同時新增層級,允許開展經授權的攻擊性安全工作,例如滲透測試與紅隊演練。
Anthropic 投 1 億美元建學院,2027 年底培訓萬名工程師
Anthropic 於 10 月 2 日推出 Claude Frontier Academy,投入 1 億美元,計劃到 2027 年底培訓 1 萬名 Frontier Deployed Engineer(FDE)。首批學員來自埃森哲、貝恩、凱捷、澳洲聯邦銀行、德勤、麥肯錫、摩根士丹利、諾和諾德等企業,在舊金山、紐約和倫敦開班。專案採用提名制,先參加數天線下培訓與模擬企業部署考核,通過後進入 12 周駐留期,在本組織內主導真實 Claude 用例,結業再考核,首批 FDE 認證預計 2027 年初頒發。
Anthropic 發布 Claude Haiku 5.5,API 價格降 90%
Anthropic 於 10 月 7 日發布 Claude Haiku 5.5,百萬輸入 Token 最低 0.1 美元,較上代降價 90%,並首次在 Haiku 系列引入可調節推理強度,支援 100 萬 Token 上下文與 12.8 萬 Token 輸出。官方基準顯示其在 OSWorld 2.1 取得 72.4% 成功率,高於 GPT-6 Luna 的 48.9%,但最高成績對應最大推理強度,中等強度下 Terminal-Bench 成績從 39.2% 降至約 20%。