搜尋
找到 22 筆
Simon Willison● 精選9/29 23:20AI 評分73
Anthropic Frontier Red Team 在內部 Binary Exploitation 基準中隨機抽取 100 個任務評估多個模型:GLM-5.3 在 4% 的試驗裡實現了完整控制流劫持,Claude Mythos Preview 為 6%。此前模型 Claude Opus 4.6 與 GLM-5.2 在這些任務中一次都沒有成功。該團隊認為,GLM-5.3 的成績雖低於 Claude Mythos Preview,但一個有意義的能力門檻已被跨過。
Anthropic Research9/29 01:00AI 評分27
Anthropic 於 2026 年 9 月 29 日啟動新研究,用 Anthropic Interviewer 訪談使用者對 AI 的真實體驗與期待,參與者可自願將完整訪談公開。訪談問題包括最有意義的正面與負面經歷、希望 AI 改變的工作教育醫療政府等領域、以及對 AI 公司的要求;公開版本只附國家,不含 Claude 帳號姓名與信箱,但官方明確警告他人仍可能通過年齡、職業、城市等細節重新識別身份,且一旦公開無法刪除已被他人儲存的內容。
Anthropic News10/2 01:00AI 評分45
Anthropic 於 2026 年 10 月 2 日啟動 Claude Frontier Academy,投入 1 億美元,目標在 2027 年底前培訓 1 萬名 Frontier Deployed Engineer(FDE)。首批學員來自 Accenture、Bain、Capgemini、Commonwealth Bank of Australia、Deloitte、McKinsey、Morgan Stanley、Novo Nordisk 等企業,課程在舊金山、紐約和倫敦開班。
Anthropic News9/18 01:00AI 評分45
Anthropic 於 2026 年 9 月 18 日宣布與埃森哲合作,對前沿 AI 模型進行獨立評估,由埃森哲旗下 AI 業務 Faculty 牽頭,內容包括模型評估、紅隊測試、對齊評估與安全防護測試。雙方預計未來五年各投入至少 10 億美元建設相關能力。嵌入式評估員將像員工一樣進入 AI 公司內部,觀察模型訓練過程與部署決策,但具體運作細節和行業標準尚未確定。Anthropic 直接資助埃森哲的工作,同時與 METR 等非營利評估機構洽談試點,該合作非排他性。
Anthropic News● 精選9/23 01:00AI 評分71
Anthropic 於 2026 年 9 月 23 日宣布成立生命科學研究組與實驗室,並公布早期成果:Claude 在僅接受高層級指令的情況下,自主發現了一個與 DNA 重複序列相關的新型酶系統,命名為 array-associated reverse transcriptases(ART)。約 950 個 agent 用 210 million tokens 搜尋 21 小時,從噬菌體中找到該 RT 系統,其定義特徵此前未被識別。
Anthropic News9/17 01:00AI 評分51
Anthropic 於 2026 年 9 月 17 日推出生命科學驗證計劃(LSVP),讓通過驗證的生命科學團隊在 Mythos、Opus、Sonnet 模型上獲得對生物學工作更寬鬆的防護設定,覆蓋藥物發現、研究生物學、臨床開發與製造等目前通用模型中被攔截的任務。計劃先以 beta 面向團隊和機構開放申請,個人 Pro 與 Max 方案後續再擴。
Anthropic News10/1 01:00AI 評分45
巴克萊銀行宣布擴大與 Anthropic 的戰略合作,在全行範圍部署 Claude,目標是 2026 年底 Claude Code 覆蓋其 50% 的開發者,2027 年覆蓋多數軟體工程師。已落地的應用包括:基於 RAG 的 Colleague Knowledge Assistant 自 2025 年上線,已有超 1.6 萬名員工使用、處理超 100 萬次搜尋;全球市場業務用 Claude 每天處理約 12 萬封客戶郵件,進行分類、資訊補全和路由判斷。
Claude Platform release notes● 精選9/28 01:00AI 評分87
Anthropic 發布 Claude Sonnet 5.5,已在 Claude API、Amazon Bedrock、AWS 上的 Claude Platform、Google Cloud 和 Microsoft Foundry 上線。
Claude Code releases● 精選9/28 19:02AI 評分90
Anthropic API 新增 Claude Sonnet 5.5(claude-sonnet-5-5),併成為預設 Sonnet 模型:1M 上下文,輸入 $2、輸出 $10 每百萬 token,快取讀取 $0.20 每百萬 token。
Claude Platform release notes● 精選9/30 01:00AI 評分73
Anthropic 宣布棄用 Claude Sonnet 4.5(模型 ID claude-sonnet-4-5-20250929),其在 Claude API 上的退役日期為 2026 年 11 月 30 日。官方建議遷移到 Claude Sonnet 5.5,詳情見 Model deprecations 文件。
Claude Platform release notes● 精選9/22 01:00AI 評分89
Anthropic 發布 Claude Opus 5.5,面向長時間執行的 agentic coding 與知識工作,預設 1M token 上下文、128k 最大輸出,每百萬 token 輸入 $4、輸出 $20(Opus 5 為 $5/$25),已上線 Claude API、Amazon Bedrock、AWS、Google Cloud 與 Microsoft Foundry。
Claude Code releases● 精選9/29 20:27AI 評分70
Claude Code 發布 v2.1.285,新增環境變數 CLAUDE_CODE_DISABLE_WEB_FETCH 用於關閉 WebFetch 工具,並加入 allowedProviders 託管設定,限制一臺機器可用的 API 提供商(Anthropic API、自定義 endpoint、Bedrock、Mantle、Vertex AI、Foundry、AWS 上的 Claude Platform、Cloud gateway)。
Claude Platform release notes9/24 01:00AI 評分56
Anthropic 自 2026-09-24 起,對在任何輸出前被拒、且 stop_details.category 為 bio、frontier_llm、reasoning_extraction 的請求恢復計費,按執行該請求的模型費率收取,所有平台適用;其他類別的輸出前拒答仍不計費,fallback credit 不變。流式輸出中途的拒答此前已在計費。
Ollama blog● 精選8/25 01:00AI 評分80
Ollama 現在可作為第三方閘道器接入 Claude Desktop,開發者在 Ollama 中開啟 Claude 開關即可自動完成配置。連線後可選任意 Ollama 模型,包括本地執行的開放模型與 Ollama 雲端模型,也能隨時切回 Anthropic 模型;在 Ollama 裡關閉 Claude 即恢復原有設定。
Claude blog● 精選9/16 01:00AI 評分83
Anthropic 於 2026 年 9 月 16 日宣布將 Claude Cowork 與聊天合併為同一個 Claude,未來幾週先向 Pro 和 Max 方案推送,無需手動開啟。同時新增 Claude Docs 和 Claude Slides,Claude Design 也可直接在對話中使用,三者均在付費方案 beta 階段,可編輯、演示或匯出為 PowerPoint、PDF。
OpenRouter announcements● 精選9/8 01:00AI 評分67
OpenRouter 發布 beta 版 openrouter:shell 服務端工具與 Files API,任何支援工具呼叫的模型都能在託管 Linux 容器裡執行命令並讀寫檔案。它相容 OpenAI 的 shell 工具(Responses API)和 Anthropic 的 bash 工具(Messages API),其中 bash 預設由你的應用本地執行,把 engine 設為 openrouter 才會在服務端沙箱執行。
TechCrunch AI10/2 18:56AI 評分61
白宮本週把 Zuckerberg、Bezos、Musk 與 Anthropic 的 Dario Amodei 等主要科技公司 CEO 聚到一起,簽署川普稱為具有道德約束力的 AI 安全承諾。川普還簽署行政令,正式把 AI 改稱 super intelligence,Meta 與 OpenAI 則在給自家 AI 產品換上更友好的形象。但原標題指出,只有 2% 的消費者在為 AI 付費。
Claude blog9/15 01:00AI 評分40
Anthropic 於 2026 年 9 月 15 日為 Claude for Small Business 推出 43 個工作流和 27 個新整合,接入 Shopify、Salesforce、Stripe、Zapier 等工具,該產品自 5 月上線以來安裝量已超 90 萬次。新工作流把 Claude 從後臺運營擴充套件到獲客、回覆諮詢和撰寫提案,並可在 Claude Cowork 桌面應用中按計劃自動執行,預設傳送、發布或付款前需使用者批准。
Latent Space● 精選10/2 07:40AI 評分79
Pi 1.0 與 Pi Durable 同日發布並登上 Hacker News 首頁,Pi 已加入 Earendil。Pi 1.0 新增 Codemode(原生支援 MCP、Jev 和影像模型)、虛擬模型擴充套件、延遲工具載入、Anthropic 模型快取預熱、對話中途系統訊息、新 TUI 主題與預設全屏。Pi Durable 把 Pi 移植到 TypeScript 並外接全部有狀態元件:每步記錄為檢查點任務,程序失敗或重啟後 agent 與子 agent 自動恢復;
TechCrunch AI10/2 18:48AI 評分57
白宮本週把扎克伯格、貝索斯、馬斯克和 Anthropic 的 Dario Amodei 等主要科技公司 CEO 聚到同一場合,簽署一份 AI 安全承諾,川普稱這份承諾具有道德約束力。川普還簽署行政令,正式把 AI 改稱為超級智慧。與此同時,Meta 和 OpenAI 正讓自己的 AI 產品顯得更親和。原文未披露承諾的具體條款、完整簽署方名單或執行方式。
Anthropic Research● 精選9/29 01:00AI 評分81
智譜 AI(海外稱 Z.ai)的 GLM-5.3 具備自主構建端到端網路漏洞利用的能力,且發布時未設有效防護,Anthropic 測試顯示攻擊者用簡單技巧即可在 64% 到 100% 的情況下繞過其防護。在 ExploitBench 上,GLM-5.3 於 410 次嘗試中成功開發出 50 次端到端利用,接近 Claude Mythos Preview 的 56 次;在內部二進位制利用基準中取得 4% 的完整控制流劫持,Claude Mythos Preview 為 6%。
Anthropic Research● 精選9/25 01:00AI 評分67
物理學家 Matt von Hippel 向 AI 公司發起挑戰,要求用學術機構級別的算力把 N=4 超楊-米爾斯理論算到九圈,Anthropic 的 Claude 在一個月內完成了。散射振幅通常只算到兩圈,少數到三圈,最精確的預測用到五圈;九圈此前被認為需要遠超學術機構可及的算力。N=4 超楊-米爾斯是振幅學界的玩具模型,不描述真實世界,專門用來檢驗新計算方法。