AISpot

Anthropic

10月2日星期五 · 7 則

  1. r/ClaudeAI top of the dayAI 評分42

    DensePack 把文字打包成圖片,Claude Code 省一半 token

    DensePack 是一個 Claude Code 外掛,把 Read 讀取的文字、Bash 輸出、Word 檔案和子代理報告打包成圖片交給 agent 閱讀,按作者基準測試可省約 50% 的 token 費用,且後續快取讀取也按這個折扣計價。它用顏色編碼和兩行圖例,聲稱能從圖片逐位元組還原始碼檔案,並保留文字副本作為回退。專案發布兩週、獲 8 個 star,已通過 Anthropic 外掛提交的初期階段,最新版本 1.3.3,1.4 將支援與其他外掛共用。

  2. TechCrunch AIAI 評分57

    白宮召集科技 CEO 簽 AI 安全承諾,川普籤令改稱超級智慧

    白宮本週把扎克伯格、貝索斯、馬斯克和 Anthropic 的 Dario Amodei 等主要科技公司 CEO 聚到同一場合,簽署一份 AI 安全承諾,川普稱這份承諾具有道德約束力。川普還簽署行政令,正式把 AI 改稱為超級智慧。與此同時,Meta 和 OpenAI 正讓自己的 AI 產品顯得更親和。原文未披露承諾的具體條款、完整簽署方名單或執行方式。

  3. r/ClaudeAI top of the dayAI 評分23

    Reddit 使用者用同一提示詞對比 Sonnet 5.5 與 Opus 5.5 動效

    r/ClaudeAI 使用者 CFNStudio 給 Sonnet 5.5 和 Opus 5.5 同一個提示詞「為自己的模型做一支發布影片,告訴人們為什麼該用它」,並放出兩支成片供對比。評論裡有人指出提示詞太籠統,無法做嚴謹的橫向比較;有人追問底層用的是 Remotion 還是 FFmpeg,帖中未回答。一位自稱給客戶做動畫的從業者說這兩支動畫客觀上很差、目前只能靠改提示詞來編輯,不可交付;也有人回帖稱這種一次成型的進步很快,並且可以用 Remotion 之類的工具再編輯。

  4. r/ClaudeAI top of the dayAI 評分41

    r/ClaudeAI 熱議 Opus 5.5 被削弱

    Reddit 的 r/ClaudeAI 版塊出現熱帖,多數評論者認為 Opus 5.5 已被削弱(發帖人把 nerfed 誤寫成 nerded)。主流猜測是官方先用新模型拉訂閱、隨後降低算力省成本,同時讓下一代模型顯得更強;少數使用者稱模型仍正常甚至仍是最好的模型,品質下滑感來自上下文堆積、未新開對話。有人貼出 nerf 追蹤基準顯示輕微下滑,但被指仍在正常誤差範圍內;也有評論指出 Opus 5.5 發布當天就會說 load-bearing,不能當作降級訊號。

  5. r/ClaudeAI top of the dayAI 評分29

    Claude 以版權為由拒絕翻譯整本書

    多位 Reddit 使用者報告 Claude 現在會以版權為由拒絕翻譯受版權保護的書籍,即使只是個人自用。有使用者建議改為分批處理、只貼短段落請求解釋,或換用其他模型;也有使用者指出 Claude 在長文字翻譯中會「厭倦」並導致品質下降。另有使用者稱 Claude 甚至拒絕閱讀一本 1957 年、在多數地區已進入公有領域的書。

  6. Latent Space● 精選AI 評分79

    Pi 1.0 與 Pi Durable 發布,Pi 移植到 TypeScript

    Pi 1.0 與 Pi Durable 同日發布並登上 Hacker News 首頁,Pi 已加入 Earendil。Pi 1.0 新增 Codemode(原生支援 MCP、Jev 和影像模型)、虛擬模型擴充套件、延遲工具載入、Anthropic 模型快取預熱、對話中途系統訊息、新 TUI 主題與預設全屏。Pi Durable 把 Pi 移植到 TypeScript 並外接全部有狀態元件:每步記錄為檢查點任務,程序失敗或重啟後 agent 與子 agent 自動恢復;

  7. Anthropic NewsAI 評分45

    Anthropic 投 1 億美元辦 Claude Frontier Academy,2027 年底前培訓 1 萬名工程師

    Anthropic 於 2026 年 10 月 2 日啟動 Claude Frontier Academy,投入 1 億美元,目標在 2027 年底前培訓 1 萬名 Frontier Deployed Engineer(FDE)。首批學員來自 Accenture、Bain、Capgemini、Commonwealth Bank of Australia、Deloitte、McKinsey、Morgan Stanley、Novo Nordisk 等企業,課程在舊金山、紐約和倫敦開班。

10月1日星期四 · 4 則

  1. X @AnthropicAIAI 評分56

    @AnthropicAI: In physics, an “impedance mismatch” occurs when two systems each work well but are poorly matched.

    Anthropic 發布 Science Blog 客座文章,哈佛物理學家 Matthew Schwartz 提出 AI 與科學之間存在類似物理學的“阻抗失配”:LLM 能力很強,但像對待人類合作者那樣使用它並非激發其科學優勢的最佳方式。為此他建置了一套用於定量科學精確計算的工具包,Claude 藉此發現了與生態學、群體遺傳學等十幾個領域的聯絡,Schwartz 再與領域專家合作把方向引導到有趣的問題上。

  2. Claude Code releases● 精選AI 評分78

    Claude Code v2.1.287 新增 Claude Mods 與 You should know 外掛

    Claude Code 發布 v2.1.287:新增 Claude Mods,外掛可以修改更深層行為;並內建 You should know,由側邊 agent 監視你或 Claude 可能遺漏的內容,用 /plugin enable cc-plugin-you-should-know@builtin 開啟(需第一方會話且開啟遙測)。agents 檢視新增 n:<text> 過濾器匹配會話名與任務;

  3. Anthropic NewsAI 評分45

    巴克萊銀行擴大與 Anthropic 合作,2026 年底 Claude Code 覆蓋半數開發者

    巴克萊銀行宣布擴大與 Anthropic 的戰略合作,在全行範圍部署 Claude,目標是 2026 年底 Claude Code 覆蓋其 50% 的開發者,2027 年覆蓋多數軟體工程師。已落地的應用包括:基於 RAG 的 Colleague Knowledge Assistant 自 2025 年上線,已有超 1.6 萬名員工使用、處理超 100 萬次搜尋;全球市場業務用 Claude 每天處理約 12 萬封客戶郵件,進行分類、資訊補全和路由判斷。

  4. Anthropic Research● 精選AI 評分68

    物理學家用 Claude 打造 BootLoops 科研工具

    理論物理學家 Matthew Schwartz 發布開源工具 BootLoops,把 Claude 當作 LLM 的"挽具",專攻適合當前 AI 的"Claude 形狀"問題。他用 Claude Fable 5 移植並改進散射振幅計算方法,還借 BootLoops 把數學物理技術帶到生態學、群體遺傳學、地質、經濟、語言學等領域,並與各領域專家合作篩選真正有價值的問題。BootLoops 開源,可搭配任意模型使用,但當前 AI 仍無法解決科學中的大多數問題。

9月30日星期三 · 4 則

  1. Latent Space● 精選AI 評分81

    OpenAI DevDay 發布 GPT-6.1 Sol、Dots 與 Agents API

    OpenAI 在 DevDay 上發布 GPT-6.1 Sol、個人助理產品 Dots,以及內建 Computer Use 的 Agents API,開發者可基於與 Codex、ChatGPT 相同的 Computer Use 建置應用。Ari Weinstein 稱 GPT-6.1 Sol 成本是 Astra 的五分之一,用在 Computer Use 上只需七分之一。

  2. Anthropic ResearchAI 評分55

    研究:機器人已能完成美國 34% 工時中的體力任務

    一項基於 O*NET 資料、用 Claude 評估任務暴露度的研究顯示,當今機器人已能完成美國 74% 的體力任務,佔全部工作時間的 34%;機器人與 LLM 合計覆蓋約 80% 的工作時間。但機器人僅在 0.3% 的任務上比人力更具成本競爭力,若價格按過去趨勢下降,40 年後這一比例才到 10%。暴露於機器人的崗位多為男性、低學歷、低薪,如駕駛與倉儲;護理與維修類崗位暴露度低。

9月29日星期二 · 6 則

  1. Simon Willison● 精選AI 評分73

    Anthropic 紅隊:GLM-5.3 在 4% 任務中實現控制流劫持

    Anthropic Frontier Red Team 在內部 Binary Exploitation 基準中隨機抽取 100 個任務評估多個模型:GLM-5.3 在 4% 的試驗裡實現了完整控制流劫持,Claude Mythos Preview 為 6%。此前模型 Claude Opus 4.6 與 GLM-5.2 在這些任務中一次都沒有成功。該團隊認為,GLM-5.3 的成績雖低於 Claude Mythos Preview,但一個有意義的能力門檻已被跨過。

  2. Claude Code releases● 精選AI 評分70

    Claude Code v2.1.285:可關閉 WebFetch,新增 API 提供商限制

    Claude Code 發布 v2.1.285,新增環境變數 CLAUDE_CODE_DISABLE_WEB_FETCH 用於關閉 WebFetch 工具,並加入 allowedProviders 託管設定,限制一臺機器可用的 API 提供商(Anthropic API、自訂 endpoint、Bedrock、Mantle、Vertex AI、Foundry、AWS 上的 Claude Platform、Cloud gateway)。

  3. X @AnthropicAIAI 評分33

    Anthropic 啟動 AI 期望調研,Claude 使用者可參與

    Anthropic 於 9 月 29 日至 10 月 6 日開展新一輪 AI 調研,Claude 與 Claude Code 的 Free、Pro、Max 使用者均可參加,參與者可選擇公開自己的回答。去年 12 月的同類研究有 81,000 人參與,Anthropic 稱這是迄今規模最大的定性研究。調研結果將影響 The Anthropic Institute 的研究方向與公司決策,若多人提出 Anthropic 應改變做法,這些意見會被公開記錄。

  4. Anthropic ResearchAI 評分27

    Anthropic 用 AI 訪談徵集公眾對 AI 的看法

    Anthropic 於 2026 年 9 月 29 日啟動新研究,用 Anthropic Interviewer 訪談使用者對 AI 的真實體驗與期待,參與者可自願將完整訪談公開。訪談問題包括最有意義的正面與負面經歷、希望 AI 改變的工作教育醫療政府等領域、以及對 AI 公司的要求;公開版本只附國家,不含 Claude 帳號姓名與信箱,但官方明確警告他人仍可能通過年齡、職業、城市等細節重新識別身份,且一旦公開無法刪除已被他人儲存的內容。

  5. Anthropic Research● 精選AI 評分81

    GLM-5.3 可自主建置端到端漏洞利用,防護易被繞過

    智譜 AI(海外稱 Z.ai)的 GLM-5.3 具備自主建置端到端網路漏洞利用的能力,且發布時未設有效防護,Anthropic 測試顯示攻擊者用簡單技巧即可在 64% 到 100% 的情況下繞過其防護。在 ExploitBench 上,GLM-5.3 於 410 次嘗試中成功開發出 50 次端到端利用,接近 Claude Mythos Preview 的 56 次;在內部二進位制利用基準中取得 4% 的完整控制流劫持,Claude Mythos Preview 為 6%。

9月28日星期一 · 3 則

9月25日星期五 · 2 則

  1. X @AnthropicAI● 精選AI 評分70

    Claude 獨立算出九圈散射振幅,成本數千美元

    Anthropic 稱 Claude 在 Claude Science 中僅憑一條描述九圈問題的提示,基本無人監督執行數天,算出平面 N=4 超楊-米爾斯模型中的九圈散射振幅,總成本數千美元,打破此前八圈的紀錄。該結果由原紀錄保持者、SLAC 的 Lance Dixon 獨立驗證,物理學家兼科學作者 von Hippel 在 Anthropic 科學部落格撰文記錄。此前多數計算止步於兩到三圈,每加一圈計算量指數增長。

  2. Anthropic Research● 精選AI 評分67

    Claude 完成 N=4 超楊-米爾斯九圈振幅計算

    物理學家 Matt von Hippel 向 AI 公司發起挑戰,要求用學術機構級別的算力把 N=4 超楊-米爾斯理論算到九圈,Anthropic 的 Claude 在一個月內完成了。散射振幅通常只算到兩圈,少數到三圈,最精確的預測用到五圈;九圈此前被認為需要遠超學術機構可及的算力。N=4 超楊-米爾斯是振幅學界的玩具模型,不描述真實世界,專門用來檢驗新計算方法。

9月24日星期四 · 1 則

  1. Claude Platform release notesAI 評分56

    September 24, 2026

    Anthropic 自 2026-09-24 起,對在任何輸出前被拒、且 stop_details.category 為 bio、frontier_llm、reasoning_extraction 的請求恢復計費,按執行該請求的模型費率收取,所有平台適用;其他類別的輸出前拒答仍不計費,fallback credit 不變。流式輸出中途的拒答此前已在計費。

9月23日星期三 · 2 則

  1. Claude Platform release notes● 精選AI 評分62

    Claude API 快取診斷轉正,不再需要 beta header

    Claude API 的快取診斷已結束 beta,正式可用,不再需要 cache-diagnosis-2026-04-07 這個 beta header。開發者只要在 Messages 請求里加上 diagnostics 物件即可啟用;仍傳送舊 header 的請求行為保持不變。POST /v1/messages 的回應現在總會包含 diagnostics 欄位,請求未帶 diagnostics 物件時該欄位為 null。

  2. Anthropic News● 精選AI 評分71

    Anthropic 用 Claude 發現類 CRISPR 新酶系統

    Anthropic 於 2026 年 9 月 23 日宣布成立生命科學研究組與實驗室,並公布早期成果:Claude 在僅接受高層級指令的情況下,自主發現了一個與 DNA 重複序列相關的新型酶系統,命名為 array-associated reverse transcriptases(ART)。約 950 個 agent 用 210 million tokens 搜尋 21 小時,從噬菌體中找到該 RT 系統,其定義特徵此前未被識別。

9月22日星期二 · 1 則

9月18日星期五 · 1 則

  1. Anthropic NewsAI 評分45

    Anthropic 與埃森哲合作開展嵌入式評估

    Anthropic 於 2026 年 9 月 18 日宣布與埃森哲合作,對前沿 AI 模型進行獨立評估,由埃森哲旗下 AI 業務 Faculty 牽頭,內容包括模型評估、紅隊測試、對齊評估與安全防護測試。雙方預計未來五年各投入至少 10 億美元建設相關能力。嵌入式評估員將像員工一樣進入 AI 公司內部,觀察模型訓練過程與部署決策,但具體運作細節和行業標準尚未確定。Anthropic 直接資助埃森哲的工作,同時與 METR 等非營利評估機構洽談試點,該合作非排他性。

9月17日星期四 · 1 則

  1. Anthropic NewsAI 評分51

    Anthropic 推出生命科學驗證計劃 LSVP

    Anthropic 於 2026 年 9 月 17 日推出生命科學驗證計劃(LSVP),讓通過驗證的生命科學團隊在 Mythos、Opus、Sonnet 模型上獲得對生物學工作更寬鬆的防護設定,覆蓋藥物發現、研究生物學、臨床開發與製造等目前通用模型中被攔截的任務。計劃先以 beta 面向團隊和機構開放申請,個人 Pro 與 Max 方案後續再擴。

9月16日星期三 · 1 則

  1. Claude blog● 精選AI 評分83

    Claude Cowork 與聊天合併為統一 Claude

    Anthropic 於 2026 年 9 月 16 日宣布將 Claude Cowork 與聊天合併為同一個 Claude,未來幾週先向 Pro 和 Max 方案推送,無需手動開啟。同時新增 Claude Docs 和 Claude Slides,Claude Design 也可直接在對話中使用,三者均在付費方案 beta 階段,可編輯、演示或匯出為 PowerPoint、PDF。

9月15日星期二 · 1 則

  1. Claude blogAI 評分40

    Claude for Small Business 新增 43 個工作流與 27 個整合

    Anthropic 於 2026 年 9 月 15 日為 Claude for Small Business 推出 43 個工作流和 27 個新整合,接入 Shopify、Salesforce、Stripe、Zapier 等工具,該產品自 5 月上線以來安裝量已超 90 萬次。新工作流把 Claude 從後臺運營擴充套件到獲客、回覆諮詢和撰寫提案,並可在 Claude Cowork 桌面應用中按計劃自動執行,預設傳送、發布或付款前需使用者批准。

9月9日星期三 · 1 則

  1. OpenRouter announcementsAI 評分57

    OpenRouter 上線美區路由,請求解密與推理全程留在所選區域

    OpenRouter 在 2026 年 9 月 9 日推出美國 In-Region Routing,此前 EU 路由已於去年 10 月上線。把請求發到 us.openrouter.ai/api/v1 或 eu.openrouter.ai/api/v1,API key、請求體、模型 ID 不變,帳戶裡的 provider 偏好、fallback、隱私設定照常生效;

8月26日星期三 · 2 則

  1. Claude blog● 精選AI 評分75

    Claude Cowork 內建瀏覽器,無需安裝擴充套件

    Claude 在桌面版 Cowork 中內建了獨立瀏覽器,本週起向 Pro、Max、Team 方案推送,Enterprise 管理員今天即可為組織開啟。任務需要訪問網站時,瀏覽器會在側邊欄開啟,Claude 可導航頁面、讀取內容、點選和輸入,能填表單、抓取儀表盤數字或操作沒有聯結器的門戶,無需擴充套件和設定。它與你自己的瀏覽器隔離,看不到你的標籤頁、書籤和密碼,登入資訊可按站點從 Chrome、Edge、Firefox 匯入,銀行、信箱和單點登入站點預設排除。

  2. Claude blog● 精選AI 評分81

    Claude in Chrome 正式向所有付費方案開放

    Claude in Chrome 於 2026 年 8 月 26 日正式可用,覆蓋所有付費 Claude 方案,並支援 Claude 在瀏覽器中自主執行操作,不再需要逐步批准。它可讀取當前頁面、輸入文字、點選連結、跨標籤頁導航和填表,並使用你已有的登入狀態訪問內部儀表盤、遺留系統和供應商門戶。每次操作前由安全分類器校驗是否安全且符合你的請求,也可在設定中關閉自動批准。

8月25日星期二 · 1 則

  1. Ollama blog● 精選AI 評分80

    Ollama 支援作為閘道器接入 Claude Desktop

    Ollama 現在可作為第三方閘道器接入 Claude Desktop,開發者在 Ollama 中開啟 Claude 開關即可自動完成配置。連線後可選任意 Ollama 模型,包括本地執行的開放模型與 Ollama 雲端模型,也能隨時切回 Anthropic 模型;在 Ollama 裡關閉 Claude 即恢復原有設定。

8月2日星期日 · 1 則

  1. X @karpathy● 精選AI 評分67

    Karpathy 用 Opus 5 把《魔戒》首段渲染成 3D 場景

    Karpathy 給 Opus 5 輸入《魔戒》第一段、100 萬 token 預算(約 10 美元),讓它用 three.js 渲染這個故事。Opus 5 執行約 2 小時,寫出 5500 行程式碼,程式化生成了粗糙但可玩的 3D 場景。他指出這類任務沒人願意手工做,但 LLM 有無限耐心,成本近乎免費;同時也暴露 LLM 無法原生高效感知影片或玩遊戲,只能緩慢截圖自查,導致不少瑕疵。

6月18日星期四 · 1 則

  1. Claude blog● 精選AI 評分81

    Claude Code 新增 artifacts,可生成即時共享網頁

    Claude Code 從 2026 年 6 月 18 日起支援 artifacts,能把會話進展生成為可即時更新、可分享的互動式網頁,如 PR 走查、儀表盤和發布清單。它基於程式碼庫、聯結器和對話上下文建置,同一連結自動發布新版本並保留版本歷史。該功能目前以 beta 形式面向 Claude Team 和 Enterprise 組織,可通過 CLI 和桌面應用使用,頁面預設僅作者可見,且只能組織內認證成員檢視。

更早的內容