AISpot

Anthropic

近期事件

  1. 1
  2. 2
  3. 3
  4. 4
  5. 5

10月4日星期日 · 3 則

  1. 量子位AI 評分43

    AI 崗位 FDE 走紅:月薪 5 萬,海外年薪中位 134 萬

    FDE(前線部署工程師)成為當下最火的 AI 崗位,國內大廠開出月薪三五萬,海外公開薪資中位數約 20 萬美元(約 134 萬元人民幣)。Anthropic 計劃投資 1 億美元到 2027 年底培訓 1 萬名 FDE,OpenAI 投 40 億美元成立部署公司,AWS 拿出 10 億美元組建 FDE 部門。從業者稱溝通需求佔工作時間七成以上,開發僅約三成,核心工作是把企業業務梳理成 Ontology 再開發應用。

  2. Claude Code releasesAI 評分56

    v2.1.289

    Claude Code 更新至 v2.1.289,集中修復外掛系統、沙箱權限規則與終端渲染的多個缺陷。其中 Bash 拒絕或詢問規則此前在環境變數字首、裸變數賦值及沙箱自動放行場景下會被跳過,Read 拒絕規則也未覆蓋通過符號連結在 IDE 中 @ 提及或選中的檔案。此外還修復了外掛熱過載、本地資料夾市場外掛顯示陳舊副本、升級後首個會話不載入已安裝 mod,以及 VSCode 中 claude auth status 導致登出更頻繁的回退問題。

10月3日星期六 · 24 則

  1. Hacker News front pageAI 評分58

    OpenAI 安全負責人離職,稱公司文化已崩壞

    OpenAI 安全負責人 David Robinson 已辭職,並撰文稱公司文化“broken”,批評前沿 AI 公司對技術開發“不夠謹慎”。他負責撰寫 ChatGPT 產品發布時的安全報告,主張前沿實驗室應像核電站或繁忙機場一樣執行,引入核能、航空等領域的安全經驗與冗餘設計。此前 OpenAI 已暫停最先進模型的訓練,並因內部測試的安全擔憂取消了一款下一代模型的發布;公司回應稱會繼續加強安全實踐,必要時暫停訓練或推遲模型發布。

  2. r/ClaudeAI top of the dayAI 評分20

    Reddit 討論 Fable 5.5 下週發布預期

    r/ClaudeAI 使用者 Minemax03 發帖詢問,若 Fable 5.5 下週發布,效能會有多大提升。評論普遍擔心 Anthropic 會削弱當前 Opus 5.5,多人稱 Opus 5.5 是目前最好的 coding agent 體驗,也有人認為 Fable 5.5 價格是 Opus 5.5 的兩倍,除非效能大幅躍升否則難言划算。另有使用者提到官方已發放一次性額度重置,需在 10 月 22 日前使用,因此不認為該日期前會再重置或發布 Fable 5.5。

  3. r/ClaudeAI top of the dayAI 評分6

    使用者稱剛開始學 Claude 感嘆其能力遠超其他 AI 工具

    一位 Reddit 使用者表示自己可能有點落後於時代,但剛開始學習 Claude AI,就難以相信它比其他 AI 工具強大這麼多。該使用者稱,如果以正確方式使用 Claude,自己的多項業務有望節省數千美元的資源成本。帖子未說明具體業務型別、使用場景或對比的是哪些工具。

  4. TechCrunch AIAI 評分30

    AWS 稱不再與政府機構籤資料中心保密協議

    AWS CEO Matt Garman 在部落格中表示,公司已停止在與政府機構的資料中心專案中使用保密協議(NDA),並稱過去三年向美國資料中心所在社群投入超 10 億美元。他同時反駁資料中心耗水、推高電價、汙染大、無益社群四點質疑,稱資料中心直接用水僅佔美國工業用水 0.5%,備用發電機 99.9% 時間閒置、每年約執行 10 小時。背景是全美已有 100 多個資料中心禁令在審議中,紐約已宣布大型資料中心許可暫停一年。

  5. Hacker News front page● 精選AI 評分88

    Getting the most out of Opus 5.5 in Claude and Claude Code

    Anthropic 於 2026 年 9 月發布 Opus 5.5 官方使用指南,作者 Addy Osmani,閱讀時長 9 分鐘。Opus 5.5 相比前代更擅長多步驟長任務,可連續數小時執行大型倉庫改動直至測試通過,且每次回覆前都會自行思考。指南建議一次性交代完整任務並說明完成標準,刪除提示詞中的 think carefully 等語句,在 CLAUDE.md 中寫明何時繼續、何時停下詢問,並讓子代理並行處理審計與遷移。

  6. Hacker News front pageAI 評分35

    LeCun 稱對 AI 滅絕人類零擔憂,批 EA 有毒

    圖靈獎得主 Yann LeCun 表示對 AI 消滅人類「零擔憂」,認為近期 OpenAI 智慧體自主入侵 Hugging Face 等事件源於沙箱設計漏洞與人類監督不足,完全可預防。他稱有效利他主義(EA)「超級有毒」,並指 Anthropic CEO Dario Amodei「完全被誤導」甚至「瘋狂」,批評其與 Sam Altman 渲染 AI 滅絕風險是「最糟糕的營銷」。LeCun 目前專注經營新公司 AMI Labs,並認為 AI 不需要新監管,真正風險是監管俘獲。

  7. r/ClaudeAI top of the dayAI 評分75

    LiveNerf 完成 Opus 5.5 十天基線測量

    LiveNerf 專案已完成 Opus 5.5 的 10 天效能基線,從明天起將收集第 30 天的資料,之後可與基線對比,判斷模型發布後是否被降智。該專案由個人開發者發起,程式碼已開源在 GitHub,目標是獨立追蹤 Opus 5.5 的逐日表現。目前尚無結論性證據,作者稱希望藉此推動 AI 公司提高透明度。

  8. r/ClaudeAI top of the dayAI 評分55

    開發者用 Claude Code 與 Remotion 生成發布影片,帶來 10 位客戶

    一位獨立開發者用 Claude Opus 智慧體(Claude Code)配合 Remotion 製作了 Mac 應用 Tack+ 的發布影片,並因此獲得前 10 位客戶。影片全長 45 秒、60 fps,輸出 1080p 與 4K,含法語和英語版本,全部由程式碼生成,沒有 After Effects、素材庫或授權音樂。智慧體無法直接看影片,就渲染幀聯絡表自行檢查並修正標題重疊、轉場空白等問題,但聲音部分它只能測響度和峰值,無法試聽,需人工把關。

  9. r/ClaudeAI top of the day● 精選AI 評分80

    handoff-compact:自動壓縮前生成交接文件的 Claude Code 外掛

    handoff-compact 是一個 Claude Code 外掛,在 autocompact 觸發時用會話分支生成交接文件並替換原對話,實現無人值守的 handoff + /clear。作者稱長時間無人值守會話中一半 token 花在上下文已超 200k 的輪次上,既貴又因 context rot 降低品質。交接文件包含目標、狀態與驗證依據、下一步、決策與理由、已排除方案、未決問題、檔案與提交、驗證命令及最近 10 條 prompt 原文。

  10. r/OpenAI top of the dayAI 評分61

    使用者實測:Opus 5.5 編碼能力遠超 Astra

    一位使用者對比 Astra 與 Opus 5.5 後稱,Opus 5.5 在編碼任務上明顯更強。他用約兩頁 A4 的提示詞、二十多次對話就讓 Opus 5.5 完成了一款包含玩法、畫面、音效與音樂的遊戲,全程未寫一行程式碼;在室內導航任務中,Opus 5.5 的掃描與追蹤準確,而 Astra 開箱即用效果很差,他給出 9/10 對 2/10 的評價。不過 Claude 會頻繁提示工具使用過多或任務未完成,且超出用量限制後完全無法使用。

  11. Latent Space● 精選AI 評分85

    GPT-6.1 Sol 發布,Sonnet 5.5 登頂 Agent Arena

    OpenAI 發布 GPT-6.1 Sol,定價 $2/$10 每百萬輸入/輸出 token,比 Astra 的 $10/$50 便宜約 80%,在 DeepSWE v1.1 上比 GPT-6 Sol 高 6.4 分。Sonnet 5.5 在 Agent Arena 首秀排第 3 並在 Chat 類別登頂,Anthropic 包攬前三;Sol 每任務中位成本 $0.56,比 GPT-6 Sol 便宜 39%。

  12. r/ClaudeAI top of the dayAI 評分36

    用 Claude Opus 5.5 生成成都定製旅行小志

    一位使用者用 Claude Opus 5.5 規劃成都旅行,通過對話說明偏好後,讓模型調研並輸出可列印的小志(zine)。最終得到 9 份主題小志,每份一張 A3 紙,外加一張標註感興趣街區的地圖,內容按具體出行日期定製,涉及活動、票務和交通。使用者稱效果不錯但非完美:模型過早固定了每主題一頁的格式,導致部分內容偏冗長、部分偏簡略。全程在瀏覽器中用 20 美元套餐完成,對話部分用較低設定、生成部分用最高設定,最終 PDF 生成約消耗兩個半 5 小時使用額度。

  13. Hacker News front pageAI 評分41

    百萬 token 每秒只是思想實驗,序列瓶頸仍在

    一篇 2026 年 10 月 3 日發布的思想實驗文章指出,每秒一百萬 token 可指四種不同含義:上下文容量、輸入處理速度、聚合吞吐量和單 agent 輸出速度,其中只有最後一種才是真正的寫作速度。文章用計算器演示:100 萬輸出 token 在 100 token/秒下需 2 小時 46 分 40 秒,在 100 萬 token/秒下僅 1 秒;但若寫作後加一次 60 秒的固定檢查,端到端加速從 10000 倍降到 132.57 倍,檢查佔 98.7% 時間。

  14. r/ClaudeAI top of the dayAI 評分65

    Claude Code 通過 MCP 當上 RPG 遊戲主持人

    開發者用 Claude Code 建置了 RPG 世界引擎 Chronicle,現在通過 MCP 讓 Claude Code 直接當遊戲主持人。在私人世界貼上一條 claude mcp add 命令並附帶 token,即可把 chronicle-storyteller 子代理裝進 ~/.claude/agents,之後由 Claude Code 接管回合;Chronicle 自身不呼叫模型,因此複用你已付費的 Claude 方案。

  15. r/ClaudeAI top of the dayAI 評分15

    使用者對比 Opus 5.5 與 Astra:Minecraft 模組品質差距明顯

    一位理論物理博士生在 Reddit 發帖稱,Anthropic 提供 50% 折扣後他以 100 美元訂閱了 20x 方案,此前是 OpenAI 的 200 美元訂閱使用者。他用 Astra 生成的 Justice League Minecraft 模組品質很差,而 Opus 5.5 生成的飛行動畫流暢、平衡性好,還能一次性完成論文圖表和審稿回覆。他認為 Fable 比 Astra Ultra 或 Pro 稍弱,但 Ultra Pro 用處不大,已決定立即切換。

  16. r/ClaudeAI top of the dayAI 評分40

    使用者用 Claude Project 做單任務待辦,ADHD 場景下跑通

    一位使用者把 Claude Project 改造成只顯示單個任務的待辦系統,規則是 Claude 永不展示完整清單。做法是把腦中所有事情無序丟進對話,Claude 排序後只給出第一件事並附時間限制,到時在同個對話裡提醒並推送下一件;夜間生成報告,記錄已完成、等待他人、順延到明天的事項及預估與實際耗時。作者稱這是自己第一天之後唯一堅持下來的方案,但明確表示它只排序、不減少任務量。

  17. r/ClaudeAI top of the day● 精選AI 評分78

    使用者稱 Opus 5.5 周額度 3 億 token 即觸頂

    一位使用者反映,改用 Opus 5.5 後每週僅用 3 億 token 就觸及訂閱週上限,而此前每週消耗 10 至 20 億 token 都沒問題。該使用者指出 Opus 5.5 單 token 價格理論上更低,懷疑是訂閱額度被削減,或與自己大量使用 subagent 的工作方式有關。目前這只是個人反饋,尚無官方說明。

  18. r/ClaudeAI top of the dayAI 評分29

    使用者求助:如何把 Claude 用到極致並搭建自動化生活系統

    一名大學生在 Reddit 發帖,稱自己每天用 Claude Pro 和 Claude Code,但感覺只發揮了其能力的一小部分。他列舉了當前用法:用 Claude Code 無程式設計背景搭建 DuckDB 分析資料庫、連線 Gmail/Calendar/GitHub/Drive/Notion、用 Otter 錄音後讓 Claude 提取要點,同時抱怨反覆重述上下文、未用 Claude Projects、Cowork、定時任務和 Chrome 擴充套件。

10月2日星期五 · 13 則

  1. r/ClaudeAI top of the dayAI 評分55

    使用者用 Claude Opus 5.5 把 100 分鐘遊戲錄影剪成 50 分鐘成片

    一位業餘創作者用 Claude Opus 5.5 完成了整段影片剪輯:自動同步音畫、生成轉錄並據此把 100 分鐘素材剪到 50 分鐘、去除停頓、平衡音量、新增箭頭縮放閃回等效果,還把遊戲棋盤做成獨立畫面並生成動畫箭頭和 YouTube Shorts。整個過程不到一天,幾乎無需人工指導,且完全在 DaVinci 和 Premiere 之外完成。作者認為這不能替代優秀剪輯師的直覺,但對業餘創作者來說效果驚人。

  2. r/ClaudeAI top of the dayAI 評分32

    在 Blender 裡用 Claude Opus 5.5 畫草圖比寫提示詞更高效

    一位使用者在 Blender 中使用 Claude Opus 5.5 做 blockout 時發現,直接畫出空間意圖比用文字描述形狀更高效,因為文字擅長說明是什麼,卻不擅長表達位置、大小和數量。整個實驗共消耗 33M tokens,API 成本 16.07 美元,執行 48.5 分鐘,貼圖與夜空素材來自 Poly Haven 的 CC0 資源。作者因此不再用文字描述形狀,而是給 Claude 提供繪圖或空間參考。

  3. Hacker News front pageAI 評分63

    三款 AI agent 多語言實測:權限請求與註冊行為差異明顯

    技術與人權研究者 Roya Pakzad 發布對比測試,用世界銀行全球公共採購資料庫任務,分別以英文(美國)和波斯語(伊朗)在網頁版 Muse、Claude Cowork Opus 5.5、GPT 6.1 Sol 上執行。權限差異明顯:GPT 只在開頭請求一次網站訪問並提供允許所有相關網站選項,Claude 兩個任務各請求 9 次,Muse 到第四步才請求。

  4. r/ClaudeAI top of the dayAI 評分50

    Claude Code 外掛 Claude Fables 把工具呼叫演成動畫

    免費開源的 Claude Code 桌面版外掛 Claude Fables 已發布在 GitHub,Claude 工作時它會觀察每次工具呼叫和每行輸出,每隔幾秒在輸入框上方用一段短動畫複述最新進展。Claude 是個橙色小生物,有 20 種動作、7 個場景和 11 種視覺風格,用 /fables style 切換;安裝只需把倉庫路徑寫進 ~/.claude/settings.json 的 CLAUDE_CODE_PLUGIN_DIRS 再重啟應用。

  5. r/ClaudeAI top of the dayAI 評分33

    r/ClaudeAI 討論:重度工作用 Opus 5.5,GPT 靠額度與畫圖

    r/ClaudeAI 一條 22 小時前的帖子問同時用 Claude 和 GPT 的人更偏好哪個,30 條評論後自動總結出的共識是:兩者都用,但嚴肅工作首選 Claude(尤其是 Opus 5.5),用於編碼、深度邏輯與科學任務;最大抱怨是 Claude Pro 額度消耗遠快於 GPT Plus。使用者繼續付費 GPT 的原因包括更寬鬆的訊息上限、DALL-E 影像生成,以及閒聊與頭腦風暴。常見工作流是先用 GPT 出想法和一般查詢,再切到 Claude 執行和打磨成品。

  6. r/ClaudeAI top of the dayAI 評分35

    團隊引入 Claude 後,衝刺幾天完成,管理層發愁找活

    一位負責企業系統開發的團隊負責人稱,團隊最近開始使用 Claude,原本按周計的衝刺現在幾天就能清空。其技術棧以 Python/TypeScript 為主,涉及大規模資料處理、DevOps 與微服務。團隊因此沒活可幹,產品管理部門難以找到更多工,他本人大部分時間花在規劃會議上,並在帖子中徵求對後續走向的猜測。

  7. TechCrunch AIAI 評分61

    白宮召集科技 CEO 簽 AI 安全承諾,僅 2% 消費者付費

    白宮本週把 Zuckerberg、Bezos、Musk 與 Anthropic 的 Dario Amodei 等主要科技公司 CEO 聚到一起,簽署川普稱為具有道德約束力的 AI 安全承諾。川普還簽署行政令,正式把 AI 改稱 super intelligence,Meta 與 OpenAI 則在給自家 AI 產品換上更友好的形象。但原標題指出,只有 2% 的消費者在為 AI 付費。

更早的內容