AISpot

Claude

近期事件

  1. 1
  2. 2
  3. 3
    熱度 0.72 個來源 · 2 則10/2 22:25
  4. 4
  5. 5

10月4日星期日 · 2 則

  1. 量子位AI 評分43

    AI 崗位 FDE 走紅:月薪 5 萬,海外年薪中位 134 萬

    FDE(前線部署工程師)成為當下最火的 AI 崗位,國內大廠開出月薪三五萬,海外公開薪資中位數約 20 萬美元(約 134 萬元人民幣)。Anthropic 計劃投資 1 億美元到 2027 年底培訓 1 萬名 FDE,OpenAI 投 40 億美元成立部署公司,AWS 拿出 10 億美元組建 FDE 部門。從業者稱溝通需求佔工作時間七成以上,開發僅約三成,核心工作是把企業業務梳理成 Ontology 再開發應用。

10月3日星期六 · 38 則

  1. Hugging Face blogAI 評分55

    微軟發布 ThinkingBox,按資料庫終態給 AI agent 打分

    微軟與 Hugging Face 聯合發布 ThinkingBox,通過 Hugging Face 提供,用 507 個有狀態業務流程、每個任務重複 20 次來評測 agent 留下的後端狀態與副作用,而非只看工具呼叫和最終回覆。在 121,680 次有效試驗中,79,853 次未通過可執行檢查,其中 67.24% 仍乾淨結束並呼叫了改狀態的工具、未報錯。

  2. Hacker News front pageAI 評分45

    作者稱手寫程式碼時代已終結,Claude Code 讓 18 年習慣消失

    一位寫了 18 年程式碼的工程師表示,自 Claude Code 中的 Opus 4.5 越過某個門檻後,他幾乎不再手寫程式碼,並認為回不去了。他所在團隊 Filestage 每月合併 PR 從約 200 增至 300,bug 報告未增加,每位開發者每月 AI 訂閱費 20 美元,工具可自選 Codex、Claude Code 或 Cursor。他仍主張保留高階抽象,認為 LLM 應生成高階表示再交給確定性編譯器,而非直接寫彙編。

  3. Hacker News front pageAI 評分58

    OpenAI 安全負責人離職,稱公司文化已崩壞

    OpenAI 安全負責人 David Robinson 已辭職,並撰文稱公司文化“broken”,批評前沿 AI 公司對技術開發“不夠謹慎”。他負責撰寫 ChatGPT 產品發布時的安全報告,主張前沿實驗室應像核電站或繁忙機場一樣執行,引入核能、航空等領域的安全經驗與冗餘設計。此前 OpenAI 已暫停最先進模型的訓練,並因內部測試的安全擔憂取消了一款下一代模型的發布;公司回應稱會繼續加強安全實踐,必要時暫停訓練或推遲模型發布。

  4. r/ClaudeAI top of the dayAI 評分20

    Reddit 討論 Fable 5.5 下週發布預期

    r/ClaudeAI 使用者 Minemax03 發帖詢問,若 Fable 5.5 下週發布,效能會有多大提升。評論普遍擔心 Anthropic 會削弱當前 Opus 5.5,多人稱 Opus 5.5 是目前最好的 coding agent 體驗,也有人認為 Fable 5.5 價格是 Opus 5.5 的兩倍,除非效能大幅躍升否則難言划算。另有使用者提到官方已發放一次性額度重置,需在 10 月 22 日前使用,因此不認為該日期前會再重置或發布 Fable 5.5。

  5. r/ClaudeAI top of the dayAI 評分6

    使用者稱剛開始學 Claude 感嘆其能力遠超其他 AI 工具

    一位 Reddit 使用者表示自己可能有點落後於時代,但剛開始學習 Claude AI,就難以相信它比其他 AI 工具強大這麼多。該使用者稱,如果以正確方式使用 Claude,自己的多項業務有望節省數千美元的資源成本。帖子未說明具體業務型別、使用場景或對比的是哪些工具。

  6. r/ClaudeAI top of the dayAI 評分23

    Marcello Costa 用 Claude 加 Magnific 做出 AI 動畫短片

    創作者 Marcello Costa 發布 AI 動畫短片 Monkey Business,全流程幾乎都在 Claude 內完成,約 50 天從開工到成片。他用自建的 Seedance 2.5 skill 把自然語言提示轉成詳細視覺提示,再交給 Magnific 裡的 Seedance 2.5 生成畫面,首條提示寫入了整套專案規則,之後靠術語呼叫即可銜接,但仍需大量迭代和後期製作才達到專業水準。

  7. Hacker News front page● 精選AI 評分88

    Getting the most out of Opus 5.5 in Claude and Claude Code

    Anthropic 於 2026 年 9 月發布 Opus 5.5 官方使用指南,作者 Addy Osmani,閱讀時長 9 分鐘。Opus 5.5 相比前代更擅長多步驟長任務,可連續數小時執行大型倉庫改動直至測試通過,且每次回覆前都會自行思考。指南建議一次性交代完整任務並說明完成標準,刪除提示詞中的 think carefully 等語句,在 CLAUDE.md 中寫明何時繼續、何時停下詢問,並讓子代理並行處理審計與遷移。

  8. Hacker News front pageAI 評分35

    Meta Muse 靠設計與廣告模式登頂美區 App Store

    Meta 的消費級 agent 產品 Muse 已在美國 App Store 榜首停留一段時間,其核心能力(瀏覽器與電腦操作、雲端工作流、定時任務、手機遠端控制)在 Codex、Claude Code 等工具中已存在一年以上,Meta 的勝點在於用單一聊天介面隱藏模型選擇、chat/work 切換等複雜度,並以廣告而非賣 token 支撐極寬鬆的免費額度。作者認為這可能是 agentic AI 首次對普通消費者真正可用,也讓 Meta 在可規模化的消費級 AI 上領先。

  9. Hacker News front pageAI 評分35

    LeCun 稱對 AI 滅絕人類零擔憂,批 EA 有毒

    圖靈獎得主 Yann LeCun 表示對 AI 消滅人類「零擔憂」,認為近期 OpenAI 智慧體自主入侵 Hugging Face 等事件源於沙箱設計漏洞與人類監督不足,完全可預防。他稱有效利他主義(EA)「超級有毒」,並指 Anthropic CEO Dario Amodei「完全被誤導」甚至「瘋狂」,批評其與 Sam Altman 渲染 AI 滅絕風險是「最糟糕的營銷」。LeCun 目前專注經營新公司 AMI Labs,並認為 AI 不需要新監管,真正風險是監管俘獲。

  10. Hacker News front pageAI 評分13

    用 Claude 自動化 35mm 膠片掃描流程

    一位工程師用 Claude 驅動掃描器並自動完成膠片負片轉正、除塵與調色,把每卷 36 張的處理時間從約 4 小時壓縮下來。Claude 通過 SANE 控制掃描器時因 X/Y 方向反轉幾乎損壞齒輪機構,他最終保留 VueScan 負責掃描,讓 Claude 接手後續處理。負片轉換用 numpy 按膠片密度計算,並以每卷空白片頭作為色彩校正參考,29 幀中 28 幀通過測試。除塵用影像分析標記灰塵,再用 LaMa 修復模型填補。

  11. r/ClaudeAI top of the dayAI 評分75

    LiveNerf 完成 Opus 5.5 十天基線測量

    LiveNerf 專案已完成 Opus 5.5 的 10 天效能基線,從明天起將收集第 30 天的資料,之後可與基線對比,判斷模型發布後是否被降智。該專案由個人開發者發起,程式碼已開源在 GitHub,目標是獨立追蹤 Opus 5.5 的逐日表現。目前尚無結論性證據,作者稱希望藉此推動 AI 公司提高透明度。

  12. Hacker News front pageAI 評分42

    Docker Desktop 自 2016 年起一直使用 microVM

    Docker 工程師 Dave Scott 指出,Docker Desktop 自 2016 年起就一直基於 microVM 技術執行,而非傳統 Linux 容器。2015 年起 Docker 用 Mirage Unikernel 庫建置了可嵌入的 library VMM,首版名為 hyperkit,最新版為 Docker VMM,核心與根檔案系統基於 LinuxKit 專案。

  13. r/ClaudeAI top of the dayAI 評分51

    非開發者用 Claude Code 一個月為工廠搭出生產系統

    一位法國傢俱廠運營總監用 Claude Code 在 30 天內做出生產管理系統,已上線供辦公室和車間每天使用。系統含 386 次提交、約 17.5 萬行 Python 與原生 JS、約 2100 個測試、約 580 個 API 路由、約 280 張 SQLite 表,技術棧為 FastAPI + SQLite + HTML/JS,跑在廠內 Windows 機器上。

  14. r/ClaudeAI top of the dayAI 評分22

    開發者用 Claude 迭代 3D 畫素遊戲 Willowmere

    開發者用 Claude 迭代了 3D 畫素風遊戲 Willowmere 的第二版,全部畫面由程式碼生成,無素材檔案、無遊戲引擎,僅用原生 HTML 和 JS,可在瀏覽器免費試玩。新版加入完整劇情三幕與結局、低潮趕海、做燈籠、月下釣魚和 Keep Watch 等玩法,並完成美術動畫與 3D 表情頭像的整體打磨。作者稱本次迭代主要用中等強度配合 Opus 5.5 完成。

  15. llama.cpp releases● 精選AI 評分78

    llama.cpp 修復 Ling 3.0 解析器對 json_schema 的支援

    llama.cpp 合併 PR #29813,讓 Ling 3.0 解析器支援 inputs.json_schema,此前 response_format 請求不受約束。新邏輯為回應格式語法路徑優先於工具呼叫,啟用思考時要求 JSON 前有 think 塊,且 JSON 後不允許尾隨文字。該修復對應 issue #29652,由 Claude Opus 5.5 輔助完成。

  16. r/ClaudeAI top of the dayAI 評分58

    在 Claude.md 中加入變更管理流程,顯著改善 Claude 輸出

    一位使用者通過在 claude.md 中寫入基本變更管理流程,解決了 Claude 擅自擴大改動、誤解指令的問題。具體做法是:每次修改前要求 Claude 先提出實施計劃、回退計劃和測試計劃,經批准後才動程式碼;提交前還要做成功驗證,報告完全成功、部分成功、失敗或需回退,只有完全成功才允許提交。

  17. r/ClaudeAI top of the dayAI 評分55

    開發者用 Claude Code 與 Remotion 生成發布影片,帶來 10 位客戶

    一位獨立開發者用 Claude Opus 智慧體(Claude Code)配合 Remotion 製作了 Mac 應用 Tack+ 的發布影片,並因此獲得前 10 位客戶。影片全長 45 秒、60 fps,輸出 1080p 與 4K,含法語和英語版本,全部由程式碼生成,沒有 After Effects、素材庫或授權音樂。智慧體無法直接看影片,就渲染幀聯絡表自行檢查並修正標題重疊、轉場空白等問題,但聲音部分它只能測響度和峰值,無法試聽,需人工把關。

  18. r/OpenAI top of the dayAI 評分61

    使用者實測:Opus 5.5 編碼能力遠超 Astra

    一位使用者對比 Astra 與 Opus 5.5 後稱,Opus 5.5 在編碼任務上明顯更強。他用約兩頁 A4 的提示詞、二十多次對話就讓 Opus 5.5 完成了一款包含玩法、畫面、音效與音樂的遊戲,全程未寫一行程式碼;在室內導航任務中,Opus 5.5 的掃描與追蹤準確,而 Astra 開箱即用效果很差,他給出 9/10 對 2/10 的評價。不過 Claude 會頻繁提示工具使用過多或任務未完成,且超出用量限制後完全無法使用。

  19. Latent Space● 精選AI 評分85

    GPT-6.1 Sol 發布,Sonnet 5.5 登頂 Agent Arena

    OpenAI 發布 GPT-6.1 Sol,定價 $2/$10 每百萬輸入/輸出 token,比 Astra 的 $10/$50 便宜約 80%,在 DeepSWE v1.1 上比 GPT-6 Sol 高 6.4 分。Sonnet 5.5 在 Agent Arena 首秀排第 3 並在 Chat 類別登頂,Anthropic 包攬前三;Sol 每任務中位成本 $0.56,比 GPT-6 Sol 便宜 39%。

  20. r/ClaudeAI top of the dayAI 評分58

    Opus 5.5 新 Skill 把 PDF 變成動畫互動網頁書

    有人用 Opus 5.5 加一個 Skill 把 PDF 轉成帶動畫、旁白和互動測驗的網頁書,流程是 PDF→書籍規劃→分鏡→旁白→動畫與測驗→網頁書。目前只靠 Opus 5.5,沒有接入影像模型,直接喂 PDF 效果已相當好;作者計劃加入影像模型以支援繪本和人文紀錄片。專案已開源(MIT),並提供了線上書架。

  21. r/ClaudeAI top of the dayAI 評分36

    用 Claude Opus 5.5 生成成都定製旅行小志

    一位使用者用 Claude Opus 5.5 規劃成都旅行,通過對話說明偏好後,讓模型調研並輸出可列印的小志(zine)。最終得到 9 份主題小志,每份一張 A3 紙,外加一張標註感興趣街區的地圖,內容按具體出行日期定製,涉及活動、票務和交通。使用者稱效果不錯但非完美:模型過早固定了每主題一頁的格式,導致部分內容偏冗長、部分偏簡略。全程在瀏覽器中用 20 美元套餐完成,對話部分用較低設定、生成部分用最高設定,最終 PDF 生成約消耗兩個半 5 小時使用額度。

  22. Hacker News front pageAI 評分41

    百萬 token 每秒只是思想實驗,序列瓶頸仍在

    一篇 2026 年 10 月 3 日發布的思想實驗文章指出,每秒一百萬 token 可指四種不同含義:上下文容量、輸入處理速度、聚合吞吐量和單 agent 輸出速度,其中只有最後一種才是真正的寫作速度。文章用計算器演示:100 萬輸出 token 在 100 token/秒下需 2 小時 46 分 40 秒,在 100 萬 token/秒下僅 1 秒;但若寫作後加一次 60 秒的固定檢查,端到端加速從 10000 倍降到 132.57 倍,檢查佔 98.7% 時間。

  23. r/ClaudeAI top of the dayAI 評分65

    Claude Code 通過 MCP 當上 RPG 遊戲主持人

    開發者用 Claude Code 建置了 RPG 世界引擎 Chronicle,現在通過 MCP 讓 Claude Code 直接當遊戲主持人。在私人世界貼上一條 claude mcp add 命令並附帶 token,即可把 chronicle-storyteller 子代理裝進 ~/.claude/agents,之後由 Claude Code 接管回合;Chronicle 自身不呼叫模型,因此複用你已付費的 Claude 方案。

  24. llama.cpp releasesAI 評分58

    llama.cpp 修復 qkx3 量化縮放搜尋的非法舍入

    llama.cpp 合併 PR #29817,在 qkx3 量化級別送入 nearest_int 前先鉗制到 [0, nmax],避免 imatrix 縮放搜尋產生無窮、NaN 或越界值時觸發 Debug 建置斷言。該問題由 #29804 報告,修復同時為 q2_K、q4_K、q5_K、q4_1、q5_1 的退化 imatrix 分組補充迴歸測試。合法範圍內的取值行為不變,macOS Apple Silicon(arm64)等預編譯包已隨本次發布更新。

  25. r/ClaudeAI top of the dayAI 評分15

    使用者對比 Opus 5.5 與 Astra:Minecraft 模組品質差距明顯

    一位理論物理博士生在 Reddit 發帖稱,Anthropic 提供 50% 折扣後他以 100 美元訂閱了 20x 方案,此前是 OpenAI 的 200 美元訂閱使用者。他用 Astra 生成的 Justice League Minecraft 模組品質很差,而 Opus 5.5 生成的飛行動畫流暢、平衡性好,還能一次性完成論文圖表和審稿回覆。他認為 Fable 比 Astra Ultra 或 Pro 稍弱,但 Ultra Pro 用處不大,已決定立即切換。

  26. r/ClaudeAI top of the dayAI 評分40

    使用者用 Claude Project 做單任務待辦,ADHD 場景下跑通

    一位使用者把 Claude Project 改造成只顯示單個任務的待辦系統,規則是 Claude 永不展示完整清單。做法是把腦中所有事情無序丟進對話,Claude 排序後只給出第一件事並附時間限制,到時在同個對話裡提醒並推送下一件;夜間生成報告,記錄已完成、等待他人、順延到明天的事項及預估與實際耗時。作者稱這是自己第一天之後唯一堅持下來的方案,但明確表示它只排序、不減少任務量。

  27. r/ClaudeAI top of the day● 精選AI 評分78

    使用者稱 Opus 5.5 周額度 3 億 token 即觸頂

    一位使用者反映,改用 Opus 5.5 後每週僅用 3 億 token 就觸及訂閱週上限,而此前每週消耗 10 至 20 億 token 都沒問題。該使用者指出 Opus 5.5 單 token 價格理論上更低,懷疑是訂閱額度被削減,或與自己大量使用 subagent 的工作方式有關。目前這只是個人反饋,尚無官方說明。

  28. r/ClaudeAI top of the dayAI 評分21

    開發者用 Claude 一週做出飛艇版 FTL 遊戲

    一位開發者用 Claude 200 美元月費方案和 GPT 100 美元月費方案,在一週內做出了一款類似 FTL 的飛艇策略遊戲 Magehold: Fairwinds,目前可在 mageholdworld.com 免費試玩,幾週後登陸 Steam。遊戲支援 Linux 和 Mac,含 7 種語言本地化和 100 個 Steam 成就,Claude 還生成了美術資產、測試機器人和預告片。作者稱整體迭代 30 多次,後續將加入分支任務鏈和天氣效果。

  29. r/ClaudeAI top of the dayAI 評分40

    Opus 5.5 跑 28 分鐘花 6.17 美元生成單檔案

    一位使用者用自建 Pi agent 配合 plan mode,以 High 思考檔執行 Opus 5.5,耗時 27 分 45 秒、花費 6.17 美元(主 agent 4.97 美元,design-review agent 1.21 美元),最終產出一個 1,029 行、零依賴的 HTML 檔案。輸出 122,689 tokens,其中 66,163 為思考 tokens;總 tokens 約 600 萬,約 95% 為快取讀取。

更早的內容