2026 年 10 月 3 日,Reddit 的 r/ClaudeAI 與 r/OpenAI 各出現一篇使用者實測帖,均稱 Anthropic 的 Opus 5.5 在編碼與生成任務上明顯強於 OpenAI 的 Astra。r/ClaudeAI 的發帖者自稱理論物理博士生,因 Anthropic 提供 50% 折扣,以… 看完整事件
使用者實測:Opus 5.5 編碼能力遠超 Astra
一位使用者對比 Astra 與 Opus 5.5 後稱,Opus 5.5 在編碼任務上明顯更強。他用約兩頁 A4 的提示詞、二十多次對話就讓 Opus 5.5 完成了一款包含玩法、畫面、音效與音樂的遊戲,全程未寫一行程式碼;在室內導航任務中,Opus 5.5 的掃描與追蹤準確,而 Astra 開箱即用效果很差,他給出 9/10 對 2/10 的評價。不過 Claude 會頻繁提示工具使用過多或任務未完成,且超出用量限制後完全無法使用。
你同時訂閱 Claude 與 ChatGPT 並用 coding agent 工作,這份實測能幫你判斷在遊戲開發和 AR 導航類任務上該優先把提示詞投給哪家模型。
原標題:Astra is great, but Opus 5.5 is next level
閱讀原文
| 評分 | 45 / 78(平均 61,門檻 76) |
|---|---|
| 狀態 | 未入選 |
相關報導
Getting the most out of Opus 5.5 in Claude and Claude Code
Anthropic 於 2026 年 9 月發布 Opus 5.5 官方使用指南,作者 Addy Osmani,閱讀時長 9 分鐘。Opus 5.5 相比前代更擅長多步驟長任務,可連續數小時執行大型倉庫改動直至測試通過,且每次回覆前都會自行思考。指南建議一次性交代完整任務並說明完成標準,刪除提示詞中的 think carefully 等語句,在 CLAUDE.md 中寫明何時繼續、何時停下詢問,並讓子代理並行處理審計與遷移。
Opus 5.5 跑 28 分鐘花 6.17 美元生成單檔案
一位使用者用自建 Pi agent 配合 plan mode,以 High 思考檔執行 Opus 5.5,耗時 27 分 45 秒、花費 6.17 美元(主 agent 4.97 美元,design-review agent 1.21 美元),最終產出一個 1,029 行、零依賴的 HTML 檔案。輸出 122,689 tokens,其中 66,163 為思考 tokens;總 tokens 約 600 萬,約 95% 為快取讀取。
Opus 5.5 全自動製作四年 AI 回顧影片
Opus 5.5 幾乎完全自主地製作了一支兩分鐘的“四年 AI 回顧”影片。作者只提供了創意、工作資料夾和音樂檔案,模型自行檢索四年 AI 資料、尋找素材與截圖、編寫 HTML 與動畫程式碼、用 Playwright 渲染場景、用 FFmpeg 合成並加入音效,最終輸出成片。
r/ClaudeAI 熱議 Opus 5.5 被削弱
Reddit 的 r/ClaudeAI 版塊出現熱帖,多數評論者認為 Opus 5.5 已被削弱(發帖人把 nerfed 誤寫成 nerded)。主流猜測是官方先用新模型拉訂閱、隨後降低算力省成本,同時讓下一代模型顯得更強;少數使用者稱模型仍正常甚至仍是最好的模型,品質下滑感來自上下文堆積、未新開對話。有人貼出 nerf 追蹤基準顯示輕微下滑,但被指仍在正常誤差範圍內;也有評論指出 Opus 5.5 發布當天就會說 load-bearing,不能當作降級訊號。
使用者用 Claude Opus 5.5 把 100 分鐘遊戲錄影剪成 50 分鐘成片
一位業餘創作者用 Claude Opus 5.5 完成了整段影片剪輯:自動同步音畫、生成轉錄並據此把 100 分鐘素材剪到 50 分鐘、去除停頓、平衡音量、新增箭頭縮放閃回等效果,還把遊戲棋盤做成獨立畫面並生成動畫箭頭和 YouTube Shorts。整個過程不到一天,幾乎無需人工指導,且完全在 DaVinci 和 Premiere 之外完成。作者認為這不能替代優秀剪輯師的直覺,但對業餘創作者來說效果驚人。