500B token 反編譯遊戲:AI agent 編排的經驗與教訓
作者花 3 個月、約 500B token 讓 AI agent 把一款第一人稱射擊遊戲反編譯成 C++,最終程式碼可讀但語義錯誤。專案同時使用 Claude Max(20x)與 Codex Pro 訂閱,agent 跑在 Claude Code CLI 與 Codex CLI 裡,主力是 Sonnet 5,也用過 Opus 5.5、Luna、Sol、Terra;
依意思最接近的 13 筆
作者花 3 個月、約 500B token 讓 AI agent 把一款第一人稱射擊遊戲反編譯成 C++,最終程式碼可讀但語義錯誤。專案同時使用 Claude Max(20x)與 Codex Pro 訂閱,agent 跑在 Claude Code CLI 與 Codex CLI 裡,主力是 Sonnet 5,也用過 Opus 5.5、Luna、Sol、Terra;
有人稱已反編譯 Adobe 套件,用 Rust 重寫並以開源軟體(OSS)形式發布。訊息來自 jamesomalley.co.uk 的 Bluesky 帖子,隨後被轉到 Hacker News 討論,該條目目前 6 分、1 條評論。原帖未披露涉及哪些 Adobe 應用、程式碼倉庫地址與開源許可證等細節。
REA 是一套接入 coding agent 的逆向工程工具,用 npx rea-agents@latest setup 安裝並連線後,agent 就能檢查程式本身並解釋其行為。官方演示了兩個案例:讀取 Chrome 恐龍游戲執行中的指令碼,取回起始速度 6、每次更新加 0.001、上限 13 的加速規則,並據此重建一個可調速版本;以及分析 Windows Calculator 的 % 按鈕,發現 + 與 × 之後使用不同規則,因此 200 + 10% 得 220。
Mistral AI 展示 Mistral Large 4 處理惡意軟體逆向工程的能力:面對一個未知二進位制樣本,模型端到端完成分析,判定其為 Cobalt Strike,並提取出 IoC 與惡意軟體配置。它還會輸出一份報告,其中包含可用於攔截同類事件的 YARA 規則。官方稱這類「分佈外」調查任務原本可能需要一天的工作量,模型用 12 分鐘完成。
哈佛大學研究者在 700 多家公司、70 萬名員工、3 億條工作事件的資料中發現,AI 程式設計工具並未讓企業軟體產出增加或減少用人,編碼階段省下的時間被下游環節吸收。程式碼審查時長明顯增加,pull request 更常需要返工,審查者留下的評論也更多。研究據此認為人工程式碼審查是 AI 編碼效率的主要瓶頸。
一位開發者撰文稱,AI 輔助程式設計(vibecoding)只把樂趣前置:能快速做出可用原型,但重構和維護階段不再有趣,也缺少手寫程式碼帶來的成就感。他把建造的樂趣分為六種,認為 vibecoding 只能滿足「想到點子」「把點子變成現實」和「解決自己的問題」三類,攻堅後的成就感、作品完成的滿足感與學習樂趣都不會自然產生。他仍用 AI 做出了一些手工做不出來的東西,包括即時野火預警系統、Kobo 資料庫遷移助手和即時音準訓練應用,但表示過程不像自己寫小指令碼那樣好玩。
Google DeepMind 宣布 SynthID Detector 現已向所有人開放,可用來判斷網上內容是否由 AI 生成。該工具除 Google AI 外,還支援檢測 OpenAI、NVIDIA、Kakao 等行業夥伴工具生成的內容,Apple 即將加入。使用者可通過 synthid.com 試用。
一位開發者把 AI Agent 跑在了只有 48MB RAM 的諾基亞 110 功能機上,並已用它自動化了幾個操作。他平時用這部手機來減少螢幕時間,最初嘗試刷入 Android 系統,因記憶體只有 48MB 而失敗,隨後花幾天時間逆向工程,最終讓 AI Agent 在這臺手機上執行。該帖發在 Hacker News 的 Show HN 板塊,目前 15 分、3 條評論,作者未說明所用的是哪個 AI 模型,也沒列出具體自動化了哪些操作。
一位寫了 18 年程式碼的開發者表示,自去年在 Claude Code 中使用 Opus 4.5 後,用自然語言描述需求比手寫程式碼更快,於是徹底停止了手寫程式碼。他所在的 Filestage 團隊月合併 PR 從約 200 增至 300,bug 報告未增加,每位開發者每月 AI 訂閱費 20 美元,工具可自選 Codex、Claude Code 或 Cursor。
OpenCode 發布 v1.18.35,核心改進是新增 canonical redirects,並提供 JSON 與 Markdown 兩種格式的 agent 可讀統計資料。本次修復讓 xAI 的工具呼叫結果可以攜帶受支援的圖片,不支援的圖片格式會被跳過,做法是把 @ai-sdk/xai 升級到 3.0.139。文件方面,Zen 文件新增 Fledge Alpha Free,生態外掛列表加入 opencode-supabase,該版本同時致謝 3 位社群貢獻者。
NDS 開源 Rampart:一個完全在瀏覽器內執行的個人資訊脫敏系統,模型含分詞器僅 14.7MB,WebGPU 下 p50 延遲 3.9ms。它由正則校驗層和 MiniLM 小模型組成,前者處理社保號、信用卡、帳號等結構化資訊,後者識別人名與街道地址。在覆蓋七種語言的 3 萬行 OpenPII 測試集上,私有詞召回率 98.42%,高於約 2.8GB 的 OpenAI Privacy Filter(97.4%)。
一名軟體工程師用 Claude Code 搭建 AI 流水線,在一夜 12 小時內檢索 435 萬頁荷蘭東印度公司檔案與舊報紙,發現一份被遺忘的隕石記錄、三隻未記錄的犀牛和未定位的火山噴發。他把 570 萬段文字轉成語義向量檢索,再用每百萬詞僅幾美分的小型決策模型 Jev 初篩(讀 5.9 萬條大象記錄約 3 美元),由 Claude Haiku 精讀並核對原始掃描頁。靈感來自歷史學家 Benjamin Breen 用 Opus 5.5 找到的 1615 年渡渡鳥目擊記錄。
OpenCode 發布 v1.18.34,主要修復本地編譯的 macOS 二進位制在 macOS 27 及以上系統無法可靠執行的問題,通過對二進位制重新簽名解決。該版本還會在模型請求中傳送帶名稱空間的會話與父會話身份頭,並對 macOS CLI 發布二進位制使用 Developer ID 簽名。此外修正了 GPT 6.1 Sol 快取定價文件和 /status 對話方塊外掛名提取問題。