AISpot

Coding Agent 與開發工具

10月3日星期六 · 31 則

  1. r/ClaudeAI top of the dayAI 評分55

    開發者用 Claude Code 與 Remotion 生成發布影片,帶來 10 位客戶

    一位獨立開發者用 Claude Opus 智慧體(Claude Code)配合 Remotion 製作了 Mac 應用 Tack+ 的發布影片,並因此獲得前 10 位客戶。影片全長 45 秒、60 fps,輸出 1080p 與 4K,含法語和英語版本,全部由程式碼生成,沒有 After Effects、素材庫或授權音樂。智慧體無法直接看影片,就渲染幀聯絡表自行檢查並修正標題重疊、轉場空白等問題,但聲音部分它只能測響度和峰值,無法試聽,需人工把關。

  2. r/ClaudeAI top of the day● 精選AI 評分80

    handoff-compact:自動壓縮前生成交接文件的 Claude Code 外掛

    handoff-compact 是一個 Claude Code 外掛,在 autocompact 觸發時用會話分支生成交接文件並替換原對話,實現無人值守的 handoff + /clear。作者稱長時間無人值守會話中一半 token 花在上下文已超 200k 的輪次上,既貴又因 context rot 降低品質。交接文件包含目標、狀態與驗證依據、下一步、決策與理由、已排除方案、未決問題、檔案與提交、驗證命令及最近 10 條 prompt 原文。

  3. Hacker News front pageAI 評分45

    GitHub 新儀表盤成為預設檢視,可檢視 agent 會話

    GitHub 新儀表盤體驗已從功能預覽轉為所有使用者的預設檢視。它把活躍 agent 會話、issue 和 pull request 集中在一處,每類列表最多顯示 12 項並支援篩選;更新動態移到獨立的 Feed 標籤頁。你還能直接在儀表盤上把 issue 指派給 Copilot coding agent,或在 Copilot Chat 中開啟 pull request。想用回舊版,點選 Preview 旁的下拉選單即可隨時切換。

  4. r/OpenAI top of the dayAI 評分61

    使用者實測:Opus 5.5 編碼能力遠超 Astra

    一位使用者對比 Astra 與 Opus 5.5 後稱,Opus 5.5 在編碼任務上明顯更強。他用約兩頁 A4 的提示詞、二十多次對話就讓 Opus 5.5 完成了一款包含玩法、畫面、音效與音樂的遊戲,全程未寫一行程式碼;在室內導航任務中,Opus 5.5 的掃描與追蹤準確,而 Astra 開箱即用效果很差,他給出 9/10 對 2/10 的評價。不過 Claude 會頻繁提示工具使用過多或任務未完成,且超出用量限制後完全無法使用。

  5. Latent Space● 精選AI 評分85

    GPT-6.1 Sol 發布,Sonnet 5.5 登頂 Agent Arena

    OpenAI 發布 GPT-6.1 Sol,定價 $2/$10 每百萬輸入/輸出 token,比 Astra 的 $10/$50 便宜約 80%,在 DeepSWE v1.1 上比 GPT-6 Sol 高 6.4 分。Sonnet 5.5 在 Agent Arena 首秀排第 3 並在 Chat 類別登頂,Anthropic 包攬前三;Sol 每任務中位成本 $0.56,比 GPT-6 Sol 便宜 39%。

  6. Hacker News front pageAI 評分70

    Offrun:一個工作區管理所有 coding agent

    Offrun 是一個統一工作區,用來管理多個 coding agent,並加入第二 agent 做 peer review:在你檢視 diff 之前先審閱,發現的問題會出現在聊天裡,此時改動尚未提交。你可以要求修復,修復內容會先進入訊息框供你確認,不會自動合併。它執行在你自己的 agent 帳號上,不需要額外訂閱,也不會在 pull request 上放機器人。

  7. r/ClaudeAI top of the dayAI 評分58

    Opus 5.5 新 Skill 把 PDF 變成動畫互動網頁書

    有人用 Opus 5.5 加一個 Skill 把 PDF 轉成帶動畫、旁白和互動測驗的網頁書,流程是 PDF→書籍規劃→分鏡→旁白→動畫與測驗→網頁書。目前只靠 Opus 5.5,沒有接入影像模型,直接喂 PDF 效果已相當好;作者計劃加入影像模型以支援繪本和人文紀錄片。專案已開源(MIT),並提供了線上書架。

  8. r/LocalLLaMA top of the dayAI 評分51

    Qwen3.8-Flash-Next 177B 在單張 RTX 5070 12GB 上跑到 11–15 tok/s

    有人在 Windows 上用 llama.cpp 的專家流式方案,在單張 RTX 5070 12GB 加 32GB DDR4-2400 記憶體上跑 Qwen3.8-Flash-Next 177B(UD-IQ3_XXS),基準約 11.5 tok/s,日常對話 14–15 tok/s,比原方案約 7 tok/s 提升明顯。一次長編碼提示以 10.15 tok/s 生成 4,892 個 token,產出一個可執行的單檔案貪吃蛇遊戲。

  9. r/LocalLLaMA top of the day● 精選AI 評分79

    llama.cpp 新 PR 將 Qwen 索引器視訊記憶體減半

    llama.cpp 的 PR #29825 把 Qwen Flash Next 的 indexer score 視訊記憶體佔用減半,例如 131072 上下文、ub 2048 時從 3.0 GiB 降到 1.5 GiB,262144 上下文、ub 4096 時從 11.7 GiB 降到 5.6 GiB。作者稱 logits 完全一致,僅分數因 fp32 舍入有差異,pp/tg 速度不變,test-llama-archs 通過。

  10. r/ClaudeAI top of the dayAI 評分36

    用 Claude Opus 5.5 生成成都定製旅行小志

    一位使用者用 Claude Opus 5.5 規劃成都旅行,通過對話說明偏好後,讓模型調研並輸出可列印的小志(zine)。最終得到 9 份主題小志,每份一張 A3 紙,外加一張標註感興趣街區的地圖,內容按具體出行日期定製,涉及活動、票務和交通。使用者稱效果不錯但非完美:模型過早固定了每主題一頁的格式,導致部分內容偏冗長、部分偏簡略。全程在瀏覽器中用 20 美元套餐完成,對話部分用較低設定、生成部分用最高設定,最終 PDF 生成約消耗兩個半 5 小時使用額度。

  11. r/LocalLLaMA top of the dayAI 評分33

    mlsubgen 本地生成 45 種語言字幕,僅支援 Linux 與 NVIDIA

    mlsubgen 是一個完全在本機執行的字幕生成工具,支援 45 種語言,但僅限 Linux 和 NVIDIA 顯示卡。它按語音片段而非整檔案檢測語言,可處理混合語言素材;同時執行兩個語音識別器並由本地 LLM 調和結果,且優先使用檔案內嵌字幕(包括藍光 PGS 點陣圖字幕的 OCR),無字幕可讀時才轉錄音訊。作者在 24 GB RTX A5000 上執行,提供 16、12、8 GB 視訊記憶體配置,需 16–32 GB 系統記憶體和 30–65 GB 模型儲存;

  12. llama.cpp releases● 精選AI 評分80

    llama.cpp 為投機解碼加入機率取樣與拒絕取樣

    llama.cpp 合併 PR #27694,把 simple draft 與 MTP 的投機解碼改為機率取樣,目標模型用拒絕取樣驗證草稿 token。新增開關控制機率草稿取樣,預設仍為貪心;語法約束請求回退到 argmax,並支援在拒絕取樣中處理語法約束。同時修復了草稿取樣器與目標模型共用 rng 流、掩碼後分布未重歸一化等問題,並隨草稿一起截斷候選。

  13. r/ClaudeAI top of the dayAI 評分65

    Claude Code 通過 MCP 當上 RPG 遊戲主持人

    開發者用 Claude Code 建置了 RPG 世界引擎 Chronicle,現在通過 MCP 讓 Claude Code 直接當遊戲主持人。在私人世界貼上一條 claude mcp add 命令並附帶 token,即可把 chronicle-storyteller 子代理裝進 ~/.claude/agents,之後由 Claude Code 接管回合;Chronicle 自身不呼叫模型,因此複用你已付費的 Claude 方案。

  14. llama.cpp releasesAI 評分58

    llama.cpp 修復 qkx3 量化縮放搜尋的非法舍入

    llama.cpp 合併 PR #29817,在 qkx3 量化級別送入 nearest_int 前先鉗制到 [0, nmax],避免 imatrix 縮放搜尋產生無窮、NaN 或越界值時觸發 Debug 建置斷言。該問題由 #29804 報告,修復同時為 q2_K、q4_K、q5_K、q4_1、q5_1 的退化 imatrix 分組補充迴歸測試。合法範圍內的取值行為不變,macOS Apple Silicon(arm64)等預編譯包已隨本次發布更新。

  15. r/ClaudeAI top of the dayAI 評分40

    使用者用 Claude Project 做單任務待辦,ADHD 場景下跑通

    一位使用者把 Claude Project 改造成只顯示單個任務的待辦系統,規則是 Claude 永不展示完整清單。做法是把腦中所有事情無序丟進對話,Claude 排序後只給出第一件事並附時間限制,到時在同個對話裡提醒並推送下一件;夜間生成報告,記錄已完成、等待他人、順延到明天的事項及預估與實際耗時。作者稱這是自己第一天之後唯一堅持下來的方案,但明確表示它只排序、不減少任務量。

  16. Hacker News front pageAI 評分25

    Google Maps Scraper MCP 上線,agent 可直查商戶資料

    Google Maps Scraper MCP 是一個遠端 Model Context Protocol 伺服器,讓相容的 AI agent 直接搜尋商戶並拿到結構化結果。它通過 https://gmapscrawl.com/api/mcp 提供無狀態 Streamable HTTP 介面,用 Bearer API key 認證,單次最多返回 20 家商戶的地址、聯絡方式、評分與評論數。

  17. r/LocalLLaMA top of the dayAI 評分30

    MegaCapybara 發布:RTX5090 上跑 Qwen3.8 27B 的推理引擎

    MegaCapybara 是專為 RTX5090 打造的推理引擎,聚焦 Qwen3.8 27B,解碼速度約為此前 SOTA 引擎 Ninfer 的兩倍:單路編碼可達 500+ t/s,12 個 agent 併發、800k 上下文時可達 2000+ t/s。它自帶權重格式與後設資料,載入前會展示各量化設定相對 BF16 的 KL 與 top-1% 損失,並支援智慧 VRAM-RAM-DISC 快取、Loop Guard 與圖形介面。採用 MIT 許可,原始碼與權重建置器稍後發布。

  18. r/ClaudeAI top of the dayAI 評分21

    開發者用 Claude 一週做出飛艇版 FTL 遊戲

    一位開發者用 Claude 200 美元月費方案和 GPT 100 美元月費方案,在一週內做出了一款類似 FTL 的飛艇策略遊戲 Magehold: Fairwinds,目前可在 mageholdworld.com 免費試玩,幾週後登陸 Steam。遊戲支援 Linux 和 Mac,含 7 種語言本地化和 100 個 Steam 成就,Claude 還生成了美術資產、測試機器人和預告片。作者稱整體迭代 30 多次,後續將加入分支任務鏈和天氣效果。

  19. r/ClaudeAI top of the dayAI 評分40

    Opus 5.5 跑 28 分鐘花 6.17 美元生成單檔案

    一位使用者用自建 Pi agent 配合 plan mode,以 High 思考檔執行 Opus 5.5,耗時 27 分 45 秒、花費 6.17 美元(主 agent 4.97 美元,design-review agent 1.21 美元),最終產出一個 1,029 行、零依賴的 HTML 檔案。輸出 122,689 tokens,其中 66,163 為思考 tokens;總 tokens 約 600 萬,約 95% 為快取讀取。

  20. TechCrunch AIAI 評分43

    Meta 開源 Muse Gadgets,可自建硬體接入 Muse

    Meta 推出開源專案 Muse Gadgets,開發者可用官方開源韌體和 Linux SDK 自製硬體連線其個人 AI 助手 Muse,支援樹莓派、ESP32 等開發板,接入螢幕、按鈕、感測器與執行器。Meta 還免費發放 5000 臺 Muse Home Link(USB-C 供電,讓 Muse 連線家庭網路並控制智慧音箱、電視),限 Muse 訂閱者先到先得,預計數週內發貨。

  21. r/ClaudeAI top of the dayAI 評分29

    使用者求助:如何把 Claude 用到極致並搭建自動化生活系統

    一名大學生在 Reddit 發帖,稱自己每天用 Claude Pro 和 Claude Code,但感覺只發揮了其能力的一小部分。他列舉了當前用法:用 Claude Code 無程式設計背景搭建 DuckDB 分析資料庫、連線 Gmail/Calendar/GitHub/Drive/Notion、用 Otter 錄音後讓 Claude 提取要點,同時抱怨反覆重述上下文、未用 Claude Projects、Cowork、定時任務和 Chrome 擴充套件。

  22. llama.cpp releases● 精選AI 評分68

    llama.cpp 新增 /v1/systemone API,支援 laya 等 5 個模型

    llama.cpp 發布 b11361,在 server 中新增 /v1/systemone API,支援 laya、julia-1、lev、openjev、kev 五個模型,並附帶模型轉換指令碼。該版本加入了共享 prompt 字首與視覺輸入支援,新增用於測試的小模型 openjev tiny,文件中明確說明不支援 date_facts。macOS Apple Silicon(arm64)建置正常,但啟用 KleidiAI 的 arm64 版本被標記為 DISABLED;

  23. r/LocalLLaMA top of the dayAI 評分37

    LocalLLaMA 討論 jev 分類模型的實際使用體驗

    r/LocalLLaMA 使用者分享 jev 系列分類模型(classifier)的真實用例:有人用 jev-reviewer 定位論文證據、避免引用幻覺,有人用 is-malicious 掃描 GitHub 倉庫與 PR 的惡意行為,還有人用 decider 4b 替代 Gemma 雙階段流程,把語音 RPG 延遲從 4-8 秒降到 2-3 秒。

10月2日星期五 · 9 則

  1. X @OpenAIDevs● 精選AI 評分76

    @OpenAIDevs: Your dot learns how you work, keeps context across apps, coordinates Codex tasks, and flags what ne…

    OpenAI 開發者帳號發布 dot,它能學習使用者的工作方式、跨應用保留上下文、協調 Codex 任務,並標記需要使用者關注的事項。目前官方只給出這四項能力描述,未公布定價、可用平台與上線時間。

  2. X @OpenAIDevsAI 評分17

    @OpenAIDevs

    OpenAI 開發者帳號 @OpenAIDevs 在 2026 年 10 月 2 日發布了一條 X 帖子,正文只有一個指向 X 文章(x.com/i/article/2106076978206175232)的連結,沒有附帶任何文字說明。目前公開可見的資訊僅此一條連結,文章的具體內容、涉及的產品或發布時間均未在帖子正文中披露。

  3. r/ClaudeAI top of the dayAI 評分55

    使用者用 Claude Opus 5.5 把 100 分鐘遊戲錄影剪成 50 分鐘成片

    一位業餘創作者用 Claude Opus 5.5 完成了整段影片剪輯:自動同步音畫、生成轉錄並據此把 100 分鐘素材剪到 50 分鐘、去除停頓、平衡音量、新增箭頭縮放閃回等效果,還把遊戲棋盤做成獨立畫面並生成動畫箭頭和 YouTube Shorts。整個過程不到一天,幾乎無需人工指導,且完全在 DaVinci 和 Premiere 之外完成。作者認為這不能替代優秀剪輯師的直覺,但對業餘創作者來說效果驚人。

  4. r/ClaudeAI top of the dayAI 評分32

    在 Blender 裡用 Claude Opus 5.5 畫草圖比寫提示詞更高效

    一位使用者在 Blender 中使用 Claude Opus 5.5 做 blockout 時發現,直接畫出空間意圖比用文字描述形狀更高效,因為文字擅長說明是什麼,卻不擅長表達位置、大小和數量。整個實驗共消耗 33M tokens,API 成本 16.07 美元,執行 48.5 分鐘,貼圖與夜空素材來自 Poly Haven 的 CC0 資源。作者因此不再用文字描述形狀,而是給 Claude 提供繪圖或空間參考。

  5. Google Developers blogAI 評分64

    Google Antigravity SDK 新增本地模型與 Ollama 支援

    Google Antigravity SDK 現在支援在本地離線執行 agentic 工作流,可通過 LiteRT 執行 Gemma 4 26B A4B 等模型。SDK 還提供對 Ollama、vLLM 等 OpenAI 相容推理服務的開箱支援,便於搭建隱私優先的本地工具。官方描述的混合編排方式是:雲端模型只做輕量規劃器,程式碼審計、打補丁這類消耗大量 token 的任務交由裝置上的本地模型處理。

  6. Meta AI blog● 精選AI 評分81

    Meta 發布 Muse Spark 1.1 多模態推理模型,開放 API 公測預覽

    Meta Superintelligence Labs 於 7 月 9 日發布 Muse Spark 1.1,是 Muse Spark 的多模態推理升級版,主打 agentic 任務,在工具與計算機使用、編碼、多模態理解上提升明顯。模型可主動管理 100 萬 token 上下文,能作為主代理編排並行子代理,在 OpenCode 中演示了自動截圖定位並修復 bug。

  7. Kimi blog● 精選AI 評分83

    Kimi K2.6 開源,主打長程編碼與 agent swarm

    Kimi K2.6 已開源,可通過 Kimi.ai、Kimi App、API 和 Kimi Code 使用,主打長程編碼、長時間執行與 agent swarm。官方稱其在內部 Kimi Code Bench 上較 K2.5 顯著提升:一個案例是在 Mac 上用 Zig 實現並最佳化推理,4000+ 次工具呼叫、連續執行 12 小時、14 輪迭代後吞吐從約 15 升至約 193 tokens/sec,比 LM Studio 快約 20%;

更早的內容