AISpot

Coding Agent 與開發工具

近期事件

  1. 1
    熱度 1.54 個來源 · 4 則10/2 23:40
  2. 2
    熱度 1.23 個來源 · 3 則10/3 01:45
  3. 3
    熱度 1.12 個來源 · 2 則10/3 12:28
  4. 4
  5. 5
    熱度 1.02 個來源 · 2 則10/3 16:36

10月4日星期日 · 2 則

  1. llama.cpp releases● 精選AI 評分63

    llama.cpp 為 WebGPU 後端加入 f16 支援

    llama.cpp 在 WebGPU 後端為 fill/set_rows 操作加入 f16 支援(PR #29897),併發布 b11382 版本。該版本覆蓋 macOS Apple Silicon、iOS、Linux、Android、Windows 等平台,其中 macOS Apple Silicon 的 KleidiAI 建置被停用。對使用 WebGPU 推理的使用者,f16 支援可減少視訊記憶體佔用並提升相容性。

    推薦理由:你準備用 Mac Studio 跑本地模型,llama.cpp 的 WebGPU 後端改進會直接影響瀏覽器或跨平台推理的 f16 效能與記憶體佔用。

  2. Simon Willison● 精選AI 評分70

    AWS 與 Google Cloud 推出硬性預算上限

    AWS 在 9 月 16 日推出月度支出上限功能,專案用量達到上限後當月暫停;Google Cloud 則在 7 月上線 Spend Caps,可對專案內特定服務設定月度財務上限。作者認為按量付費的 API 與託管服務應預設開啟硬性預算上限,而非只發警告郵件,因為 coding agent 會大幅降低啟動付費服務的門檻,可能在你睡覺時燒掉數百甚至上萬美元。AWS 該功能目前僅向少量客戶開放,尚未全面可用。

    推薦理由:你同時訂閱多家按量付費服務並用 coding agent 自動寫程式碼,預設硬性預算上限能防止 agent 失控呼叫 API 或部署服務時產生意外賬單,選型時可優先考慮已支援該功能的雲廠商。

10月3日星期六 · 14 則

  1. Hacker News front page● 精選AI 評分88

    Getting the most out of Opus 5.5 in Claude and Claude Code

    Anthropic 於 2026 年 9 月發布 Opus 5.5 官方使用指南,作者 Addy Osmani,閱讀時長 9 分鐘。Opus 5.5 相比前代更擅長多步驟長任務,可連續數小時執行大型倉庫改動直至測試通過,且每次回覆前都會自行思考。指南建議一次性交代完整任務並說明完成標準,刪除提示詞中的 think carefully 等語句,在 CLAUDE.md 中寫明何時繼續、何時停下詢問,並讓子代理並行處理審計與遷移。

    推薦理由:你日常用 Claude Code 跑 coding agent,這份指南直接給出 Opus 5.5 的提示詞寫法、CLAUDE.md 停止規則與子代理拆分方式,可立刻套用到現有工作流。

  2. r/OpenAI top of the day● 精選AI 評分80

    OpenAI 發布 GPT-6 系列模型指南

    OpenAI 發布了 GPT-6 系列的模型指南,內容涵蓋模型選擇、推理強度(reasoning effort)與工具使用。該指南面向使用 GPT-6 系列的開發者,幫助其在具體場景中決定選哪個模型、投入多少推理算力以及如何呼叫工具。原文未披露具體模型型號、引數或發布時間等細節。

    推薦理由:你日常用 Codex 等 coding agent 並訂閱 ChatGPT,這份官方指南可直接用來調整模型選擇與推理強度,最佳化日常開發中的成本與效果。

  3. llama.cpp releases● 精選AI 評分78

    llama.cpp 修復 Ling 3.0 解析器對 json_schema 的支援

    llama.cpp 合併 PR #29813,讓 Ling 3.0 解析器支援 inputs.json_schema,此前 response_format 請求不受約束。新邏輯為回應格式語法路徑優先於工具呼叫,啟用思考時要求 JSON 前有 think 塊,且 JSON 後不允許尾隨文字。該修復對應 issue #29652,由 Claude Opus 5.5 輔助完成。

    推薦理由:你在本地跑開源模型並可能用結構化輸出,這個修復直接決定 Ling 3.0 在 llama.cpp 上的 JSON 約束是否可靠。

  4. llama.cpp releases● 精選AI 評分77

    llama.cpp 修復圖重分配導致的排程中止

    llama.cpp 合併 PR #29856,把 build_rs 中分散的 get_rows 合併為一次收集全部 n_rs 個 recurrent states,使預留空間按 n_rs 最大值計算,避免 ubatch 單元不連續時在節點數不變的情況下觸發圖重分配、進而在 GGML_SCHED_NO_REALLOC 下中止。

    推薦理由:你在 Mac Studio 上用 llama.cpp 或 MLX 跑本地模型時,這類排程中止會直接讓長上下文或多序列推理崩掉,升級到 b11375 可避開該問題。

  5. llama.cpp releases● 精選AI 評分72

    llama.cpp 最佳化 lightning indexer 視訊記憶體與多後端支援

    llama.cpp 合併了 qwen4exp 的 lightning indexer 最佳化,把索引器打分視訊記憶體減半:原先同時存在兩個 [n_pool, n_idx_h, n_tokens] f32 張量,現在每個 head 單獨計算並原地累加進一個 [n_pool, n_tokens] 分數。同時 CUDA 支援 4 heads、Metal 用函式常量傳 head 數、Vulkan 按 keys×tokens 分塊並向量化 fp16 點積。

    推薦理由:你在 Mac Studio 上跑本地模型時,長上下文視訊記憶體佔用和 Metal/Vulkan 後端效能會直接受益,升級 llama.cpp 即可獲得這些最佳化。

  6. r/OpenAI top of the day● 精選AI 評分77

    OpenAI API 帳戶與 Codex 積分疑似被重置

    一名使用者報告其長期使用的 OpenAI API 帳戶和 Codex 20x 帳戶同時出現異常:Codex 的 60,000 積分在一次重新整理後歸零,API 帳戶則顯示為全新狀態,無發票、無呼叫記錄、無餘額。該使用者還發現組織 ID 已變更,與其歷史賬單郵件中的 ID 不一致,且其帳戶一直是個人帳戶、未建立過其他組織。目前尚無官方回應或其他使用者報告類似情況。

    推薦理由:如果你同時使用 OpenAI API 和 Codex,需要留意帳戶積分與組織 ID 是否被意外重置,並保留歷史賬單作為憑證。

  7. r/ClaudeAI top of the day● 精選AI 評分80

    handoff-compact:自動壓縮前生成交接文件的 Claude Code 外掛

    handoff-compact 是一個 Claude Code 外掛,在 autocompact 觸發時用會話分支生成交接文件並替換原對話,實現無人值守的 handoff + /clear。作者稱長時間無人值守會話中一半 token 花在上下文已超 200k 的輪次上,既貴又因 context rot 降低品質。交接文件包含目標、狀態與驗證依據、下一步、決策與理由、已排除方案、未決問題、檔案與提交、驗證命令及最近 10 條 prompt 原文。

    推薦理由:你常用 Claude Code 跑長會話,這個外掛能在 autocompact 時自動完成 handoff + /clear,幫你省 token 並緩解上下文退化。

  8. Latent Space● 精選AI 評分85

    GPT-6.1 Sol 發布,Sonnet 5.5 登頂 Agent Arena

    OpenAI 發布 GPT-6.1 Sol,定價 $2/$10 每百萬輸入/輸出 token,比 Astra 的 $10/$50 便宜約 80%,在 DeepSWE v1.1 上比 GPT-6 Sol 高 6.4 分。Sonnet 5.5 在 Agent Arena 首秀排第 3 並在 Chat 類別登頂,Anthropic 包攬前三;Sol 每任務中位成本 $0.56,比 GPT-6 Sol 便宜 39%。

    推薦理由:Sol 把前沿模型價格壓到 $2/$10,直接影響你用 Codex 與 Claude Code 的成本結構;llama.cpp 與 Ollama 的新端點則關係到你 Mac Studio 本地推理的選型。

  9. llama.cpp releases● 精選AI 評分62

    llama.cpp 發布 b11370,CUDA 後端將共享專家融合進 MMVQ

    llama.cpp 發布建置版本 b11370,CUDA 後端新增將共享專家(shared experts)融合進 MMVQ 的改動(#29184),並修復緩衝區空值檢查、把 stride_col_dst 移入融合引數。

    推薦理由:你準備用 Mac Studio 本地跑開源模型,這次 CUDA 側的 MoE 融合最佳化雖不直接作用於 Apple Silicon,但能幫你判斷 llama.cpp 各後端迭代節奏,並留意 macOS 建置中 KleidiAI 被停用對 MLX 之外推理路徑的影響。

  10. r/LocalLLaMA top of the day● 精選AI 評分79

    llama.cpp 新 PR 將 Qwen 索引器視訊記憶體減半

    llama.cpp 的 PR #29825 把 Qwen Flash Next 的 indexer score 視訊記憶體佔用減半,例如 131072 上下文、ub 2048 時從 3.0 GiB 降到 1.5 GiB,262144 上下文、ub 4096 時從 11.7 GiB 降到 5.6 GiB。作者稱 logits 完全一致,僅分數因 fp32 舍入有差異,pp/tg 速度不變,test-llama-archs 通過。

    推薦理由:你準備用 Mac Studio 跑本地模型,這項改動能直接降低長上下文推理的視訊記憶體佔用,讓更多層留在 GPU 上。

  11. llama.cpp releases● 精選AI 評分80

    llama.cpp 為投機解碼加入機率取樣與拒絕取樣

    llama.cpp 合併 PR #27694,把 simple draft 與 MTP 的投機解碼改為機率取樣,目標模型用拒絕取樣驗證草稿 token。新增開關控制機率草稿取樣,預設仍為貪心;語法約束請求回退到 argmax,並支援在拒絕取樣中處理語法約束。同時修復了草稿取樣器與目標模型共用 rng 流、掩碼後分布未重歸一化等問題,並隨草稿一起截斷候選。

    推薦理由:你正為 Mac Studio 評估本地推理,這條改動直接影響 llama.cpp 在 Apple Silicon 上投機解碼的取樣正確性與速度,值得在選型時納入測試。

  12. X @ollama● 精選AI 評分67

    Cloudflare 決策模型 Clef 上線 Ollama

    Cloudflare 的決策模型現已在 Ollama 上提供,可用於影像分類、給 bug 報告打標籤或把支援工單路由到正確團隊。共兩個型號:Clef(27B)用 ollama pull clef 拉取,Clef Flash(9B)用 ollama pull clef-flash 拉取。

    推薦理由:你正準備用 Mac Studio 跑本地模型,這兩個 9B/27B 模型可直接用 Ollama 拉取,正好用來試 Apple Silicon 上的本地推理。

  13. llama.cpp releases● 精選AI 評分80

    llama.cpp 為 Metal 加入 F16 KV 的 tensor API flash attention 核心

    llama.cpp 合併 PR #29570,在 Metal 後端新增基於 tensor API 的 flash attention 核心,支援 F16 KV 快取。同一批提交還補充了 DK=DV=512、DK=576/DV=512、DK=192/DV=128 等形狀的 tensor FA 核心,並支援 attention sinks、ALiBi 與 logit softcap。

    推薦理由:你準備用 Mac Studio 跑本地開源模型,這條直接關係到 Apple Silicon 上長上下文推理的視訊記憶體佔用與速度,可等新版 llama.cpp 發布後實測對比 MLX 與 Ollama 的表現。

  14. llama.cpp releases● 精選AI 評分68

    llama.cpp 新增 /v1/systemone API,支援 laya 等 5 個模型

    llama.cpp 發布 b11361,在 server 中新增 /v1/systemone API,支援 laya、julia-1、lev、openjev、kev 五個模型,並附帶模型轉換指令碼。該版本加入了共享 prompt 字首與視覺輸入支援,新增用於測試的小模型 openjev tiny,文件中明確說明不支援 date_facts。macOS Apple Silicon(arm64)建置正常,但啟用 KleidiAI 的 arm64 版本被標記為 DISABLED;

    推薦理由:你正打算在 Apple Silicon 上用 llama.cpp 跑本地模型,這次 server 新增的 systemone API、共享 prompt 字首與視覺支援,以及 KleidiAI 建置被停用的情況,都直接影響你本地推理服務的選型與部署。

10月2日星期五 · 13 則

  1. X @OpenAIDevs● 精選AI 評分76

    @OpenAIDevs: Your dot learns how you work, keeps context across apps, coordinates Codex tasks, and flags what ne…

    OpenAI 開發者帳號發布 dot,它能學習使用者的工作方式、跨應用保留上下文、協調 Codex 任務,並標記需要使用者關注的事項。目前官方只給出這四項能力描述,未公布定價、可用平台與上線時間。

    推薦理由:你日常用 Codex 和 Claude Code 等 coding agent,dot 若能跨應用保留上下文並統一排程 Codex 任務,可能減少你在多個工具間手動搬運上下文的開銷,值得關注後續是否開放試用。

  2. Claude Code releases● 精選AI 評分84

    Claude Code 2.1.288 修復恢復會話丟失上下文與超時中斷問題

    Claude Code 發布 v2.1.288。修復了長對話報「Prompt is too long」卻不自動壓縮、--resume 丟失剛被壓縮恢復的檔案與上下文、恢復的會話不儲存該輪最後回覆,以及回應中途 API 超時導致整輪失敗——非互動會話與子代理現在會從部分回應繼續,僅有思考內容的回應會重試。

    推薦理由:你日常依賴 Claude Code 跑長會話與子代理,這些修復直接避免 --resume 丟上下文和超時中斷整輪工作,值得儘快升級。

  3. r/LocalLLaMA top of the day● 精選AI 評分80

    微軟發布 4B 智慧體模型 FrogNano,主打倉庫級編碼

    微軟發布 FrogNano-4B-2609,一個面向算力有限開發者的 4B 智慧體模型,Hugging Face 上已有 GGUF 量化版本。它由 Qwen3.5-4B 派生,沿用 32 層混合 Gated DeltaNet 與門控注意力架構,後訓練為純文字、聚焦倉庫級軟體工程,用強化學習在約 1500 個 TaskPilot 生成的合成 SWE 環境上訓練,獎勵來自可執行測試,配套五工具的 Leaf harness。與行為蒸餾不同,它不訓練強模型的解題軌跡。

    推薦理由:你可以用它的 GGUF 在 Mac Studio 上本地跑一個 4B 倉庫級編碼智慧體,但補丁必須自己審查。

  4. Ollama releases● 精選AI 評分75

    Ollama v0.35.1 接入 Cloudflare 決策模型 Clef 與 Clef Flash

    Ollama v0.35.1 新增對 Cloudflare 開源決策模型 Clef(27B)與 Clef Flash(9B)的支援,通過 /v1/systemone 呼叫。兩者支援多模態,請求可同時傳入圖片與文字 state,所有 questions 共享該狀態並聯合打分,返回如 noul 機率 0.958 的答案。

    推薦理由:你在 Mac Studio 上本地跑開源模型時,可以直接用 Ollama 試這兩個多模態決策模型,並留意 llama.cpp 與 MLX 引擎更新對 Apple Silicon 推理的影響。

  5. Google AI blog● 精選AI 評分68

    Google 發布 Gemini 4 Argon,100 萬 token 輸出上限

    Google 9 月發布新前沿模型 Gemini 4 Argon,擁有業界領先的 100 萬 token 輸出上限,面向編碼、網路安全防禦、金融研究與法律起草等重負載任務;目前僅通過 Fairwind Program 向受信任的網路安全防禦者開放,尚未放開給開發者、企業和消費者。

    推薦理由:你日常靠 Claude Code、Codex、OpenCode 跑 agent,可直接在 AI Studio 或 Gemini API 上試 Gemini 3.8 Flash 的 agentic 與長週期編碼表現,而 Argon 因僅限 Fairwind 防禦者計劃,暫時和你無關…

  6. X @ggerganov● 精選AI 評分82

    llama.cpp 上線 Decision 模型與 /v1/systemone 端點

    llama.cpp 最新建置已支援 Decision 模型,新增 /v1/systemone 端點,可在本地高效、私密地做 Jev 風格推理。該端點支援多個開源模型,後續還會增加。

    推薦理由:你正打算用 Mac Studio 跑本地開源模型,這條更新直接關係到 llama.cpp 的可用能力與端點用法。

  7. Cloudflare blog (AI)● 精選AI 評分65

    Cloudflare 在 AI Gateway 推出 Web Search API

    Cloudflare 宣布與 Ceramic.ai、Exa、Linkup 三家搜尋服務商合作,在 AI Gateway 上推出 Web Search API,讓 agent 先搜尋再作答,而不是猜 URL 後 curl 出 404。開發者可通過標準 REST 介面呼叫,或在 Workers 裡用一行程式碼繫結,未來還將作為內建 Server Tools 提供。

    推薦理由:你日常用 Claude Code、Codex 這類 agent 查最新文件和 API 時,可以用它替代靠猜 URL 的抓取,並用已有的 AI Gateway 額度與 BYOK 統一計費和觀測。

  8. NVIDIA blog● 精選AI 評分72

    NVIDIA DGX Spark 增 64GB 版,10 月 23 日 4999 美元起

    NVIDIA DGX Spark 將新增 64GB 統一記憶體版本,10 月 23 日由 Acer、ASUS、Dell、Gigabyte、HP、MSI 開賣,起價 4999 美元,保留 GB10 Grace Blackwell 晶片、DGX OS 與完整 NVIDIA AI 軟體棧,可完全本地執行最高 1000 億引數模型。兩臺機器可用 QSFP 線經 ConnectX-7 直連,記憶體池化到 128GB,模型上限提到 2000 億引數;

    推薦理由:如果你在 Mac Studio 之外考慮本地跑開源模型,這是同價位可對比的 CUDA 方案,且開箱即支援 Ollama、llama.cpp、LM Studio,並能一鍵把本地模型接給 OpenCode 用。

  9. X @deepseek_ai● 精選AI 評分75

    DeepSeek 發布 Harness 桌面版,支援 macOS 與 Windows

    DeepSeek 推出 DeepSeek Harness 的打包桌面版,覆蓋 macOS 與 Windows,Linux 使用者可通過 npm 上的 @deepseek-ai/dsh 包獲取。官方在社交平台公布了這一訊息,並給出下載地址 deepseek.com/harness。

    推薦理由:你日常用 coding agent 工作,又多平台切換,可以先在 macOS 上裝一份 Harness 桌面版,評估它能否補進現有 Claude Code、Codex、OpenCode 的工作流。

  10. Latent Space● 精選AI 評分79

    Pi 1.0 與 Pi Durable 發布,Pi 移植到 TypeScript

    Pi 1.0 與 Pi Durable 同日發布並登上 Hacker News 首頁,Pi 已加入 Earendil。Pi 1.0 新增 Codemode(原生支援 MCP、Jev 和影像模型)、虛擬模型擴充套件、延遲工具載入、Anthropic 模型快取預熱、對話中途系統訊息、新 TUI 主題與預設全屏。Pi Durable 把 Pi 移植到 TypeScript 並外接全部有狀態元件:每步記錄為檢查點任務,程序失敗或重啟後 agent 與子 agent 自動恢復;

    推薦理由:你天天用 Claude Code、Codex、OpenCode,Pi Durable 的檢查點崩潰恢復、並行分支會話和工具熱替換正對長時 agent 任務的痛點,TypeScript 化後也更容易在本地或雲端自建執行。

  11. Latent Space● 精選AI 評分67

    Latent Space 播客:MIT 的 Alex Zhang 談 RLM 與 agent swarm

    Latent Space 最新一期播客請到 MIT 的 Alex Zhang,聊遞迴語言模型(RLM)、AI 寫 GPU kernel 與多智慧體 swarm。據他介紹,基於 RLM 的 harness 是首個接近解出 ARC-AGI-3 的方案,早於 OpenAI 的 Astra;他還談到 OpenAI 的 1 萬 agent、1300 億輸出 token、約合 4000 萬美元的問題求解實驗。

    推薦理由:你每天用的 Claude Code、Codex 本質就是 harness,這期直接講 harness 設計、context offloading 與持久化 subagent,對自建 agent 流程和本地跑開源模型都有參考價值。

  12. OpenRouter announcements● 精選AI 評分62

    OpenRouter 上線 Model Router Benchmarks 路由器評測頁

    OpenRouter 推出 Model Router Benchmarks 頁面,用品質、速度、成本三個維度對比各家模型路由器,併合成 0 到 10 分的 Router Index。預設權重是品質 60%、每任務時間 20%、成本 20%,頁面上可拖動滑塊自行調整。

    推薦理由:你同時用 Claude Code、Codex、OpenCode 且按量付費,可以先在這頁看清各家路由器在品質、延遲與成本之間的取捨,再決定是否把模型換成路由器來省錢。

  13. NVIDIA blog● 精選AI 評分86

    OpenAI 上線 GPT-6 Astra Ultrafast,跑在 NVIDIA Blackwell 上

    GPT-6 Astra Ultrafast 已上線,執行在 NVIDIA Blackwell GPU 上,面向 OpenAI 內部以及符合條件的 ChatGPT Work 和 Codex 使用者開放,token 生成速度最高可達 Astra Standard 模式的 8 倍。開發者今天就能通過 API 呼叫,接入方式、定價與實現細節見官方 Ultrafast 指南。更快的生成可縮短 coding agent 的編輯—測試—除錯迴圈,減少工具呼叫之間的等待時間。

    推薦理由:你日常用 Codex,可對照這條訊息看是否符合條件走 ChatGPT Work/Codex 入口,或直接用 API 實測更快生成對 agent 編輯—測試—除錯迴圈的實際提速。

10月1日星期四 · 3 則

  1. Claude Code releases● 精選AI 評分78

    Claude Code v2.1.287 新增 Claude Mods 與 You should know 外掛

    Claude Code 發布 v2.1.287:新增 Claude Mods,外掛可以修改更深層行為;並內建 You should know,由側邊 agent 監視你或 Claude 可能遺漏的內容,用 /plugin enable cc-plugin-you-should-know@builtin 開啟(需第一方會話且開啟遙測)。agents 檢視新增 n:<text> 過濾器匹配會話名與任務;

    推薦理由:可以用 /plugin enable cc-plugin-you-should-know@builtin 給日常 Claude Code 會話加一層側邊 agent 複核,同時注意自建 MCP 伺服器升級後可能需要補上 bareElicitationCapability 才不會斷…

  2. Cloudflare blog (AI)● 精選AI 評分66

    Cloudflare 開源決策模型 Clef 與 Clef-flash,並推出 RL 微調平台

    Cloudflare 在 Workers AI 上發布自研決策模型 Clef 與 Clef-flash,並以 Apache 2.0 許可在 Hugging Face 完全開源、可本地執行,同時推出可把 Clef 微調到自家場景的強化學習產品。

    推薦理由:Apache 2.0 開源意味著你可以把這兩個小模型拉到 Mac Studio 本地跑,用它替掉 agent 裡高頻的路由與分類判斷,換來遠低於 LLM 的延遲和確定性結構化輸出。

  3. Anthropic Research● 精選AI 評分68

    物理學家用 Claude 打造 BootLoops 科研工具

    理論物理學家 Matthew Schwartz 發布開源工具 BootLoops,把 Claude 當作 LLM 的"挽具",專攻適合當前 AI 的"Claude 形狀"問題。他用 Claude Fable 5 移植並改進散射振幅計算方法,還借 BootLoops 把數學物理技術帶到生態學、群體遺傳學、地質、經濟、語言學等領域,並與各領域專家合作篩選真正有價值的問題。BootLoops 開源,可搭配任意模型使用,但當前 AI 仍無法解決科學中的大多數問題。

    推薦理由:你日常用 Claude Code 等 coding agent,BootLoops 展示瞭如何按模型能力挑問題、而非硬套人類科研流程,可直接借鑑到你的 agent 工作流與本地模型實驗。

9月30日星期三 · 2 則

  1. OpenCode releases● 精選AI 評分75

    OpenCode v1.18.34 修復 macOS 27+ 本地編譯執行問題

    OpenCode 發布 v1.18.34,修復本地編譯的 macOS 二進位制在 macOS 27+ 上無法可靠執行的問題,改為編譯後重新簽名,並用 Developer ID 簽名 macOS CLI 發布版。同時模型請求現在會傳送帶名稱空間的會話與父會話身份頭,TUI 的 /status 對話方塊改用 path.sep 提取外掛名,網頁文件修正了 GPT 6.1 Sol 的快取定價。

    推薦理由:你日常用 OpenCode 且準備在 Apple Silicon 上本地跑模型,這個版本直接解決 macOS 27+ 本地編譯二進位制的簽名與執行問題,升級後本地建置更可靠。

  2. Latent Space● 精選AI 評分81

    OpenAI DevDay 發布 GPT-6.1 Sol、Dots 與 Agents API

    OpenAI 在 DevDay 上發布 GPT-6.1 Sol、個人助理產品 Dots,以及內建 Computer Use 的 Agents API,開發者可基於與 Codex、ChatGPT 相同的 Computer Use 建置應用。Ari Weinstein 稱 GPT-6.1 Sol 成本是 Astra 的五分之一,用在 Computer Use 上只需七分之一。

    推薦理由:GPT-6.1 Sol 的 Computer Use 成本與新 Agents API 的非同步呼叫、快取預熱、compaction 機制,直接影響你用 Codex 等 coding agent 時的延遲與賬單。