AISpot

GPT

近期事件

  1. 1
    熱度 1.02 個來源 · 2 則10/3 16:36
  2. 2
  3. 3

10月3日星期六 · 2 則

  1. r/OpenAI top of the day● 精選AI 評分80

    OpenAI 發布 GPT-6 系列模型指南

    OpenAI 發布了 GPT-6 系列的模型指南,內容涵蓋模型選擇、推理強度(reasoning effort)與工具使用。該指南面向使用 GPT-6 系列的開發者,幫助其在具體場景中決定選哪個模型、投入多少推理算力以及如何呼叫工具。原文未披露具體模型型號、引數或發布時間等細節。

    推薦理由:你日常用 Codex 等 coding agent 並訂閱 ChatGPT,這份官方指南可直接用來調整模型選擇與推理強度,最佳化日常開發中的成本與效果。

  2. Latent Space● 精選AI 評分85

    GPT-6.1 Sol 發布,Sonnet 5.5 登頂 Agent Arena

    OpenAI 發布 GPT-6.1 Sol,定價 $2/$10 每百萬輸入/輸出 token,比 Astra 的 $10/$50 便宜約 80%,在 DeepSWE v1.1 上比 GPT-6 Sol 高 6.4 分。Sonnet 5.5 在 Agent Arena 首秀排第 3 並在 Chat 類別登頂,Anthropic 包攬前三;Sol 每任務中位成本 $0.56,比 GPT-6 Sol 便宜 39%。

    推薦理由:Sol 把前沿模型價格壓到 $2/$10,直接影響你用 Codex 與 Claude Code 的成本結構;llama.cpp 與 Ollama 的新端點則關係到你 Mac Studio 本地推理的選型。

10月2日星期五 · 3 則

  1. Latent Space● 精選AI 評分79

    Pi 1.0 與 Pi Durable 發布,Pi 移植到 TypeScript

    Pi 1.0 與 Pi Durable 同日發布並登上 Hacker News 首頁,Pi 已加入 Earendil。Pi 1.0 新增 Codemode(原生支援 MCP、Jev 和影像模型)、虛擬模型擴充套件、延遲工具載入、Anthropic 模型快取預熱、對話中途系統訊息、新 TUI 主題與預設全屏。Pi Durable 把 Pi 移植到 TypeScript 並外接全部有狀態元件:每步記錄為檢查點任務,程序失敗或重啟後 agent 與子 agent 自動恢復;

    推薦理由:你天天用 Claude Code、Codex、OpenCode,Pi Durable 的檢查點崩潰恢復、並行分支會話和工具熱替換正對長時 agent 任務的痛點,TypeScript 化後也更容易在本地或雲端自建執行。

  2. OpenRouter announcements● 精選AI 評分62

    OpenRouter 上線 Model Router Benchmarks 路由器評測頁

    OpenRouter 推出 Model Router Benchmarks 頁面,用品質、速度、成本三個維度對比各家模型路由器,併合成 0 到 10 分的 Router Index。預設權重是品質 60%、每任務時間 20%、成本 20%,頁面上可拖動滑塊自行調整。

    推薦理由:你同時用 Claude Code、Codex、OpenCode 且按量付費,可以先在這頁看清各家路由器在品質、延遲與成本之間的取捨,再決定是否把模型換成路由器來省錢。

  3. NVIDIA blog● 精選AI 評分86

    OpenAI 上線 GPT-6 Astra Ultrafast,跑在 NVIDIA Blackwell 上

    GPT-6 Astra Ultrafast 已上線,執行在 NVIDIA Blackwell GPU 上,面向 OpenAI 內部以及符合條件的 ChatGPT Work 和 Codex 使用者開放,token 生成速度最高可達 Astra Standard 模式的 8 倍。開發者今天就能通過 API 呼叫,接入方式、定價與實現細節見官方 Ultrafast 指南。更快的生成可縮短 coding agent 的編輯—測試—除錯迴圈,減少工具呼叫之間的等待時間。

    推薦理由:你日常用 Codex,可對照這條訊息看是否符合條件走 ChatGPT Work/Codex 入口,或直接用 API 實測更快生成對 agent 編輯—測試—除錯迴圈的實際提速。

10月1日星期四 · 4 則

  1. X @sama● 精選AI 評分78

    @sama: Also, 6.1 Sol was our fastest-growing model ever, and was a bit slow under load.

    OpenAI 的 Sam Altman 表示,6.1 Sol 是公司史上增長最快的模型,此前在高負載下回應偏慢,現在應該好很多。這條訊息只提到效能改善,沒有給出具體延遲數字、上線時間或適用方案範圍。

    推薦理由:你訂閱了 ChatGPT 並用 Codex 做 coding agent,若 6.1 Sol 已進入你的使用路徑,這次負載最佳化可能直接改善高峰時段的回應速度。

  2. 量子位● 精選AI 評分80

    Google 突然發布 Gemini 4 Argon,多項榜單登頂

    Google 於 2026 年 10 月 1 日發布 Gemini 4 Argon,在 DeepSWE v1.1 長期軟體工程任務得 77.9%,高於 Claude Opus 5.5 的 74.2% 和 GPT-6 Astra 的 74.1%,並以 68.90% 登頂 Vals Index。定價為每百萬輸入 Token 2 美元、輸出 Token 10 美元,優惠期單題成本比 Astra 低約四成,輸出上限達百萬 Token。

    推薦理由:作為同時用 Claude Code、Codex 等 coding agent 的付費使用者,可以記下 Argon 的百萬 Token 長任務能力和更低單價,但它現階段只面向稽核過的安全團隊,短期內還用不上。

  3. Latent Space● 精選AI 評分84

    Gemini 4 Argon 發布,輸出上限 100 萬 token,僅限安全預覽

    Google DeepMind 發布 Gemini 4 Argon,首次支援最高 100 萬 token 輸出,但目前僅在 Fairwind 計劃下對政府使用者與受信任網路安全人員開放預覽,開發者、企業與消費者開放時間未定。標準價 $4/$20 每百萬輸入/輸出 token,首推五折 $2/$10,快取輸入 95% 折扣;19 項公開基準中拿下 13 項第一。100 萬輸出靠新 API 功能 Long Decode Continuation 實現,長回覆會暫停並跨呼叫續寫;

    推薦理由:Argon 現階段只對政府與安全人員開放,你還用不上,但每任務 $1.99 的折扣成本、$2/$10 定價和 15% 幻覺率(Astra 51%)可作為比較 Claude Code、Codex 背後模型價效比的參照。

  4. Anthropic Research● 精選AI 評分68

    物理學家用 Claude 打造 BootLoops 科研工具

    理論物理學家 Matthew Schwartz 發布開源工具 BootLoops,把 Claude 當作 LLM 的"挽具",專攻適合當前 AI 的"Claude 形狀"問題。他用 Claude Fable 5 移植並改進散射振幅計算方法,還借 BootLoops 把數學物理技術帶到生態學、群體遺傳學、地質、經濟、語言學等領域,並與各領域專家合作篩選真正有價值的問題。BootLoops 開源,可搭配任意模型使用,但當前 AI 仍無法解決科學中的大多數問題。

    推薦理由:你日常用 Claude Code 等 coding agent,BootLoops 展示瞭如何按模型能力挑問題、而非硬套人類科研流程,可直接借鑑到你的 agent 工作流與本地模型實驗。

9月30日星期三 · 2 則

  1. OpenCode releases● 精選AI 評分75

    OpenCode v1.18.34 修復 macOS 27+ 本地編譯執行問題

    OpenCode 發布 v1.18.34,修復本地編譯的 macOS 二進位制在 macOS 27+ 上無法可靠執行的問題,改為編譯後重新簽名,並用 Developer ID 簽名 macOS CLI 發布版。同時模型請求現在會傳送帶名稱空間的會話與父會話身份頭,TUI 的 /status 對話方塊改用 path.sep 提取外掛名,網頁文件修正了 GPT 6.1 Sol 的快取定價。

    推薦理由:你日常用 OpenCode 且準備在 Apple Silicon 上本地跑模型,這個版本直接解決 macOS 27+ 本地編譯二進位制的簽名與執行問題,升級後本地建置更可靠。

  2. Latent Space● 精選AI 評分81

    OpenAI DevDay 發布 GPT-6.1 Sol、Dots 與 Agents API

    OpenAI 在 DevDay 上發布 GPT-6.1 Sol、個人助理產品 Dots,以及內建 Computer Use 的 Agents API,開發者可基於與 Codex、ChatGPT 相同的 Computer Use 建置應用。Ari Weinstein 稱 GPT-6.1 Sol 成本是 Astra 的五分之一,用在 Computer Use 上只需七分之一。

    推薦理由:GPT-6.1 Sol 的 Computer Use 成本與新 Agents API 的非同步呼叫、快取預熱、compaction 機制,直接影響你用 Codex 等 coding agent 時的延遲與賬單。