AISpot

產品與方案

近期事件

  1. 1
    熱度 1.54 個來源 · 4 則10/3 00:03
  2. 2
    熱度 1.54 個來源 · 4 則10/2 23:40
  3. 3
    熱度 1.23 個來源 · 3 則10/3 01:45
  4. 4
  5. 5
    熱度 0.83 個來源 · 4 則10/3 01:56

10月4日星期日 · 1 則

  1. Simon Willison● 精選AI 評分70

    AWS 與 Google Cloud 推出硬性預算上限

    AWS 在 9 月 16 日推出月度支出上限功能,專案用量達到上限後當月暫停;Google Cloud 則在 7 月上線 Spend Caps,可對專案內特定服務設定月度財務上限。作者認為按量付費的 API 與託管服務應預設開啟硬性預算上限,而非只發警告郵件,因為 coding agent 會大幅降低啟動付費服務的門檻,可能在你睡覺時燒掉數百甚至上萬美元。AWS 該功能目前僅向少量客戶開放,尚未全面可用。

    推薦理由:你同時訂閱多家按量付費服務並用 coding agent 自動寫程式碼,預設硬性預算上限能防止 agent 失控呼叫 API 或部署服務時產生意外賬單,選型時可優先考慮已支援該功能的雲廠商。

10月3日星期六 · 7 則

  1. Hacker News front page● 精選AI 評分88

    Getting the most out of Opus 5.5 in Claude and Claude Code

    Anthropic 於 2026 年 9 月發布 Opus 5.5 官方使用指南,作者 Addy Osmani,閱讀時長 9 分鐘。Opus 5.5 相比前代更擅長多步驟長任務,可連續數小時執行大型倉庫改動直至測試通過,且每次回覆前都會自行思考。指南建議一次性交代完整任務並說明完成標準,刪除提示詞中的 think carefully 等語句,在 CLAUDE.md 中寫明何時繼續、何時停下詢問,並讓子代理並行處理審計與遷移。

    推薦理由:你日常用 Claude Code 跑 coding agent,這份指南直接給出 Opus 5.5 的提示詞寫法、CLAUDE.md 停止規則與子代理拆分方式,可立刻套用到現有工作流。

  2. r/OpenAI top of the day● 精選AI 評分77

    OpenAI API 帳戶與 Codex 積分疑似被重置

    一名使用者報告其長期使用的 OpenAI API 帳戶和 Codex 20x 帳戶同時出現異常:Codex 的 60,000 積分在一次重新整理後歸零,API 帳戶則顯示為全新狀態,無發票、無呼叫記錄、無餘額。該使用者還發現組織 ID 已變更,與其歷史賬單郵件中的 ID 不一致,且其帳戶一直是個人帳戶、未建立過其他組織。目前尚無官方回應或其他使用者報告類似情況。

    推薦理由:如果你同時使用 OpenAI API 和 Codex,需要留意帳戶積分與組織 ID 是否被意外重置,並保留歷史賬單作為憑證。

  3. r/OpenAI top of the day● 精選AI 評分87

    Did they reduce Plus's usage limit?

    有 ChatGPT Plus 使用者反映,其每週 API 等值用量從此前的約 80 至 100 美元降至穩定的 49 至 50 美元,5 小時限額約為 7 至 8 美元。該說法來自 Reddit 使用者 pensuke89 的觀察,僅為個人體驗,OpenAI 未作回應,也未公布額度調整。

    推薦理由:你同時訂閱 ChatGPT 付費方案並用 coding agent 工作,額度若真減半會直接影響每週可用的模型呼叫量,可對照自己的用量記錄判斷是否受影響。

  4. Latent Space● 精選AI 評分85

    GPT-6.1 Sol 發布,Sonnet 5.5 登頂 Agent Arena

    OpenAI 發布 GPT-6.1 Sol,定價 $2/$10 每百萬輸入/輸出 token,比 Astra 的 $10/$50 便宜約 80%,在 DeepSWE v1.1 上比 GPT-6 Sol 高 6.4 分。Sonnet 5.5 在 Agent Arena 首秀排第 3 並在 Chat 類別登頂,Anthropic 包攬前三;Sol 每任務中位成本 $0.56,比 GPT-6 Sol 便宜 39%。

    推薦理由:Sol 把前沿模型價格壓到 $2/$10,直接影響你用 Codex 與 Claude Code 的成本結構;llama.cpp 與 Ollama 的新端點則關係到你 Mac Studio 本地推理的選型。

  5. r/ClaudeAI top of the day● 精選AI 評分78

    使用者稱 Opus 5.5 周額度 3 億 token 即觸頂

    一位使用者反映,改用 Opus 5.5 後每週僅用 3 億 token 就觸及訂閱週上限,而此前每週消耗 10 至 20 億 token 都沒問題。該使用者指出 Opus 5.5 單 token 價格理論上更低,懷疑是訂閱額度被削減,或與自己大量使用 subagent 的工作方式有關。目前這只是個人反饋,尚無官方說明。

    推薦理由:你同時訂閱 Claude 並用 coding agent 跑 subagent,這條反饋提示 Opus 5.5 的實際額度消耗可能與單價直覺相反,值得留意自己的周用量。

  6. X @ollama● 精選AI 評分67

    Cloudflare 決策模型 Clef 上線 Ollama

    Cloudflare 的決策模型現已在 Ollama 上提供,可用於影像分類、給 bug 報告打標籤或把支援工單路由到正確團隊。共兩個型號:Clef(27B)用 ollama pull clef 拉取,Clef Flash(9B)用 ollama pull clef-flash 拉取。

    推薦理由:你正準備用 Mac Studio 跑本地模型,這兩個 9B/27B 模型可直接用 Ollama 拉取,正好用來試 Apple Silicon 上的本地推理。

  7. Ars Technica AI● 精選AI 評分78

    蘋果收緊 macOS 完整磁碟取用權限,防 AI agent 濫用

    蘋果宣布調整 macOS 隱私設定,阻止第三方應用開發者濫用權限讀取資訊記錄。此前有專欄作家稱 Meta 的通用 AI agent Muse 未經授權就推送了涉及他與同事 Apple Messages 對話的通知,引發大量使用者共鳴。Meta CTO 回應稱,Muse 要讀取 Apple Messages 需使用者手動授予完整磁碟取用權限並在 Muse 中開啟 Messages 聯結器。

    推薦理由:你在 Mac 上跑本地模型和 coding agent,完整磁碟取用權限正是 Ollama、LM Studio 這類工具常被要求授予的權限,這次改動會直接影響你給本地 AI 工具放權的邊界。

10月2日星期五 · 12 則

  1. X @OpenAIDevs● 精選AI 評分76

    @OpenAIDevs: Your dot learns how you work, keeps context across apps, coordinates Codex tasks, and flags what ne…

    OpenAI 開發者帳號發布 dot,它能學習使用者的工作方式、跨應用保留上下文、協調 Codex 任務,並標記需要使用者關注的事項。目前官方只給出這四項能力描述,未公布定價、可用平台與上線時間。

    推薦理由:你日常用 Codex 和 Claude Code 等 coding agent,dot 若能跨應用保留上下文並統一排程 Codex 任務,可能減少你在多個工具間手動搬運上下文的開銷,值得關注後續是否開放試用。

  2. Claude Code releases● 精選AI 評分84

    Claude Code 2.1.288 修復恢復會話丟失上下文與超時中斷問題

    Claude Code 發布 v2.1.288。修復了長對話報「Prompt is too long」卻不自動壓縮、--resume 丟失剛被壓縮恢復的檔案與上下文、恢復的會話不儲存該輪最後回覆,以及回應中途 API 超時導致整輪失敗——非互動會話與子代理現在會從部分回應繼續,僅有思考內容的回應會重試。

    推薦理由:你日常依賴 Claude Code 跑長會話與子代理,這些修復直接避免 --resume 丟上下文和超時中斷整輪工作,值得儘快升級。

  3. The Verge AI● 精選AI 評分80

    Apple 將限制 Mac 完整磁碟取用權限,應對 AI 代理風險

    Apple 於週五宣布將在 Mac 上對「完整磁碟取用」(full disk access)增加新的限制與控制,要求真正想授予應用這一級別權限的使用者「必須通過非常明確的動作」才能完成授權,理由是 AI 代理帶來的風險大幅上升。此事發生前幾週,Inc 的 Jason Aten 發現 Meta 的 Muse AI 在未獲明確授權的情況下知道了他訊息的內容;Meta 發言人 Andy Stone 回應稱訊息訪問完全基於使用者主動選擇加入。

    推薦理由:你日常跑 Claude Code、Codex、OpenCode,這類代理一旦拿到完整磁碟取用就能讀到專案目錄之外的程式碼與憑據,這項改動會直接影響你今後給它們授權的方式。

  4. Ollama releases● 精選AI 評分75

    Ollama v0.35.1 接入 Cloudflare 決策模型 Clef 與 Clef Flash

    Ollama v0.35.1 新增對 Cloudflare 開源決策模型 Clef(27B)與 Clef Flash(9B)的支援,通過 /v1/systemone 呼叫。兩者支援多模態,請求可同時傳入圖片與文字 state,所有 questions 共享該狀態並聯合打分,返回如 noul 機率 0.958 的答案。

    推薦理由:你在 Mac Studio 上本地跑開源模型時,可以直接用 Ollama 試這兩個多模態決策模型,並留意 llama.cpp 與 MLX 引擎更新對 Apple Silicon 推理的影響。

  5. Hugging Face blog● 精選AI 評分65

    Ai2 開源 AstaBrief 8B 科學報告生成模型

    Ai2 開源了 8B 的科學報告生成模型 AstaBrief,可把研究問題和檢索到的文獻片段直接寫成帶引用的報告。它已在 Asta 的 Generate a report 功能中以 Fast mode 上線,與 Claude 驅動的 Thinking mode 並列:Fast mode 平均 51.1 秒生成一份報告,Thinking mode 為 178.5 秒,快約 3.5 倍。模型基於 Qwen3-8B,用 SFT 加 DPO 訓練,一次成稿,跳過了片段摘要與聚類環節。

    推薦理由:你正打算在 Mac Studio 上跑開源模型,而 AstaBrief 就是 8B 級 Qwen 系小模型的長文生成配方,附帶的範例工作流可直接改造成本地 PDF 報告生成。

  6. Google AI blog● 精選AI 評分68

    Google 發布 Gemini 4 Argon,100 萬 token 輸出上限

    Google 9 月發布新前沿模型 Gemini 4 Argon,擁有業界領先的 100 萬 token 輸出上限,面向編碼、網路安全防禦、金融研究與法律起草等重負載任務;目前僅通過 Fairwind Program 向受信任的網路安全防禦者開放,尚未放開給開發者、企業和消費者。

    推薦理由:你日常靠 Claude Code、Codex、OpenCode 跑 agent,可直接在 AI Studio 或 Gemini API 上試 Gemini 3.8 Flash 的 agentic 與長週期編碼表現,而 Argon 因僅限 Fairwind 防禦者計劃,暫時和你無關…

  7. Cloudflare blog (AI)● 精選AI 評分65

    Cloudflare 在 AI Gateway 推出 Web Search API

    Cloudflare 宣布與 Ceramic.ai、Exa、Linkup 三家搜尋服務商合作,在 AI Gateway 上推出 Web Search API,讓 agent 先搜尋再作答,而不是猜 URL 後 curl 出 404。開發者可通過標準 REST 介面呼叫,或在 Workers 裡用一行程式碼繫結,未來還將作為內建 Server Tools 提供。

    推薦理由:你日常用 Claude Code、Codex 這類 agent 查最新文件和 API 時,可以用它替代靠猜 URL 的抓取,並用已有的 AI Gateway 額度與 BYOK 統一計費和觀測。

  8. NVIDIA blog● 精選AI 評分72

    NVIDIA DGX Spark 增 64GB 版,10 月 23 日 4999 美元起

    NVIDIA DGX Spark 將新增 64GB 統一記憶體版本,10 月 23 日由 Acer、ASUS、Dell、Gigabyte、HP、MSI 開賣,起價 4999 美元,保留 GB10 Grace Blackwell 晶片、DGX OS 與完整 NVIDIA AI 軟體棧,可完全本地執行最高 1000 億引數模型。兩臺機器可用 QSFP 線經 ConnectX-7 直連,記憶體池化到 128GB,模型上限提到 2000 億引數;

    推薦理由:如果你在 Mac Studio 之外考慮本地跑開源模型,這是同價位可對比的 CUDA 方案,且開箱即支援 Ollama、llama.cpp、LM Studio,並能一鍵把本地模型接給 OpenCode 用。

  9. X @deepseek_ai● 精選AI 評分75

    DeepSeek 發布 Harness 桌面版,支援 macOS 與 Windows

    DeepSeek 推出 DeepSeek Harness 的打包桌面版,覆蓋 macOS 與 Windows,Linux 使用者可通過 npm 上的 @deepseek-ai/dsh 包獲取。官方在社交平台公布了這一訊息,並給出下載地址 deepseek.com/harness。

    推薦理由:你日常用 coding agent 工作,又多平台切換,可以先在 macOS 上裝一份 Harness 桌面版,評估它能否補進現有 Claude Code、Codex、OpenCode 的工作流。

  10. Latent Space● 精選AI 評分79

    Pi 1.0 與 Pi Durable 發布,Pi 移植到 TypeScript

    Pi 1.0 與 Pi Durable 同日發布並登上 Hacker News 首頁,Pi 已加入 Earendil。Pi 1.0 新增 Codemode(原生支援 MCP、Jev 和影像模型)、虛擬模型擴充套件、延遲工具載入、Anthropic 模型快取預熱、對話中途系統訊息、新 TUI 主題與預設全屏。Pi Durable 把 Pi 移植到 TypeScript 並外接全部有狀態元件:每步記錄為檢查點任務,程序失敗或重啟後 agent 與子 agent 自動恢復;

    推薦理由:你天天用 Claude Code、Codex、OpenCode,Pi Durable 的檢查點崩潰恢復、並行分支會話和工具熱替換正對長時 agent 任務的痛點,TypeScript 化後也更容易在本地或雲端自建執行。

  11. OpenRouter announcements● 精選AI 評分62

    OpenRouter 上線 Model Router Benchmarks 路由器評測頁

    OpenRouter 推出 Model Router Benchmarks 頁面,用品質、速度、成本三個維度對比各家模型路由器,併合成 0 到 10 分的 Router Index。預設權重是品質 60%、每任務時間 20%、成本 20%,頁面上可拖動滑塊自行調整。

    推薦理由:你同時用 Claude Code、Codex、OpenCode 且按量付費,可以先在這頁看清各家路由器在品質、延遲與成本之間的取捨,再決定是否把模型換成路由器來省錢。

  12. NVIDIA blog● 精選AI 評分86

    OpenAI 上線 GPT-6 Astra Ultrafast,跑在 NVIDIA Blackwell 上

    GPT-6 Astra Ultrafast 已上線,執行在 NVIDIA Blackwell GPU 上,面向 OpenAI 內部以及符合條件的 ChatGPT Work 和 Codex 使用者開放,token 生成速度最高可達 Astra Standard 模式的 8 倍。開發者今天就能通過 API 呼叫,接入方式、定價與實現細節見官方 Ultrafast 指南。更快的生成可縮短 coding agent 的編輯—測試—除錯迴圈,減少工具呼叫之間的等待時間。

    推薦理由:你日常用 Codex,可對照這條訊息看是否符合條件走 ChatGPT Work/Codex 入口,或直接用 API 實測更快生成對 agent 編輯—測試—除錯迴圈的實際提速。

10月1日星期四 · 4 則

  1. X @sama● 精選AI 評分78

    @sama: Also, 6.1 Sol was our fastest-growing model ever, and was a bit slow under load.

    OpenAI 的 Sam Altman 表示,6.1 Sol 是公司史上增長最快的模型,此前在高負載下回應偏慢,現在應該好很多。這條訊息只提到效能改善,沒有給出具體延遲數字、上線時間或適用方案範圍。

    推薦理由:你訂閱了 ChatGPT 並用 Codex 做 coding agent,若 6.1 Sol 已進入你的使用路徑,這次負載最佳化可能直接改善高峰時段的回應速度。

  2. Cloudflare blog (AI)● 精選AI 評分66

    Cloudflare 開源決策模型 Clef 與 Clef-flash,並推出 RL 微調平台

    Cloudflare 在 Workers AI 上發布自研決策模型 Clef 與 Clef-flash,並以 Apache 2.0 許可在 Hugging Face 完全開源、可本地執行,同時推出可把 Clef 微調到自家場景的強化學習產品。

    推薦理由:Apache 2.0 開源意味著你可以把這兩個小模型拉到 Mac Studio 本地跑,用它替掉 agent 裡高頻的路由與分類判斷,換來遠低於 LLM 的延遲和確定性結構化輸出。

  3. 量子位● 精選AI 評分80

    Google 突然發布 Gemini 4 Argon,多項榜單登頂

    Google 於 2026 年 10 月 1 日發布 Gemini 4 Argon,在 DeepSWE v1.1 長期軟體工程任務得 77.9%,高於 Claude Opus 5.5 的 74.2% 和 GPT-6 Astra 的 74.1%,並以 68.90% 登頂 Vals Index。定價為每百萬輸入 Token 2 美元、輸出 Token 10 美元,優惠期單題成本比 Astra 低約四成,輸出上限達百萬 Token。

    推薦理由:作為同時用 Claude Code、Codex 等 coding agent 的付費使用者,可以記下 Argon 的百萬 Token 長任務能力和更低單價,但它現階段只面向稽核過的安全團隊,短期內還用不上。

  4. Latent Space● 精選AI 評分84

    Gemini 4 Argon 發布,輸出上限 100 萬 token,僅限安全預覽

    Google DeepMind 發布 Gemini 4 Argon,首次支援最高 100 萬 token 輸出,但目前僅在 Fairwind 計劃下對政府使用者與受信任網路安全人員開放預覽,開發者、企業與消費者開放時間未定。標準價 $4/$20 每百萬輸入/輸出 token,首推五折 $2/$10,快取輸入 95% 折扣;19 項公開基準中拿下 13 項第一。100 萬輸出靠新 API 功能 Long Decode Continuation 實現,長回覆會暫停並跨呼叫續寫;

    推薦理由:Argon 現階段只對政府與安全人員開放,你還用不上,但每任務 $1.99 的折扣成本、$2/$10 定價和 15% 幻覺率(Astra 51%)可作為比較 Claude Code、Codex 背後模型價效比的參照。

9月30日星期三 · 2 則

  1. OpenCode releases● 精選AI 評分75

    OpenCode v1.18.34 修復 macOS 27+ 本地編譯執行問題

    OpenCode 發布 v1.18.34,修復本地編譯的 macOS 二進位制在 macOS 27+ 上無法可靠執行的問題,改為編譯後重新簽名,並用 Developer ID 簽名 macOS CLI 發布版。同時模型請求現在會傳送帶名稱空間的會話與父會話身份頭,TUI 的 /status 對話方塊改用 path.sep 提取外掛名,網頁文件修正了 GPT 6.1 Sol 的快取定價。

    推薦理由:你日常用 OpenCode 且準備在 Apple Silicon 上本地跑模型,這個版本直接解決 macOS 27+ 本地編譯二進位制的簽名與執行問題,升級後本地建置更可靠。

  2. Latent Space● 精選AI 評分81

    OpenAI DevDay 發布 GPT-6.1 Sol、Dots 與 Agents API

    OpenAI 在 DevDay 上發布 GPT-6.1 Sol、個人助理產品 Dots,以及內建 Computer Use 的 Agents API,開發者可基於與 Codex、ChatGPT 相同的 Computer Use 建置應用。Ari Weinstein 稱 GPT-6.1 Sol 成本是 Astra 的五分之一,用在 Computer Use 上只需七分之一。

    推薦理由:GPT-6.1 Sol 的 Computer Use 成本與新 Agents API 的非同步呼叫、快取預熱、compaction 機制,直接影響你用 Codex 等 coding agent 時的延遲與賬單。