AISpot

產品與方案

10月2日星期五 · 24 則

  1. r/ClaudeAI top of the dayAI 評分33

    r/ClaudeAI 討論:重度工作用 Opus 5.5,GPT 靠額度與畫圖

    r/ClaudeAI 一條 22 小時前的帖子問同時用 Claude 和 GPT 的人更偏好哪個,30 條評論後自動總結出的共識是:兩者都用,但嚴肅工作首選 Claude(尤其是 Opus 5.5),用於編碼、深度邏輯與科學任務;最大抱怨是 Claude Pro 額度消耗遠快於 GPT Plus。使用者繼續付費 GPT 的原因包括更寬鬆的訊息上限、DALL-E 影像生成,以及閒聊與頭腦風暴。常見工作流是先用 GPT 出想法和一般查詢,再切到 Claude 執行和打磨成品。

  2. The Verge AIAI 評分51

    OpenAI 發布 Dots 智慧體平台,主打辦公也能幫訂餐

    OpenAI 本週發布智慧體平台 Dots,可替使用者在辦公場景幹活,也能幫使用者訂餐。它被定位為企業軟體,重點在工作,而不像 Meta Muse 那樣走親和路線;每個 Dot 有圓潤的擬人化頭像,名字可自訂。目前每位使用者只能擁有一個 Dot,OpenAI 說未來可以擁有多個。互動介面與 Muse 類似:一個視窗和 agent 對話,另一個視窗跟進它的工作。

  3. TechCrunch AIAI 評分61

    白宮召集科技 CEO 簽 AI 安全承諾,僅 2% 消費者付費

    白宮本週把 Zuckerberg、Bezos、Musk 與 Anthropic 的 Dario Amodei 等主要科技公司 CEO 聚到一起,簽署川普稱為具有道德約束力的 AI 安全承諾。川普還簽署行政令,正式把 AI 改稱 super intelligence,Meta 與 OpenAI 則在給自家 AI 產品換上更友好的形象。但原標題指出,只有 2% 的消費者在為 AI 付費。

  4. r/ClaudeAI top of the dayAI 評分42

    DensePack 把文字打包成圖片,Claude Code 省一半 token

    DensePack 是一個 Claude Code 外掛,把 Read 讀取的文字、Bash 輸出、Word 檔案和子代理報告打包成圖片交給 agent 閱讀,按作者基準測試可省約 50% 的 token 費用,且後續快取讀取也按這個折扣計價。它用顏色編碼和兩行圖例,聲稱能從圖片逐位元組還原始碼檔案,並保留文字副本作為回退。專案發布兩週、獲 8 個 star,已通過 Anthropic 外掛提交的初期階段,最新版本 1.3.3,1.4 將支援與其他外掛共用。

  5. TechCrunch AIAI 評分57

    白宮召集科技 CEO 簽 AI 安全承諾,川普籤令改稱超級智慧

    白宮本週把扎克伯格、貝索斯、馬斯克和 Anthropic 的 Dario Amodei 等主要科技公司 CEO 聚到同一場合,簽署一份 AI 安全承諾,川普稱這份承諾具有道德約束力。川普還簽署行政令,正式把 AI 改稱為超級智慧。與此同時,Meta 和 OpenAI 正讓自己的 AI 產品顯得更親和。原文未披露承諾的具體條款、完整簽署方名單或執行方式。

  6. r/ClaudeAI top of the dayAI 評分30

    Opus 5.5 與 Sol 6.1 15 分鐘用 three.js 建布萊德湖城堡

    一位使用者用 15 分鐘限時提示,讓 Opus 5.5 和 Sol 6.1 分別用 three.js 建置可旋轉視角的簡化版布萊德湖城堡。Opus 5.5 用時 5 分 46 秒,約 300k 輸入加 18k 輸出 token,估算 API 成本約 1.56 美元;Sol 6.1 用時 11 分 2 秒,約 400k 輸入加 16k 輸出 token,估算約 0.96 美元。Opus 5.5 產出約 27 KB、520 行、3 個 CDN 指令碼;

  7. r/ClaudeAI top of the dayAI 評分23

    Reddit 使用者用同一提示詞對比 Sonnet 5.5 與 Opus 5.5 動效

    r/ClaudeAI 使用者 CFNStudio 給 Sonnet 5.5 和 Opus 5.5 同一個提示詞「為自己的模型做一支發布影片,告訴人們為什麼該用它」,並放出兩支成片供對比。評論裡有人指出提示詞太籠統,無法做嚴謹的橫向比較;有人追問底層用的是 Remotion 還是 FFmpeg,帖中未回答。一位自稱給客戶做動畫的從業者說這兩支動畫客觀上很差、目前只能靠改提示詞來編輯,不可交付;也有人回帖稱這種一次成型的進步很快,並且可以用 Remotion 之類的工具再編輯。

  8. r/ClaudeAI top of the dayAI 評分41

    r/ClaudeAI 熱議 Opus 5.5 被削弱

    Reddit 的 r/ClaudeAI 版塊出現熱帖,多數評論者認為 Opus 5.5 已被削弱(發帖人把 nerfed 誤寫成 nerded)。主流猜測是官方先用新模型拉訂閱、隨後降低算力省成本,同時讓下一代模型顯得更強;少數使用者稱模型仍正常甚至仍是最好的模型,品質下滑感來自上下文堆積、未新開對話。有人貼出 nerf 追蹤基準顯示輕微下滑,但被指仍在正常誤差範圍內;也有評論指出 Opus 5.5 發布當天就會說 load-bearing,不能當作降級訊號。

  9. Hugging Face blog● 精選AI 評分65

    Ai2 開源 AstaBrief 8B 科學報告生成模型

    Ai2 開源了 8B 的科學報告生成模型 AstaBrief,可把研究問題和檢索到的文獻片段直接寫成帶引用的報告。它已在 Asta 的 Generate a report 功能中以 Fast mode 上線,與 Claude 驅動的 Thinking mode 並列:Fast mode 平均 51.1 秒生成一份報告,Thinking mode 為 178.5 秒,快約 3.5 倍。模型基於 Qwen3-8B,用 SFT 加 DPO 訓練,一次成稿,跳過了片段摘要與聚類環節。

  10. Google AI blog● 精選AI 評分68

    Google 發布 Gemini 4 Argon,100 萬 token 輸出上限

    Google 9 月發布新前沿模型 Gemini 4 Argon,擁有業界領先的 100 萬 token 輸出上限,面向編碼、網路安全防禦、金融研究與法律起草等重負載任務;目前僅通過 Fairwind Program 向受信任的網路安全防禦者開放,尚未放開給開發者、企業和消費者。

  11. Ars Technica AIAI 評分40

    Nvidia Shield TV Pro 因記憶體成本上漲漲價 100 美元

    Nvidia 宣布 Shield TV Pro 即日起漲價 100 美元,售價從 199.99 美元升至 299.99 美元,官方給出的原因是 AI 導致記憶體等零部件成本在全行業大幅上升。這款 2019 年發布的 Android TV 盒子仍搭載老舊的 Tegra X1+ 處理器,支援 AI 超分和幾乎各類媒體的硬體解碼,非 Pro 版本已經停產。Nvidia 發言人稱漲價自 10 月 2 日起生效。

  12. Latent SpaceAI 評分51

    Airbnb 稱 60% 程式碼由 AI 編寫,靠內部工具 Everest 加速開發

    Airbnb CTO Ahmad Al-Dahle(前 Meta 生成式 AI 負責人、Llama 系列發布負責人)披露,Airbnb 目前約 60% 的程式碼由 AI 編寫,功能交付量同比增加近 80%,工程師的 PR 吞吐量提升約 1.6 倍。約一半客服工單已由 AI 獨立解決(Q2 財報為近 45%),但安全類問題仍轉人工,上線前用合成資料做測試。

  13. Cloudflare blog (AI)● 精選AI 評分65

    Cloudflare 在 AI Gateway 推出 Web Search API

    Cloudflare 宣布與 Ceramic.ai、Exa、Linkup 三家搜尋服務商合作,在 AI Gateway 上推出 Web Search API,讓 agent 先搜尋再作答,而不是猜 URL 後 curl 出 404。開發者可通過標準 REST 介面呼叫,或在 Workers 裡用一行程式碼繫結,未來還將作為內建 Server Tools 提供。

  14. NVIDIA blog● 精選AI 評分72

    NVIDIA DGX Spark 增 64GB 版,10 月 23 日 4999 美元起

    NVIDIA DGX Spark 將新增 64GB 統一記憶體版本,10 月 23 日由 Acer、ASUS、Dell、Gigabyte、HP、MSI 開賣,起價 4999 美元,保留 GB10 Grace Blackwell 晶片、DGX OS 與完整 NVIDIA AI 軟體棧,可完全本地執行最高 1000 億引數模型。兩臺機器可用 QSFP 線經 ConnectX-7 直連,記憶體池化到 128GB,模型上限提到 2000 億引數;

  15. Cloudflare blog (AI)AI 評分38

    Cloudflare 向 30 家非營利組織發放 750 萬美元 AI 額度

    Cloudflare 公布首批非營利創業扶持計劃的 30 家入選組織,共獲得超過 750 萬美元開發者服務額度,每家最高 25 萬美元。這些組織用 Workers AI、AI Gateway 等建置自動化工具:LebTown 用自建編輯管理系統替代 Google Docs,Kaya Guides 的 WhatsApp 心理健康應用截至 2026 年 9 月已服務 10,439 人、每月處理約 50 萬條訊息。

  16. 量子位AI 評分52

    openJiuwen 首發 X-Router 自演進模型路由,實測省 50%+ Token

    openJiuwen 首發 X-Router 自演進模型路由技術,按任務複雜度在本地與雲端模型池中動態選模型,實測減少 50%+ Token 消耗。該平台由華為 2012 實驗室、華為雲等團隊聯合高校與企業建置,主打昇騰親和,路由分三層:優於 1 分鐘重新整理的模型能力畫像、結合 KV 快取親和與即時負載的啟發式決策、用 Contextual Bandit 與輕量強化學習做反饋自演進,樣本不足時保留原判定。

  17. Latent Space● 精選AI 評分79

    Pi 1.0 與 Pi Durable 發布,Pi 移植到 TypeScript

    Pi 1.0 與 Pi Durable 同日發布並登上 Hacker News 首頁,Pi 已加入 Earendil。Pi 1.0 新增 Codemode(原生支援 MCP、Jev 和影像模型)、虛擬模型擴充套件、延遲工具載入、Anthropic 模型快取預熱、對話中途系統訊息、新 TUI 主題與預設全屏。Pi Durable 把 Pi 移植到 TypeScript 並外接全部有狀態元件:每步記錄為檢查點任務,程序失敗或重啟後 agent 與子 agent 自動恢復;

  18. Anthropic NewsAI 評分45

    Anthropic 投 1 億美元辦 Claude Frontier Academy,2027 年底前培訓 1 萬名工程師

    Anthropic 於 2026 年 10 月 2 日啟動 Claude Frontier Academy,投入 1 億美元,目標在 2027 年底前培訓 1 萬名 Frontier Deployed Engineer(FDE)。首批學員來自 Accenture、Bain、Capgemini、Commonwealth Bank of Australia、Deloitte、McKinsey、Morgan Stanley、Novo Nordisk 等企業,課程在舊金山、紐約和倫敦開班。

  19. OpenAI NewsAI 評分43

    Chatham 用 Codex 與 GPT-5.6 把交易驗證從 30 分鐘壓到 4 分鐘內

    Chatham Financial 使用 Codex 和 GPT-5.6 建置技術並重新設計工作流,把交易驗證時間從 30 分鐘縮短到 4 分鐘以內。這是 OpenAI 公布的客戶案例,說明 Codex 加 GPT-5.6 的組合已進入資本市場業務的實際生產流程,而不只是寫程式碼。對做 coding agent 的人來說,可參考它把模型能力接到具體業務流程、以縮短單次任務耗時為目標的做法。

  20. NVIDIA blog● 精選AI 評分86

    OpenAI 上線 GPT-6 Astra Ultrafast,跑在 NVIDIA Blackwell 上

    GPT-6 Astra Ultrafast 已上線,執行在 NVIDIA Blackwell GPU 上,面向 OpenAI 內部以及符合條件的 ChatGPT Work 和 Codex 使用者開放,token 生成速度最高可達 Astra Standard 模式的 8 倍。開發者今天就能通過 API 呼叫,接入方式、定價與實現細節見官方 Ultrafast 指南。更快的生成可縮短 coding agent 的編輯—測試—除錯迴圈,減少工具呼叫之間的等待時間。

10月1日星期四 · 15 則

  1. X @AnthropicAIAI 評分56

    @AnthropicAI: In physics, an “impedance mismatch” occurs when two systems each work well but are poorly matched.

    Anthropic 發布 Science Blog 客座文章,哈佛物理學家 Matthew Schwartz 提出 AI 與科學之間存在類似物理學的“阻抗失配”:LLM 能力很強,但像對待人類合作者那樣使用它並非激發其科學優勢的最佳方式。為此他建置了一套用於定量科學精確計算的工具包,Claude 藉此發現了與生態學、群體遺傳學等十幾個領域的聯絡,Schwartz 再與領域專家合作把方向引導到有趣的問題上。

  2. 量子位● 精選AI 評分80

    Google 突然發布 Gemini 4 Argon,多項榜單登頂

    Google 於 2026 年 10 月 1 日發布 Gemini 4 Argon,在 DeepSWE v1.1 長期軟體工程任務得 77.9%,高於 Claude Opus 5.5 的 74.2% 和 GPT-6 Astra 的 74.1%,並以 68.90% 登頂 Vals Index。定價為每百萬輸入 Token 2 美元、輸出 Token 10 美元,優惠期單題成本比 Astra 低約四成,輸出上限達百萬 Token。

  3. Cloudflare blog (AI)AI 評分63

    Workers AI 上線 EuroLLM 與 Apertus 兩款歐洲開源模型

    Cloudflare 在 Workers AI 上線兩款由歐洲公共機構訓練的開源模型:覆蓋全部 24 種歐盟官方語言的 EuroLLM,以及瑞士 ETH Zurich、EPFL 等打造的 Apertus,今天即可申請訪問。Apertus 用逾 15 萬億 token、1500 多種語言訓練,40% 訓練資料非英語,架構、權重、資料與方法全部公開,並按 EU AI Act 與 GDPR 處理訓練退出與個人資料。

  4. NVIDIA blogAI 評分22

    NVIDIA 提出 AI 工廠回報三要素,稱 Vera Rubin 每兆瓦吞吐超 GB300 30 倍

    NVIDIA 提出衡量 AI 工廠投資回報的三個變數:產能(每兆瓦吞吐與每 token 成本)、使用壽命和需求。它援引 SemiAnalysis AgentX 資料稱,Vera Rubin NVL72 每兆瓦吞吐量比 GB300 NVL72 高 30 倍以上,在 DeepSeek V4 Pro 上每百萬 token 成本最多低 45 倍;每兆瓦 AI 工廠造價約 6000 萬美元。

  5. Cloudflare blog (AI)AI 評分45

    Cloudflare OS 開放全託管等待名單,新增 GitHub 倉庫與 Google Workspace 支援

    Cloudflare OS 開放全託管部署的等待名單:企業只需在 Cloudflare 控制台指定自訂域名、Access 策略與 AI Gateway,其餘配置與運維由 Cloudflare 負責。該產品上月開源,已有數千家組織用它處理公司資料、生成文件幻燈片和自動化任務。

  6. Latent Space● 精選AI 評分84

    Gemini 4 Argon 發布,輸出上限 100 萬 token,僅限安全預覽

    Google DeepMind 發布 Gemini 4 Argon,首次支援最高 100 萬 token 輸出,但目前僅在 Fairwind 計劃下對政府使用者與受信任網路安全人員開放預覽,開發者、企業與消費者開放時間未定。標準價 $4/$20 每百萬輸入/輸出 token,首推五折 $2/$10,快取輸入 95% 折扣;19 項公開基準中拿下 13 項第一。100 萬輸出靠新 API 功能 Long Decode Continuation 實現,長回覆會暫停並跨呼叫續寫;

  7. releasebot: ChatGPTAI 評分32

    ChatGPT 上線虛擬試穿與商品收藏功能

    ChatGPT 在移動端和網頁版新增虛擬試穿與商品收藏功能。服裝和配飾的商品列表會出現 Try on 按鈕,點選後拍攝或上傳自拍,即可用 ChatGPT Images 生成試穿效果,參考照片會儲存供後續使用,可在 Settings → Personalization → Reference photos 中更改或刪除。商品還能存入 Favorites,或在 ChatGPT Library 中建資料夾整理。

9月30日星期三 · 1 則

  1. OpenCode releases● 精選AI 評分75

    OpenCode v1.18.34 修復 macOS 27+ 本地編譯執行問題

    OpenCode 發布 v1.18.34,修復本地編譯的 macOS 二進位制在 macOS 27+ 上無法可靠執行的問題,改為編譯後重新簽名,並用 Developer ID 簽名 macOS CLI 發布版。同時模型請求現在會傳送帶名稱空間的會話與父會話身份頭,TUI 的 /status 對話方塊改用 path.sep 提取外掛名,網頁文件修正了 GPT 6.1 Sol 的快取定價。

更早的內容