AISpot

GPT

近期事件

  1. 1
    熱度 0.92 個來源 · 2 則10/3 16:36
  2. 2
  3. 3

10月4日星期日 · 1 則

  1. 量子位AI 評分44

    Meshy 不到兩年 ARR 從 100 萬漲到 1 億美元

    AI 3D 生成公司 Meshy 披露,其 ARR 從 100 萬美元增長至 1 億美元,用時不到兩年,比 HeyGen 的 29 個月更快。增長來自三層收入:個人訂閱、企業 API(三七互娛、網易遊戲、Nexon 等已接入生產管線)以及 3D 列印硬體生態(拓竹、創想三維等)。Meshy 7.1 將幾何生成解析度從 2048³ 提升至 4096³,並推出即時互動架構 Mora。

10月3日星期六 · 6 則

  1. Hugging Face blogAI 評分55

    微軟發布 ThinkingBox,按資料庫終態給 AI agent 打分

    微軟與 Hugging Face 聯合發布 ThinkingBox,通過 Hugging Face 提供,用 507 個有狀態業務流程、每個任務重複 20 次來評測 agent 留下的後端狀態與副作用,而非只看工具呼叫和最終回覆。在 121,680 次有效試驗中,79,853 次未通過可執行檢查,其中 67.24% 仍乾淨結束並呼叫了改狀態的工具、未報錯。

  2. r/OpenAI top of the dayAI 評分62

    GPT-6 Astra 在 ChatGPT 聊天側消失,Pro 工作區仍可見

    多名 ChatGPT Pro 使用者報告 GPT-6 Astra 模型在 Chat 介面突然無法選擇,但在 Work 側仍可見。發帖者稱已連續數週用它進行詳細對話,Windows 應用和網頁端均消失,重啟與重新登入無效。有評論者表示已兩週無法選擇該模型,其訂閱為每月 100 美元方案;也有人質疑聊天側此前是否上線過 GPT-6 系列。

  3. r/OpenAI top of the day● 精選AI 評分80

    OpenAI 發布 GPT-6 系列模型指南

    OpenAI 發布了 GPT-6 系列的模型指南,內容涵蓋模型選擇、推理強度(reasoning effort)與工具使用。該指南面向使用 GPT-6 系列的開發者,幫助其在具體場景中決定選哪個模型、投入多少推理算力以及如何呼叫工具。原文未披露具體模型型號、引數或發布時間等細節。

  4. r/OpenAI top of the dayAI 評分56

    ChatGPT 跑 30 分鐘才報用量超限,不提前提醒

    有使用者用 GPT-6 Astra 處理 10 萬字元以上素材生成 70 多頁文件時,任務跑 30 到 40 分鐘、消耗大量算力後,直接報 5 小時用量上限錯誤,一個字都沒輸出。使用者只能新開對話、縮小任務重試,反覆多次。按 ChatGPT 與 Gemini 估算,這類大規模執行每次 API 等效算力成本約 3 到 5 美元。

  5. Latent Space● 精選AI 評分85

    GPT-6.1 Sol 發布,Sonnet 5.5 登頂 Agent Arena

    OpenAI 發布 GPT-6.1 Sol,定價 $2/$10 每百萬輸入/輸出 token,比 Astra 的 $10/$50 便宜約 80%,在 DeepSWE v1.1 上比 GPT-6 Sol 高 6.4 分。Sonnet 5.5 在 Agent Arena 首秀排第 3 並在 Chat 類別登頂,Anthropic 包攬前三;Sol 每任務中位成本 $0.56,比 GPT-6 Sol 便宜 39%。

  6. r/ClaudeAI top of the dayAI 評分21

    開發者用 Claude 一週做出飛艇版 FTL 遊戲

    一位開發者用 Claude 200 美元月費方案和 GPT 100 美元月費方案,在一週內做出了一款類似 FTL 的飛艇策略遊戲 Magehold: Fairwinds,目前可在 mageholdworld.com 免費試玩,幾週後登陸 Steam。遊戲支援 Linux 和 Mac,含 7 種語言本地化和 100 個 Steam 成就,Claude 還生成了美術資產、測試機器人和預告片。作者稱整體迭代 30 多次,後續將加入分支任務鏈和天氣效果。

10月2日星期五 · 9 則

  1. Hacker News front pageAI 評分63

    三款 AI agent 多語言實測:權限請求與註冊行為差異明顯

    技術與人權研究者 Roya Pakzad 發布對比測試,用世界銀行全球公共採購資料庫任務,分別以英文(美國)和波斯語(伊朗)在網頁版 Muse、Claude Cowork Opus 5.5、GPT 6.1 Sol 上執行。權限差異明顯:GPT 只在開頭請求一次網站訪問並提供允許所有相關網站選項,Claude 兩個任務各請求 9 次,Muse 到第四步才請求。

  2. Hacker News front pageAI 評分42

    開源工具用 GPT-6 Astra 與 Opus 5.5 生成 LDraw 樂高模型

    一位開發者發布了開源樂高 AI 生成器:一套 Python 工具、指令與文件,讓 AI agent 直接生成 LDraw 語言的樂高 CAD 模型。作者從去年 12 月開始試驗用 ChatGPT 和 Claude 寫 LDraw 程式碼,最終用 GPT-6 Astra 和 Opus 5.5 跑通,並打包成 Docker 化 Web 應用,可選 OpenAI、Claude、OpenRouter 三類提供方。

  3. r/ClaudeAI top of the dayAI 評分33

    r/ClaudeAI 討論:重度工作用 Opus 5.5,GPT 靠額度與畫圖

    r/ClaudeAI 一條 22 小時前的帖子問同時用 Claude 和 GPT 的人更偏好哪個,30 條評論後自動總結出的共識是:兩者都用,但嚴肅工作首選 Claude(尤其是 Opus 5.5),用於編碼、深度邏輯與科學任務;最大抱怨是 Claude Pro 額度消耗遠快於 GPT Plus。使用者繼續付費 GPT 的原因包括更寬鬆的訊息上限、DALL-E 影像生成,以及閒聊與頭腦風暴。常見工作流是先用 GPT 出想法和一般查詢,再切到 Claude 執行和打磨成品。

  4. 量子位AI 評分58

    丘成桐新論文致謝 GPT 6 Astra 與 Claude Pro

    丘成桐參與的最新論文在致謝中感謝 GPT 6 Astra 與 Claude Pro,稱兩者幫助探索了部分證明思路和計算。論文證明七維空間的 28 種球面(含 27 種怪球)都能配上截面曲率嚴格為正的度量,補上了 2020 年非負曲率結果到正曲率的最後一步;該問題是丘成桐 1982 年列進自己問題清單的第二位,已懸置約 70 年。論文附帶一套 SageMath 編寫的驗證程式碼,作者宣告人工驗證與論文寫作由自己負責,結論仍待數學界接受。

  5. Latent Space● 精選AI 評分79

    Pi 1.0 與 Pi Durable 發布,Pi 移植到 TypeScript

    Pi 1.0 與 Pi Durable 同日發布並登上 Hacker News 首頁,Pi 已加入 Earendil。Pi 1.0 新增 Codemode(原生支援 MCP、Jev 和影像模型)、虛擬模型擴充套件、延遲工具載入、Anthropic 模型快取預熱、對話中途系統訊息、新 TUI 主題與預設全屏。Pi Durable 把 Pi 移植到 TypeScript 並外接全部有狀態元件:每步記錄為檢查點任務,程序失敗或重啟後 agent 與子 agent 自動恢復;

  6. OpenAI NewsAI 評分43

    Chatham 用 Codex 與 GPT-5.6 把交易驗證從 30 分鐘壓到 4 分鐘內

    Chatham Financial 使用 Codex 和 GPT-5.6 建置技術並重新設計工作流,把交易驗證時間從 30 分鐘縮短到 4 分鐘以內。這是 OpenAI 公布的客戶案例,說明 Codex 加 GPT-5.6 的組合已進入資本市場業務的實際生產流程,而不只是寫程式碼。對做 coding agent 的人來說,可參考它把模型能力接到具體業務流程、以縮短單次任務耗時為目標的做法。

  7. NVIDIA blog● 精選AI 評分86

    OpenAI 上線 GPT-6 Astra Ultrafast,跑在 NVIDIA Blackwell 上

    GPT-6 Astra Ultrafast 已上線,執行在 NVIDIA Blackwell GPU 上,面向 OpenAI 內部以及符合條件的 ChatGPT Work 和 Codex 使用者開放,token 生成速度最高可達 Astra Standard 模式的 8 倍。開發者今天就能通過 API 呼叫,接入方式、定價與實現細節見官方 Ultrafast 指南。更快的生成可縮短 coding agent 的編輯—測試—除錯迴圈,減少工具呼叫之間的等待時間。

10月1日星期四 · 4 則

  1. 量子位● 精選AI 評分80

    Google 突然發布 Gemini 4 Argon,多項榜單登頂

    Google 於 2026 年 10 月 1 日發布 Gemini 4 Argon,在 DeepSWE v1.1 長期軟體工程任務得 77.9%,高於 Claude Opus 5.5 的 74.2% 和 GPT-6 Astra 的 74.1%,並以 68.90% 登頂 Vals Index。定價為每百萬輸入 Token 2 美元、輸出 Token 10 美元,優惠期單題成本比 Astra 低約四成,輸出上限達百萬 Token。

  2. Latent Space● 精選AI 評分84

    Gemini 4 Argon 發布,輸出上限 100 萬 token,僅限安全預覽

    Google DeepMind 發布 Gemini 4 Argon,首次支援最高 100 萬 token 輸出,但目前僅在 Fairwind 計劃下對政府使用者與受信任網路安全人員開放預覽,開發者、企業與消費者開放時間未定。標準價 $4/$20 每百萬輸入/輸出 token,首推五折 $2/$10,快取輸入 95% 折扣;19 項公開基準中拿下 13 項第一。100 萬輸出靠新 API 功能 Long Decode Continuation 實現,長回覆會暫停並跨呼叫續寫;

  3. Anthropic Research● 精選AI 評分68

    物理學家用 Claude 打造 BootLoops 科研工具

    理論物理學家 Matthew Schwartz 發布開源工具 BootLoops,把 Claude 當作 LLM 的"挽具",專攻適合當前 AI 的"Claude 形狀"問題。他用 Claude Fable 5 移植並改進散射振幅計算方法,還借 BootLoops 把數學物理技術帶到生態學、群體遺傳學、地質、經濟、語言學等領域,並與各領域專家合作篩選真正有價值的問題。BootLoops 開源,可搭配任意模型使用,但當前 AI 仍無法解決科學中的大多數問題。

9月30日星期三 · 2 則

  1. OpenCode releases● 精選AI 評分75

    OpenCode v1.18.34 修復 macOS 27+ 本地編譯執行問題

    OpenCode 發布 v1.18.34,修復本地編譯的 macOS 二進位制在 macOS 27+ 上無法可靠執行的問題,改為編譯後重新簽名,並用 Developer ID 簽名 macOS CLI 發布版。同時模型請求現在會傳送帶名稱空間的會話與父會話身份頭,TUI 的 /status 對話方塊改用 path.sep 提取外掛名,網頁文件修正了 GPT 6.1 Sol 的快取定價。

  2. Latent Space● 精選AI 評分81

    OpenAI DevDay 發布 GPT-6.1 Sol、Dots 與 Agents API

    OpenAI 在 DevDay 上發布 GPT-6.1 Sol、個人助理產品 Dots,以及內建 Computer Use 的 Agents API,開發者可基於與 Codex、ChatGPT 相同的 Computer Use 建置應用。Ari Weinstein 稱 GPT-6.1 Sol 成本是 Astra 的五分之一,用在 Computer Use 上只需七分之一。

9月29日星期二 · 6 則

  1. Simon WillisonAI 評分40

    Photo Scrubber:本地模糊人臉並清除照片後設資料

    Photo Scrubber 是一個實驗性工具,能自動識別照片中的人臉並打碼,同時按名稱所述移除後設資料,處理在本地完成。作者拍下抗議者照片後不願分享陌生人可識別的面孔,於是讓 GPT-6 Astra 做了這個工具。它使用 Google 的 MediaPipe C++ 庫,通過 @mediapipe/tasks-vision 編譯成 WebAssembly,人臉檢測採用 BlazeFace 模型。

  2. OpenAI Codex changelog● 精選AI 評分88

    GPT-6.1 Sol 在 Codex 與 ChatGPT Work 上線

    GPT-6.1 Sol 現已在 Codex 和 ChatGPT Work 中提供,官方稱其複雜工作的表現接近 Astra,但成本低於 Astra。它適合程式碼、應用和文件類可重複、長時間執行的任務,呼叫模型名為 gpt-6.1-sol。可用性取決於你的套餐、客戶端和工作區設定,具體支援情況需查閱 Models 文件來對比與選擇模型。

  3. releasebot: ChatGPT● 精選AI 評分92

    ChatGPT 上線月費 500 美元的 Pro 500,獨佔 GPT-6 Astra Ultrafast

    ChatGPT 推出 Pro 500,月費 500 美元,是 Pro 系列中包含用量最高的方案,並在 ChatGPT Work 與 Codex 中提供 Astra Ultrafast。Ultrafast 是 GPT-6 Astra 的更快服務層,在模型選擇器中選用,先扣套餐內額度、用完再扣積分餘額;Pro 系列中只有 Pro 500 能用,Pro 100 與 Pro 200 即便買積分也不解鎖,上線時僅可通過網頁版 ChatGPT 訂閱。

9月28日星期一 · 1 則

  1. OpenCode releases● 精選AI 評分63

    OpenCode v1.18.33 修復 Cloudflare 超時與 Gemini 思考引數

    OpenCode 發布 v1.18.33:Cloudflare AI Gateway 上的模型現在會遵循 provider 的回應與流超時,Gemini 的 thinking 預設值與 effort 選項也與各代模型支援的控制對齊。同版本還讓 MCP 瀏覽器啟動失敗在啟動器立即退出時被報告,並讓除錯配置輸出遮蔽憑據與敏感 header。

9月22日星期二 · 1 則

  1. OpenAI Codex changelog● 精選AI 評分92

    GPT-6 Sol 與 Luna 登陸 Codex 和 ChatGPT Work

    GPT-6 Sol 與 GPT-6 Luna 正陸續推送至 Codex 與 ChatGPT Work,token 價格低於上一代 GPT-5.6。Sol 適合複雜編碼與 agentic 工作流,Luna 面向高頻、聚焦型任務;Plus、Pro、Business、Enterprise、Edu 使用者均可使用,Free 與 Go 使用者可在桌面端使用 Luna。在 ChatGPT 中兩個模型只在 Work 和 Codex 提供、Chat 裡不可用,需在模型選擇器中選擇;

8月2日星期日 · 1 則