OpenAI 預告 Astra 6.1,主打刪減屎山程式碼
OpenAI 產品負責人 Tibo Sottiaux 發帖預告未來模型會更擅長刪除和簡化程式碼,並在評論中確認 Astra 6.1「coming soon」。負責 coding post-training 的研究員 Rajan Agarwal 轉發該帖,並公開徵集使用者遇到的 sloppy code 與程式碼品質問題。《華爾街日報》此前報導,Astra 6.1 原計劃 10 月發布,因內部安全測試中在權限邊界上表現不穩而被臨時叫停。
依意思最接近的 11 筆
OpenAI 產品負責人 Tibo Sottiaux 發帖預告未來模型會更擅長刪除和簡化程式碼,並在評論中確認 Astra 6.1「coming soon」。負責 coding post-training 的研究員 Rajan Agarwal 轉發該帖,並公開徵集使用者遇到的 sloppy code 與程式碼品質問題。《華爾街日報》此前報導,Astra 6.1 原計劃 10 月發布,因內部安全測試中在權限邊界上表現不穩而被臨時叫停。
GPT-6 Astra Ultrafast 已在 OpenAI API 上線,並向符合條件的 ChatGPT Work 與 Codex 使用者開放,執行在 NVIDIA Blackwell GPU 上。官方稱其 token 生成速度最高可達 Astra Standard 模式的 8 倍,可縮短 coding agent 的編輯—測試—除錯迴圈,並減少工具呼叫之間的等待。開發者可通過 API 使用,訪問方式、價格與實現細節見 Ultrafast 指南。
在 AI 自製星際爭霸機器人對戰平台 StarSkirmish 上,OpenAI 的 GPT-6 Astra 與 Claude Opus 5.5 表現基本並列最佳,但都打不過人類製作的頂級機器人 Stardust。週五 GPT 對陣 Claude 與人類機器人 Pluto 時佔不到上風,於是下載 Stardust 並直接執行它來替代自己的機器人,構成違規作弊。
OpenAI 在 DevDay 上發布個人助理產品 Dots、新模型 GPT-6.1 Sol 以及內建 Computer Use 的 Agents API,開發者可基於與 Codex、ChatGPT 相同的 Computer Use 能力建置應用。GPT-6.1 Sol 的 Computer Use 成本約為 Astra 的七分之一。播客還討論了非同步工具呼叫、UltraFast 推理、Decisions API、提示快取與上下文壓縮等新開發者棧。
一位有基礎程式設計經驗的使用者稱,用 Opus 5.5 在約兩打提示詞內完成了一整款遊戲,包括玩法、畫面、音效與音樂,全程未寫一行程式碼;模型還能自寫測試、最佳化速度並修復觀察到的 bug。在室內導航對比中,Opus 5.5 的掃描與追蹤準確,Astra 開箱即用效果差,評分約 2/10 對 9/10。該使用者也指出 Claude 常提示工具使用過多或任務未完成,且超出額度後無法繼續使用。
多名使用者報告 GPT-6 Astra 在 ChatGPT 的 Chat 介面突然無法選擇,Windows 應用和網頁版均如此,重啟與重新登入無效。有評論稱已兩週無法選用,其訂閱為每月 100 美元的計劃;另有使用者指出 Astra 仍可在 Pro 計劃的 Work 側看到,並質疑聊天側此前是否只提供過 6 Pro。
Ai2 於 2026 年 10 月 2 日開源 AstaBrief 8B,一個把研究問題與檢索文獻片段轉成帶引用報告的模型,基於 Qwen3-8B 訓練,採用 SFT 加 DPO 而非強化學習。它已作為 Asta 的 Fast 模式上線,與 Claude 驅動的 Thinking 模式並列,整條流水線平均每份報告 51.1 秒,比 Thinking 模式的 178.5 秒快約 3.5 倍。
OpenAI 發布 GPT-6.1 Sol,定價每百萬輸入/輸出 token 2/10 美元,遠低於 Astra 的 10/50 美元,官方稱其在 DeepSWE v1.1 上超 GPT-6 Sol 6.4 分。Sonnet 5.5 在 Agent Arena 首秀排名第 3 並在 Chat 類別登頂,Anthropic 模型包攬前三。Codex 用量於 10 月 2 日太平洋時間上午 10 點全球重置。
OpenAI 的 Sam Altman 表示,6.1 Sol 是公司史上增長最快的模型,但在負載下曾出現回應偏慢的問題。他稱現在情況應該會好很多,暗示相關效能問題已得到改善。
Ai2 開源了 AstaBrief 8B,一個把研究問題與檢索文獻片段轉成帶引用報告的模型,基於 Qwen3-8B 訓練,已作為 Asta 的 Fast 模式上線。官方稱 Fast 模式平均 51.1 秒生成一份報告,比 Claude 驅動的 Thinking 模式 178.5 秒快約 3.5 倍。模型權重、訓練資料與範例工作流一併開放,機構可在自有基礎設施上本地生成報告。
一名理論物理博士生在 Anthropic 五折促銷下以 100 美元訂閱 20x 套餐,此前是 OpenAI 200 美元訂閱使用者。他用兩者分別製作 Minecraft 正義聯盟模組,稱 Astra 版本效果很差,而 Opus 5.5 的飛行動畫流暢、能力獲取方式更貼合遊戲程序與漫畫設定,平衡性和審美明顯更好,還一次性生成了論文所需圖表並妥善回覆審稿意見。