搜尋 關鍵字 語意 找到 12 筆
OpenAI News10/2 00:00 AI 評分40
Chatham Financial 公布其使用 OpenAI Codex 與 GPT-5.6 重構資本市場工作流的進展,交易驗證時間從約 30 分鐘縮短至 4 分鐘以內。該應用由 Codex 開發,自動收集交易證據、比對關鍵條款並標記差異,目前仍在與資深稽核人員的真實交易結果做對照驗證。公司內部員工建置平台 Chatham Vibes 預設使用 GPT-5.6 Terra,可選升級 GPT-5.6 Sol;
機器之心● 精選 10/10 10:36 AI 評分72
田淵棟在播客中稱,把 GPT-5 當合作者完成在 Meta 的最後一篇論文(grokking 研究)後,效率提升約 6 到 10 倍,由此判斷自己的工作五年內會被取代,於是聯合創辦 Recursive Superintelligence。該公司今年 5 月結束隱身,以 46.5 億美元估值融資超 6.5 億美元,GV 和 Greycroft 領投,輝達、AMD 參投。他同時強調模型自己想出的點子仍很平庸,研究閉環中最難自動化的是提出想法,並表示公司會開源研究成果。
Simon Willison10/9 00:34 AI 評分46
ttok 1.0 發布,預設分詞器從 GPT-4 改為 GPT-5/GPT-6。OpenAI 尚未官方確認 GPT-6 沿用 GPT-5 系列的分詞器,但 William Liu 的實驗顯示,5.5、5.6 Sol/Terra/Luna 與 6 Astra/Sol/Luna 這七個 GPT 模型在 31 個樣本上 token 數完全一致,均為 44,794,GPT-6 在這批語料上沒有增加輸入 token。
OpenAI News10/8 12:00 AI 評分30
Pollo AI 推出影片創作 Agent,呼叫 OpenAI 的 GPT-5.6、GPT-6 Astra 與 GPT-Image-2.5 完成從創意到成片的全流程。系統用 GPT-5.6 做任務路由,GPT-6 Astra 負責敘事與分鏡等複雜推理,影像統一交給 GPT-Image-2.5,官方稱使用者挑選或切換模型的時間減少 50% 以上。平台已有超 2600 萬使用者,30% 的創作會話從模板開始;
Hacker News front page● 精選 10/8 00:46 AI 評分80
LLM 從零將 TypeScript 編譯器移植為 Rust 版 tsc-rs 併發布,Claude Opus 5.5 用兩週、約 24,047 美元 API 費用完成;此前用 OpenAI 的 GPT-5.6 Sol 與 GPT 6 Astra 花掉逾 40 萬美元仍未突破約 84% 相容度。
OpenAI Codex changelog● 精選 9/22 00:00 AI 評分92
GPT-6 Sol 和 GPT-6 Luna 正陸續登陸 Codex 與 ChatGPT Work,token 價格低於前代 GPT-5.6。Sol 面向複雜編碼與 agentic 工作流,Luna 面向高頻聚焦任務。Plus、Pro、Business、Enterprise、Edu 使用者可逐步獲得,Free 與 Go 使用者可在桌面應用使用 Luna;Enterprise 管理員需手動啟用。ChatGPT 中僅 Work 和 Codex 可用,Chat 不可用;
機器之心● 精選 10/8 02:35 AI 評分94
OpenAI 宣布 GPT-6 面向全球所有 ChatGPT 使用者開放,取代 ChatGPT 中的 GPT-5.6 Sol 與 Luna;Plus、Pro、Business、Enterprise 今天起逐步開放,Free 與 Go 使用者明天開始。最受關注的新能力是 Intelligent UI:模型可自主組合文字、圖表、按鈕與表單,生成可互動的回答介面,也能按需即時做出計算器、賬單分攤工具等小工具。
量子位● 精選 10/8 01:07 AI 評分94
OpenAI 從 10 月 8 日起向 ChatGPT 免費和 Go 使用者推送 GPT-6 Luna,替換此前的 GPT-5.6 Luna,Plus、Pro 等付費使用者則從 10 月 7 日起使用 GPT-6 Sol。新版聊天框加入 Intelligent UI,可按問題生成圖表、按鈕、計算器等互動元件,並能在思考時先給出部分回答,聯網搜尋問題的首答時間平均比上一代早 44%。
Kimi blog● 精選 10/2 21:11 AI 評分88
月之暗面發布 Kimi K3,2.8T 引數,號稱全球首個開源 3T 級模型,具備原生視覺與 100 萬 token 上下文,已在 Kimi.ai、Kimi Work、Kimi Code 和 Kimi API 上線,預設使用最高思考強度。官方稱其整體效能仍落後 Claude Fable 5 與 GPT 5.6 Sol,但在自測中達到前沿水平,並優於其他受測模型。完整權重將於 2026 年 7 月 27 日發布,技術報告隨後公布。
OpenAI News10/8 12:00 AI 評分46
法律 AI 公司 LegalOn 通過在 GPT-6 Luna、GPT-6.1 Sol 和 GPT-6 Astra 之間按任務複雜度選型,把 Codex 的預估日成本降低約 65%,同時保持開發速度。此前開發者可無限使用 GPT-5.5 的 Fast 模式,公司隨後預設限制 Fast 模式,並按部門、小組和個人設定月度用量與預算上限。輕量任務交給 Luna 寫程式碼,Sol 負責常規設計、資料分析與文件,Astra 處理架構設計等複雜判斷;
機器之心● 精選 10/10 02:42 AI 評分75
人大高瓴 GeWu-Lab、智源研究院等提出 ROMA 系統,讓多感測器機器人主動與物體互動來補全物理理解,其 ROMA-7B 模型在 ROMA Bench 的 2100 道題上取得 72.9% 成功率,整體與 GPT-6 Astra 持平,並超過 GPT-5.4 與 Gemini 3.5 Flash。該工作同時開源了覆蓋近 2000 個真實物體、視聽觸力四模態同步採集的互動資料集 ROMI-2K,以及包含單鏈、多鏈和意圖驅動三類任務的評測基準。
機器之心● 精選 10/5 11:40 AI 評分72
VA-Bench 用 14 類機器人操作任務、280 個物理驗證場景測試 12 個主流多模態模型,發現目標識別與定位可達 100%、操作語義理解接近 100%,但完整任務成功率最高的 Qwen3.8-max、Opus-5、GPT-5.6-sol 分別只有 53.93%、52.86%、51.55%。測試中模型先觀看成功示範影片,但拿不到物體座標與專家軌跡,需自行決定是否消耗步數切換視角,並直接給出移動距離、旋轉角度與夾爪開合時機。