ttok 1.0 發布:預設分詞器改用 GPT-5/GPT-6
ttok 1.0 發布,預設分詞器從 GPT-4 改為 GPT-5/GPT-6。OpenAI 尚未官方確認 GPT-6 沿用 GPT-5 系列的分詞器,但 William Liu 的實驗顯示,5.5、5.6 Sol/Terra/Luna 與 6 Astra/Sol/Luna 這七個 GPT 模型在 31 個樣本上 token 數完全一致,均為 44,794,GPT-6 在這批語料上沒有增加輸入 token。
原標題:ttok 1.0
閱讀原文
| 評分 | 48 / 45(平均 46,門檻 65) |
|---|---|
| 狀態 | 未入選 |
相關報導
tiktoken 命令列工具 ttok 發布 0.4,新增 --list-models
基於 OpenAI 開源 tiktoken 庫的命令列 token 計數工具 ttok 發布 0.4 版,新增 --list-models 命令可列出可用模型,同時修復了一處 Click 警告並更新了 CI。該專案已約兩年沒有更新,這次屬於維護性版本。ttok 可直接通過 uvx 執行,例如把檔案內容用管道傳入 cat file.txt | uvx ttok 就能統計其中的 token 數。
OpenAI 上線 GPT-6 Astra Ultrafast,基於 NVIDIA Blackwell
GPT-6 Astra Ultrafast 已在 OpenAI API 上線,並向符合條件的 ChatGPT Work 與 Codex 使用者開放,執行在 NVIDIA Blackwell GPU 上。官方稱其 token 生成速度最高可達 Astra Standard 模式的 8 倍,可縮短 coding agent 的編輯—測試—除錯迴圈,並減少工具呼叫之間的等待。開發者可通過 API 使用,訪問方式、價格與實現細節見 Ultrafast 指南。
OpenAI 宣布 GPT-6 提速 50%,第三方實測訂閱額度只有 Claude 的 1/5
OpenAI 兌現 28 天連更承諾的第 1 天更新:GPT-6 Astra 與 GPT-6.1 Sol 預設速度提升約 50%,輸出從 30 TPS 提到 50 TPS,使用者無需操作、兩小時內生效,並覆蓋 OpenCode、Pi、Amp、Devin 等通過 Sign in with ChatGPT 接入的合作伙伴。
llama.cpp 合併 GLM5-Next MTP 支援,可作 draft 模型
llama.cpp 合併 PR #29928,為 GLM5-Next 加入多 token 預測(MTP)的 NextN 計算圖,使其能作為投機解碼的 draft 模型使用。改動包括支援只含 NextN 層或只含主幹張量的拆分 GGUF 檔案載入,並把 MTP 圖按輸出行裁剪,無輸出行的 4-token catch-up 核心耗時從 6.9 ms 降到 2.9 ms,貪心輸出雜湊與 draft 接受率不變。
OpenAI 向全體 ChatGPT 使用者推出 GPT‑6 與 Intelligent UI
OpenAI 於 10 月 7 日發布面向所有 ChatGPT 使用者的 GPT‑6,覆蓋每週超過 12 億的使用者;上個月首批 GPT‑6 模型僅向付費使用者開放。新模型在 ChatGPT 中引入 Intelligent UI,能把回答組織成文字、圖形、可點按鈕、表單、圖表與可互動元件的組合,形式依問題而定,純文字回答依然保留。官方範例中,一份週日烤羊排計劃會同時給出按人數換算的羊肉與土豆用量表、分時段安排和步驟說明。