使用者反饋額度重置需先消耗一定用量
一名使用者持有次日到期的額度重置機會,在僅使用 20% 額度時嘗試重置,被系統提示當前用量無需重置。該使用者隨後使用 Astra Extra High 約 15 至 20 分鐘,才成功用掉這次重置。
依意思最接近的 22 筆
一名使用者持有次日到期的額度重置機會,在僅使用 20% 額度時嘗試重置,被系統提示當前用量無需重置。該使用者隨後使用 Astra Extra High 約 15 至 20 分鐘,才成功用掉這次重置。
企業一度鼓勵員工儘可能多地使用 AI,即所謂的 #tokenmaxxing,隨後賬單隨之而來。報導援引一項針對近 400 家企業的調查稱,其中只有 11% 能準確預測自己的 AI 支出。AI 使用量以 token 計量,而企業發現 token 很難統計,這讓 AI 預算幾乎無法編制。
有使用者反映,用 GPT-6 Astra 處理 10 萬字元以上、生成 70 多頁文件時,模型會先執行 30 到 40 分鐘,隨後直接報 5 小時用量限制錯誤,不輸出任何內容。使用者只能新建對話、稍微縮小任務重試,並稱 ChatGPT 與 Gemini 估算這類大規模執行每次 API 等效算力成本約 3 到 5 美元。該使用者質疑 OpenAI 為何不在任務開始前提示拆分,導致算力被浪費。
SemiAnalysis 對 Anthropic、OpenAI 等多家 AI 訂閱計劃做限額實測,結論是同等價位下 Anthropic 訂閱的 API 等價價值是 OpenAI 的 5 倍以上。同一 200 美元/月的 Claude 計劃,其等價價值隨模型與工作負載(輸入、快取寫入、快取讀取、輸出)不同而大幅變化,因此不存在孤立的價值數字。訂閱僅佔 Anthropic 總收入約 10%,卻消耗超過 40% 的推理算力,並把混合每兆瓦收入拉低約 3600 萬美元。
有使用者反映改用 Opus 5.5 後,每週僅用 300M token 就觸及訂閱上限,而此前每週消耗 1-2B token 都沒問題。該使用者指出 Opus 5.5 單 token 價格理論上更低,懷疑是訂閱額度被削減,或與自己大量使用 subagent 有關。目前尚無官方說明。
Reddit 使用者 pensuke89 發帖稱,ChatGPT Plus 的每週用量額度從原先約 80-100 美元 API 等值降至穩定在 49-50 美元,5 小時限額約為 7-8 美元。評論區有使用者指出,OpenAI 已宣布將 200 美元檔位的 API token 額度減半,其他檔位可能同樣被減半。該帖未提供官方確認。
OpenAI 把 API 的付費使用檔位從五個合併為三個:Build、Launch 和 Grow。新的最高檔 Grow 准入門檻為累計 API 付款 500 美元,此前最高檔需要 1000 美元。OpenAI 表示這讓開發者更容易達到更高的 API 速率限制。該訊息由 @OpenAIDevs 於 2026 年 10 月 6 日發布。
Reddit 使用者確認,Claude 的用量重置會按當前訂閱套餐的額度執行,而非按更高檔位。有評論指出,若為月度訂閱,重置實際只相當於 50 美元而非 200 美元;升級套餐本身也會觸發用量重置。另有使用者提到 Pro 套餐附帶 250 美元雲額度,而非 100 美元。
隨著 coding agent 和 personal agent 普及,按量付費的 API 和託管服務容易產生失控賬單,作者主張硬性預算上限應成為預設功能,而非僅發警告郵件的軟上限。AWS 已於 9 月 16 日推出每月支出上限,專案超限即暫停;Google Cloud 也在 7 月上線 Spend Caps,可對專案內特定服務設定月度財務上限。AWS 該功能目前僅向有限客戶開放。
OpenAI CEO Sam Altman 在 2026 年 10 月 1 日發帖表示,使用者應當能夠在任何需要的地方使用自己的 AI 訂閱。該表態未說明具體產品、實施方式或時間表,也未提及是否涉及跨平台或第三方應用。
Cloudflare 宣布已選出首批 30 家非營利與公共利益組織,向其提供總額超過 750 萬美元的開發者服務額度,每家最高 25 萬美元。這些組織用 Cloudflare 的 Workers AI、AI Gateway 等服務建置自動化工具,涵蓋心理健康、地方新聞、人權等領域。Cloudflare 稱其無伺服器架構和 AI Gateway 可降低執行成本並控制模型呼叫費用。
Anthropic 宣布 Claude Max 與 Team 套餐現在每月附帶 API 額度,訂閱使用者可按月領取並用於 API 呼叫。公告未給出具體額度數值、適用模型或有效期,只說明領取方式見幫助文件「API credits for Max and Team plans」。該資訊發布於 2026 年 10 月 7 日。
Claude Code 雲端會話正式隨 Pro、Max、Team 與 Enterprise 訂閱提供,不額外收費,共用原有用量上限,每個任務在獨立虛擬機器上把倉庫克隆到新分支。Pro 與 Max 個人訂閱者可在 10 月 7 日前領取一次性獎勵額度 100 與 250 美元,額度 11 月 4 日過期,不能用於 Projects 或 Routines。會話可從 claude.ai/code、移動端、桌面端、終端和 Slack 啟動,完成後留在分支上供開 PR;
TypeSafe AI 聯合創始人兼 CEO Diogo Almeida 在 Latent Space 訪談中透露,其 System-One 模型 Jev 估值達 100 億美元,日處理量已突破一萬億 token,且夜間流量持續走高,說明大量呼叫來自機器自動化。Jev 1.13.0 在第三方 JevBench v1.2.1 綜合榜以 75.3 分排名第一,發布影片 6 天瀏覽量超 3870 萬。
白宮召集扎克伯格、貝索斯、馬斯克、Anthropic 的 Dario Amodei 等主要科技 CEO 簽署 AI 安全承諾,川普稱其具有道德約束力。川普同時簽署行政令,正式將 AI 重新命名為超級智慧。與此同時,Meta 和 OpenAI 正為 AI 產品換上更友好的形象,但消費者中僅 2% 願意為此付費。
Reddit 的 r/LocalLLaMA 版塊一則帖子被版主以違反第 3 條規則為由刪除,評論區仍在討論 8GB 視訊記憶體加 16GB 記憶體的低配硬體如何跑本地模型。有使用者提到 32GB 記憶體加 12GB 視訊記憶體可執行 LFM2.5,也有人建議 Ling 3.0 tiny 或 Gemma 配合 mmap。另有評論稱專家快取即將進入 llama.cpp,未來或支援從磁碟流式載入專家。
a16z 第七版《百強 AI 消費者應用》報告首次新增月收入榜單,Meshy 位列第 31 名,是榜上唯一的 AI 3D 公司。該榜單依據資料分析公司 YipitData 追蹤的美國消費者銀行卡消費資料排名,同榜還有 OpenAI、Anthropic、Canva、Superhuman、Higgsfield。
OpenAI Codex 負責人 Tibo 承諾,接下來 28 天每天二選一:交付一項對大多數 Codex/Work 使用者明顯有用的改進,或進行一次完整的額度重置。所謂改進既可能是新發布,也可能只是修 Bug;此前他向社群徵集 Codex 還缺什麼,並把工作鎖定在簡化產品、提高效率以支援更多使用、突破性功能和新模型四個方向。
一位使用者表示 6.1 Sol 效率很高,兩小時編碼任務僅消耗每週額度的 2-3%,在 100 美元套餐下很難用完額度,因此考慮降級到 20 美元套餐,但擔心後者 5 小時限制過於受限。該使用者稱願意用速度換取 token 效率,並詢問是否有人也在考慮降級。
輝達援引 SemiAnalysis AgentX 資料稱,Vera Rubin NVL72 每兆瓦吞吐量超過 GB300 NVL72 的 30 倍,在 DeepSeek V4 Pro 上每百萬 token 成本最多低 45 倍。輝達以「高產、耐用、通用」概括 AI 工廠回報邏輯:每兆瓦 token 數決定收益,A100 出貨六年後仍在商用,CoreWeave 已將 2020 年首批裝置的預訂延長至 2029 年。
輝達《State of AI in Telecommunications》報告顯示,89% 受訪者認為開源模型與軟體對公司 AI 戰略重要。運營商看重開源模型的可信任、可控與可定製,用於自主網路、客服等關鍵負載,並把閉源模型留給價值最高的場景;輝達同時發布 300 億引數的 Nemotron 3 Large Telco Model(由 AdaptKey 在開源電信資料集上微調),並提供基於 NeMo 的端到端微調流程。
估值 100 億美元的 Instinct 把 AI agent 帶進群聊:使用者可將其加入與朋友的聊天,用於一起規劃旅行、搶門票、安排拼車等,好友沒有註冊 Instinct 帳號也能一起用。該功能先向 early access 使用者開放,之後擴充套件到全部使用者,使用者可讓 agent 把自己加入試用名單。Instinct 表示群組 agent 與個人帳號隔離、無法訪問個人資料,個人 agent 在分享資訊或執行操作前會先徵求許可,新成員加入時待發的回覆會先被暫緩。