StepFun 的 Step 5 Preview 上線 OpenRouter,1M 上下文
StepFun 的旗艦模型 Step 5 Preview 已在 OpenRouter 上線,採用稀疏 MoE 架構(啟用 27B、總引數 600B),支援 100 萬 token 上下文,主打跨大型程式碼庫與文件的多步 agentic 任務,於 2026 年 10 月 8 日發布。定價為每百萬 token 輸入 1 美元、輸出 2.70 美元,快取命中率約 93.5%,實際加權平均輸入價約 0.096 美元。
StepFun 的 1M 上下文 MoE 旗艦模型登陸 OpenRouter,公開了每百萬 token 輸入 1 美元、輸出 2.7 美元的定價,以及工具呼叫錯誤率 0.86% 等執行指標,可供按成本與可靠性做 agent 模型選型的開發者參考。
原標題:Step 5 Preview, a 1M-context MoE from StepFun, shows up on OpenRouter
閱讀原文
| 評分 | 68 / 77(平均 72,門檻 76) |
|---|---|
| 狀態 | 未入選 |
相關報導
openJiuwen X-Router 首發,實測減少 50%+ Token 消耗
openJiuwen 團隊發布自演進模型路由技術 X-Router,在 PinchBench 全量 147 個任務實測中,靜態路由得分 66.3%、成本 $8.25,相比全量呼叫 Kimi-K2-Thinking 的 71.36%、$11.11,成本降低 44.6%。該技術基於五檔複雜度分檔路由,用本地 Qwen3-0.6B 做程序內分類器,支援端雲分級與 Bandit 自演進,並已接入 WorkSwarm 的 MoA 多模型協同。
Opus 5.5 跑 28 分鐘生成單檔案網頁,花費 6.17 美元
一位使用者用自訂 Pi agent 搭配 High 思考檔位的 Opus 5.5,耗時 27 分 45 秒、花費 6.17 美元(主 agent 4.97 美元、設計審查 agent 1.21 美元),產出一個 1029 行、零依賴的 HTML 檔案。輸出 122,689 tokens,其中思考 66,163 tokens;總 token 約 600 萬,約 95% 為快取讀取。
OpenRouter 發布 Model Router Benchmarks 對比頁
OpenRouter 於 2026 年 10 月 2 日上線 Model Router Benchmarks 頁面,用品質、速度、成本三個維度對多家模型路由器打分,並給出 0 到 10 的 Router Index 綜合分,預設權重為品質 60%、單任務耗時 20%、成本 20%,使用者可拖動滑塊調整。
Getting the most out of Opus 5.5 in Claude and Claude Code
Anthropic 於 2026 年 9 月 22 日發布由 Addy Osmani 撰寫的 Opus 5.5 使用指南,覆蓋 Claude 應用與 Claude Code。Opus 5.5 每次回覆前都會自行思考,無需再寫「think carefully」;它更擅長長時間多步驟任務,早期測試者可讓其連續數小時執行編碼任務。指南建議一次性給出完整任務與完成標準、在 CLAUDE.md 中寫明何時停下詢問、用子代理拆分大型審計或遷移,並把任務清單寫入檔案。
使用者實測 Opus 5.5 程式設計能力遠超 Astra
一位有基礎程式設計經驗的使用者稱,用 Opus 5.5 在約兩打提示詞內完成了一整款遊戲,包括玩法、畫面、音效與音樂,全程未寫一行程式碼;模型還能自寫測試、最佳化速度並修復觀察到的 bug。在室內導航對比中,Opus 5.5 的掃描與追蹤準確,Astra 開箱即用效果差,評分約 2/10 對 9/10。該使用者也指出 Claude 常提示工具使用過多或任務未完成,且超出額度後無法繼續使用。