OpenRouter 上線 Model Router Benchmarks 路由器評測頁
OpenRouter 推出 Model Router Benchmarks 頁面,用品質、速度、成本三個維度對比各家模型路由器,併合成 0 到 10 分的 Router Index。預設權重是品質 60%、每任務時間 20%、成本 20%,頁面上可拖動滑塊自行調整。
找到 8 筆
OpenRouter 推出 Model Router Benchmarks 頁面,用品質、速度、成本三個維度對比各家模型路由器,併合成 0 到 10 分的 Router Index。預設權重是品質 60%、每任務時間 20%、成本 20%,頁面上可拖動滑塊自行調整。
DeepSeek 發布 V4.1-Flash,採用更高效架構,API 價格下調,新價格於 2026 年 9 月 10 日 04:00 UTC 生效。繼續實行峰谷定價,低谷費率為高峰的 50%,彈性工作負載可安排在低谷時段以節省成本。
DeepSeek 在 API 上線 V4.1-Flash,原生支援多模態,模型名設為 deepseek-flash。V4-Flash 與 V4-Flash-Vision-Exp 已退役,舊名暫時路由到新模型;多方測試稱 V4.1-Flash 在效能、成本、速度和總執行時間上均超過 V4-Pro,V4-Pro 正被淘汰。
一位使用者用 15 分鐘限時提示,讓 Opus 5.5 和 Sol 6.1 分別用 three.js 建置可旋轉視角的簡化版布萊德湖城堡。Opus 5.5 用時 5 分 46 秒,約 300k 輸入加 18k 輸出 token,估算 API 成本約 1.56 美元;Sol 6.1 用時 11 分 2 秒,約 400k 輸入加 16k 輸出 token,估算約 0.96 美元。Opus 5.5 產出約 27 KB、520 行、3 個 CDN 指令碼;
OpenAI 在 DevDay 上發布 GPT-6.1 Sol、個人助理產品 Dots,以及內建 Computer Use 的 Agents API,開發者可基於與 Codex、ChatGPT 相同的 Computer Use 建置應用。Ari Weinstein 稱 GPT-6.1 Sol 成本是 Astra 的五分之一,用在 Computer Use 上只需七分之一。
一位使用者在 Blender 中使用 Claude Opus 5.5 做 blockout 時發現,直接畫出空間意圖比用文字描述形狀更高效,因為文字擅長說明是什麼,卻不擅長表達位置、大小和數量。整個實驗共消耗 33M tokens,API 成本 16.07 美元,執行 48.5 分鐘,貼圖與夜空素材來自 Poly Haven 的 CC0 資源。作者因此不再用文字描述形狀,而是給 Claude 提供繪圖或空間參考。
DeepSeek 發布 V4.1-Flash:552B MoE、原生多模態,已上線 DeepSeek API(模型名 deepseek-flash),舊版 V4-Flash 與 V4-Flash-Vision-Exp 退役。新因果編碼器–解碼器架構只有 8B 輸入、16B 輸出啟用引數,KV 快取降至上一代的 1/4 HBM 與 1/8 SSD,官方稱多方測試顯示其在效能、成本、速度和總執行時間上超過 V4-Pro,V4-Pro 將逐步淘汰。
使用者 basnijholt 在 Reddit 發帖並附上部落格文章,論證自託管 AI 並不比用 API 更省錢,但他表示自己照樣會做。他提出兩點:把 200 美元的訂閱(如 Opus 5.5、Astra)與 Qwen 3.8 27B 這類本地模型直接比價並不對等;他也不會把 200 GB 的郵件、聊天記錄和位置歷史交給 API,哪怕對方承諾零資料保留。帖子發出後引發了不少爭議。