X @deepseek_ai● 精選9/10 07:10AI 評分75
DeepSeek V4.1-Flash 上線 API,原生多模態
DeepSeek 在 API 上線 V4.1-Flash,原生支援多模態,模型名設為 deepseek-flash。V4-Flash 與 V4-Flash-Vision-Exp 已退役,舊名暫時路由到新模型;多方測試稱 V4.1-Flash 在效能、成本、速度和總執行時間上均超過 V4-Pro,V4-Pro 正被淘汰。
找到 5 筆
DeepSeek 在 API 上線 V4.1-Flash,原生支援多模態,模型名設為 deepseek-flash。V4-Flash 與 V4-Flash-Vision-Exp 已退役,舊名暫時路由到新模型;多方測試稱 V4.1-Flash 在效能、成本、速度和總執行時間上均超過 V4-Pro,V4-Pro 正被淘汰。
DeepSeek 發布 V4.1-Flash:552B MoE、原生多模態,已上線 DeepSeek API(模型名 deepseek-flash),舊版 V4-Flash 與 V4-Flash-Vision-Exp 退役。新因果編碼器–解碼器架構只有 8B 輸入、16B 輸出啟用引數,KV 快取降至上一代的 1/4 HBM 與 1/8 SSD,官方稱多方測試顯示其在效能、成本、速度和總執行時間上超過 V4-Pro,V4-Pro 將逐步淘汰。
DeepSeek 發布 V4.1-Flash,採用更高效架構,API 價格下調,新價格於 2026 年 9 月 10 日 04:00 UTC 生效。繼續實行峰谷定價,低谷費率為高峰的 50%,彈性工作負載可安排在低谷時段以節省成本。
DeepSeek 發布 V4.1-Flash,其 KV cache 相比上一代只需 1/4 的 HBM 和 1/8 的 SSD 儲存。官方指出快取命中費用常佔 agent 成本很大比例,壓縮快取可顯著降低這部分開銷。
DeepSeek 表示將與開源社群緊密合作,為 V4.1-Flash 提供推理支援,並探索更多部署選項。官方同時放出模型與論文連結,並稱可承接 2000 塊 GPU 加儲存叢集的大規模部署需求。