AISpot

DeepSeek 4.1 Flash 為何未引業界震動,HN 熱議

Hacker News front page10/7 20:14觀點模型

有文章提出疑問:DeepSeek 4.1 Flash 為何沒有讓業界感到震動。該文在 Hacker News 上獲得 158 分、127 條評論,討論熱度並不低。原文未披露該模型的引數、定價、基準測試等具體資訊。

一篇質疑 DeepSeek 4.1 Flash 未引發行業震動的文章在 Hacker News 拿到 158 分、127 條評論,值得關注新模型發布後業界與開發者反應的人一看。

原標題:Why isn't the industry freaking out about DeepSeek 4.1 Flash?
閱讀原文

評分75 / 55(平均 65,門檻 76)
狀態未入選

相關報導

量子位● 精選10/9 03:11AI 評分81

位元組 Seed 發現 DeepSeek-V4 準確率隨輸入位置週期性波動

位元組 Seed 團隊發現,DeepSeek-V4 系列在 128K 長上下文檢索中的準確率會隨目標資訊的位置以 4 個 Token 為週期起伏,同一條資訊換個位置最多相差 40.2 個百分點,V4-Pro-Base 也有 34.8 個百分點。原因指向其為省記憶體採用的分塊 KV Cache 壓縮:資訊在壓縮視窗內所處相位不同,檢索能力就出現系統性差異,團隊稱之為相位敏感性,並用基於 Qwen3-0.6B 自訓的多種分塊壓縮模型復現了同樣的週期。

機器之心● 精選10/4 07:21AI 評分72

DeepSeek Harness 更新,加入 Claude Code Mods 相容層

DeepSeek Harness 發布 v0.2.1-alpha.1,新增實驗性 Claude Code Mods 相容層,讓按 Claude Code Mods 介面編寫的擴充套件有機會接入 DSH 外掛系統執行。官方稱該相容層主要用於驗證 Mods API 能力,大致屬於 DSH 外掛能力的子集,暫不提供完整實用相容性;diff、agents-md、sec-default 和 telemetry 仍標註為不可執行。

量子位● 精選10/3 03:54AI 評分76

DeepSeek 彈性計算團隊擴招,披露 DSec 沙盒基礎設施

DeepSeek 彈性計算團隊大量招聘,尤其需要資深工程師,併發布技術報告《DeepSeek 彈性計算(DSec):面向大規模 Agent 訓練的沙盒基礎設施》。DSec 支撐 DeepSeek-V4 全部訓練、評測和資料預處理,單個分片約 160 臺伺服器、3 萬 CPU 核心、250TB 記憶體,每天服務約 300 萬個沙盒,高峰線上超 38 萬個,每秒建立 5000 多個。團隊接下來要把 Agent 執行環境的數量和種類擴充成百上千倍。

Hacker News front page10/3 05:13AI 評分58

Google 取消 Gemini Flash 與 Pro 模型免費使用

Google 將停止 Gemini Flash 和 Pro 模型的免費使用,使用者需付費訂閱才能繼續使用。此舉在 r/GeminiAI 社群引發大量討論,使用者對 Flash 被納入付費範圍尤為不滿,認為 Flash-Lite 能力不足。部分使用者表示將轉向 ChatGPT、Claude 或 DeepSeek 等替代方案。