回上列表
DeepSeek V4.1 Flash為552B參數的MoE模型,採用全新的Causal-Encoder-Decoder結構,輸入和輸出不對稱,輸入激活只有8B,輸出激活16B,成本顯著低於已知的同尺寸模型。同時,V4.1 Flash還採用新的預訓練方式、經過更大規模的強化學習後訓練,在基準測試中,成功超越包括DeepSeek V4 Pro在內的一眾旗艦模型的智能水平。
新一代模型大幅減少KV Cache緩存的大小,與上一代模型相比,對HBM的需求減少到1/4,對SSD的需求減少到1/8。在Agent使用場景中,緩存命中的費用往往佔比較高,對KV Cache的壓縮大幅降低Agent類任務的使用成本。
騰訊(00700.HK)旗下WorkBuddy及CodeBuddy,和OpenCode作為官方合作夥伴,現已全量接入DeepSeek V4.1 Flash。
同時,為了更合理地調配資源,DeepSeek仍然採用峰谷定價,閒時價格為高峰時段價格的一半。新價格於今日(10日)12時開始生效。(jl/u)~
阿思達克財經新聞
網址: www.aastocks.com
DeepSeek發布DeepSeek V4.1 Flash模型 基準測試超越V4 Pro等旗艦模型水平
2026/09/10 14:32
DeepSeek公布,正式發布DeepSeek V4.1 Flash模型,是公司全新模型結構系列中的最小尺寸的模型,具備原生多模態視覺理解能力。新模型結構的設計初衷是能力上限更高、推理速度更快、吞吐更大、可擴展到更大參數模型。DeepSeek V4.1 Flash為552B參數的MoE模型,採用全新的Causal-Encoder-Decoder結構,輸入和輸出不對稱,輸入激活只有8B,輸出激活16B,成本顯著低於已知的同尺寸模型。同時,V4.1 Flash還採用新的預訓練方式、經過更大規模的強化學習後訓練,在基準測試中,成功超越包括DeepSeek V4 Pro在內的一眾旗艦模型的智能水平。
新一代模型大幅減少KV Cache緩存的大小,與上一代模型相比,對HBM的需求減少到1/4,對SSD的需求減少到1/8。在Agent使用場景中,緩存命中的費用往往佔比較高,對KV Cache的壓縮大幅降低Agent類任務的使用成本。
騰訊(00700.HK)旗下WorkBuddy及CodeBuddy,和OpenCode作為官方合作夥伴,現已全量接入DeepSeek V4.1 Flash。
同時,為了更合理地調配資源,DeepSeek仍然採用峰谷定價,閒時價格為高峰時段價格的一半。新價格於今日(10日)12時開始生效。(jl/u)~
阿思達克財經新聞
網址: www.aastocks.com
![]() |

