DeepSeek V4.1 Flash模型發佈:更強、更快、更普惠
【CNMO科技消息】9月10日,DeepSeek正式發佈DeepSeek V4.1 Flash模型。這是其全新模型結構系列中的最小尺寸的模型,具備原生多模態視覺理解能力。
DeepSeek
據CNMO科技瞭解,DeepSeek V4.1 Flash爲552B參數的MoE模型,採用全新的Causal-Encoder-Decoder結構,輸入和輸出不對稱,輸入激活只有8B,輸出激活16B,成本顯著低於已知的同尺寸模型。同時,V4.1 Flash還採用了新的預訓練方式、經過了更大規模的強化學習後訓練,在基準測試中,成功超越了包括DeepSeek V4 Pro在內的一衆旗艦模型的智能水平。
新一代模型大幅減少了KV Cache緩存的大小,與上一代模型相比,對HBM的需求減少到1/4,對SSD的需求減少到1/8。在Agent使用場景中,緩存命中的費用往往佔比較高,對KV Cache的壓縮大幅降低了Agent類任務的使用成本。
此外,DeepSeek V4.1 Flash已同步上線DeepSeek API,原生支持多模態,將模型名稱更改爲deepseek-flash即可調用最新的V4.1 Flash模型。舊版本模型V4 Flash 與 V4 Flash Vision Exp現已下線,出於兼容考慮,模型名deepseek-v4-flash、
deepseek-v4-flash-vision-exp將被暫時路由到V4.1 Flash。
得益於模型架構的創新,DeepSeek V4.1 Flash能夠以更低的成本服務更多的用戶,因此DeepSeek相應下調了V4.1 Flash 的定價。同時,爲了更合理地調配資源,其仍然採用峯谷定價,閒時價格爲高峯時段價格的一半。新價格於2026年9月10日12:00開始生效。