動察 Beating AI 快訊,DeepSeek 正式發布 V4.1 Flash。新模型總參數 552B(5520 億),採用全新的 Causal-Encoder-Decoder 架構,並原生支援圖片理解。它也是 DeepSeek 這套新架構系列裡目前最小的模型。
這套架構把輸入和輸出分開處理。讀取輸入時只激活 8B(80 億)參數,生成回答時激活 16B(160 億)。DeepSeek 稱,這讓 552B 的大模型也能把推理成本壓下來。經過新的預訓練和更大規模強化學習後,V4.1 Flash 在官方基準中已經超過 V4 Pro。
緩存也被大幅壓縮。相比上一代,V4.1 Flash 對 HBM 顯存的需求降至 1/4,SSD 存儲需求降至 1/8,主要用來降低長上下文和 Agent 反覆調用時的成本。
V4.1 Flash 已同步上線 API,模型名改成 deepseek-flash 即可調用。