header-langage
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
掃碼下載APP

DeepSeek V4.1 Flash正式發布:552B新架構,輸入只激活8B

動察 Beating AI 快訊,DeepSeek 正式發布 V4.1 Flash。新模型總參數 552B(5520 億),採用全新的 Causal-Encoder-Decoder 架構,並原生支援圖片理解。它也是 DeepSeek 這套新架構系列裡目前最小的模型。


這套架構把輸入和輸出分開處理。讀取輸入時只激活 8B(80 億)參數,生成回答時激活 16B(160 億)。DeepSeek 稱,這讓 552B 的大模型也能把推理成本壓下來。經過新的預訓練和更大規模強化學習後,V4.1 Flash 在官方基準中已經超過 V4 Pro。


緩存也被大幅壓縮。相比上一代,V4.1 Flash 對 HBM 顯存的需求降至 1/4,SSD 存儲需求降至 1/8,主要用來降低長上下文和 Agent 反覆調用時的成本。


V4.1 Flash 已同步上線 API,模型名改成 deepseek-flash 即可調用。

举报 糾錯/舉報
糾錯/舉報
提交
新增文庫
僅自己可見
公開
保存
選擇文庫
新增文庫
取消
完成