header-langage
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
掃碼下載APP

DeepSeek計劃訓練8萬億參數模型,規模直奔現有最大開源模型近3倍

動察 Beating AI 快訊,DeepSeek 又要把模型做大了。CEO 梁文鋒向投資人透露,公司正在訓練一個 2 萬億參數模型,之後還計劃開發一個 8 萬億參數模型。現有旗艦 V4-Pro 只有 1.6 萬億參數。


8 萬億是什麼概念?目前已經公開權重的超大模型裡,Moonshot AI 的 Kimi K3 達到 2.8 萬億參數,已經是全球最大的開源模型。DeepSeek 規劃中的 8 萬億模型,規模還要再大接近 3 倍。


不過總參數越多,不代表每次運行都要調用全部參數。Kimi K3 就是 MoE 架構,2.8 萬億總參數裡每個 Token 只激活 1040 億。

举报 糾錯/舉報
糾錯/舉報
提交
新增文庫
僅自己可見
公開
保存
選擇文庫
新增文庫
取消
完成