header-langage
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
掃碼下載APP

黃仁勳最擔心的事情正在發生:DeepSeek開始搬離美國主導的AI技術棧,底層組件集體適配華為昇騰

動察 Beating AI 快訊,DeepSeek 聯合華為,把一整套 AI 訓練和推理底層組件搬上了昇騰。新開源的工具覆蓋算子開發、矩陣計算、跨卡通信、Attention 和數據篩選,基本對應 DeepSeek 此前為英偉達 GPU 打造的那套底層工具。路透社稱,這是中國科技公司尋找英偉達生態替代方案的最新進展。


這裡最關鍵的是 TileLang。DeepSeek V4 訓練中的大量算子已經用它實現。它解決的是一個很底層的問題:開發者怎麼把模型裡的計算,真正高效地跑在芯片上。過去這套能力高度圍繞 CUDA 建立,現在 DeepSeek 和華為正在給昇騰補上對應版本。


這正好擊中黃仁勳幾個月前最擔心的事情。今年 4 月,他在 Dwarkesh Patel 的播客裡說,如果有一天 DeepSeek 率先在華為芯片上發布,對美國會是一個「糟糕的結果」。他擔心的從來不只是華為芯片本身,而是模型開始圍繞華為架構優化。一旦全球開發者拿到同一個模型時,默認在非美國硬件上跑得更好,美國芯片的優勢就會被一點點削弱。


DeepSeek 隨後的動作幾乎沿著這條路徑展開。V4 已經開始適配昇騰 950,華為還稱自家芯片參與了部分 V4 訓練。《The Information》上週又披露,梁文鋒已把增加國產芯片訓練列為 DeepSeek 的重點押注,並預計最早第四季度拿到新的華為訓練芯片。


現在補上的是軟件這一層。從模型適配,到訓練芯片,再到矩陣計算、MoE 通信、Attention 和算子開發,DeepSeek 正在把過去嚴重依賴英偉達和 CUDA 的一部分底層能力,逐步遷到華為昇騰上。


中美 AI 博弈過去競爭的是誰的模型更強、誰有更多 GPU;現在開始變成,誰能建立一整套從芯片、算子、通信到訓練框架的技術棧。CUDA 過去最難替代的,從來不是一張顯卡,而是圍繞它長出來的整套軟件。DeepSeek 和華為現在補的,正是這一層。

举报 糾錯/舉報
糾錯/舉報
提交
新增文庫
僅自己可見
公開
保存
選擇文庫
新增文庫
取消
完成