header-langage
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
掃碼下載APP

谷歌要將 Gemini 架構刻入晶片,推理效率最高可提升 10 倍

据動察 Beating 監測,Google 被曝正在研發 Frozen v2 AI 推理晶片。它會把 Gemini 的部分架構直接固化進晶片,減少運行模型時的計算和資料搬運。

內部預計,它每瓦可處理的 Token 數將達到最新 TPU 的 6 至 10 倍。Google 計劃最早於 2028 年部署。

Google 希望用它緩解算力短缺。缺口已迫使 Google Cloud 拒絕部分外部客戶訂單。

Frozen v2 將與 TPU 並行存在。TPU 可以運行不同模型,Frozen v2 則用靈活性換效率。

這也是一場架構押注。未來 Gemini 如果大改底層設計,這批晶片可能無法繼續使用。

举报 糾錯/舉報
糾錯/舉報
提交
新增文庫
僅自己可見
公開
保存
選擇文庫
新增文庫
取消
完成