据動察 Beating 監測,Google 被曝正在研發 Frozen v2 AI 推理晶片。它會把 Gemini 的部分架構直接固化進晶片,減少運行模型時的計算和資料搬運。
內部預計,它每瓦可處理的 Token 數將達到最新 TPU 的 6 至 10 倍。Google 計劃最早於 2028 年部署。
Google 希望用它緩解算力短缺。缺口已迫使 Google Cloud 拒絕部分外部客戶訂單。
Frozen v2 將與 TPU 並行存在。TPU 可以運行不同模型,Frozen v2 則用靈活性換效率。
這也是一場架構押注。未來 Gemini 如果大改底層設計,這批晶片可能無法繼續使用。