BlockBeats 消息,6 月 21 日,GPU 銷售商 Tinygrad 發文稱,据可靠消息 GLM 5.2 模型在兩台联網 Blackwell 架構 tinybox 上可實現每秒 120 個 token 的推理速度。
該配置售價 15 萬美元,可選雙台標準 tinybox 或單台 tinybox Pro,均可達到上述性能表現。Tinygrad 以此為賣點,主打「一次購買、永不付雲費」的私有化部署路線,直接對標按需計費的雲端推理服務。
目前該消息尚未經 GLM 官方證實,Tinygrad 亦未披露更多技術細節。
---------------------------------
點擊下方原文鏈接,加入動察 Beating · 飛書 AI 新聞渠道,7×24 小時不間斷監測全球 AI 熱點與新聞。