動察 Beating AI 快訊,智譜上線 GLM-5.3-FlashX,可以理解為 GLM-5.3-Flash 的高速版本,最高輸出速度達到 200 tokens/s。官方這次沒有公佈新的能力跑分或架構變化,更新重點就是繼續提高推理速度。
這次發布正好接在昨天的推理系統優化之後。智譜剛披露,GLM-5.3 驅動的 Infra Agent 參與優化 Flash 的推理基礎設施。不到兩週,端到端吞吐提高到最初約 3 倍,整套服務運行在超過 10 萬張國產 AI 芯片上。