据动察 Beating 监测,Artificial Analysis 公布最新 Token 效率对比。本月已有 5 家以上实验室密集发新模型,OpenAI 仍占据大部分帕累托前沿。
所謂帕累托前沿,就是同等智能下,沒有別的模型能用更少 Token。GPT-5.6 Sol max 得 59 分,每項任務平均消耗約 1.5 萬輸出 Token。Claude Fable 5 得 60 分,消耗約 3.3 萬 Token。
GPT-5.6 Sol 的輸出單價為每百萬 Token 30 美元,並不便宜。但在這套測試中,每項任務成本仍只有 1.04 美元,約為 Fable 5 的三分之一。OpenAI 自家的 Terra 和 Luna 沒有進入這條效率前沿。