据動察 Beating 監測,Artificial Analysis 終於補上 Qwen3.8-27B 的獨立跑分:Intelligence Index 52 分。
這個只有 27B 參數的 Dense 模型,直接追平 DeepSeek V4 Flash 0731 和 GPT-5.6 Luna Max,距離 DeepSeek V4 Pro 0813、GLM-5.2 的 53 分只差 1 分。上一代 Qwen3.6-27B 只有 38 分。
更誇張的是 Agent 能力。Qwen3.8-27B 的 Agentic Index 達到 51 分,甚至超過 DeepSeek V4 Pro 的 50 分、DeepSeek V4 Flash 的 48 分和 GPT-5.6 Luna 的 47 分。這個指標專門測試模型調用工具、規劃步驟和連續完成複雜任務的能力。
不過 52 分也有代價。Artificial Analysis 跑完整套 Intelligence Index 時,Qwen3.8-27B 總共生成了約 1.6 億輸出 Token,明顯屬於「用 token 堆智能」的類型。
Qwen 官方預設推理檔位正是 xhigh,同時支持 medium、low 和關閉思考。目前 Artificial Analysis 沒有標明具體用了哪個推理檔位,因此還不能確認這是不是預設 xhigh 的成績。