動察 Beating AI 快訊,Artificial Analysis 完成 DeepSeek V4.1 Flash 獨立測試,綜合智能指數拿到 40 分。它已經超過自家 V4 Pro 0813 的 36 分,但仍低於 Kimi K3 的 44 分和 GLM-5.3 的 45 分。按這套第三方榜單,DeepSeek 還沒奪回國產模型第一。
但價格差距非常誇張。V4.1 Flash 跑完一個 Intelligence Index 任務平均只花 0.27 美元,Kimi K3 和 GLM-5.3 都在 2 美元左右,相差約 7 倍。輸出速度達到 197 Token/s,也遠高於 Kimi K3 的約 36 Token/s 和 GLM-5.3 的約 58 Token/s。
Agent 依然是它最強的部分。AutomationBench-AA 上,V4.1 Flash 拿到 69%,追平 GPT-6 Astra,並超過 GLM-5.3 的 62%;長上下文測試 AA-LCR 也拿到 84%。缺點是它特別能說,AA 測試中單任務平均輸出約 8.9 萬 Token,比 V4 Pro 多 62%,吃掉了一部分價格優勢。