動察 Beating AI 速報、Artificial Analysis が DeepSeek V4.1 Flash の独立テストを完了し、総合知能指数で 40 点を獲得した。すでに自社の V4 Pro 0813 の 36 点を上回っているが、Kimi K3 の 44 点と GLM-5.3 の 45 点にはまだ及ばない。この第三者ランキングによると、DeepSeek はまだ国産モデル首位を奪還していない。
しかし価格差は非常に大きい。V4.1 Flash が Intelligence Index のタスクを 1 回完了するのに平均わずか 0.27 ドルしかかからず、Kimi K3 と GLM-5.3 はともに約 2 ドルで、約 7 倍の差がある。出力速度は 197 Token/s に達し、Kimi K3 の約 36 Token/s と GLM-5.3 の約 58 Token/s を大きく上回っている。
Agent は依然として最も強い部分だ。AutomationBench-AA では、V4.1 Flash が 69% を獲得し、GPT-6 Astra に並び、GLM-5.3 の 62% を超えた。長コンテキストテストの AA-LCR でも 84% を獲得した。欠点は非常によく喋ることだ。AA テストでは 1 タスクあたりの平均出力が約 8.9 万 Token で、V4 Pro より 62% 多く、価格優位性の一部を食いつぶしている。