
DeepSeek V4.1 Flash 第三方实测:未夺回国产模型第一,但成本仅为 Kimi、GLM 的七分之一
Artificial Analysis 完成了对 DeepSeek V4.1 Flash 的独立测试。该模型综合智能指数为 40 分,超过自家 V4 Pro 0813 的 36 分,但仍低于 Kimi K3 的 44 分和 GLM-5.3 的 45 分。按这份第三方榜单,DeepSeek 尚未夺回国产模型第一。
价格差距则十分明显。V4.1 Flash 完成一个 Intelligence Index 任务的平均成本仅为 0.27 美元,而 Kimi K3 和 GLM-5.3 均约为 2 美元,相差约 7 倍。
V4.1 Flash 的输出速度达到 197 Token/s,远高于 Kimi K3 的约 36 Token/s 和 GLM-5.3 的约 58 Token/s。
Agent 能力仍是其优势
在 AutomationBench-AA 测试中,V4.1 Flash 得分 69%,追平 GPT-6 Astra,并超过 GLM-5.3 的 62%;在长上下文测试 AA-LCR 中则取得 84%。
不过,该模型的输出量也明显更大。在 AA 测试中,单任务平均输出约 8.9 万 Token,比 V4 Pro 多 62%,抵消了部分价格优势。
© 版权声明
文章版权归作者所有,未经允许请勿转载。
THE END










暂无评论内容