DeepSeek V4.1 Flash 第三方实测:未夺回国产模型第一,但成本仅为 Kimi、GLM 的七分之一

DeepSeek V4.1 Flash 第三方实测:未夺回国产模型第一,但成本仅为 Kimi、GLM 的七分之一
DeepSeek V4.1 Flash 第三方实测:未夺回国产模型第一,但成本仅为 Kimi、GLM 的七分之一

Artificial Analysis 完成了对 DeepSeek V4.1 Flash 的独立测试。该模型综合智能指数为 40 分,超过自家 V4 Pro 0813 的 36 分,但仍低于 Kimi K3 的 44 分和 GLM-5.3 的 45 分。按这份第三方榜单,DeepSeek 尚未夺回国产模型第一。

价格差距则十分明显。V4.1 Flash 完成一个 Intelligence Index 任务的平均成本仅为 0.27 美元,而 Kimi K3 和 GLM-5.3 均约为 2 美元,相差约 7 倍。

V4.1 Flash 的输出速度达到 197 Token/s,远高于 Kimi K3 的约 36 Token/s 和 GLM-5.3 的约 58 Token/s。

Agent 能力仍是其优势

在 AutomationBench-AA 测试中,V4.1 Flash 得分 69%,追平 GPT-6 Astra,并超过 GLM-5.3 的 62%;在长上下文测试 AA-LCR 中则取得 84%。

不过,该模型的输出量也明显更大。在 AA 测试中,单任务平均输出约 8.9 万 Token,比 V4 Pro 多 62%,抵消了部分价格优势。

© 版权声明
THE END
喜欢就支持一下吧
点赞10 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容