根据Artificial Analysis测评,DeepSeek V4
Flash的智能指数达到50,在101款同类模型中位列第三,较开放权重模型中位数高出一倍;输出速度约104
Token/秒,输入、输出价格分别只有每百万Token
0.14和0.28美元。这意味着模型竞争正在从单纯追逐最高性能,转向比较“完成一次任务需要多少钱”。低价、开放权重和百万Token上下文,使其更适合批量搜索、编程辅助及多智能体调用,也会迫使高价闭源模型依靠可靠性、生态和企业服务维持溢价。不过,DeepSeek完成测评生成了2.1亿Token,约为同类中位数的两倍,显示其推理较为冗长。基准成绩也无法完全反映复杂任务成功率,因此Token单价很低,并不代表所有实际任务都能获得相同比例的成本优势。