DeepSeekV4Pro正式版
8月13日凌晨,DeepSeek没开发布会、没发官宣推文,就这么静悄悄地把V4 Pro从预览版“转正”了。但消息一出,整个AI圈都睡不着了。
Terminal Bench 2.1测试里,V4 Pro拿下87.9分,而全球公认最强的Anthropic Fable 5是88.0分——差距只剩0.1分。三个月前预览版才72.1分,这一跃升了15.8分。更狠的是,在AI安全测试Cybergym上,V4 Pro 83.3分直接压过Fable 5的83.1;工作流自动化测试AutomationBench也赢了。软件工程能力DeepSWE从12.8分暴涨到62.7分,涨了近五倍。
V4 Pro每百万输出Token定价6元人民币,约0.87美元。而Fable 5是50美元——整整57倍的价差。0.1分的性能差距,57倍的价格鸿沟,这个等式足以让任何CTO重新算账。
DeepSeek在定价页挂了条注释:“计划近期整体上调API服务定价,预计涨幅较大”。也就是说,现在的“地板价”可能是新模型上线初期的引流策略。想长期用的开发者,可能需要提前做成本评估。
对行业来说,V4 Pro真正的冲击在于:前沿Agent能力的价格锚点被再次拉低了。当逼近第一梯队的性能以百分之一的价格供给,中间层模型会最先感受到压力。过去用DeepSeek是“便宜够用”,现在变成了“又强又便宜”。OpenAI和Anthropic,该睡不着了。
当然,所有跑分都是DeepSeek自己发的,还没第三方验证。而且有开发者实测发现,长时间连续执行时仍会出现提前停止、任务完成质量不稳定的问题。性能摸到天花板是一回事,稳定可靠是另一回事。
凌晨的这波“偷袭”,DeepSeek打的不是价格战,是价值战。当“便宜”和“好用”不再二选一,整个行业的游戏规则,正在被重写。DeepSeekV4Pro正式版
