DC娱乐网

从DeepSeek和Grok同日发布,看AI下半场 今天又是热闹的一天,Deep

从DeepSeek和Grok同日发布,看AI下半场
今天又是热闹的一天,DeepSeek V4 Pro 正式版和 Grok 4.6 同一天发布,双双逼近Claude Fable 5体验。

DP V4 Pro 从 4 月开始一直挂着 preview 标签,昨天悄咪咪把 API 切到了 0813 正式版,连个博客推文都没发,只在定价页改了个版本号。 公开数据还是很能打:跟Fable 5 对比,9 项 Agent 基准测试平均只差 5.3%,其中两项还反超。DP传统手艺杀手锏还是价格,对比Fable 5 ,DP整体价格只是其37分之一,对你没看错Fable 5价格是其37倍之多。

Grok4.5发布才不到一个月,4.6 就已经端出来了,Musk今天还预告全面超越4.6模型的4.7已经在路上,预计一个月后即将发布。数据表现看起来也不错,V3.2 跑到 69.9%,超了 GPT-5.6 Sol Max 的 67.2%,离 Fable 5 的 70.5% 也就差一那么丢丢。

另外大家忽视一个细节是:DP 自研Harness Agent其实也已经在路上了。

抛开这些表象,我们跳出来,大胆对未来阶段性趋势做一次预测,未来会发生什么?

DP和Grok目前在什么位置?

A社更重可靠性与安全,产品闭环更“重”;OpenAI更重模型层级覆盖与分发,产品闭环更“广”。两者定价仍显著高于Grok与DP,但在高价值长程任务上仍保持领先地位。

短期预测

Grok 4.7若如期落地并兑现“超过所有现有模型 + 真实工程优势”,将在复杂长程Agent场景进一步冲击A社与OpenAI的高端份额,尤其是在需要强工程约束的任务上。DP自研的Harness若加速成熟,搭配V4系列模型,会快速吃掉中低端与规模化Agent调用市场份额。A社与OpenAI将被迫加速高端模型降价,或者推出价格更低、性能还不错中端模型,来守住中端模型市场,从成本层面防止用户快速流失。同时倒逼自家Claude Code、Codex产品,把产品做的更好,从产品层面加强用户粘性。

长期预测

高价值、复杂、不能出错的任务,会继续流向A社、OpenAI和Grok这些闭源+深度产品方案;量大、成本敏感的任务,则会流向DP这类高性价比开源方案。两边价格可能差5到15倍,但在各自擅长的场景里,实际干活完成率的差距会越来越小。未来市场格局会形成双轨并行的局面。

deepseek grok claude