DeepSeek V4 Flash正式版上线,舆论场最热的话题是“Agent能力在GLM 5.2和Kimi K3之间”。
这个说法很容易把人带偏。
所谓“居中”,不是简单的“A>B>C”线性排序,而是三家走的是三条不同的路,比的是不同维度:
- Kimi K3:性能旗舰,2.8万亿总参,原生100万Token上下文,编程榜单超了GPT-5.6 Sol,专攻复杂前端和长程Agent任务。买的是“上限”。
- GLM 5.2:综合均衡,744B总参,响应速度约168 token/秒,低延迟、高频调用场景的王。买的是“快且稳”。
- DeepSeek V4 Flash:普惠性价比,1.6万亿MoE,针对Agent特化。输入1元/百万token、输出3元/百万token,把高端模型成本压到海外七分之一,支持私有化部署。
再说成本。价格这块是真的有断层:DeepSeek V4 Flash输出3块,Kimi和GLM基本是它的几倍往上。中小团队做Agent、或者私有化部署的,DeepSeek这波价格就是降维打击。
DeepSeek V4和GLM 5.2都是MIT协议,商用微调随便用。
Kimi K3虽然承诺开源,但据传可能带用户量限制条款。
与其纠结谁强谁弱,不如看你要拿来干啥。
做长程复杂任务选Kimi,求速度选GLM,预算敏感、要规模化部署Agent的,DeepSeek基本是当前国产最优解。