是木马屠城还是借刀杀人?Anthropic快被中国大模型逼疯了!KIMI K3的冲击还没有完全褪去,DeepSeek V4-Flash又来了,然后阿里巴巴发布了Qwen3.8-Max,一经公开就获得了中国制造文本模型的最高评价,在图像和多模态领域也挤进了世界顶尖行列。
几年前,中国AI还被说成是“追随美国”,然而现在Kimi、DeepSeek、Qwen的开发者正与世界各地的AI研究者直接讨论,接连公开新模型和研究成果。中国顶尖模型接连登场,在开源权重AI领域正成为世界的中心。
这两天,有网友在外网社交媒体上公布了一个本地化部署DeepSeek V4-Flash的成本。因为V4-Flash是284B(2840亿)总参数、13B激活,官方FP4+FP8权重只有160GB,比起动辄TB的大模型来说,V4-Flash算一个超级轻量级大模型!所以列出来的本地部署成本已经可以让很多中小企业开始下手了:
显卡:2张H200,或者2张H100/H20就够生产用
网络:普通NVLink就行,不用整机柜800G
CPU:双路EPYC/Xeon
内存:256-512GB DDR5
存储:2TB NVMe起步
散热:风冷勉强能扛住
电源:单机柜几kW就够
硬件成本:大约60万–120万人民币,总计10~20万美元不到。电费:2张H200满载约1.4kW,加上PUE,一年满载大概几万块电费。
这个价格对普通人来说依然是个天价,但是对那些数据有保密要求的中小型企业来说已经可以轻松入局了。这些企业因为数据敏感,无法通过订阅大模型使用API调用,或者被限制数据出境,这些企业的选择要么只能去订阅死贵的Anthropic或者OpenAI模型,要么干脆就不用!
但是现在DeepSeek的V4-Flash来了,支持纯离线部署,符合数据安全要求,不依赖任何外部API或网络连接。这就是V4-Flash在本地/私有部署的最核心优势之一!
当然最关键的是V4-Flash性能相当优秀。据Artificial Analysis最新数据显示,在同一套AI综合能力评测中,V4-Flash的成绩是Anthropic的Claude Fable 5的约83%左右。各位可能会觉得差距依然很大,但是这套是Flash版,完全轻量化,10万美元可以全部落地,这个价格甚至远低于很多公司向Anthropic一个月的订阅费!
如果是个人使用,对Token速度没有那么高的话,5K美元就可以跑起来了,能做到你用Claude Fable 5的事情,也能做到Opus 4.8做的那些事!
这意味着什么?Anthropic的几乎所有路子都已经被截胡了!从性能上来看,KIMI K3与Anthropic最优秀的Fable 5大模型相差无几,API订阅用户大批转向KIMI K3,连Google和微软都开始与KIMI K3合作。还有刚发布的Qwen3.8-Max,目前在Frontend Code Arena排行榜第4位,得分1,668!怎么说呢,有点点差距,但是相差无几。
但是噩耗远未结束,DeepSeek V4-Pro也要发布了。按DeepSeek的水平,这次发布的Pro版本性能应该会相当炸裂,超过Claude Opus 4.8也不是没有可能。性能上齐平,API订阅单价上几分之一到几十分之一的价格,现在轻量化部署大幅度降低了入门的门槛,还抢走了原本每年能产生订阅的客户,不只是Anthropic疯了,OpenAI也要疯了!
因为他们的初衷是把大模型圈起来收高昂的订阅费,护城河就是高性能、极高的算力资源垄断!中国的大模型如果去比性能、堆积算力资源,从这个角度来看是必败无疑的,因为再高的性能都没用,算力资源暂时卡在美国人手中!
但是中国走了开源路线,啥意思呢?就是开源模型大家随便用,但是算力资源你们得自己去采购。哪个AI玩家能挡得住白嫖高性能AI模型的诱惑?所以各方都快快乐乐地自建算力资源,自己去部署大模型了。
更好玩的是,很多西方国家,也就是美国原本制定圈地收费的国家,正拿着中国的大模型改吧改吧就成了自己的大模型,然后采购算力卡自己去搞大模型了,原本要收到的钱被中国横插一杠就灰飞烟灭了。Anthropic和OpenAI辛辛苦苦建立起来的“圈地计划”全面失败,而且还是从西方内部阵营中开始的!
你要说是木马屠城也好,还是说借刀杀人也行,反正中国是达到目的了!并且中国还可以塞进个极为宏伟的计划,现在美国闭源模型的几万亿美元投资面临无法收回,已经到了叙事崩溃的边缘。未来中国大模型如果在算力卡上支持国产的更优秀,也就是跑在中国产算力卡上性能更好,你猜结果会如何?







评论列表