彭博社 9 月 4 日这条消息,比任何国产芯片宣传都硬。DeepSeek 一口气订了 16 万颗昇腾 950DT,25.6 亿美元,要用在内蒙古 1 吉瓦数据中心。但最扎心的是 —— 华为今年产量才几十万颗,关键零部件被卡,交货至少等一年。放着现成的渠道不选,偏要花大价钱等货,DeepSeek这波操作到底图啥?
答案藏在芯片的性能数据里。别看昇腾950DT的制程比英伟达B300落后两代,能效却实现了反超。海外博主的仿真推演显示,单位功耗下生成TOKEN数量,950DT全面优于B300。
这背后是华为的技术巧劲。不靠单一制程领先,而是通过异构计算架构、软硬件协同优化,硬生生实现了跨代追赶。144GB自研HiZQ 2.0内存、4TB/s带宽,这些参数刚好戳中AI大模型的痛点。
DeepSeek根本没得选。英伟达的H20是阉割版,算力密度只有H100的40%,H200虽获准出口,却因“战略陷阱”被卡住审批。2026年英伟达在中国AI芯片市场的份额,已经跌到了8%。
更关键的是技术协同。DeepSeek的V4模型不是简单适配昇腾,而是照着950DT的硬件特性量身定做的。稀疏矩阵乘、FP4/FP8混合精度,这些核心设计全是昇腾的强项。
V4模型发布当天,能完整跑通推理的只有两套系统:英伟达CUDA和华为CANN。其他国产芯片的适配,要么晚了一天,要么拿不出可验证的性能数据。
华为的超节点架构更是杀手锏。Atlas 950 SuperPoD最大支持8192张卡互联,集群规模是英伟达方案的56.8倍。对需要大规模部署的AI公司来说,这就是无法拒绝的诱惑。
DeepSeek创始人梁文锋说得直白:所有GB300能做的任务,华为超节点都能做,延迟完全一样。哪怕四张华为卡顶一张英伟达卡,贵一倍也无所谓。
这背后是AI行业的算力焦虑。2024年中国AI芯片市场规模达1412亿元,互联网企业采购占比42%,算力需求还在爆发式增长。字节、腾讯2024年就买了46万块GPU,占全球23%。
内蒙古的1吉瓦数据中心,不只是DeepSeek自己用。按照规划,多余算力会租赁给其他公司,这意味着16万颗芯片能撬动更大的产业生态。
没人敢赌英伟达的未来。美国的出口管制层层加码,今天能卖的芯片,明天可能就被禁运。对DeepSeek这样的头部AI公司来说,算力自主是生死线。
其实DeepSeek也在留后手。早在一年前,他们就秘密启动了自研芯片项目,专攻推理场景。2026年6月完成的510亿元融资,就有一部分要投进自研芯片。
但自研芯片远水救不了近火。一款有竞争力的AI芯片,研发周期要数年,还得砸巨额资金。现阶段,华为昇腾是唯一能打的国产选项。
华为的产能瓶颈确实棘手。高端内存等零部件依赖进口,年产能只有几十万颗。16万颗的订单,相当于要占去相当大一部分产能,交付周期自然拉长。
但对DeepSeek来说,等一年是值得的。AI算力的竞争是长期战,现在锁定华为的产能,就能在未来的市场竞争中抢占先机。
这已经不是单纯的商业采购,而是国产软硬件的双向奔赴。DeepSeek用模型适配芯片,华为用硬件支撑创新,形成了自主可控的闭环。
WAIC 2026上,华为展示的昇腾950超节点真机,已经证明了这套方案的成熟度。1024卡集群实现1 EFLOPS FP8算力,足以支撑超大规模模型的运行。
行业格局正在悄然改变。过去是芯片厂商定义生态,现在模型公司开始反向主导硬件设计。DeepSeek和华为的合作,正在重构国产算力的规则。
现在再看这笔“等一年”的订单,就不难理解了。这不是冲动消费,而是深思熟虑后的战略押注。押的是华为的技术突破,押的是国产算力的未来。
个人观点来看,DeepSeek的选择戳破了一个真相:国产芯片的竞争,早已不是单点参数的比拼,而是系统级能力的较量。华为用架构创新弥补制程差距,给国产算力指明了一条路。
但这只是开始。产能瓶颈、生态完善、零部件自主,这些问题还需要时间解决。16万颗芯片的订单,既是强心针,也是催命符,倒逼国产产业链加速成熟。
未来几年,AI行业的竞争会越来越集中在算力自主上。谁能掌控核心硬件,谁能打通软硬件协同,谁就能在这场竞赛中笑到最后。DeepSeek的等待,或许就是国产AI突围的第一步。
