马斯克把话说得很直白:在人类历史的大部分时间里,中国曾处于强国地位,如今更像是是恢复历史地位,而不是凭空崛起。
2025年1月28日,德国WELT经济峰会上,马斯克线上连线接受主编专访。他说中国有大量聪明又肯拼的工程师,接下来会做出很多了不起的事,DeepSeek就是其中之一。这句评价放在马斯克嘴里并不突兀——早在2023年他就说过"中国被低估了",这话背后并非单纯的立场表态,特斯拉在中国有巨大的市场和产能利益,FSD也在争取进入中国市场,加上他当时正以特朗普政府顾问的身份活动,这些因素都掺杂在他的对华表态里;2024年他又说"中国以外的人总是低估中国"。这次不过是把同一个判断,用DeepSeek又验证了一遍。
但他没有一味夸。同一段采访里,马斯克紧接着补了一句:这算不上AI领域的彻底革命,xAI和其他公司很快会拿出比DeepSeek更好的模型。捧一句、泼一盆水,这才是马斯克说话的完整版本。
DeepSeek凭什么被点名,得看它到底做了什么。2024年12月26日,DeepSeek发布V3模型,671B参数,用2048张H800显卡训练,成本约557.6万美元。一个月后的2025年1月20日,推理模型R1上线,多项基准测试跑到和OpenAI的o1正式版同一水平线。1月27日,DeepSeek登顶中美苹果商店免费下载榜。同一时间,英伟达股价单日暴跌近17%,市值蒸发约5890亿美元,创下美股单日市值跌幅的纪录。
一个中国团队的开源模型,让华尔街最贵的芯片公司一天蒸发约5890亿美元市值——这是DeepSeek留在资本市场上的真实痕迹,不是营销叙事。
更硬的验证在半年后到来。2025年9月17日,DeepSeek-R1的研究论文登上《自然》杂志封面,梁文锋担任通讯作者,经过8位专家同行评审,是全球首个通过顶级学术期刊评审的主流大语言模型。论文首次披露了一个关键数字:R1的后训练阶段只用了512张H800显卡、80小时、29.4万美元——这只是后训练成本,不包括V3-Base基础模型本身约600万美元的投入,但即便如此,这个数字仍然让不少同行意外。不过也要看到,官方对外提供的服务在响应延迟、吞吐量上有明显妥协,上下文窗口也被限制在64K,低成本背后是有取舍的。论文同时正面回应了外界关于"蒸馏OpenAI输出"的质疑,明确否认了这一做法。
马斯克说的"很多聪明的头脑",不是空泛的恭维。2024年,中国理工科毕业生超过500万人;高被引科学家数量到2025年已达1406人次,占全球19.7%;顶尖科学家人数从2020年的1.88万增至2024年的3.25万,全球占比28%。这是一个规模仍在扩大的人才池,DeepSeek只是这个池子里冒出来的一个样本,不是孤例。
马斯克说的"恢复历史地位",也不是他临场发明的说法。根据麦迪森《世界经济千年史》的估算,中国经济总量自两汉以来,在相当长的历史时期里领先世界,北宋时期占全球GDP约22.7%,清朝一度达到32.9%的最高值。这组数据本身存在测算口径上的争议,学者刘逖曾对相关估算做过修正,杜恂诚等人也提出过批评意见,但"中国曾长期是全球经济体量最大的国家"这一大方向,是有学术数据支撑的判断,不是空口白话。
把这几件事摆在一起看,马斯克这句评价就不再是随口一夸。一个靠开源策略、用相对有限的算力投入做出全球现象级产品的团队,一份能经得住《自然》同行评审的技术论文,一场让英伟达单日蒸发约5890亿美元市值的市场反应——这些是能摆到桌面上的硬事实。
马斯克这个人从不吝啬自我加冕,他说xAI很快会超过DeepSeek,这话不是空穴来风——他也曾公开质疑DeepSeek隐藏了真实的GPU数量,在X平台上用"Lmao, no"回应过外界关于其算力投入的说法,这份怀疑同样要和他的称赞一起记住。世界首富愿意公开承认对手的分量,本身就说明这个对手已经站到了牌桌上。至于中国AI下一步能走多远,答案不会写在这次采访里,而会写在DeepSeek之后还有没有第二个、第三个团队冒出来。


