DC娱乐网

*想办法让中国停下来。为了赢得竞赛,美国辗转反侧终于决定制裁中国AI企业,然而,

*想办法让中国停下来。为了赢得竞赛,美国辗转反侧终于决定制裁中国AI企业,然而,中国又要加速了。

时间线拉一下,7月21日,美国财政部长贝森特在福克斯商业频道抛出一段话,说政府要调查中国AI大模型有没有"蒸馏"美国前沿模型,如果查实,美国有权制裁。

第二天,白宫科技政策办公室主任克拉齐奥斯直接点名月之暗面,指其K3模型是在Anthropic的Fable模型上蒸馏出来的,还声称月之暗面拿到了本已禁运的英伟达GB300芯片服务器用于训练。

7月23日,贝森特又在X平台补了一刀,明确说可以考虑把相关中国企业列入实体清单,到7月27日,中国商务部新闻发言人正式回应,把美方做法定性为"人工智能霸权主义行径"。

一周多的时间里,两个大国就AI这件事完成了一轮公开交锋。

先解释一句,模型蒸馏是什么?说白了,就是用一个大模型的输出去训练一个小模型,让小模型学到大模型的"思路"。

这在AI行业里几乎是家常便饭,一些美国大型跨国企业都表示,模型蒸馏是行业广泛应用的技术。

贝森特这次做的关键动作,是把一个技术术语直接改写成"盗窃",再把中国企业挂上去,我认为这一步最需要盯着看——它不是在讨论技术,是在做定性。

那么,这份指控立不立得住?我的判断是:目前不太立得住,可争议空间也确实存在。

美方到现在没有公开一份像样的实锤证据,贝森特说"许多中国模型上检测到美国大模型的水印",具体是哪个模型、检测方法是什么、样本量多大,一样都没说。

克拉齐奥斯点名K3蒸馏Fable,月之暗面员工Randy在回应中就贴出一个事实:Fable于7月1日恢复全球公开访问,K3于7月中旬上线,团队在仅十几天内完成新一代前沿模型的训练,"堪称吉尼斯世界纪录级别",这是用反讽的方式做的一句非常直白的反驳。

我也不打算把话说满,国内一部分厂商在训练中借鉴过海外开源模型的输出,业内并不神秘,只是各家做的规模、方式和用途差别很大。

真正麻烦的地方在于,克拉齐奥斯自己也承认,应当区分合法的模型蒸馏技术与大规模工业化知识产权盗窃,两者并不相同,制裁大棒一旦落下,往往不会做这么细的区分——这才是让人真正担心的部分。

更能说明问题的,是美国自己人的反应,7月22日,包括Y Combinator、Proton等在内的近200家硅谷企业联合发声,敦促特朗普政府不要切断美国开发者对中国开放权重AI模型的访问渠道,警告即便禁止美国用户下载,也无法阻止这些模型在全球范围内继续传播,反而会削弱美国初创企业的竞争力。

英伟达CEO黄仁勋认为美国政府夸大了中国大模型的影响力,美国贸易代表格里尔本人也表示,政府尚未就限制措施做出结论。

一个连自己内部都没吵明白的指控,被拿出来当作制裁的理由,说服力有多强,读者自己心里就有数。

我更想聊的是另一层:为什么是这个时间点。

7月16日,月之暗面发布Kimi K3,参数规模达2.8万亿,这是目前全球参数最大的开源模型。

在Arena AI前端编程榜单上,K3以1679分登顶,超越Claude Fable 5和GPT-5.6。

往前一个月,美团6月30日开源LongCat-2.0,总参数1.6万亿,是业界首个完全依靠国产算力完成训练与推理全流程的万亿参数模型;智谱GLM 5.3于7月2日迭代上线;腾讯混元第三代大语言模型Hy3于7月6日正式发布。

MiniMax M3也在世界人工智能大会上首发。一个月的时间,中国大模型密集出货,密集开源。

在我看来,这才是"制裁威胁"选择在这一周被抛出来的真正原因,制裁不是要阻止已经出货的模型,是要阻止后面还会出货的模型。

中国这边的回应,说到底不是靠嘴。开源本身就是最直接的反制手段。

K3把完整权重开放给全世界开发者下载,等于把技术扩散做到极限——美国禁掉,用户去欧洲下载;欧洲禁掉,用户去东南亚下载。

这跟当年芯片出口管制反倒逼出国产厂商在算力效率上的深耕,是同一个逻辑。

月之暗面总裁张予彤自己说过:从创业第一天起,我们就清醒地意识到,中国初创公司没有随意堆砌算力的条件,这迫使我们通过大量的基础研究创新来换取极致效率。

K3的KDA注意力算法、Attention Residuals结构,都是被这个约束条件逼出来的成果。

从这一周的动作看,我的判断是——制裁大概率无法让中国AI停下来,反而会让开源、国产算力、底层研究这三条线走得更快、更狠、更彻底。

中美原定9月开展人工智能会谈,贝森特将作为美方代表参会,到那时谈桌上要谈的,恐怕已经不是"要不要合作",而是"各自还能守住多少"。

大国之间真正在争的,从来不是一个模型、一枚芯片,而是一整条产业链在世界上的可获得性。想让谁停下来,先得看自己能不能停。