DC娱乐网

美国驻华使领馆今晚(7月23日晚)写道:“美国财政部部长斯科特·贝森特:我们支持

美国驻华使领馆今晚(7月23日晚)写道:“美国财政部部长斯科特·贝森特:我们支持开源人工智能及其激发的创新。但开源并不意味着可以任意侵犯美国的知识产权。当中华人民共和国的公司开展隐蔽、大规模的蒸馏攻击,并且已经构成知识财产盗窃时,对这些公司实施制裁和将其列入实体清单都是我们可以采取的措施。”

那你要这么说美方只需回应一个根本问题:GPT和Claude用于训练的中文语料究竟从何而来?嘴上挂着开源精神,转头就把模型蒸馏定性为秘密攻击与知识产权窃取,动辄挥舞制裁大棒。说白了,这无非是看到Kimi K3等国产开源模型性能追平、全球采用率飙升之后,急不可耐地踩下科技霸凌的急刹车。

为什么贝森特急成这样?因为7月16日,中国AI企业月之暗面发布了新一代开源模型Kimi K3。2.8万亿参数,百万Token上下文,是目前全球参数量最大的开源权重模型。《华尔街日报》承认,在许多基准测试中,Kimi K3得分高于美国大模型Anthropic的Claude Opus 4.8。美国科技股随之暴跌。美国阿克西奥斯新闻网站称,因成本更低、性能又与美国技术几乎相当,美国企业正越来越多地采用中国开源模型。

贝森特嘴上说“支持开源”,可当中国真的做出全球最大的开源模型时,他的反应是什么?调查、审查、制裁、实体清单。这套路,跟芯片断供、跟华为封杀、跟TikTok禁令,一模一样。每次中国在某个领域追上来,美国的剧本翻来覆去就那几页——先骂你偷,再制裁你,最后封杀你。

可美国人永远回答不了一个问题:GPT和Claude里的中文数据,是哪里来的?

OpenAI训练GPT系列模型时,爬取了海量互联网公开数据。中文互联网上的新闻、博客、论坛、百科、代码仓库——只要是公开可访问的,全被吞进了训练集。那些数据是谁写的?是中国人写的。那些知识是谁创造的?是中国人创造的。美国人用中国公开数据训练模型的时候,怎么不说“窃取知识产权”?

更讽刺的是Anthropic自己。Claude系列模型被曝使用了一个包含大量盗版电子书的数据集“The Pile”来训练。作者们提起集体诉讼,指控Anthropic从盗版网站下载了数百万本受版权保护的书籍。埃隆·马斯克亲自下场发推嘲讽:“他们(中国)怎么敢偷Anthropic从人类程序员那里偷来的东西?”

美国AI公司一边用爬虫把全网的公开数据薅了个遍,一边指责别人“蒸馏”是盗窃。你爬别人数据的时候叫“合理使用”,别人用公开技术训练模型就叫“工业规模的蒸馏攻击”。这套双标,比贝森特的那张脸还厚。

微软CEO纳德拉早就看不下去了。他本月早些时候公开批评大型AI实验室的双重标准——“模型提供商在公共数据上训练模型时主张合理使用权,但随后又对蒸馏施加限制性条款。”Hugging Face高管也认为,蒸馏是行业通用手段,并非中国AI能快速追赶美国同行的主因,优质研发团队与开放协作模式才是核心优势。

贝森特把“蒸馏”直接定义为“盗窃”,可美国业界自己都吵翻了天。近200家硅谷公司联名反对封杀中国开源模型,认为这会扼杀创新、让小公司失去国际替代方案。黄仁勋也公开反对,直言中国AI模型非常优秀,美国无需害怕,就应该使用。

美国越是这样歇斯底里地封锁、制裁、扣帽子,越说明一件事——他们怕了。怕的是中国AI真的追上来了,怕的是开源生态不再由美国主导,怕的是技术霸权的围墙被中国用代码一点点凿穿。

Kimi K3完整模型权重将于7月27日前开源。到那时候,全球开发者都能下载、修改、部署这个2.8万亿参数的开源模型。而美国财政部还在琢磨怎么给它贴“盗窃”的标签。

贝森特的制裁威胁改变不了一个事实:中国AI正在用自己的方式跑出自己的赛道。你封你的,我开我的。你查你的水印,我发我的开源。历史从来不是靠制裁写就的,是靠代码一行一行敲出来的。