美国AI巨头OpenAI总裁布罗克曼表示:认可中国AI企业月之暗面最新发布的Kimi K3模型“相当不错”,但不确定月之暗面是否通过“蒸馏”方式借助OpenAI的技术开发这款模型。
他说:“这是我们一直密切监测的事情。”
大家品品这话的味儿:你做得好,不是你本事大,是偷了我们的技术。这股傲慢都快溢出屏幕了,说句不好听的,也太把自己当回事了,真让人觉得可笑!
说白了,这套“中国AI做得好就是抄我们”的套路,我们早就见怪不怪了。
去年年底DeepSeek的R1推理模型横空出世,推理能力直逼OpenAI当时的旗舰模型o1,一举打破了“只有美国能做顶级推理大模型”的固有认知。
那时候美国AI圈的反应跟现在一模一样,一窝蜂跳出来喊,说这肯定是蒸馏了GPT的模型,不然中国企业不可能凭空做出来这么强的推理能力,各种阴谋论传得有鼻子有眼。
结果呢?后来全球好几家独立第三方评测机构做了专项验证,从模型的输出逻辑、错误路径,到核心的推理架构,DeepSeek的R1跟OpenAI的模型完全不是一个路子,解题思路、底层逻辑天差地别。
人家DeepSeek直接把完整的技术路线、训练方案都公开了,是靠自己独创的强化学习框架一步步练出来的,跟OpenAI半点儿关系都没有。
事实摆出来之后,当初那些喊抄袭喊得最凶的人,灰溜溜删了帖,连个像样的道歉都没有,这事就这么不了了之了。
你看,才过去半年多,一模一样的戏码又上演了。
上次是DeepSeek,这次是月之暗面,只要中国企业拿出个能打的顶级模型,美国人第一反应从来不是正视差距、研究技术,而是先下意识扣一顶“抄我们的”帽子,好像除了他们,全世界没人能搞出先进AI一样。
可能有朋友听不懂“模型蒸馏”到底是什么,这东西说白了,就是拿别人已经训练好的大模型当“老师”,让自己的小模型照着老师的输出结果学,相当于抄作业,只能学个表面的答题套路,学不到人家底层的解题思路和完整的知识体系。
这种法子一般用来给小模型做轻量化、降成本,根本不可能靠它做出顶级的旗舰大模型。
就拿这次的Kimi K3来说,2.8万亿的参数规模,原生支持多模态理解,还有100万token的超长上下文,再加上登顶全球的编程能力,这些全都是实打实的底层硬功夫,涉及到模型架构设计、万亿级数据处理、分布式训练框架、多模态对齐技术一大堆核心难点,哪一样是靠抄答案能抄出来的?
真要是蒸馏就能做出全球顶级模型,那全世界那么多AI公司,早都照着GPT抄出一堆顶级模型了,还至于被技术垄断卡这么多年?
再说工信部上个月刚公开发布,中国研发的开源大模型,全球累计下载量已经突破100亿次。
全球最大的开源AI平台Hugging Face的春季报告也印证了这个趋势:中国AI模型的下载量占比已经达到41%,第一次超过了美国的36.5%,排在全球第一。
这是什么概念?这根本不是一家两家企业靠投机取巧冒头,是整个中国AI产业整体冲上来了。
从底层的芯片适配、训练框架,到中间的大模型研发、算法优化,再到上层的应用落地、开源生态,全链条都在跟上甚至部分领跑。
按布罗克曼的逻辑,难道这上百个中国大模型、全行业的技术进步,全都是靠蒸馏你们OpenAI一家的技术做出来的?
也太抬举自己了,你们一家的技术,撑不起整个中国AI产业的崛起!
回顾两三年前,他们还觉得中国AI跟他们差着十万八千里,根本构不成威胁。
结果这两年,中国企业跟开了挂一样,DeepSeek、月之暗面、智谱、通义,一家接一家往上冲,开源的比他们便宜好用,闭源的性能也追平甚至部分反超。
就拿这次K3来说,直接成了全球最强的开源大模型,编程能力连他们的闭源旗舰都打不过,还要开放全部权重,等于把顶级AI技术免费给全世界开发者用,这直接砸了他们靠技术垄断赚钱的饭碗。
过去OpenAI靠闭源收天价API费用,躺着就能赚全世界的钱,现在中国企业把同等水平的技术开源了,中小企业、普通开发者不用再花大价钱买他们的服务,他们的垄断地位摇摇欲坠,能不慌吗?
拿“蒸馏”说事,既可以抹黑中国企业的技术成色,又能给自己的用户灌输“还是我们原创的靠谱”的印象,说白了就是给自己的垄断地位找补。
说到底,以后这种质疑肯定还会有,毕竟动了人家垄断了多年的蛋糕,人家肯定要找点事、泼点脏水。
但我们不用管那么多,踏踏实实走自己的路,把技术做扎实,把产品做好,用实力说话,比什么都管用。
等哪天我们的技术全面领先了,这些质疑的声音,自然就会慢慢消失。

评论列表