美国指控六家中国大陆人工智能公司大规模“蒸馏”美国模型,对此,中方予以否认。
美国国家安全局、联邦调查局和网络安全与基础设施安全局9月8日联合发布报告,指控深度求索、月之暗面、阿里巴巴、MiniMax、阶跃星辰和智谱等六家中国人工智能公司,长期大规模调用美国领先模型的输出,用来训练和强化自己的模型。
美国称,这类活动至少从2024年底开始,涉及数百万次请求和数十亿个文本单位。
“模型蒸馏”是让一个较小模型大量学习更强模型给出的答案。这个技术本身很常见,也不违法;争议在于是否未经允许,大规模调用封闭商业模型,把对方已经训练出来的推理、编程和数学能力“学”到自己的模型里。
美国三家机构称,中国企业曾通过多个账号、第三方接口和代理服务绕过使用限制,目标包括GPT、Claude、Gemini和Grok。
美国认为,这种做法能让中国企业少付出一部分昂贵的算力、数据和基础研究成本,更快缩小与美国顶尖模型的差距,因此已经把它提升为人工智能竞争和国家安全问题。
中国大陆外交部9月9日回应称,中国人工智能的发展来自科技自立自强和开放合作,要求美国停止“不实指责和抹黑”。
