DC娱乐网

刚发布就登顶,这个国产AI凭什么让硅谷慌了

刷到一条消息:国产模型Kimi K3在编程评测上拿了全球第一,把Claude和GPT都超了。

第一反应是,真的假的?

看完评测和定价,发现事情比想象中复杂。聊聊这次发布真正值得关注的东西。

表现:整体前排,编程封王

综合实力全球第三,排在Claude和GPT之后,不算意外。

但前端编程上,K3在Arena AI的Code Arena榜单以1679分登顶,Vercel创始人的网页工程评测中也排第一,代码任务成功率92%。这是开源模型头一次在这个权威榜单上超越所有闭源模型。

不是什么全面碾压,而是在编程这个关键战场上打了一次精准突破。长程任务也相当能打,SWE Marathon第一,信息检索最高分。架构效率比上一代提升了约2.5倍。

当然,缺点也有。生成速度比Claude慢,对历史思考内容敏感。但瑕不掩瑜,开源模型第一次站上前沿擂台,还在关键项目上拿了冠军,这个事实摆在这儿。

中美AI:追到并排跑了

有意思的是,就在K3发布前不久,Anthropic高管还信誓旦旦说领先中国6到12个月。结果话音刚落,K3编程登顶了。

彭博社说这“颠覆了美国仍领先的固有认知”,Axios更直接,标题写“中国抹去了美国的领先优势”。话说得有点满,准确讲是在前端编程这个维度上抹平了,但已经够硅谷震一震的。伯克利教授也承认,差距可能只剩两三个月。

商业上的冲击更实在。K3开放权重,企业可以自己部署,美国公司靠巨额算力堆出来的壁垒被削了一截。消息一出,全球科技股跟着抖。加上美国监管导致OpenAI和Anthropic推迟新模型发布,追赶的时间窗口又打开了。

问题已经从“能不能追上”变成了“在哪条赛道上能赢”。