第一反应是,真的假的?
看完评测和定价,发现事情比想象中复杂。聊聊这次发布真正值得关注的东西。
表现:整体前排,编程封王
综合实力全球第三,排在Claude和GPT之后,不算意外。
但前端编程上,K3在Arena AI的Code Arena榜单以1679分登顶,Vercel创始人的网页工程评测中也排第一,代码任务成功率92%。这是开源模型头一次在这个权威榜单上超越所有闭源模型。
不是什么全面碾压,而是在编程这个关键战场上打了一次精准突破。长程任务也相当能打,SWE Marathon第一,信息检索最高分。架构效率比上一代提升了约2.5倍。
当然,缺点也有。生成速度比Claude慢,对历史思考内容敏感。但瑕不掩瑜,开源模型第一次站上前沿擂台,还在关键项目上拿了冠军,这个事实摆在这儿。
中美AI:追到并排跑了
有意思的是,就在K3发布前不久,Anthropic高管还信誓旦旦说领先中国6到12个月。结果话音刚落,K3编程登顶了。
彭博社说这“颠覆了美国仍领先的固有认知”,Axios更直接,标题写“中国抹去了美国的领先优势”。话说得有点满,准确讲是在前端编程这个维度上抹平了,但已经够硅谷震一震的。伯克利教授也承认,差距可能只剩两三个月。
商业上的冲击更实在。K3开放权重,企业可以自己部署,美国公司靠巨额算力堆出来的壁垒被削了一截。消息一出,全球科技股跟着抖。加上美国监管导致OpenAI和Anthropic推迟新模型发布,追赶的时间窗口又打开了。
问题已经从“能不能追上”变成了“在哪条赛道上能赢”。






