整条帕累托前沿,除了最便宜端的IBM小模型,全部是中国模型。从Kimi、智谱、MiniMax到小米。Anthropic、OpenAI、Google的模型全部散落在前沿左下方的无标注色块里,也就是说在这个基准上,它们每一个都被"更便宜且更强"的模型支配了。
在代码生成这个细分赛道上,性价比前沿已经整条被中国阵营占领。
图三则是前端编程中美AI模型对抗史。在最近的18个月里,美国(绿线)和中国(红线)围绕各自最高分模型的争夺。
图的下半部分是差值图(Gap):绿柱表示美国领先的分数,红柱表示中国领先的分数。注意整个下图从头到尾几乎全是绿柱,直到最右端出现第一根红柱。这根红柱就是这张图存在的理由:Kimi K3以1679分越过Claude Fable 5的1631分,是这条时间线上中国第一次转为领先。


