DC娱乐网

一个不署名的模型在国外免费开放,编程测试80%,GPT-5.6只有52%

一个不署名的模型在国外免费开放,编程测试80%,GPT-5.6只有52%

OpenRouter上多了一个模型,叫 Ox Alpha,中文社区管它叫"牛来"。页面写着由匿名第三方开发和运营,平台声明自己只负责路由,不是开发者。

预览期免费,上下文104万token。上线两天,已处理约1.83万亿token。

有开发者从 DeepSWE 里抽了10项编程任务测它,完成8项,通过率80%。同一组对比里,GLM-5.3 Max 和 Grok 4.6 都是62%,GPT-5.6 Sol Max 52%。

得说清楚:10道题样本太小,另一批开发者换了组子集测,结果约63%。排名现在定不了。

真正有意思的是社区怎么把它认出来的。

不是靠问它"你是谁",那种自报家门本来就不可靠。他们做的是分词器探针:同一串文字,各家模型数出来的token数不一样,这个数法很难改。十几项探针跑下来,Ox Alpha 和 GLM 全中,其他厂商最多对上四项。

开发者 Ben Davis 说,他有99%把握认为它属于 GLM-5.x 系列。这是他的判断,不是官方承认。上一代代号"小马"的匿名模型,后来也证实是 GLM-5。

我更在意的不是80%这个分数,是署不署名这件事。

一家公司做出自认为够强的新模型,第一个动作不是开发布会,是把牌子摘掉扔到国外平台免费给人用几天。这说明他们判断,挂着名字上去,评价会先被产地影响,才轮到代码质量。

匿名首发正在变成标准动作:先让海外开发者在不知产地的情况下用一周,攒够反馈再认领。

等它正式认领的那天,评论区会有一批人说早就看出来了,但真正认出它的人是靠数token,不是靠猜。

AI大模型 国产大模型 GPT