DC娱乐网

GLM-5.3 正式发布:基座没换,编程能力却暴涨 50% GLM-5.3 正

GLM-5.3 正式发布:基座没换,编程能力却暴涨 50%

GLM-5.3 正式发布:基座没换,编程能力却暴涨 50%

国产大模型又落下一子。今天(8 月 14 日),智谱正式发布 GLM-5.3,直接叫板"编程能力最强开源模型"——内部评测较上一代 GLM-5.2 提升 50%,在 Terminal Bench 3.0 等公开基准上拿下开源第一。

最难得的是,它换了"芯"却没换"底盘"。GLM-5.3 的基座模型和 GLM-5.2 完全一样,靠的是后训练的大规模强化学习,把同一副底盘的智能上限硬生生拉高:Terminal Bench 3.0 从 4.6 分直接干到 28.3 分,翻了 6 倍。

体感上也扳回一城。在真实编程场景的评测中,GLM-5.3 准确率 31.4%,超过 Claude Opus 4.8 最高档的 29.5%;它每项任务只用约 5 万 tokens,Opus 4.8 要 12 万——活干得更好还更省。

这个时间点发布,智谱有点被市场逼着走——半个月内 Kimi K3、Qwen 3 Max 相继亮相,智谱股价一度蒸发 3453 亿港元。这次亮出编程"最强"招牌,等于正面回应。它还顺带强化了网络安全能力,权重两周后开源。

国产大模型军备竞赛又卷高一格:从"换发动机"到"榨干同一台发动机",这种卷法,对普通用户是实实在在的进步。

ai 人工智能 大模型