GLM-5.3 正式发布,编程能力开源第一
智谱正式发布GLM-5.3。
这次最值得关注的是:它与GLM-5.2使用相同的基座模型,全部能力提升都来自后训练。
智谱通过增加数十倍的长程任务环境、扩展训练场景以及延长后训练时间,进一步挖掘出了基座模型的能力上限。¹
提升最明显的是编程和Agent能力。
据智谱公布,GLM-5.3在内部编程体感评测中较GLM-5.2提升50%,并在多项公开测试中取得开源模型第一。
具体来看:
Terminal-Bench 3.0从4.6分升至28.3分;
DeepSWE v1.1从46.2分升至66.9分;
Agents’ Last Exam从23.8分升至28.5分。
整体编程与智能体能力已经接近Claude Fable 5。
除了编程,GLM-5.3还强化了网络安全能力。在代码审查、漏洞发现等任务中,官方称其表现与Mythos 5持平。
目前,GLM-5.3已经上线ZCode、AutoClaw和GLM Coding Plan,多家编码平台也开放抢先体验,API即将上线。
完整模型权重将在两周内开源。在此之前,智谱将先完成安全评估和模型加固,尽量保留防御能力,同时限制潜在的攻击用途。
此外,GLM Coding Plan所有用户的使用额度也已重置。
基座没换,仅靠后训练就实现大幅提升。GLM-5.3证明,大模型的能力上限,可能还远没有被真正挖出来。
关注我,持续分享AI模型最新动态。
资料
¹ 智谱AI,GLM-5.3发布说明
