智谱不愧是后训练之神,GLM 5.3 的能力提升这么多,基座竟然和 GLM5.2 是同一个
这个 756B 的基座要被智谱薅秃噜皮了
他们的文章里说,不,其实还有很大的后训练空间...
再结合 DeepSeek V4 Flash 的情况,304B 的参数干掉了 GLM5.2
后训练确实伟大
我现在猜测 Luna 也就 500B 左右,OpenAI 也是后训练的神

智谱不愧是后训练之神,GLM 5.3 的能力提升这么多,基座竟然和 GLM5.2 是同一个
这个 756B 的基座要被智谱薅秃噜皮了
他们的文章里说,不,其实还有很大的后训练空间...
再结合 DeepSeek V4 Flash 的情况,304B 的参数干掉了 GLM5.2
后训练确实伟大
我现在猜测 Luna 也就 500B 左右,OpenAI 也是后训练的神
