DC娱乐网

GLM要做小模型?我怎么不信呢

最近流传出来两张截图,给下一代GLM透了点底。
说这次智谱要做小模型?

但仔细看这聊天记录
智谱囤了不止1GW算力
还放出豪言说,咱不缺卡

这配置,你说它只做小参数,我是不信的。
但你说它只往大了莽干,好像也不全是那味儿。

我听到一种说法,更有说服力
这次应该还是大参数路线。
但真正值得看的,可能不是参数,而是工程能力。
如果Post-training和Infra真的做到位,大模型未必意味着更慢、更贵,它也可以拥有接近小模型的推理效率和部署体验。

具体怎么实现,咱也不知道,咱也不敢乱说。
但就冲这囤货的架势,友商今晚估计是睡不好了。