一个机柜顶别人20个,要不怎么说曙光8000是镇馆之宝呢
今年WAIC的镇馆之宝一公布,不少人都在讨论为啥曙光8000能排第一。怎么说的都有,但我发现曙光8000有个数据被很多人忽略了,就是单个计算单元算力密度比传统方案高20倍。
高密架构设计,单机柜内实现超高速总线互连,构建大规模、高带宽、低时延的超节点通信域。就是说别人一个机柜放1张卡的话,它能放20张。同样面积,算力翻着跟头往上涨。
这背后是工程能力的硬仗。十万卡集群包含约30亿个部件
任何微小波动都可能影响整体运行。曙光8000靠的是全链路自研,从芯片到网络到存储到散热,代码在自己手里,参数自己调。
而且它的散热也相当牛。整机柜浸没相变液冷,全年自然冷却,PUE低于1.04。
现场听工作人员说曙光8000上线第一周就满载,日均15万个作业,说明这些工程能力不是实验室数据,是生产环境验证过的。从万卡到十万卡,真正拉开差距的不是芯片数量,是让这么多芯片同时高效工作的系统能力。
中科曙光 AI WAIC镇馆之宝曙光8000
