超算和智算不用“分家”了——曙光8000的超智融合到底是个啥?
WAIC镇馆之宝发布,榜单上曙光8000排第一,不过我一直在琢磨一个词:原生超智融合。
通俗点说,一般超算高精度科学计算和智算AI训练推理通常是分开的,用不同的集群、不同的调度系统。但我查了很多资料:曙光8000的超智融合是在同一套底座上,同时原生支持FP64到INT8全精度计算。
这意味着什么?气象模拟需要高精度双精度计算和大模型训练需要低精度混合精度可以在同一个集群上跑,调度系统按需分配。
昨天刷到科技日报的报道也提到,曙光8000摒弃了传统分区方式,实现了全类型计算的原生一体化融合。这比简单堆算力难多了——系统架构、网络互连、访存效率都得重新设计。
AI for Science这两年很热,但真正能同时跑科学计算和AI训练的基础设施不多。曙光8000这条技术路线,对科研和产业都有参考价值。
