DC娱乐网

展台上最不起眼的那个“网”,才是AI4S算力的隐形冠军 今天在科学智能大会上跟

展台上最不起眼的那个“网”,才是AI4S算力的隐形冠军

今天在科学智能大会上跟几个同行聊,有个共识挺有意思:现在缺的不是算力,是“能喂进去数据、能跑得起来”的算力。展区逛了一圈,服务器、存储各家都有,但真正把“算存网”全链路方案摆出来讲的,还真就中科曙光一家。

为啥这么讲?很多科研集群的卡闲着,不是算力不够,是数据从存储搬到计算节点半路堵死了。算力再强,数据和计算之间隔着一条“乡村小路”,模型跑起来就是“饿着肚子干活”。曙光这次展出的scaleFabric 400G无损高速网络,就是专门解决这个问题的,国内首款全栈自研的原生RDMA方案。配合ParaStor F9000单节点220GB/s带宽,能同时给单节点的40张GPU卡每卡提供超5GB专属带宽。行业数据显示,稠密大模型训练中通信耗时占比超30%——网络这个隐藏的瓶颈,平时真容易被忽略。

这套算存网协同方案已经在郑州国家超算互联网核心节点落地了,完成近百项万卡规模测试。万亿原子级水分子动力学模拟这类应用能跑出来,靠的不只是卡多,更是整个系统设计对得起这些卡。算存网一体化交付,算是把这个结给解了。