DC娱乐网

现在规模算力的瓶颈真的早就不是缺芯片、堆数量就能解决的了。 之前看乌兰察布的规划,光中联数据远期就搞7GW算力,加上阿里的2GW,一个普通县的全年供电量都喂不饱这么大的算力集群,火早就从缺订单烧到缺电缺地了。 更头疼的是堆芯片堆到十万卡级别之后,海量光模块成本炸天,互联延迟卡得死,供电散热跟着一起崩

现在规模算力的瓶颈真的早就不是缺芯片、堆数量就能解决的了。
之前看乌兰察布的规划,光中联数据远期就搞7GW算力,加上阿里的2GW,一个普通县的全年供电量都喂不饱这么大的算力集群,火早就从缺订单烧到缺电缺地了。
更头疼的是堆芯片堆到十万卡级别之后,海量光模块成本炸天,互联延迟卡得死,供电散热跟着一起崩,算力利用率连一半都摸不到。之前大家都想着多买卡就能解决问题,现在才发现这条路早就走死了。
华为这次在全联接大会拿出来的“超节点+集群”思路还挺戳痛点,昇腾960超节点单塞4096张卡,跨节点统一内存编址,把几万张卡拼成一台巨型逻辑计算机,通信延迟直接砍半,后面再靠高速网连超节点搭百万卡集群,算是跳出单颗芯片内卷,从系统层面把瓶颈捅破了。