DC娱乐网

英伟达补齐智能体AI推理“最后一公里”Groq 3 LPX正式投产 8月24日

英伟达补齐智能体AI推理“最后一公里”Groq 3 LPX正式投产

8月24日英伟达宣布Groq 3 LPX全面投产。LPX为独立机架系统,与NVL72异构协同而非替代:GPU负责Prefill与训练,LPX专攻Decode超低延迟生成,适配智能体多轮工具调用。SpaceXAI入局建设地面算力,远期规划太空AI卫星。异构集群直接利好1.6T/3.2T高端光模块。
一、关键事实
英伟达与Groq关系:技术授权+人才聘用,Groq保持独立运营,原版LPU与英伟达LPX形成竞合。
硬件部署形态:LPX是独立机架系统,通过高速链路与NVL72集群协同;“七大专用芯片统一超算”为逻辑层面定义,非单机箱物理集成。
SpaceX算力规模:现有约1GW,2026年底目标超2GW,远期2027年底向10GW迈进。
二、异构算力分工:面向Agent的Prefill‑Decode解耦
智能体任务特征:大量循环执行工具调用与校验,每一轮Decode时延直接决定整体任务耗时。
分工模式:Vera Rubin NVL72承担Prefill、超大上下文与训练等重负载;Groq 3 LPX聚焦Decode解码,依靠片上SRAM实现确定性低时延。
硬件规格:单机架256颗LPU,128GB SRAM +12TB DDR5,40PB/s SRAM带宽。
性能与产能:智能体负载响应最高达竞品4倍;2026年预计交付6000台LPX机架,核心客户为谷歌、AWS、微软。注意:30倍吞吐量是整套系统在特定Agent负载下的能效提升,非单芯片速度提升30倍。
三、SpaceXAI:地面大规模算力+轨道算力构想
地面:落地Vera Rubin集群,目标2027年接近10GW,Vera CPU承接智能体沙箱与工作流编排。
远期规划:Starmind首代AI卫星,部署定制Vera Rubin NVL72于太空,在轨完成推理,减少星地回传压力。暂无明确发射时间表。
四、产业映射
光互联板块(直接利好):多机架并置协同爆发机架间高速互联需求,1.6T/3.2T高端光模块订单能见度抬升。1-3年内可插拔光模块逻辑未被削弱,中际旭创、新易盛、天孚通信等龙头受益。
国产算力启示:“通用GPU+专用推理LPU”分离架构提供可参考范式;国内最大短板在全栈互联生态;太空算力(星载AI推理)为长期赛道。
五、核心风险
30倍吞吐量等为特定基准最优结果,通用场景收益会大幅回落;
LPX刚进入投产,真实落地表现待验证,短期产能受限;
太空AI卫星属远期构想,工程难度极高。

Groq 3 LPX投产标志着AI算力竞争标尺从训练FLOPS转向智能体Token经济学。英伟达通过“通用GPU+专用LPU”异构架构,卡位智能体爆发窗口。算力总量扩张与集群复杂度抬升,对高速光互联产业链形成现实利好。
投资需谨慎。