AB
AiBoss站
快讯

英伟达称Groq 3 LPX已全面投产,用于扩展Vera Rubin推理

NVIDIA Groq 3 LPX已进入全面投产阶段,定位为Vera Rubin NVL72的低延迟Token生成扩展。Nebius成为首个采用该平台的AI云服务商。

英伟达宣布NVIDIA Groq 3 LPX已全面投产。该平台与Vera Rubin NVL72协同工作,由Rubin GPU处理大规模上下文,LPX负责对延迟敏感的Token生成任务。

英伟达称机架级部署最多可包含256个LP30加速器,Nebius是首个采用该平台的AI云服务商。公告中的性能对比属于特定模型和测试条件下的结果。

参考:NVIDIA公告