News
英伟达称Vera Rubin NVL72代理式AI能效最高提升30倍
英伟达公布Vera Rubin NVL72早期实测数据,称其在特定代理式编码负载下,相比GB300 NVL72可实现最高30倍的每兆瓦吞吐量和最高35倍的Token成本降幅。
英伟达发布Vera Rubin NVL72面向代理式AI工作负载的早期性能数据。在SemiAnalysis AgentX记录的真实代理式编码轨迹中,英伟达称该系统运行DeepSeek V4 Pro时,每兆瓦吞吐量相比GB300 NVL72最高提升30倍,每百万Token成本最高降低35倍。
这些数字由英伟达测得,目前仍等待SemiAnalysis复核,也未计入Vera CPU在工具调用环节的性能,不能直接泛化到所有模型和工作负载。
参考:NVIDIA测试说明