RecodeX 重构消息,英伟达宣布,其Vera Rubin NVL72平台相比GB300 NVL72,每兆瓦的代理式AI推理吞吐量可提升至30倍,每百万Token成本降低至35倍。该平台旨在提升AI推理效率,降低运营成本。
英伟达Vera Rubin NVL72:AI吞吐量提升30倍,Token成本降35倍
后续报道
英伟达首测Vera Rubin NVL72,DeepSeek吞吐量飙升30倍
RecodeX 重构消息,英伟达在Hot Chips 2026大会上首次公布下一代旗舰机柜Vera Rubin NVL72的片上实测数据。在DeepSeek-V4-Pro(1.6T)的AgentX基准测试中,其每兆瓦吞吐量较GB300 NVL72最高提升30倍,每百万Token成本最高降低35倍。英伟达称,传统AI基准已无法衡量Agent工作流,需采用SemiAnalysis的AgentX基准。 同时,英伟达宣布Groq 3 LPX全面量产,该芯片专为Vera Rubin NVL72设计,在10万Token上下文下运行Gemma 4 31B,输出速度达3400 Token/秒,编码任务最大输出速度6981 Token/秒。Nebius已在其Token Factory中部署该芯片。此外,英伟达发布首款Agent专属CPU Vera,马斯克的SpaceXAI已连夜装机,计划将其送入太空。