RecodeX 重构消息,在AI基础设施峰会上,英伟达展示面向AI工厂的DSX MaxLPS功耗调度系统,称可使每兆瓦token吞吐量最高提升40%。该技术已由Emerald AI集成至Conductor平台,其DSX Flex可依据电网状态动态调整数据中心用电需求,已接收200次电网状态信号且无需用户干预;Lambda测试后在固定功率预算下token吞吐量提升24%。

英伟达同时披露,Vera Rubin与Groq 3 LPX机架在相同站点功耗范围内,GPU数量最多可增加40%,token吞吐量最多提升35%,其中Groq 3 LPX在特定工作负载中达到每位用户每秒2529个输出token。多家企业测试Vera CPU,结果显示性能、吞吐量、查询任务吞吐量等指标大幅提升,并在安全沙箱启动速度、编排步骤延迟和分析查询性能等方面取得显著优化。