智客 ZICQ
EN 登录 / 注册
智客前沿 大模型 #NVIDIA #AI工厂 #DSX平台 #Vera Rubin #能源效率

NVIDIA发布AI工厂生产优化平台:Vera Rubin与DSX平台引领能效革命

Mr.Xu 的头像

文 / Mr.Xu

发布时间: · 4 次阅读

中文阅读 (Chinese) English Version

摘要:在AI Infra Summit上,NVIDIA副总裁Ian Buck介绍了AI工厂效率的最新进展,展示了Vera Rubin系统和DSX平台在优化AI基础设施能效方面的突破性成果。Vera Rubin系统结合DSX MaxLPS软件,可实现高达40%的GPU容量提升和35%的token吞吐量增长,同时降低能耗。NVIDIA还与合作伙伴如Emerald AI、Lambda等展示了AI工厂在电网灵活性和性能优化方面的应用,验证了AI基础设施从峰值性能向每兆瓦token效率转变的趋势。


AI工厂效率革命:Vera Rubin与DSX平台引领新方向

在AI Infra Summit上,NVIDIA副总裁Ian Buck分享了AI工厂效率的最新进展,展示了NVIDIA在AI基础设施领域的重大突破。以下是本次发布的关键要点:

Vera Rubin系统与DSX MaxLPS

  • GPU容量提升:通过DSX MaxLPS的动态功率分配,AI工厂可以在相同功率预算下运行多达40%的额外GPU。
  • Token吞吐量增长:DSX MaxLPS优化了混合工作负载AI工厂的功率分配,使token吞吐量提高35%,且无需新增电力线路。
  • 智能功率管理:Intelligent Power Smoothing软件和扩展的能量缓冲技术吸收短期峰值,使系统更接近持续需求,从而提高计算效率。

AI工厂与电网灵活性

  • Emerald AI的合作:Emerald AI与NVIDIA合作开发了灵活负载程序,通过NVIDIA DSX Flex实现AI工厂的动态负载平衡,从而支持电网灵活性。
  • 实时响应电网信号:DSX Flex能够接收电网信号(如负载削减请求、需求响应事件和定价信号),并自动在预定义的工作负载层次结构中采取行动,确保关键任务继续运行,其他任务暂时暂停后恢复。

性能与经济性

  • AgentX基准测试:在SemiAnalysis AgentX基准测试中,NVIDIA Vera Rubin NVL72在DeepSeek V4 Pro模型上实现了每兆瓦高达30倍的吞吐量提升,成本每百万token降低45倍。
  • 实际应用案例:Lambda在NVIDIA Blackwell服务器上使用DSX MaxLPS,集群范围内的token吞吐量提高了24%,每瓦性能提升了23%。

技术亮点解析

  1. 全栈AI工厂平台:NVIDIA构建了一个从硅到电网的完整AI工厂平台,包括Vera Rubin系统、Dynamo推理软件、NeMo库和NVIDIA网络技术。
  2. NVLink与Groq 3 LPX:NVLink 6通过多层弹性架构确保AI工厂的可靠性,而Groq 3 LPX则提供超低延迟推理,与DSX MaxLPS互补,提升AI工厂的整体性能。
  3. AI智能体支持:Vera Rubin NVL72和Groq 3 LPX的结合,使得AI智能体在处理长上下文任务时能够实现更高的推理效率。

行业影响与开发者建议

  • AI基础设施转型:AI基础设施的评估标准正从峰值性能转向每兆瓦token效率,这要求AI工厂从芯片到电网进行协同设计。
  • 开发者工具优化:NVIDIA DSX MaxLPS和Groq 3 LPX为开发者提供了强大的工具支持,帮助他们在资源受限的环境中实现更高的AI性能。
  • 电网交互性增强:AI工厂与电网的实时交互能力将成为未来AI基础设施的重要特征,开发者应关注AI系统在电网灵活性方面的应用潜力。

总结

NVIDIA通过Vera Rubin系统和DSX平台展示了AI基础设施在能效和性能方面的革命性进步。这一发布不仅为AI工厂的能效优化提供了新的解决方案,也为AI智能体在复杂任务中的应用开辟了新的可能性。


消息来源:NVIDIA AI News (2026-09-15)

—— 完 ——

主题标签: #NVIDIA #AI工厂 #DSX平台 #Vera Rubin #能源效率

社区整体评论区

正在加载实时智能评论与划词标注…