AIDC
← 返回全部动态
NVIDIA · AI 筛选AI 评分 75/10009月16日 00:55

英伟达在AI Infra Summit展示Vera Rubin与DSX平台:全面优化AI工厂每瓦Token能效

在圣克拉拉举行的AI Infra Summit上,英伟达超大规模与高性能计算副总裁Ian Buck发表了关于AI工厂效率的演讲。英伟达展示了其下一代Vera Rubin架构和DSX平台的最新进展,重点阐述了如何通过提升“每瓦Token数”(Tokens Per Watt)来优化AI算力基础设施的能源效率,以应对AI数据中心不断增长的能耗挑战。

推荐理由英伟达高管公开阐述下一代Vera Rubin架构及AI工厂每瓦能效优化策略,对全球算力基础设施发展具有指引意义。

原标题:AI Infra Summit: NVIDIA Vera Rubin and DSX Platform Advancements Showcase Energy Efficiencies of Optimizing Tokens Per Watt for AI Factories

阅读 NVIDIA · AI 筛选 原文 ↗

同一事件的其他来源

NVIDIA · AI 筛选09月16日 23:00

英伟达 Vera Rubin NVL72 在 MLPerf Inference v6.1 评测中首秀展现领先性能

英伟达下一代 Vera Rubin NVL72 系统在 MLPerf Inference v6.1 基准测试中正式亮相并取得领先成绩。测试强调了系统性能、基础设施高效扩展与持续软件优化对 AI 推理经济性的决定性影响:高系统性能可提升 Token 生成效率与商业收益,高效扩展能确保硬件吞吐量成比例增长并降低资源开销,持续优化则可最大化基础设施的投资回报价值。

NVIDIA Developer Blog09月16日 00:55

英伟达探讨 Groq 3 LPX 确定性执行如何驱动 Vera Rubin 架构实现高效低延迟推理

功耗已成为 AI 数据中心的关键制约因素。随着 AI 工作负载对全栈计算平台提出更高要求,计算平台的各个组件都必须最大化能效。文章探讨了在英伟达下一代 Vera Rubin 平台上,如何通过 Groq 3 LPX 风格的确定性执行机制来优化高交互性推理任务,从而在严苛的功耗限制下实现极低延迟和高能效表现。