NVIDIAVeraRubin发布,从芯片到电网全栈优化,单Token成本再降10倍

在人工智能基础设施领域掀起新一轮变革的NVIDIA Vera Rubin平台正式登场。这款全新AI系统不仅重新定义了数据中心算力的交付方式,更通过从芯片到电网的全栈协同设计,在降低每个Token成本方...

人工智能

在人工智能基础设施领域掀起新一轮变革的NVIDIA Vera Rubin平台正式登场。这款全新AI系统不仅重新定义了数据中心算力的交付方式,更通过从芯片到电网的全栈协同设计,在降低每个Token成本方面实现了革命性突破。

图片

作为NVIDIA在AI硬件领域的最新力作,Vera Rubin平台的核心在于其极致的协同设计。五种机架系统(包括Vera NVL72、Vera CPU机架等)被作为一个完整的系统进行工程研发,而非简单的通用产品拼凑。其中,Vera CPU作为平台的核心,采用了定制的Olympus核心架构,相较于竞品的芯粒方案,单线程性能提升2倍、核间带宽提升3倍、内存延迟降低40%。这一设计使得Vera CPU成为面向最关键智能体负载时最高效的单线程处理器。

在网络层面,Vera Rubin平台的第六代NVLink纵向扩展技术展现出显著优势。在处理复杂工作负载时,相比通用以太网,其吞吐量提升超过2倍、延迟降低1/3、数据包处理速率提升10倍。横向扩展方面,采用NVIDIA光电一体化封装(CPO)技术的Spectrum-X 以太网交换机系统,能效提升5倍、平均无故障间隔时间(MTBF)提升10倍。CoreWeave、Lambda和OCI等领先AI基础设施提供商已率先采用该技术。

图片

值得注意的是,尽管Vera Rubin平台在性能上取得突破,但在成本控制方面也进行了精心优化。由于HBM价格持续上涨,NVIDIA对系统内存配置进行了调整。原本计划搭载384GB HBM4E的Rubin Ultra,最终版本改为192GB HBM4,这直接将单机架成本从约760万美元降至约680万美元。虽然单颗GPU的HBM容量减半,但系统整体成本下降约20%,同时通过增加scale-up网络预算,提升了跨机架互联能力。

图片

Vera Rubin平台的供应链覆盖30个国家的350多家工厂,拥有迄今为止规模最大、最成熟的机架级供应链。目前,CoreWeave、Google Cloud、Microsoft Azure和Oracle Cloud Infrastructure等全球领先的云服务提供商均已部署该平台。特别是在CoreWeave针对DeepSeek-R1的首次基准测试中,其每兆瓦吞吐量比Grace Blackwell NVL72提升了10倍,充分验证了Vera Rubin平台在电力受限环境下的卓越表现。