英伟达VeraRubinNVL72投产,Token吞吐量提升4.8倍,AI算力再升级
英伟达新一代Vera Rubin NVL72系统已在CoreWeave Cloud正式投入生产,成为首个运行生产工作负载的客户。该系统在SWE-2推理任务中实现总Token吞吐量较GB200 NVL7...
10月3日,AI云服务商CoreWeave宣布,英伟达最新一代Vera Rubin NVL72系统已正式投入生产。作为全球领先的AI计算平台,Vera Rubin NVL72的投产标志着AI基础设施性能的又一次重大飞跃。根据CoreWeave提供的测试数据,该系统在SWE-2推理任务中实现了总Token吞吐量较前代GB200 NVL72提升高达4.8倍的显著优势。
在强化学习场景中,Vera Rubin NVL72的表现同样令人瞩目。每GPU输出Token吞吐量达到GB200 NVL72的3.8倍,这意味着像Devin这样的智能体可以同时处理更多会话并加速多步推理过程。此外,该系统的每瓦性能也得到大幅提升,在DeepSeek-R1推理基准测试中,Vera Rubin NVL72每兆瓦Token吞吐量达到GB200 NVL72的10倍,充分体现了其能效比的显著优化。
从硬件配置来看,NVL72系统采用了创新的模块化设计,由36颗Vera CPU和72颗Rubin GPU构成,并采用100%全液冷设计。这种设计不仅提高了散热效率,还通过无缆线模块化托盘将安装时间从两小时压缩至五分钟,大幅提升了部署效率。值得注意的是,CoreWeave还将Vera CPU作为独立计算层提供给客户,单机架可部署128颗Vera CPU、总计11264核,支持超过11000个并发隔离环境,智能体沙箱启动速度比x86 CPU快3倍以上。
在软件生态方面,CoreWeave同步推出了Forge开发环境,将Weights & Biases、OpenPipe等工具整合为统一开发层,覆盖实验追踪、模型评估与生产部署全流程。这一举措大大简化了AI应用的开发和部署流程,为开发者提供了更高效的开发体验。
英伟达超大规模与高性能计算副总裁Ian Buck表示,CoreWeave的V100 GPU至今仍在运行客户工作负载,而Vera Rubin NVL72已进入生产,这体现了英伟达平台跨代持续创造价值的长期能力。这一表态表明,英伟达正在构建一个能够持续迭代升级的AI基础设施生态系统,为客户带来持续的技术红利。
在实际应用场景中,Vera Rubin NVL72已经展现出强大的商业价值。AI软件公司Cognition成为首个在该平台上运行生产工作负载的客户,其成功案例证明了Vera Rubin NVL72在实际业务中的可靠性和高效性。随着更多企业开始采用这一先进平台,预计将推动整个AI产业的快速发展。
从市场表现来看,英伟达股价近期持续攀升,截至发稿时已达236.65美元,创下历史新高。这一强劲表现反映了市场对AI基础设施投资周期延续的预期,以及对英伟达技术领先地位的认可。摩根大通分析师指出,外国投资者正持续加大对北美人工智能计算基础设施的资金投入,显示出全球资本对AI产业发展的高度关注。
总体而言,Vera Rubin NVL72的投产不仅标志着英伟达在AI基础设施领域的又一重大突破,也为整个AI产业的发展注入了新的动力。随着更多企业和机构开始采用这一先进平台,预计将在未来几年内推动AI技术在各个行业的深度应用和创新发展。
