英伟达重启RubinCPX项目,改用168GBHBM4内存提升AI推理性能

近日,有消息称英伟达(NVIDIA)已重启其备受关注的“Rubin CPX”人工智能推理加速器项目。这一消息由知名供应链分析师郭明錤在其最新产业调查中披露,标志着该项目在一度搁置后重新启动,并且在设计...

人工智能

近日,有消息称英伟达(NVIDIA)已重启其备受关注的“Rubin CPX”人工智能推理加速器项目。这一消息由知名供应链分析师郭明錤在其最新产业调查中披露,标志着该项目在一度搁置后重新启动,并且在设计上进行了显著调整。

根据郭明錤的分析,新版本的Rubin CPX芯片在多个方面进行了优化升级。首先,在内存配置上,原计划搭载128GB GDDR7显存的设计被改为配备168GB HBM4高带宽内存。这种改变不仅提升了数据传输效率,还为处理大规模AI推理任务提供了更强的支持。

在芯片性能方面,新Rubin CPX与标准Rubin GPU保持了接近的算力水平,同时进一步优化了预填充性能。这意味着它能够更高效地处理输入并建立KV Cache,从而满足日益增长的AI推理需求。此外,单体最高功耗仍维持在2300W,确保了高性能的同时兼顾能效比。

从系统架构来看,新Rubin CPX采用了更为灵活的部署方式。8颗新Rubin CPX芯片构成一个计算托盘,8个计算托盘组成一个机架模组。内部通过Spectrum-6全铜以太网实现横向扩展(Scale-out),而独立的MGX ETL机架则支持1~4组机架模组的灵活组合。机架模组间的横向扩展则采用Spectrum-6 + OSFP光学方案,进一步提升了系统的扩展性和可靠性。

在系统层面,NVIDIA建议将Rubin CPX与标准Rubin按1:1的比例进行配对使用。Rubin CPX ETL机架与Vera Rubin NVL72机架之间采用基于以太网的RDMA连接,这种设计不仅提高了数据传输速度,还降低了延迟,为大规模AI推理任务提供了更好的支持。

此次Rubin CPX项目的重启和设计调整,反映了英伟达在AI硬件领域的持续创新和技术积累。随着AI技术的快速发展,对高性能计算的需求也在不断增加。新Rubin CPX的推出,不仅能够满足当前市场对AI推理加速器的需求,还为未来的AI应用提供了强大的硬件支持。

预计新Rubin CPX将于2027年第一季度开始生产,届时将为AI开发者和企业提供更强大的硬件解决方案,推动AI技术在各个领域的广泛应用。

图片