英伟达VeraCPU发布,重新定义AI基础设施中的CPU角色

近年来,随着人工智能技术的快速发展,英伟达凭借其GPU产品在数据中心市场占据主导地位。然而,在智能体(Agent)应用兴起后,传统的GPU-centric计算模式面临新的挑战。英伟达最新发布的Vera...

人工智能

近年来,随着人工智能技术的快速发展,英伟达凭借其GPU产品在数据中心市场占据主导地位。然而,在智能体(Agent)应用兴起后,传统的GPU-centric计算模式面临新的挑战。英伟达最新发布的Vera CPU,正是针对这一变化而推出的全新解决方案。

Vera CPU的核心设计围绕着提升AI工作负载的整体效率展开。与传统服务器CPU追求高核心数量不同,Vera采用了88个经过专门优化的Olympus核心,每个核心都配备了10路解码前端、深度乱序执行单元以及先进的神经网络分支预测机制。这种设计使得Vera在处理Python脚本、代码编译等智能体任务时,相比x86基准系统最高可实现约1.8倍的性能提升。

图片

在架构层面,Vera CPU采用了Chiplet设计,将88个计算核心集成在一个计算裸片上,并通过第二代Scalable Coherency Fabric连接共享缓存、内存和I/O模块。这种设计虽然牺牲了一部分核心密度,但显著降低了核心间的数据传输延迟,确保了在高负载下的稳定性能表现。

英伟达表示,Vera CPU的推出反映了AI基础设施评价标准的转变。过去,数据中心更关注每美元能获得多少核心;而现在,衡量标准已经转向每美元和每瓦电力能够产生的Token数量。Vera正是基于这一理念设计,旨在让昂贵的GPU资源得到更充分的利用。

图片

"GPU正在努力完成计算任务,但CPU却常常成为瓶颈。"英伟达的一位高管表示,"我们希望通过Vera CPU,让整个AI工作流更加顺畅,减少不必要的等待时间。"

当前,AMD和Intel等竞争对手仍在沿着多芯粒提高核心密度的方向发展,而英伟达的选择则显得更为独特。这种架构分叉是否会带来不同的市场结果,还有待时间检验。不过可以肯定的是,Vera CPU的发布标志着英伟达在数据中心处理器领域的又一次重要布局。