浪潮发布元脑SD200Ultra,128芯超节点突破AI算力极限

9月23日,浪潮在2026人工智能计算大会(AICC2026)上发布元脑SD200 Ultra超节点AI服务器。该产品基于本土AI芯片,采用128核设计,单机可承载2.8万亿参数Kimi K3大模型,...

人工智能

在2026年人工智能计算大会(AICC2026)上,浪潮信息正式发布了其最新一代AI超节点产品——元脑SD200 Ultra。这款基于本土AI芯片的高性能计算设备,以开放系统设计紧耦合128核处理器,单机即可承载运行2.8万亿参数规模的Kimi K3大模型,标志着中国AI算力基础设施建设迈入全新阶段。

据发布会介绍,元脑SD200 Ultra的核心技术突破主要体现在三个方面:首先是极低的Token生成时延,首次将响应时间控制在5.85毫秒以内,相当于单用户每秒可生成约170个Token,这一性能指标达到业界平均水平的5倍;其次是强大的模型承载能力,不仅能支持2.8万亿参数的Kimi K3,还可扩展至10万亿参数规模的前沿模型;最后是创新的系统架构设计,通过3D Hyper Mesh架构实现统一内存寻址和低延迟通信,使GPU显存直连远端显存成为可能,AllReduce通信时间降低3.5倍。

浪潮首席AI战略官刘军在发布会上指出,随着Agent时代的到来,AI计算产业正经历从"提供算力"到"生产智能"的范式转变。他强调,衡量计算系统价值的标准已从单纯的算力规模转向支撑智能强度和生产效率的综合考量。针对复杂Agent任务对计算、通信和软件栈提出的更高要求,元脑SD200 Ultra通过超级算子智能体技术,将KDA、Gated MLA、MoE等基础算子融合,使算子数量降低10倍,推理性能提升3倍以上。

浪潮元脑SD200超节点参数展示

与此同时,浪潮还推出了面向规模化智能供给的元脑HC2000多元算力机组。该产品采用DirectCom 2.0极速架构和高密液冷AI整机柜设计,搭配MCIS推理软件栈,可在同等投资下将Token产能提升10倍。刘军表示,当前AI计算需求已分化为能力型智算和容量型智算两大方向,前者致力于突破智能上限,后者则侧重于实现智能充分供给,这要求计算系统必须统筹算子、内存、互连与整机系统,进行贯穿式创新。

元脑SD200 Ultra架构示意图

此次浪潮发布的两款产品,不仅展示了中国在AI芯片和系统架构领域的自主研发能力,更标志着AI算力基础设施的竞争维度正在发生深刻变化。从单一芯片性能比拼,转向系统级工程能力的全面较量,这一趋势将推动中国AI产业向更高层次发展。