曦云C系列GPU率先适配星辰Xing4.0,国产算力再迎里程碑

9月19日,中国电信发布新一代星辰大模型Xing4.0-29B-A4B,沐曦股份依托自研MXMACA软件栈,使曦云C系列GPU率先完成对该模型的Day 0适配。该模型采用MOE架构,参数量29B,激活...

人工智能

9月19日,中国电信正式发布了新一代星辰大模型Xing4.0-29B-A4B,这是国内首个基于国产算力与国产框架完成训练、面向复杂工程任务深度优化的百亿参数大模型。与此同时,沐曦股份宣布,其曦云C系列GPU率先完成了对Xing4.0-29B-A4B的Day 0适配,实现了"上线即适配"的高效部署。

Xing4.0-29B-A4B采用了先进的MOE(Mixture of Experts)架构,总参数量为290亿,但激活参数仅为40亿,这种设计不仅降低了计算资源需求,还显著提升了模型的效率和可扩展性。该模型原生支持256K上下文长度,并可扩展至512K,使其能够处理更长的文本序列,满足复杂工程任务的需求。

性能方面,Xing4.0-29B-A4B在多个权威评测中表现出色。在SWE-bench Verified测试中得分75.0,在Terminal-Bench 2.1测试中得分为57.5,均超过同尺寸竞品。特别是在SuperCLUE智能体能力评测中,Xing4.0-29B-A4B以93.52分位列第三,与两款头部Qwen模型的差距均不足1分,展现了强大的智能体能力。

值得注意的是,通过4-bit量化技术,Xing4.0-29B-A4B的显存占用降低至15GB,这意味着RTX 3090、RTX 4090等消费级显卡即可本地运行该模型,大大降低了硬件门槛。

此次适配的核心支撑来自沐曦自研的MXMACA软件栈。该软件栈全链路覆盖底层驱动、MXCC编译器、算子深度适配及主流训练/推理框架对接,将传统模型适配周期从数周压缩至小时级。目前,MXMACA已兼容40余种AI框架,适配超1000款模型,全量支持PyTorch 2.8的2410个GPU算子。

自2025年12月以来,沐曦已完成38个主流顶尖模型的Day 0适配,范围涵盖智谱AI、阿里千问、MiniMax、DeepSeek、阶跃星辰、腾讯混元等头部厂商,适配速度、数量与生态广度均位居行业前列。

SuperCLUE智能体能力评测

图表显示,Xing4.0-29B-A4B在多个基准测试中表现优异,尤其是在t¹-Bench和Claw-Eval测试中,其得分远超其他模型,充分展示了其在任务规划、工具调用和自主执行等方面的能力。

在SuperCLUE智能体能力评测中,Xing4.0-29B-A4B以93.52分位列第三,与前两名Qwen模型的差距均不足1分,表明其在智能体场景下的综合表现非常接近顶级水平。

此次适配不仅标志着国产算力在智能体时代的重大突破,也为后续的商业化应用奠定了坚实基础。随着更多国产芯片和软件栈的成熟,预计未来将有更多类似的创新成果涌现,推动中国人工智能产业的快速发展。