小米MiMoV2.6Pro登顶智能体编程中文测评榜单,国产大模型表现亮眼

10月9日,SuperCLUE发布的智能体终端编程中文测评榜单显示,小米MiMo V2.6 Pro以64.65分高居榜首。该测评重点考察大模型在驱动智能体框架时对中文需求的理解、任务规划等核心能力。与...

人工智能

近日,人工智能领域迎来一项重要进展。10月9日,SuperCLUE公布了智能体终端编程中文测评榜单,小米公司推出的MiMo V2.6 Pro版本以64.65分的综合得分荣登榜首。这份测评采用Claude Code作为标准平台,横向对比了包括Kimi、GLM、Hy4等在内的多款大模型的核心能力。

从测评结果来看,MiMo V2.6 Pro不仅在得分上领先,其每题成本仅为1.52元,展现出极高的性价比。相比之下,DeepSeek-V4.1-Flash(max)虽然时间效率更高,但得分仅为50.51分;而Hy4-Preview(high)虽得分55.56分,但每题成本高达11.61元。这一结果表明,在中文场景下,国产大模型已经能够与海外主流产品展开竞争。

此次测评还揭示了智能体编程技术的发展现状。很多开发者已经开始将智能体作为辅助工具,用于生成脚本、排查报错和修复bug。与传统编程方式相比,这种方式可以显著提高开发效率。特别是在中文指令理解方面,不少海外大模型存在明显短板,而国产模型则展现出更强的适配能力。

文章配图

值得注意的是,尽管国产大模型在本次测评中表现出色,但智能体终端编程仍处于发展阶段,尚无法完全替代程序员。不过,这次榜单无疑展示了中国企业在人工智能领域的进步,尤其是在硬核工程任务处理方面,已经具备与国际巨头一较高下的实力。

此外,小米公司在其他领域的表现也值得关注。近期数据显示,小米移动智慧屏(即俗称的闺蜜机)销量逆势增长,8月销量实现翻倍,市场份额提升至15.1%,成功进入行业线上销量前三。这主要得益于小米强大的IoT生态体系,以及其27英寸Max27机型在电池容量、尺寸适中等方面的综合优势。