中国Kimi K3开源模型发布,2.8万亿参数超越Fable 5登顶前端代码榜
近日,中国人工智能公司Moonshot AI发布了其最新研发的Kimi K3大模型,这款拥有2.8万亿参数的开源模型在多个权威基准测试中表现出色,特别是在前端代码生成领域,成功超越了此前被认为是全球最...
近日,中国人工智能公司Moonshot AI发布了其最新研发的Kimi K3大模型,这款拥有2.8万亿参数的开源模型在多个权威基准测试中表现出色,特别是在前端代码生成领域,成功超越了此前被认为是全球最强的Claude Fable 5和GPT-5.6 Sol等闭源模型。
根据Arena AI发布的前端代码能力排行榜显示,Kimi K3以1,679分的成绩位列第一,领先第二名的Claude Fable 5(1,631分)和第三名的GPT-5.6 Sol(1,618分)。这一成绩标志着中国在大模型领域的技术实力已达到国际顶尖水平。
Kimi K3的发布不仅展示了中国在AI模型开发上的突破性进展,也体现了中国企业在面对美国技术限制时的创新能力和应对策略。Moonshot AI表示,K3模型的研发团队克服了诸多技术难题,特别是在计算资源受限的情况下,通过优化算法和架构设计,实现了模型性能的显著提升。
值得注意的是,Kimi K3的定价策略也颇具特色。官方宣布每百万token输入费用为20元,输出费用为100元,这一价格定位与GPT-5.6 Terra相当,显示出对中国市场的充分考量。此外,Kimi K3的发布时间选在了世界人工智能大会(WAIC)前夕,这一时机选择也反映了公司对市场推广的重视和信心。
从技术细节来看,Kimi K3不仅在前端代码生成方面表现出色,在通用任务处理、表格分析、视觉理解等多个维度都展现了强大的能力。例如,在GDPval-AA v2 Elo测试中,Kimi K3以1768.0分的成绩领先于Claude Fable 5的1748.0分;在Spreadsheet Bench 2测试中,Kimi K3更是以91.2分的高分遥遥领先。
尽管Kimi K3在多个测试中表现优异,但Moonshot AI也坦诚指出,该模型的整体表现仍略逊于目前最强大的闭源模型如Claude Fable 5和GPT-5.6 Sol。不过,Kimi K3已经稳定超过了除上述两款模型外的所有其他模型,这一成就足以证明其技术实力。
随着Kimi K3的全面开源,预计将在全球范围内引发新一轮的技术浪潮。开源社区的加入将加速模型的迭代优化,推动整个AI行业的发展。同时,这也为中国AI企业走向国际舞台提供了强有力的技术支撑。
图1] 展示了Kimi-K3在Arena AI前端代码能力排行榜上的领先地位,其得分远超竞争对手,彰显了模型在代码生成领域的卓越性能。
图2] 则详细列出了Kimi K3在多个测试项目中的具体得分情况,包括通用任务处理、表格分析、视觉理解等多个维度的表现,进一步印证了其全面的技术实力。