MoonshotAI发布Kimi-K3开源模型,2.8T参数挑战OpenAI

近日,中国人工智能公司 Moonshot AI 宣布将其最先进大模型 Kimi-K3 的完整权重正式开源,这一里程碑事件不仅刷新了开源模型的参数规模上限,更在全球范围内引发了广泛关注。Kimi-K3 ...

人工智能

近日,中国人工智能公司 Moonshot AI 宣布将其最先进大模型 Kimi-K3 的完整权重正式开源,这一里程碑事件不仅刷新了开源模型的参数规模上限,更在全球范围内引发了广泛关注。Kimi-K3 是一款基于 MoE(混合专家)架构的超大规模语言模型,拥有 2.8 万亿参数和 1 万亿 token 的超长上下文窗口,能够在复杂任务中表现出与顶级闭源模型相当甚至更优的性能。

与传统的闭源模型不同,Kimi-K3 的开源策略使其能够被开发者、研究机构和企业自由下载并在本地部署。Moonshot AI 表示,他们已与多家推理合作伙伴及开源维护者协作,确保模型能在主流硬件和框架中稳定运行。这意味着,无论是学术研究还是商业应用,用户都可以基于 Kimi-K3 进行二次开发或构建专属的智能系统。

Kimi-K3 的技术突破主要体现在其架构创新上。首先,它采用了 KDA(Knowledge Distillation Attention)混合线性注意力机制,专为处理超长序列设计;其次,引入了 Attention Residuals 技术,显著提升了深层模型的训练稳定性;最后,通过优化 MoE 架构,将 896 个专家网络压缩至仅激活 16 个,结合 Stable LatentMoE 框架,在保持巨量参数的同时极大提高了计算效率。官方数据显示,这些创新让 Kimi-K3 的整体扩展效率较前代 K2 提升约 2.5 倍,真正实现了「规模」与「可用性」的平衡。

此外,Kimi-K3 还具备原生多模态视觉理解能力,支持高达 100 万 token 的超长上下文。其视觉编码器 MoonViT-V2 完全从零开始训练,仅依赖后续 token 预测,可直接依据语言建模目标调整表征。在视觉评估中,MoonViT-V2 的表现与 SigLIP 初始化的基线模型相当,进一步证明了其强大的多模态处理能力。

图片

Kimi-K3 的开源不仅展示了中国 AI 团队的技术实力,也为全球开源社区带来了真正的前沿级智能。Moonshot AI 创始人杨植麟表示:「前沿智能属于所有人。」这一理念的实践,使得 Kimi-K3 成为全球首个在长逻辑链编程、超长上下文智能体协作和复杂推理等场景中,能够与目前最强闭源模型(如 Fable 5 和 GPT-5.6 Sol)掰手腕的开源模型。

尽管 Kimi-K3 的系统要求较高(例如需要配备 Nvidia DGX B200 或 AMD EPYC 系统),但 Moonshot AI 计划在未来推出经过蒸馏优化的版本,以降低运行门槛,使其能够在消费级 PC 上运行。例如,近期推出的 Bosgame VTA-439 AI mini PC(配备 256GB RAM)就成为潜在的适配设备之一。

Kimi-K3 的发布被视为中国 AI 竞赛中的一个重要转折点。此前,Moonshot AI 曾因商业化决策失误导致 Kimi 聊天机器人频繁宕机,市场份额被更大规模的竞争对手超越。然而,随着 DeepSeek R1 模型的成功,杨植麟决定重新聚焦于模型训练,并承诺开源核心 AI 模型,允许用户下载并在自己的硬件上运行。这一战略调整不仅帮助 Moonshot AI 实现了技术上的翻盘,也吸引了大量投资者的关注。

目前,Moonshot AI 正准备进行首次公开募股(IPO),并正在进行两轮连续融资。据知情投资者透露,第二轮融资将使其估值达到约 500 亿美元。与此同时,人工智能编码助手和自主代理的蓬勃发展,推动了开发者需求的激增,使 Moonshot 成为中国增长最快的模型提供商之一。该公司补充说,6 月份的年度经常性收入已达到约 3 亿美元。

Kimi-K3 的开源不仅改变了中国 AI 竞赛的格局,也对国际巨头构成了新的挑战。美国主要竞争对手(如 OpenAI 和 Anthropic)长期以来主导着高端 AI 模型市场,而 Kimi-K3 的出现打破了这一垄断局面。有分析认为,随着更多开源模型的涌现,未来 AI 领域的竞争将更加激烈,同时也将加速技术创新和应用落地。