海外开源模型提速,美版DeepSeekBeam与MistralLarge4同台竞技
当地时间10月5日,美国创业公司Reflection发布首款开放权重模型Beam,对标中国领先模型。随后法国Mistral推出最大规模的Mistral Large 4。数据显示,中国开源模型已占据全球...
随着中国开源模型在全球范围内的快速崛起,西方阵营也开始加速追赶步伐。当地时间10月5日,被称作"美版DeepSeek"的美国创业公司Reflection发布了其首个开放权重模型Beam;一天之后,法国人工智能公司Mistral推出了迄今最大的Mistral Large 4模型。这两款新模型的发布,标志着西方在开源AI领域正式进入新一轮竞争周期。
Hugging Face平台数据显示,过去一年中,中国开源模型已经占据了该平台模型下载量的约41%,无论是月度下载量还是累计下载量均已超过美国。包括DeepSeek、阿里Qwen、月之暗面Kimi、智谱GLM、MiniMax以及小米MiMo在内的多款中国模型,不断刷新着开源模型的能力上限,成为全球开发者竞相模仿的对象。
值得注意的是,开源模型已不再局限于研究者和极客群体的小众工具。Vercel AI Gateway的生产流量数据显示,今年8月,开放权重模型已经处理了其平台56%的Token,而这一比例在去年12月还不到10%。这表明开源模型正在快速渗透到实际生产环境中,其重要性日益凸显。
作为"美版DeepSeek"的代表作,Reflection的Beam模型采用了MoE(混合专家)架构,总参数量达到5010亿,但在推理时仅激活230亿参数。该公司强调,Beam在高级推理任务上的表现可以达到GLM-5.2约四分之一到三分之一的算力水平,显示出显著的效率优势。然而,在与最新一代中国模型的横向对比中,Beam仍存在一定差距。例如在Agent编程测试DeepSWE v1.1中,Beam得分为44.4,低于GLM-5.3的61.0、Kimi K3的68.0以及DeepSeek V4.1 Flash的74.2。
Mistral Large 4则展示了法国公司在开源模型领域的雄心。这款模型的推出,不仅体现了Mistral在技术上的持续突破,也反映了欧洲在AI领域追赶中国的决心。两家公司的模型发布,共同推动了全球开源模型竞赛的升级。
尽管Beam在某些指标上表现出色,但其与最新一代中国模型的差距仍然明显。例如在Humanity's Last Exam(HLE)测试中,Beam得分为36.2,低于GLM-5.3的42.3和Kimi K3的46.9。这表明,虽然Beam将美国开源模型重新拉回到与中国头部模型相近的位置,但要真正追上最新的中国模型,还需要进一步的技术突破。
Reflection CEO Misha Laskin表示,Beam的主要定位是为企业提供长期可用的"主力模型",而不是单纯追求性能排名。这种策略与DeepSeek早期的成功模式相似,即通过提供性价比更高的解决方案来赢得市场。不过,由于Beam的研发成本高昂,其"低成本版DeepSeek"的定位可能难以完全实现。
