DeepSeek美国版Beam发布,性能追至V4.1Flash3%差距
DeepSeek美国版公司Reflection正式发布5010亿参数的MoE大模型Beam,其性能在基准测试中已追至中国顶尖开源模型DeepSeek V4.1 Flash的3%差距。该模型使用NVID...
近日,在开源AI大模型领域,美国企业开始发力追赶中国企业。10月6日,由DeepSeek美国版公司Reflection发布的Beam大模型正式亮相。这款5010亿参数的稀疏混合专家(Sparse MoE)架构模型,仅激活230亿参数,支持1M上下文长度,是一款纯文本处理大模型。
Beam模型的训练过程耗时4周,使用了10500张NVIDIA B300显卡,预训练数据量高达23.8T tokens。该模型将于本月以Apache 2.0协议全权重开源。从性能表现来看,Beam在多个基准测试中已经超越了此前美国代表性的开源大模型——NVIDIA的Nemotron系列,成为西方体系下目前最强的开源AI模型。
然而,与国内顶尖开源模型相比,Beam仍有一定差距。彭博社行业研究高级分析师罗伯特·利亚(Robert Lea)指出,自DeepSeek推出V4.1 Flash后,中国顶尖模型在权威基准测试中的得分仅落后美国对手3%,这一差距较5月份的9%和年初的15%大幅收窄。
具体到性能对比,Beam在Terminal-Bench 2.1测试中得分为80.1分,而DeepSeek V4.1 Flash则达到90.6分。在SWE Bench Pro V1测试中,Beam得分为65.2分,V4.1 Flash为67.3分。尽管Beam在部分测试中表现优异,但在整体性能上仍逊于V4.1 Flash等国产模型。
值得注意的是,Beam的具体定价尚未公布,但官方表示其算力成本仅为GLM-5.2的1/4到1/3,暗示在成本控制方面具有明显优势。不过,考虑到性能与价格的综合考量,DeepSeek V4.1 Flash凭借其卓越的性价比,仍然是满足大部分用户需求的首选。
当前,中美两国在AI领域的竞争日益激烈。彭博社报告指出,随着DeepSeek等中国AI实验室的技术不断突破,美国AI公司在性能上的领先优势正在急剧缩小,这不仅对美国的科技主导地位构成挑战,也引发了关于技术出口管制有效性的广泛讨论。
“我们看到中国AI企业在技术积累和硬件优化方面取得了显著进展,”利亚表示,“这种持续的技术提升将使中国竞争者进一步扩大市场份额。”
尽管Beam的发布标志着美国企业在开源AI领域的重要进展,但要真正撼动中国AI模型的市场地位,仍需在性能、成本和生态建设等多个维度取得突破。
