十一长假国内大模型厂商集体静默,竞争重心转向Agent与商业化

今年十一假期,国内DeepSeek、智谱、阿里等大模型厂商罕见地停止了密集发布新模型的节奏,转而聚焦于底层工具链建设、国产算力适配、融资进程及商业化布局。尽管海外厂商仍在持续更新,但国内厂商似乎正酝酿...

人工智能

随着2026年国庆长假的结束,国内人工智能大模型领域迎来了一段难得的平静期。往年每逢长假,DeepSeek、智谱、月之暗面、MiniMax、阿里、字节、腾讯等厂商都会扎堆发布新模型或进行价格战,但今年十一假期却显得格外安静。从10月1日至7日,没有一家主流厂商推出旗舰级大模型更新,甚至连备受期待的DeepSeek V4.1 Pro和豆包2.2也未如期亮相。

这种反常现象引发了海外网友的关注。OpenAI在DevDay上宣布多项更新,并开启为期28天的连续更新;Anthropic则推出了Haiku 5.5,补齐了Claude 5.5模型家族。相比之下,中国大模型厂商的"小长假"显得尤为特殊。不过,这并不意味着厂商们真的放了七天假。相反,他们将精力转向了其他重要方向:底层工具链完善、国产算力适配、融资推进以及商业化落地。

以DeepSeek为例,该公司在假期期间连续推出了多个版本的DeepSeek Harness,支持实验性的Claude Code Mods兼容,并让Agent能够自己创建插件。同时,DeepSeek还与华为合作,开源了面向华为昇腾芯片的一批底层计算和通信组件,包括DeepGEMM-Ascend、DeepEP-Ascend等,进一步推进基于国产算力的解决方案。

智谱方面,则专注于将GLM系列模型推向国际市场。10月5日,AWS正式宣布GLM 5.3上线Amazon Bedrock,这意味着海外企业可以直接通过AWS的托管服务调用这款模型,无需自行部署推理环境。这一动作标志着国产大模型在全球企业客户争夺战中的进一步深入。

文章配图

资本市场上,这些AI公司同样没有闲着。10月6日,路透社报道称DeepSeek正在筹集超过800亿元的新一轮融资,目标估值约5000亿元,腾讯、宁德时代等企业据称参与其中。与此同时,月之暗面传出完成上市前最后一轮私募,估值约500亿美元,计划最快2027年在香港上市。

值得注意的是,今年春节时,国内大模型厂商的竞争异常激烈。1月20日,DeepSeek发布了R1模型;1月28日,阿里发布了Qwen2.5-Max;2月12日,智谱和MiniMax分别推出了GLM-5和M2.5;2月16日,阿里又发布了Qwen3.5系列。当时,几乎每天都有新模型发布,甚至除夕当天也有厂商推出新产品。相比之下,今年十一的"冷清"显得尤为突出。

有业内人士分析认为,这种"静默"可能是厂商们有意为之。由于去年9月DeepSeek发布的V3.2-Exp引入了稀疏注意力机制,重点解决了长上下文推理效率问题,并大幅降低了API调用价格,导致整个行业在假期前进行了集中更新。而今年,厂商们可能更倾向于在节后推出经过打磨的版本,以追求更高的技术突破,而非仓促上线。

此外,竞争重心似乎也在悄然发生变化。过去,大模型厂商的主要焦点是跑分和参数规模,但现在越来越多的厂商开始关注Agent(智能体)和产品落地。DeepSeek Harness支持Agent插件,腾讯Handy Bot、字节Spell等个人Agent产品曝光,阿里千问也明确表示将加强Agent能力。这种转变表明,大模型厂商正在从单纯的技术竞赛转向实际应用场景的探索。

尽管今年十一假期国内大模型厂商整体表现低调,但各方并未真正"放假"。相反,他们正在为即将到来的节后发布做准备,同时也通过工具链建设、国产算力适配、融资推进和商业化布局,为未来的竞争奠定基础。