网通社科技快报

十一假期国内大模型厂商静默 聚焦Agent与商业化

今年国庆长假(10月1日至7日),国内人工智能大模型领域迎来一段难得的平静期。DeepSeek、智谱、阿里、字节跳动等主流厂商均未推出旗舰级大模型更新,甚至连备受期待的DeepSeek V4.1 Pro和豆包2.2也未能如期亮相。相比之下,OpenAI在DevDay上宣布多项更新,Anthropic则推出了Haiku 5.5,海外厂商仍在持续发力。

然而,这种“静默”并非厂商们真正放了七天假。相反,他们将精力转向了其他重要方向:底层工具链完善、国产算力适配、融资推进以及商业化落地。以DeepSeek为例,该公司在假期期间连续推出了多个版本的DeepSeek Harness,支持实验性的Claude Code Mods兼容,并让Agent能够自己创建插件。同时,DeepSeek还与华为合作,开源了面向华为昇腾芯片的一批底层计算和通信组件,包括DeepGEMM-Ascend、DeepEP-Ascend等,进一步推进基于国产算力的解决方案。

智谱方面,则专注于将GLM系列模型推向国际市场。10月5日,AWS正式宣布GLM 5.3上线Amazon Bedrock,这意味着海外企业可以直接通过AWS的托管服务调用这款模型,无需自行部署推理环境。这一动作标志着国产大模型在全球企业客户争夺战中的进一步深入。

资本市场上,这些AI公司同样没有闲着。10月6日,路透社报道称DeepSeek正在筹集超过800亿元的新一轮融资,目标估值约5000亿元,腾讯、宁德时代等企业据称参与其中。与此同时,月之暗面传出完成上市前最后一轮私募,估值约500亿美元,计划最快2027年在香港上市。

有业内人士分析认为,这种“静默”可能是厂商们有意为之。由于去年9月DeepSeek发布的V3.2-Exp引入了稀疏注意力机制,重点解决了长上下文推理效率问题,并大幅降低了API调用价格,导致整个行业在假期前进行了集中更新。而今年,厂商们可能更倾向于在节后推出经过打磨的版本,以追求更高的技术突破,而非仓促上线。

此外,竞争重心似乎也在悄然发生变化。过去,大模型厂商的主要焦点是跑分和参数规模,但现在越来越多的厂商开始关注Agent(智能体)和产品落地。DeepSeek Harness支持Agent插件,腾讯Handy Bot、字节Spell等个人Agent产品曝光,阿里千问也明确表示将加强Agent能力。这种转变表明,大模型厂商正在从单纯的技术竞赛转向实际应用场景的探索。

尽管今年十一假期国内大模型厂商整体表现低调,但各方并未真正“放假”。相反,他们正在为即将到来的节后发布做准备,同时也通过工具链建设、国产算力适配、融资推进和商业化布局,为未来的竞争奠定基础。