AI下半场,大模型厂商密集融资,算力与持续迭代成竞争关键

2026年,大模型行业进入资源密集型竞争阶段。Anthropic、DeepSeek和智谱等头部公司近期完成巨额融资,资金主要用于下一代模型研发、自训练体系构建及算力基础设施建设。随着模型迭代周期缩短至...

人工智能

在人工智能领域,2026年下半年标志着大模型竞赛进入全新阶段——"下半场"。继年初智谱登陆港股成为全球大模型第一股后,9月13日,该公司宣布完成约50亿美元融资,包括20亿美元股份配售和30亿美元零息可转债发行。这一轮资本运作距离其7月完成40亿美元配售仅过去两个月,显示出行业融资节奏的显著加快。

与此同时,美股市场也传来重磅消息。据传Anthropic正筹备以2万亿美元估值进行IPO,若成功将超越SpaceX成为史上最高估值上市公司。英伟达也被曝洽谈投资100亿美元。A股方面,DeepSeek新一轮融资仍在推进,并与中信证券接洽筹备科创板上市。三家分处中美两地的科技巨头,尽管技术路线和股东结构各异,却同时选择扩大资本储备,反映出行业竞争逻辑的根本性转变。

文章配图

"上半场比的是谁能做出一款好模型,下半场比的是谁能以更好的组织能力,持续做出下一代模型。"一位资深行业分析师指出,决定一家公司中长期位置的变量已从单一模型排名扩展至算力供给、人才密度、工程效率和商业收入等多个维度。这种变化背后,是模型迭代速度的显著提升。Claude Code团队在访谈中提到,Anthropic需要在极快的迭代节奏下开发产品,"你必须对自己正在构建的东西保持非常不执着的态度,因为它们很快就会消失。"

数据显示,智谱的GLM系列在约11个月内完成了从4.6到5.3的六代迭代,智能指数从32提升至60。DeepSeek继被质疑迭代放缓后,今年重新提速,在4月发布V4,6月推出V4.1,迭代周期缩短到"月"甚至"周"级别。这种快速迭代的背后,是递归式自我改进(RSI)趋势的显现。Anthropic联合创始人兼CEO Dario Amodei认为,AI正在逼近RSI的临界点,时间窗口为6到12个月。智谱也将约六成资金投向"完全自训练"体系,通过数据自产、环境自造和基础设施自我优化,实现模型的自我改进。

"过去的模型迭代瓶颈在于人,现在这个瓶颈被解除了。"该分析师进一步解释道,更强的模型带来更快的自我改进,而更快的自我改进又催生更强的模型,形成良性循环。这种持续突破智力上界的竞争,使得每一代模型的迭代成本都在抬高。因此,这一轮融资潮的共同潜台词是,确保公司在技术创新道路上持续前行。

尽管短期内都不缺钱,但头部AI公司的密集融资具有进攻性目的,旨在锁定下一轮竞赛的参赛位置。三家公司的融资路线各具特色:Anthropic采用"全球产业资本+美国公开市场"模式,股东名单几乎涵盖整个AI产业链;DeepSeek采取"创始人控制+本土产业资本"架构,最大单一出资方为创始人梁文锋;智谱则依托港股,连接公开市场和长期资本,上市八个月累计净募资约755亿港元。

在商业化造血方面,大模型的营收结构正在发生结构性改善。智谱2026年上半年实现收入9.54亿元,同比增长399.7%,其中开放平台及API业务收入达到8.25亿元,占总收入比例从15.2%飙升至86.5%。这意味着从依赖人力交付的本地化部署,转向标准化的云端API服务。更值得关注的是成本端的变化,智谱单位Token推理成本较年初下降约80%,MaaS业务毛利率由-0.4%升至24.6%。

"单纯比模型能力的阶段已经过去,行业正式进入一场以造血能力、算力壁垒和生态落地为核心的‘耐力赛’。"多位受访行业人士表示,资本仍在疯狂涌入,但竞争逻辑已经彻底改变。算力作为大模型的粮草,已成为企业核心竞争力的重要组成部分。智谱已建成一座1GW级数据中心,配备超过1万块国产AI芯片;DeepSeek计划在内蒙古乌兰察布部署至少16万颗国产芯片用于模型推理。这些投入表明,模型公司正在从算力的使用者,转变为算力基础设施的建设者。

展望未来,大模型行业的竞争将更加激烈。能否在持续的技术创新中保持领先,同时构建强大的生态壁垒,将成为决定企业成败的关键因素。对于投资者而言,关注的重点将从单一模型性能,转向企业的综合能力,包括技术研发实力、商业化落地能力以及资本运作能力。