智谱GLM-5.3调用量暴涨40倍,AIAgent驱动增长与算力博弈
智谱AI上半年MaaS平台收入暴增2736%,Token调用量飙升40倍,前十大客户日均调用量涨98倍。这主要得益于AI应用从Chatbot向Agent的转变,长程任务消耗大量Token。尽管收入激增...
在人工智能大模型竞争日益激烈的背景下,智谱AI交出了一份令人瞩目的中期成绩单。根据其2026年中期财报显示,上半年MaaS(Model as a Service)开放平台及API服务收入达到8.25亿元,同比增长约2736%,占总收入的86.5%。更引人注目的是,平台Token调用量增长了40多倍,付费日活跃用户数增加了603%。
这一业绩背后,是AI应用形态正在发生根本性变化。从早期的问答式Chatbot,转向能够自主执行任务的Agent应用。例如,智谱的Coding Plan套餐连续三次涨价后,其调用量仍增长了23倍以上,前十大客户的日均调用量更是暴涨98倍。这些数据表明,随着Agent应用的普及,AI模型的使用场景从简单的对话交互扩展到了复杂的编程、任务调度等长程工作流,导致Token消耗量呈指数级增长。
然而,高速增长并未转化为盈利。上半年智谱净亏损20.72亿元,经调整后净亏损扩大至19.6亿元,经营亏损达到21.5亿元。毛利率也从2024年的56.3%骤降至2025年上半年的26.4%。主要原因在于收入结构的变化:高毛利的本地化部署业务占比下降,而低毛利的云端API业务成为主力。此外,公司在研发上的巨额投入——上半年研发开支达21.3亿元,是同期收入的2.2倍,超过总毛利的8倍——也进一步侵蚀了利润空间。
为了应对Agent时代对持续算力的需求,智谱正在加速构建自己的算力基础设施。今年7月,公司宣布建成一座1GW级国产AI数据中心,并开始部分运营,全部采用国产AI芯片。同时,智谱还投资了多家AI基础设施企业,如基流科技、无问芯穹等。这种自建算力底座的战略,不仅是为了降低推理成本(GLM系列模型的推理成本已下降80%),也是为了确保在未来竞争中拥有稳定的算力供应。
智谱的算力布局并非孤例。DeepSeek也在乌兰察布规划新增1GW规模的算力,并从外部租赁额外算力。MiniMax同样在实施All-in-Infra战略,自建数据中心。这些动作表明,头部大模型公司正在从单纯的模型开发者,转变为算力基础设施的建设者。
尽管面临巨大的财务压力,智谱依然获得了资本市场的青睐。9月13日,公司宣布完成约50亿美元的新一轮融资,包括约20亿美元的股份配售和约30亿美元的可转债发行。这笔资金将主要用于下一代模型的研发、算力基础设施的建设和业务拓展。智谱表示,新增资本将帮助公司扩充推理供给、提升模型能力和扩大客户服务规模,为参与下一阶段全球前沿模型竞争增加筹码。
AI行业分析师指出,智谱的增长模式反映了整个大模型行业的趋势:模型能力、Token消耗和营收规模都在快速增长,但盈利压力也随之增大。每100美元收入中,约有35到40美元会以推理算力费用的形式流向亚马逊AWS、微软Azure和谷歌云三大云平台。因此,自建算力基础设施成为头部模型公司的必然选择。
展望未来,智谱需要在智能上界、Token规模与算力成本之间找到平衡点。只有解决这一不可能三角,才能在Agent时代的竞争中保持领先地位。