液冷技术崛起,AI服务器功率攀升推动模拟芯片新增长

随着AI服务器功率持续攀升,传统风冷散热已难满足需求,液冷技术成为行业主流解决方案。本文分析液冷系统对温度、压力、流量等参数的监测需求激增,带动传感器、ADC、电机驱动等模拟芯片用量显著提升,为半导体...

互联网/IT

近年来,AI服务器的功率密度持续攀升,数据中心散热技术正经历深刻变革。26年前,典型机架功率约为5kW,如今已突破100kW,部分高端机架甚至可能达到1MW。这种功率增长主要源于GPU数量增加和单颗芯片功耗提升,单纯依靠增加风量已难以有效散热,液冷技术开始在AI服务器中大规模应用。

NVIDIA作为行业先锋,其产品路线清晰展示了液冷技术的应用趋势。从Blackwell架构开始大量采用液冷装置,到Vera Rubin架构实现100%全液冷设计,NVIDIA的技术迭代直接推动了液冷从试点阶段迈向规模化应用。当前常见的直接冷板液冷方案中,冷却液通过流经安装在CPU、GPU等发热器件上的冷板进行热交换,再经由歧管返回冷却液分配单元(CDU)。这一过程中,需要持续监测和控制的压力、温度、液位等参数,为模拟芯片带来了新的市场机遇。

液冷系统的运行依赖于精密的检测与控制系统,这使得温度传感器、压力传感器、流量计以及漏液检测装置的需求大幅增加。以温度监测为例,除了传统的芯片级测温外,还需要测量冷板附近及冷却液进出口的温度。目前主要的温度传感器包括RTD、热敏电阻和集成式温度传感器芯片,它们各自具有不同的优势:RTD提供良好的线性度和长期稳定性;经过校准的NTC热敏电阻在有限温区内可获得高精度;而数字温度芯片则因出厂一致性好、绝对精度高且系统实现简便而备受青睐。

压力监测是确保液冷系统可靠性的关键环节。泵前、泵后、过滤器两侧以及不同支路的压力都需要实时监控,这要求CDU配备多个模拟输入通道。流量监测则更为复杂,小流量系统常用热式流量传感器,而大流量数据中心CDU更多采用压差法、超声波或电磁流量计。其中,压差法通过测量孔板或文丘里管前后的压差来计算流量,虽然成熟且成本可控,但会带来一定压力损失;超声波流量计则无需在流路中增加明显阻挡,特别适合大流量冷却回路;电磁流量计利用导电液体在磁场中运动时产生的感应电压来测量流速,对大口径和大流量较为友好,但要求冷却液具备一定导电性。

漏液检测成为液冷系统特有的新增量需求。传统风冷服务器基本不需要考虑漏液问题,但液冷管路进入服务器内部后,一旦接头或冷板发生泄漏,冷却液可能直接接触PCB、连接器和其他电子器件。因此,液冷系统普遍采用电阻式漏液检测绳或湿度传感器,当检测到局部温度异常或湿度突然升高时,即可发出早期预警。

电机驱动也成为液冷系统的重要组成部分。相比传统风扇散热,液冷系统增加了水泵、阀门、压缩机等执行器,对MCU、栅极驱动、MOSFET及位置传感器的需求显著上升。STMicroelectronics预计,冷却系统最高可占AI数据中心能源成本的40%,高效控制成为关键。

从产业链角度看,英伟达的液冷升级直接带动了相关零部件的量价齐升。数据显示,英伟达2025年AI芯片市占率达86%,GB200和GB300系列液冷机柜单柜功耗分别达到132kW和140kW,液冷价值量从8万美元升至10万美元。Rubin架构更实现了100%全液冷,并将微通道冷板精度提升至100μm级别。机构研报指出,英伟达的技术路线具有全球示范效应,其平台迭代直接推动液冷从试点迈入规模化应用元年。

文章配图

政策层面也在加速液冷技术的普及。《数据中心绿色低碳发展专项行动计划》明确大型、超大型数据中心PUE管控目标,算力枢纽节点PUE不得高于1.2,多地对PUE超标数据中心实施差别电价、惩罚性电价,倒逼风冷机房开展液冷改造。储能安全新规也对电池温差、热管理可靠性提出严格指标,推动风冷方案逐步退出大型储能项目。国内算力基础设施标准新增液冷机房设计规范,欧美也陆续出台数据中心能效指令。

市场方面,浙商证券研报指出,第三季度是液冷行业从试点走向批量交付、业绩集中兑现的关键拐点,以英伟达VR200机柜规模化出货为核心驱动。赛迪顾问数据显示,2025年国内液冷数据中心市场规模将达到159.8亿元,同比增长45.2%,预计2026年达到232.5亿元,2028年突破470亿元。A股市场上,华之杰、宏盛股份等液冷概念股近期表现抢眼,显示出市场对这一新兴领域的高度关注。

展望未来,冷板式液冷将在存量机房改造、中高密度算力场景中持续占据主流份额,浸没式液冷则凭借PUE可降至1.1以内的突出优势,在万卡级大规模AI集群中加速渗透。叠加新能源汽车热管理、大功率电力电子设备等新兴应用场景拓展,液冷产业的成长空间将进一步打开。