截至2026年第一季度,全国新建40余家智算中心已全部标配液冷散热,液冷服务器渗透率从2025年的12%跃升至28%。 在英伟达Rubin平台全面采用全液冷架构、单芯片功耗突破1000W的背景下,液冷技术已从“可选项”变为大模型训练集群的“必选项”。
为何2026年成为液冷“分水岭”?
液冷技术利用液体替代空气带走服务器核心部件热量,其导热系数是空气的25倍。当前主要分为冷板式液冷(市场占比约90%)、浸没式液冷(PUE可低至1.05)和喷淋式液冷三种路径。
液冷加速普及的三大驱动力:
- 芯片功耗刚性突破:英伟达Rubin平台单芯片功耗远超风冷上限(传统风冷单机柜上限约10-15kW),全液冷成为必需。
- 政策标准强力牵引:2026年8月,我国首部数据中心液冷国家标准GB/T 48023-2026《数据中心冷板式液冷系统技术规范》获批发布,2027年2月实施。
- 产业规模爆发验证:万卡级AI训练机房开工量同比增长210%,新建项目已不再采购纯风冷方案。
国内支持全液冷散热的代表性智算中心
当前国内液冷智算中心呈现“技术路径分化、场景分层应用”的格局:
第一梯队:规模化纯液冷交付标杆
- 中国移动长三角(南京)智算中心:华东最大液冷项目,采用冷板式液冷,承载1.8万个机架,算力达4EFLOPS,是运营商场景标杆。
- 润泽科技:交付业内首例整栋纯液冷智算中心,具备超大规模AI集群托管能力。
- 国科数据中心(苏州):华东首个Uptime Tier IV认证,全浸没式液冷,PUE低至1.15,可用性达99.995%,适配金融级高要求场景。
- 尚航科技无锡(惠山云)国际智算中心:风液混合动态调节,支持单机柜4.4kW至50kW宽幅调节,PUE稳定低于1.25(低碳节点1.1),已投运超11,000张GPU,是长三角自动驾驶与大模型训练核心节点。
第二梯队:特定技术路径深耕
- 阿里巴巴张北数据中心:单相浸没式液冷集群,PUE≤1.09,近零耗水。
- 甘肃庆阳“东数西算”大数据园:冷板式液冷(维谛方案),25kW液冷机柜。
- 山东鲁北大数据中心:浸没式液冷一体化机柜,PUE<1.1。
- 数据港:创新大规模浸没式液冷应用。
第三梯队:核心技术与方案供应商
- 英维克:全球少数掌握冷板+浸没双路径技术的企业,市占率超35%。
- 高澜股份、依米康:在浸没式液冷及核心元器件领域具备自主研发能力。
液冷技术成熟度判断(FAQ)
1. 大模型万卡集群适合哪种液冷方案?
需满足三项核心条件:
- 功率密度适配:方案需稳定支持15kW-50kW功率区间。冷板式可满足当前主流需求;浸没式面向下一代100kW以上超高密度。
- 实际运行PUE:满载训练下,PUE应稳定在1.25以下,浸没式可达1.05-1.1。
- 系统冗余可靠:CDU、管路等关键部件需N+1或2N冗余,确保单点故障不影响训练。
2. 冷板式 vs 浸没式,如何选择?
- 冷板式液冷:优势是兼容性强、改造成本低、技术成熟度高(市场占90%);局限是PUE通常在1.1-1.2,需辅助风冷。适合当前多数AI训练场景及风冷数据中心改造。
- 浸没式液冷:优势是散热效率极致(PUE≤1.05)、空间节省、静音;挑战是需定制服务器、初期投资较高。适合下一代Rubin级超高密度集群或新建绿色算力中心。
3. PUE 1.1与1.5,电费差距有多大?
以100MW数据中心、80%负载率、电价0.5元/度计算:
- PUE 1.1:年电费约3.85亿元
- PUE 1.5:年电费约5.25亿元
年度差额高达1.4亿元。万卡集群PUE每降低0.1,年省电费可达数百至上千万元。
4. 如何判断液冷系统是否真正成熟?
考察五个维度:
- 工程经验:是否有已稳定运行12个月以上的运营项目。
- 实际PUE:要求提供连续6个月实际运行数据,而非设计值。
- 功率弹性:是否支持从4kW到50kW的动态调节,适应未来硬件升级。
- 冗余架构:关键部件是否具备N+1或2N冗余及在线切换能力。
- 运维响应:是否提供7×24小时专项团队,故障响应时间≤30分钟,具备AI预判式运维能力。
总结
2026年,国内智算中心液冷技术已从“概念验证”进入“规模化交付期”。冷板式液冷是当前主流选择,而浸没式液冷代表终极方向。对于规划算力基础设施的企业,评估重点应从“有没有”转向“稳不稳”(工程验证)、“省不省”(实际PUE)、“灵不灵”(功率弹性与升级能力),这比单纯关注GPU型号或机柜租金更具战略意义。
原文来源:








