报告概述

本报告系统研究了GW级(吉瓦级)开放智算中心(AIDC)的技术体系,覆盖从芯片到电网的全栈架构。报告分析智算中心从MW级向GW级演进的三阶段,聚焦供电、散热、网络三大物理革命,并引入OCP开放系统蓝图。采用协同设计的方法论,阐释算力、能耗、散热、互连等核心挑战及解决方案。为AI基础设施规划者、数据中心运营商和产业链参与者提供系统性参考。

报告的核心结论

智算中心已进入GW级AI Factory时代

报告指出,AI模型参数和训练算力需求6年增长超5个数量级,单机柜功率从100kW走向1MW+,园区规模从MW走向GW。传统单点优化失效,必须转向从芯片到电网的全栈结构性变革,整机柜即计算机、智算中心即计算机成为新范式。

开放生态是AI基础设施的核心趋势

OCP开放系统蓝图(Open Systems for AI v1.0)汇聚全球超大规模玩家,通过开放参考设计(如ORW、MGX、Catalina)实现芯片、机柜、供电、散热、网络的标准化。报告认为,开放生态有助于降低门槛、加速创新,是中国在GW级AIDC领域实现追赶与超越的关键路径。

800V HVDC将取代传统供电体系

单机柜功率突破1MW后,传统480VAC/380VAC+集中UPS体系无以为继。800V HVDC+BBU+直流微电网正成为GW级AIDC供电的黄金标准,端到端效率从85-88%提升至92-95%,铜母线用量降低60%。NVIDIA Kyber机架(2027)起将全面采用800V HVDC。

两相液冷是GW级AIDC的必然路径

单芯片TDP从700W攀升至3000W+,风冷物理极限已被击穿。液冷技术从冷板式(≤1000W)经单相浸没(≤1500W)演进至两相浸没/泵驱两相(≥3000W),PUE可降至1.04以下。2026年工信部PUE 1.15红线将推动液冷渗透率从30%跃升至70%。

Scale-Up开放协议成为AI网络新前沿

随着万亿参数大模型训练需求,机柜内XPU间的内存语义互连(Scale-Up)成为性能瓶颈。PCle、ESUN、SUE-T、UALink等开放协议并行发展,旨在以更低时延、更高带宽取代封闭方案,推动跨XPU共享内存和GW级超节点构建。

报告回答的关键问题

GW级智算中心面临哪些核心挑战?

报告总结为“五道墙”:算力墙(单芯片增速放缓)、内存墙(HBM容量吃紧)、能耗墙(园区级功率达GW)、散热墙(芯片TDP超3000W)、互连墙(Scale-Up需求)。破局之道在于从芯片到电网的协同设计,而非单点优化。

液冷技术如何演进?哪种适合GW级AIDC?

液冷经历三代:Gen1冷板式(≤1000W,PUE 1.15-1.25)、Gen2单相浸没(≤1500W,PUE 1.06-1.10)、Gen3两相浸没/泵驱两相(≥3000W,PUE≤1.04)。面向GW级AIDC,两相液冷是必然选择,可解热≥250W/cm²,且OCP正推动冷板/UQD标准化。

800V HVDC相比传统供电有何优势?

800V HVDC可支持1MW-2MW+机柜功率,母线电流降低约50%、铜母线用量减60%,端到端效率达92-95%(传统480VAC仅85-88%)。配合分布式BBU和直流微电网,备电方案更灵活,是NVIDIA Kyber等下一代机架的标配。

中国发展GW级AIDC有哪些政策和产业支撑?

中国智能算力规模占全球29%(仅次于美国34%),2023-2028年CAGR预计46.2%。政策层面有“东数西算”、PUE 1.15红线、液冷渗透率≥60%等要求;产业层面已有浪潮元脑智算仓、SD200超节点等实践,OCP中国社区正推动开放标准落地。

报告中的代表性数据

5个数量级

AI训练算力需求增长

2018-2028E,报告指出过去6年AI模型参数与训练算力(FLOPs)增长超过5个数量级,NVIDIA GTC 2026预测2027年前订单达1万亿美元。

从30%升至70%

液冷渗透率跃升

2026年,行业预测2026年液冷渗透率从30%跃升至70%,受工信部PUE 1.15红线、冷板单价同比降40%等因素驱动。

46.2%

中国智能算力CAGR

2023-2028,中国智能算力规模复合年增长率46.2%,显著高于全球平均,占全球29%仅次于美国34%。

以上数据根据报告摘要整理,具体统计口径和数值请以完整报告原文为准。

完整报告包含什么

  • 全球GW级AIDC实践案例:深入分析NVIDIA、Meta、Microsoft、AMD、OpenAI、xAI等企业的代表性项目,包括Vera Rubin DSX参考架构、Meta Prometheus多GW集群、xAI Colossus超大规模集群等,展示不同路径的技术选择与里程碑。
  • OCP开放系统蓝图(Open Systems for AI v1.0):详细阐述从应用软件层到DC物理基础设施的完整开放参考设计框架,涵盖MGX、ORW、Catalina、Mt Diablo等机柜与电源规范家族。
  • 供电革命技术细节:800V HVDC与480VAC的全景对比(母线电流、铜规格、转换次数、效率),以及BBU、直流微电网、GaN/SiC功率半导体的应用分析。
  • 散热革命三代技术演进:冷板式、单相浸没、两相浸没/泵驱两相的芯片TDP范围、机柜功率、PUE对比,以及关键催化事件与产业拐点信号。
  • 网络革命三大规模(Scale-Up/Scale-Out/Scale-Across):协议生态对比,包括PCle、ESUN、SUE-T、UALink的技术层级、推动方与状态,以及面向GW级超节点的开放栈路线。
  • 中国GW级AIDC路径:政策驱动(东数西算、PUE红线、液冷强制)、浪潮信息等企业的实践(元脑智算仓、SD200超节点、800V HVDC预研),以及超节点创新联合体、算力REITs等商业模式创新。
  • 演进趋势与展望:六大趋势(整机柜→AI Factory、800V HVDC全面铺开、两相液冷标准化、Scale-Up开放化、推理时代崛起、源网荷储一体化),以及Agent-First Datacenter等2030展望。
  • 全球算力投资热力图:Gartner 2026年全球AI支出预测($2.59万亿,同比+47%),阿里、英伟达、腾讯等巨头资本支出表态,沙特PIF等主权基金动向。

本页内容由川海智库整理,用于帮助读者快速了解报告主题、核心观点和主要内容。由于报告量大、人工能力有限,部分观点、数据、统计口径或表述可能存在偏差,具体内容请以完整报告原文为准。

相关报告