报告概述
本报告深入研究了超节点架构这一AI算力基础设施的核心演进方向。报告覆盖了超节点的定义、Scale Up组网架构(包括胖树、Mesh、Torus等拓扑)及主流互联协议(NVLink、UAlink、SUE、UB等),并详细分析了超节点机柜中计算节点、交换节点、供电、液冷等模块的技术规格。报告还重点剖析了华为CloudMatrix 384/950/960等国产超节点案例,论证了超节点如何弥补单卡算力差距。最后,报告提出了网络端、AIDC、计算端三大投资主线及光、液冷、供电、芯片四大赛道,为投资者提供了系统的产业链分析框架。
报告的核心结论
超节点通过Scale Up互联将多芯片整合为逻辑上的“超级GPU”。
超节点集群通过高速互联协议(如NVLink、UB)和拓扑结构(胖树、Fullmesh等),将多个GPU/ASIC连接在一个高带宽域内,使其协同工作,突破传统8卡服务器在效率、可靠性上的瓶颈,满足大模型训练和推理对超大算力和内存的需求。
超节点架构推动光通信、液冷、供电、芯片等四大环节全面升级。
随着超节点机柜功耗攀升至132kW以上,传统风冷转向风液混合甚至全液冷,液冷占比超80%;高功率电源和高压UPS/HVDC需求增长;Scale Up互联催生高速光模块、铜缆及交换芯片新需求,例如博通Tomahawk Ultra实现250ns低延迟。
国产超节点能有效弥补单芯片算力差距,助力AI生态发展。
以华为CloudMatrix 384为例,单个集群BF16性能是英伟达NVL72的1.7倍,总内存容量为3.6倍,总内存带宽为2.1倍。华为已推出Atlas 950/960超节点,算力规模超50万卡和百万卡,国产AI基础设施有望弯道超车。
Scale Up协议正从大厂私有走向开源开放。
英伟达NVLink Fusion开放技术方案允许第三方厂商互联;UAlink联盟由AMD、谷歌等发起;博通推出SUE框架;华为开放UB 2.0;中国移动推出OISA协议。开源趋势降低了厂商创新门槛,推动超节点生态繁荣。
报告回答的关键问题
什么是超节点?
超节点(SuperPod)最早由英伟达提出,是一种通过高速网络互联将多个算力芯片(GPU/ASIC)整合为逻辑上单个“大型GPU/ASIC”的服务器集群。它突破了传统8卡服务器的互联瓶颈,实现高带宽、低延迟的统一计算单元,是AI大模型训练的必然趋势。
超节点如何提升算力集群性能?
超节点通过Scale Up(纵向扩展)取代部分Scale Out(横向扩展),在机柜内实现GPU间全互联,任意GPU可直接访问其他GPU的内存,大幅降低通信延迟。例如,华为CloudMatrix 384集群通过UB网络使节点间带宽衰减小于3%,延迟增加不到1微秒,使集群总性能超过同代英伟达NVL72。
超节点架构带动哪些产业链环节升级?
超节点大幅增加对算力卡、交换芯片、交换机的需求,同时拉动高功率供电单元、高压UPS/HVDC、液冷散热(风液混合或全液冷)、铜缆及光模块等环节升级。Rack内液冷占比超80%,供电功率达132kW,Switch tray采用高速交换芯片(如51.2Tbps)。
国产超节点进展如何?
华为已部署超300套Atlas 900 A3超节点,服务超20位客户;CloudMatrix 384集群性能优于NVL72;Atlas 950支持8192张NPU,算力达8EFlops,Atlas 960支持15488张NPU。中兴、紫光股份、浪潮信息等也推出自研超节点产品,国产万卡集群加速发展。
报告中的代表性数据
CloudMatrix 384集群相对NVL72的性能倍数
2025年,单个CloudMatrix 384集群的BF16性能是英伟达GB200 NVL72的1.7倍,总内存容量为其3.6倍,总内存带宽为其2.1倍。
Atlas 900 A3超节点累计部署量
截至2025年9月,华为Atlas 900 A3 SuperPoD已累计部署超300套,服务超20位客户。
以上数据根据报告摘要整理,具体统计口径和数值请以完整报告原文为准。
完整报告包含什么
- 详细分析Scale Up组网架构(胖树、Mesh、Torus拓扑)及各自优缺点,帮助读者理解不同场景下的网络设计选择。
- 系统梳理Scale Up协议演进,包括NVLink(至NVLink 5.0)、UAlink、SUE、UB、HSL、OISA等,对比带宽、延迟、开放程度等关键参数。
- 超节点机柜的完整拆解:计算节点(Computer tray)、交换节点(Switch tray)、供电单元(Power shelf)、液冷系统等模块的详细设计与技术路线。
- 华为CloudMatrix 384/950/960超节点深度案例:从芯片(910C/950DT)、Node内互联、UB交换系统到集群性能对比,展示国产超节点如何实现算力逆袭。
- ETH-X国产超节点标准及背脊互联Fat tree方案,适配电力受限机房的实用设计。
- 完整投资建议:明确“网络端+AIDC+计算端”三大主线及“光+液冷+供电+芯片”四大赛道,并列出各赛道重点上市公司。
- 多家龙头企业深度分析:盛科通信、中兴通讯、锐捷网络、紫光股份、浪潮信息等,介绍其超节点相关产品及市场地位。
- 风险提示:AI发展不及预期、芯片供应风险、市场竞争加剧等影响因素及对产业链的潜在冲击。
本页内容由川海智库整理,用于帮助读者快速了解报告主题、核心观点和主要内容。由于报告量大、人工能力有限,部分观点、数据、统计口径或表述可能存在偏差,具体内容请以完整报告原文为准。





