软件与服务行业:超节点引领新一代算力基础设施-算力产业跟踪250822
这篇研报讲什么?
摘要原文摘录全球算力产业龙头英伟达 2025 年逐渐开始主要以超节点 GB200 面向市场出货,而华为也在2025 年推出昇腾 384 超节点,浪潮信息在 2025 开放计算技术大会发布超节点 AI 服务器“元脑 SD200”。
机构观点归属长江证券,研报雷达仅作摘要整理与机构观点聚合。以下为研报摘要原文摘录,内容以原始报告为准。
研报摘要
事件描述
全球算力产业龙头英伟达 2025 年逐渐开始主要以超节点 GB200 面向市场出货,而华为也在2025 年推出昇腾 384 超节点,浪潮信息在 2025 开放计算技术大会发布超节点 AI 服务器“元脑 SD200”。
事件评论
超节点是新一代算力基础设施,当前算力龙头企业纷纷推出超节点产品。超节点,英文名为 SuperPod,是英伟达公司最先提出的概念,英伟达将 AI 服务器中以超大带宽互联 16卡以上 GPU-GPU 的 Scale Up 系统称为超节点。当前业界算力领军企业纷纷推出超节点:1)英伟达基于 NVLink 协议连接服务器之间的 GPU,将相关设备连接到同一个超带宽域,构成超节点,当前主推的 GB200 中包含 36 个 Grace CPU 和 72 个 Blackwell GPU;2)华为于鲲鹏昇腾开发者大会 2025—昇腾 AI 开发者峰会上推出昇腾超节点,其创新应用全总线架构,采用高速互连技术将 384 张 910C 智算卡紧密耦合形成大型算力单元;3)浪潮信息于 2025 开放计算技术大会发布超节点 AI 服务器“元脑 SD200”,单机即可运行超万亿参数大模型,并在多个全参模型实测中,实现 64 卡整机推理性能的超线性扩展;4)其他服务器厂商如超聚变、华勤技术等也均有超节点产品布局。
超节点能解决大模型训练推理中以通信速度为核心的性能瓶颈。众所周知,在 AI 大模型领域遵循 ScalingLaw 定律,随着 AI 大模型参数规模不断扩大,对 AI 算力集群的规模需求也在不断增长,海外已经出现十万卡级别算力集群,未来或将进一步扩大。与此同时,DeepSeek 带来创新架构与工程优化,助力 MOE(专家混合模型)成为主流模型结构,其复杂的混合并行策略带来巨大挑战,需要具备超大显存空间、更低通信时延、更强计算性能,传统 AI 服务器依赖以太网络实现跨机互联,通信带宽较低,成为性能瓶颈。超节点作为 Scale Up 的当前最优解,通过内部高速总线互连,能够有效支撑并行计算任务,加速 GPU 之间的参数交换和数据同步,缩短大模型的训练周期。其本质是在现有技术、生态和成本约束下,从系统层面去打破 AI 芯片本身的性能边界,最大化用户价值。
技术升级和复杂度提升,超节点带来多个算力环节价值量提升。相比于过往的八卡或十六卡 AI 服务器,超节点 AI 服务器算力密度和通信复杂度等大幅提升,单节点功耗也显著增加,其带来的产业影响包括互联需求提升、液冷价值量提升、从传统产品厂商向系统解决方案厂商的升级等,建议关注产业链相关环节投资机会:1)纯正的国产 AI 芯片领军企业寒武纪和国产高端 CPU 和 DCU 领军企业;2)超节点服务器厂商;3)超节点配套 PCB、链接、液冷厂商;4)华为超节点相关合作伙伴。
风险提示
- 下游需求不及预期;2、国内 AI 芯片供应不及预期;3、行业竞争加剧的风险;4、盈利能力波动的风险。
同公司研报
继续比较不同机构对同一公司的判断。
同行业近期研报
从单家公司继续回到行业研究。