超节点正在成为国产AI基础设施的共同技术路线。国金证券研报显示,2026年WAIC大会上国内主要算力厂商集中展示超节点产品,华为昇腾950超节点1024卡真机首次公开亮相,昇腾384超节点已商用落地750多套,中兴OEX、沐曦曦景S600、摩尔线程MTTC256等方案亦集中展示。需求端,Kimi K3官方部署建议明确提出64张及以上加速卡组成的超节点配置。国产算力竞争框架正从单颗芯片峰值算力转向高带宽域内可协同的加速卡规模、通信效率和系统交付能力。
超节点供给端大检阅:华为/中兴/沐曦/摩尔线程集中发布
本届WAIC是国产超节点的一次集中“大阅兵”。华为Atlas 950 SuperPoD首次公开真机,支持1024卡单一高速互联域,提供1EFLOPS FP8、2EFLOPS FP4算力,拥有256TB全局统一内存编址空间,采用TB级NPU互联带宽与3us RTT。昇腾384超节点已商用落地750多套,覆盖互联网、运营商、金融、教育、医疗、交通和制造等行业,Atlas 850E风冷超节点支持96卡扩展。
中兴通讯发布OEX超节点,通过底层协议标准化与接口统一兼容国内多元GPU生态,采用正交无背板和“三零线缆”设计,柜内采用57.6T自研芯片电交换与柜间dOCS光交换相结合架构。沐曦曦景S600实现单机柜64卡高密度部署,柜内全互连架构支持灵活扩展至万卡级别。摩尔线程MTT C256将256张GPU组织在一层Scale-up网络内,燧原ESL64-O采用正交架构与零线缆高密集成,并展示NPO光互连原型系统支持512卡以上部署。新华三UniPoD S80000覆盖32卡至16384卡,训练性能提升70%、推理性能提升3倍。
需求端迈入超节点时代:Kimi K3明确64卡以上部署要求
Kimi K3技术博客成为需求侧进入超节点时代的关键信号。K3为2.8万亿参数Stable Latent MoE模型,每次有效激活16/896个专家。官方指出推理效率同样受益于更大的高带宽通信域,因此建议在64张及以上加速卡组成的超节点配置中部署。超大MoE模型放大了专家并行与内存访问压力,更大的Scale-up域有助于提升专家路由、KV缓存与张量并行效率。
多款国产超节点平台已与国产大模型完成适配与部署。百度天池256已适配DeepSeek、文心、GLM和MiniMax,推理效率提升50%;阿里擎久AL128通过百炼支持Qwen、DeepSeek和Kimi。昇腾超节点全系列产品支持DeepSeek V4,昇腾950通过融合kernel和多流并行降低Attention计算与访存开销。DeepSeek已成为国产超节点软件成熟度的重要验证负载。
超节点核心增量:交换机/交换芯片、整机柜、高速连接器
国金证券认为超节点核心增量环节在于三方面。一是交换机及交换芯片:超节点将Scale-out网络延伸至机柜内和柜间Scale-up互联,推动交换需求从传统以太网交换机扩展至高带宽、低时延专用交换芯片。以NV为例,Vera Rubin NVL72单卡互联带宽翻倍,单柜NVSwitch ASIC数量从18颗增至36颗(GPU:交换从4:1变为2:1)。昇腾384超节点中NPU与交换芯片配比达1:1.17。交换芯片数量、端口速率和单机价值量均有望上行。
二是服务器及整机柜:交付单元由单台白盒服务器升级至整机柜乃至Pod级系统,供电(单柜100kW+)、散热(液冷成为必选)、互联及系统调优难度显著提升,头部ODM工程壁垒与盈利能力有望同步提升。三是高速连接器:112G/224G高速通道迭代驱动正交、Cable-tray和NPO多种连接架构并行演进,华丰科技112G正交高速背板已批量生产、224G样品试制合格,胜蓝股份224G样品制作中,中航光电CPO全光互连方案涉及光shuffle、光背板等。
供需共振向上,继续重申国内算力黄金年代
需求端,国产模型调用量持续攀升。据OpenRouter,中国周调用量近13万亿Token,连续八周超过美国居全球首位,调用量前五中前四款均为国产模型。供给端,国产GPU供给加速释放,字节跳动2026年CapEx上限提至700亿美元(约2025年3倍),腾讯明确H2将有更多国产芯片投入使用。国产芯片Day0适配逐步成为标配,DeepSeek V4和智谱GLM-5.2均在发布当日完成与8家以上国产算力平台的适配。随着国产芯片供应释放,需求将依次向交换网络、服务器与整机柜、算力租赁、AIDC上架和云服务传导,继续重申国内算力黄金年代。
图表1:WAIC 2026主要国产超节点产品对比| 厂商 | 产品 | 超节点规模 | 关键特性 |
|---|
| 华为 | Atlas 950 SuperPoD | 1024卡 | 首次公开真机,1EFLOPS FP8,256TB全局内存 |
| 华为 | 昇腾384超节点 | 384卡 | 已商用750+套,覆盖互联网/运营商/金融等 |
| 中兴通讯 | OEX超节点 | — | 兼容多元国产GPU,正交无背板,57.6T自研交换 |
| 沐曦 | 曦景S600 | 64卡/单柜 | 柜内全互连,0线缆直连,可扩展万卡 |
| 摩尔线程 | MTT C256 | 256卡 | 一层Scale-up网络,计算交换一体化高密 |
| 新华三 | UniPoD S80000 | 32-16384卡 | 训练性能+70%,推理+3倍 |