华为Atlas 950超节点FP8算力8EFLOPS、Atlas 960达到30EFLOPS——国产AI芯片超节点正以惊人的速度迭代。中科曙光发布国内首个AI计算开放架构超集群,浪潮信息元脑SD200实现64路本土GPU互连,沐曦推出光互连/3D Mesh/液冷整机柜多种超节点形态,曦智科技发布国内首个光互连光交换GPU超节点。国海证券认为,国产芯片超节点布局已从“单点突破”走向“全面开花”。
华为——超节点领域的引领者
Atlas 900(CloudMatrix 384) :2025年3月推出,满配384颗Ascend 910C芯片,为当时全球算力最大超节点。已累计部署超300套,服务20+客户,涵盖互联网、电信、制造等行业。
Atlas 950超节点(预计2026Q4上市):
- 满配8192颗Ascend 950DT芯片
- FP8算力:8EFLOPS,FP4算力:16EFLOPS
- 互联带宽:16PB/s(超全球互联网峰值带宽10倍)
- 内存容量:1152TB(英伟达NVL144的15倍)
- 互联带宽:NVL144的62倍
Atlas 960超节点(预计2027Q4上市):
- 满配15488颗Ascend 960芯片
- FP8算力:30EFLOPS,FP4算力:60EFLOPS
- 内存容量:4460TB,互联带宽:34PB/s
- 训练性能相比Atlas 950提升3倍,推理性能提升4倍以上
TaiShan 950超节点:全球首个通用计算超节点(预计2026Q1上市),基于Kunpeng 950,最大16节点32处理器,最大内存48TB,支持内存/SSD/DPU池化。
集群产品:Atlas 950 SuperCluster(50万卡)和Atlas 960 SuperCluster(百万卡),支持UBoE与RoCE双协议。
开放生态:华为开放灵衢2.0(Unified Bus)互联协议技术规范,支持万卡级超节点架构,允许产业界基于技术规范自研相关产品。
中科曙光——开放架构先行者
2025年9月5日,中科曙光发布国内首个基于AI计算开放架构设计的曙光AI超集群系统。除紧耦合设计外,该集群系统还支持多品牌AI加速卡以及兼容CUDA等主流软件生态,为用户提供更多开放性选择,大幅降低硬件成本和软件开发适配成本。
海光信息同步开放CPU互联总线协议(HSL),面向GPU、IO、OS、OEM全栈开放完整总线协议、IP参考设计、指令集。产业伙伴可通过海光系统互联总线实现更高效的系统连接,支持缓存一致性和自由多链路扩展。
浪潮信息——元脑SD200的突破
2025年8月7日,浪潮信息发布面向万亿参数大模型的超节点AI服务器“元脑SD200”:
- 基于自主研发的开放总线交换技术,首创多主机三维网格系统架构
- 实现64路本土GPU芯片高速互连
- 远端GPU虚拟映射技术突破多主机交换域统一编址难题
- 显存统一地址空间扩增8倍
- 单机最大4TB显存和64TB内存
沐曦与曦智——超节点形态创新
沐曦股份(2025年7月):
- 曦云C500X光互连64xGPU超节点(16-64 GPU):通过光模块降低延迟
- 耀龙S8000G2超节点(32/64 GPU):业界首创3D Mesh互联,通信性能提升4倍
- Shanghai Cube:47U单机柜128 GPU高密度液冷部署,8机柜组成千卡集群
- 高密度液冷算力POD:适配AI训练/推理/通用计算全场景
曦智科技(2025年7月):
- 发布国内首个光互连光交换GPU超节点“光跃LightSphere X”
- 联合壁仞科技、中兴通讯首次示范应用
- 即将于上海仪电国产超节点算力集群落地
- 采用首创硅光dOCS芯片,以光互连替代传统电互联