返回顶部
返回首页 会员充值 我的足迹 返回上一页
跳转三个皮匠报告小程序
具身智能
情绪经济
商业航天
十五五
银发经济

Scale-Across技术

北京时间8月21日,NVIDIA宣布推出Spectrum-XGS以太网,这项跨区域扩展(Scale-Across)技术可将多个分布式数据中心组合成一个十亿瓦级AI超级工厂。广发证券通信团队指出,Spectrum-XGS将NVIDIA集合通信库性能提升了近一倍,北美云厂已开始加速部署。本报告基于广发证券研报,解析Scale-Across技术的原理、性能提升与产业影响。

Spectrum-XGS技术解析——跨区域扩展的三大突破

NVIDIA Spectrum-XGS以太网是继纵向扩展(Scale-Up)和横向扩展(Scale-Out)之后的第三维扩展技术,其核心突破体现在三个方面。

第一,距离动态适配。Spectrum-XGS完全集成于Spectrum-X平台,通过算法实现了网络和数据中心设施间距离的动态适配。这使得不同地理位置的数据中心能够以低延迟、高带宽的方式互联,打破了物理距离对算力集群规模的限制。

第二,性能大幅提升。Spectrum-XGS将NVIDIA集合通信库(NCCL)性能提升了近一倍,加速了多GPU和多节点的通信性能。NCCL是NVIDIA多GPU通信的核心软件库,其性能提升直接决定了分布式训练的效率。

第三,可预测的异地AI集群性能。通过优化跨区域网络的延迟和抖动,Spectrum-XGS实现了异地AI集群性能的可预测性,使跨数据中心的AI训练成为可行的工程方案。

十亿瓦级AI超级工厂——数据中心扩展的新范式

NVIDIA创始人兼首席执行官黄仁勋表示:AI工业革命已经到来,而巨型AI工厂是这场变革的核心基础设施。Spectrum-XGS的推出将AI工厂的规模从单个数据中心扩展至跨区域、跨国家的超级集群。

单个设施内的数据中心功率和容量正在成为AI算力扩展的核心瓶颈。大型AI训练集群的功耗已从兆瓦级攀升至百兆瓦甚至吉瓦级,单个数据中心的供电和散热能力难以支撑无限扩展。Scale-Across技术通过将多个分布式数据中心组合成一个逻辑上的超级工厂,解决了单站点容量不足的问题。

Spectrum-X以太网网络平台面向超大规模AI工厂,提供的带宽密度较传统以太网高出1.6倍,可实现超低延迟。Spectrum-XGS现已可以供货,标志着跨区域AI集群从概念走向现实。

北美云厂加速部署,CoreWeave成为首批用户

北美云厂商已开始加速部署Spectrum-XGS平台。CoreWeave成为首批使用Spectrum-XGS以太网的企业。CoreWeave作为专注于AI算力的云服务提供商,其对新技术的采纳速度往往反映了行业的前沿趋势。

除了CoreWeave,其他北美云厂商也在积极评估和部署Spectrum-XGS。跨区域扩展技术解决了云厂商在多区域部署AI算力时的网络瓶颈问题,使分布式AI训练成为可能。

广发证券认为,Spectrum-XGS的推出将推动数据中心间光互联需求的增长。跨区域数据中心的连接需要更高带宽、更低延迟的光通信基础设施,光模块和光互联技术将持续受益于Scale-Across的部署浪潮。
表:NVIDIA Spectrum-XGS核心性能指标
技术指标性能表现产业意义
NCCL性能提升提升近一倍多GPU通信效率大幅提升
带宽密度较传统以太网高1.6倍超大规模AI工厂支撑
延迟表现超低延迟异地AI集群性能可预测
部署进展现已供货CoreWeave为首批用户
点击阅读报告原文: 通信行业:AI数据中心网络多层互连趋势确定持续关注产业链投资机会-250824(16页)
相关报告