中国移动以“供给者、汇聚者、运营者”定位,通过打造云智算技术体系构筑AI时代算力底座。大云磐石超节点实现64卡互联、800GB/s点对点带宽、微秒级时延;全向智感互联OISA和全调度以太网GSE构建“卡间-机间”全栈智能互联;算力原生“芯合”计划实现7家智算芯片一体接入;异构混训系统加速比超95%。从算力芯片到算网大脑,中国移动正构建一条自主可控的云智算全栈技术路径。
大云磐石超节点——64卡国芯国连的算力密度突破
中国移动基于原创COCA异构计算架构,联合国产全产业链伙伴打造大云磐石超节点。超节点以统一开放互联的自主协议为基础,构建64卡互联规模、800GB/s点对点带宽、微秒级时延的算力集群。三大核心能力:一是以开放式硬件架构为核心构建跨GPU厂商互通兼容的技术体系,并积极推进相关行业标准落地;二是融合COCA智算软件栈实现算力应用一体加速,依托大云磐石DPU提升集群通信效率;三是设计16/32/64卡多种产品规格实现算力灵活配置,可同时满足大规模并行训练、私有化训推一体等不同场景需求。
2025年中关村论坛展示的64卡“国芯国连”超节点AI算力集群,标志着我国在智算基础设施领域开启自主可控的技术革新。面向近期聚焦超节点生态构建和应用示范;面向中远期以更高规模、更大带宽、更低时延为构建目标,驱动国产GPU、交换芯片协同创新。
OISA+GSE——全栈智能互联的中国方案
中国移动构建“卡间-机间”全栈智能互联技术体系。卡间互联OISA(全向智感互联)通过全向连接拓扑架构构建支持大规模GPU卡级互联的通信体系,包含统一报文格式设计、多语义融合、多层次流控与重传机制,为大规模集群提供百纳秒级时延与无损传输能力。2024年以来,在多样性算力峰会成立“OISA协同创新平台”,在中国算力大会发布“OISA Gen1.1”协议,成立“超节点算力集群创新联合体”。
机间互联GSE(全调度以太网)全面革新以太网底层转发机制和上层协议栈,发布全套GSE技术标准、全量支持GSE能力的千卡级商用交换机及业界首颗GSE网卡芯片“智算珠光”。GSE引入基于PKTC的多路径喷洒、基于DGSQ的拥塞避免、基于66B原子码块的故障检测与通告三大原创技术,满足超十万卡GPU集群组网需求。
芯合算力原生与异构混训——国产芯片生态融通
算力原生方面,当前国内智算芯片生态碎片化,上层模型向国产体系迁移难。中国移动发布业内首部《面向智算的算力原生白皮书》,推动统一算力抽象、编程模型及虚拟指令集等系列标准及开源工作组建设,推出COCA算力原生平台,发布“芯合”计划,已实现7家智算芯片的一体接入,服务“分钟级”上线。面向近期接入更多AI芯片,支撑跨厂商低成本迁移;面向中远期探索虚拟指令集等深度算力抽象技术,形成即插即用的统一XPU算力底座。
异构混训方面,中国移动自主研发“芯合”异构混训系统,百亿参数大模型混训加速比达95%以上。通过非均匀拆分计算任务、拉通异构芯片间集合通信机制,实现跨厂商、跨代际、跨架构多类型智算芯片的分布式训练。面向近期实现异构流水线并行、异构数据并行等非均匀并行技术;面向中远期实现最优并行策略推荐,构建异构统一集合通信标准。
算网大脑——资源、任务、智能体三级编排
中国移动云智算的核心运营能力体现在算网大脑的三级编排调度体系。资源编排调度通过多集群资源统一抽象层和算力度量技术,量化异构算力、存储容量及网络状态,形成全局资源动态画像和多目标动态调度策略。任务式编排调度面向数据处理、分布式推理与集中式训练三类核心业务范式:数据处理通过弹性层级队列和负载感知调度保障稳定性;推理通过全局流量负载均衡和自适应弹性伸缩提升全局Token吞吐;训练通过分时调度实现训推混合负载、白天推理晚上训练,有效降低总体成本。
智能体编排调度基于分布式AI Agent协同架构,整合ANP与MCP协议,通过智能体路由实现多智能体动态协作与资源高效管控。中国移动正推动ANP协议标准化,实现多智能体自主协商与契约达成,逐步构建全球化智能体网络。