返回顶部
返回首页 会员充值 我的足迹 返回上一页
具身智能
情绪经济
商业航天
十五五
银发经济

推理边缘算力交换机

国金证券研究所认为,DeepSeek R1以低成本实现与OpenAI o1相当的推理性能,验证了“无需海量标注数据+低成本算力”的可行性,推动AI推理与边缘侧加速落地。推理端多采用200G/400G中小型交换机,国产交换机已在该速率段规模商用,推理需求起量将提前拉动国产交换机出货。

DeepSeek开启AI推理普及时代,算力结构逆转

DeepSeek R1通过群组相对策略优化(GRPO)替代传统PPO算法、知识蒸馏技术将大模型推理能力迁移至小模型、自生成数据与自博弈机制,实现性能与成本的双重突破。在AIME 2024数学测试得分79.8%、MATH-500达97.3%、GPQA Diamond达71.5%、LiveCode Bench达65.9%,均显著优于GPT-4o。API定价仅为每百万输入tokens 0.14美元(缓存命中)/0.55美元(未命中),输出2.19美元,仅为OpenAI o1的3%-4%。低成本+高性能使DeepSeek迅速在140个市场移动应用下载榜登顶,华为云、腾讯云、阿里云等主流云平台及昇腾、海光等国产芯片厂商纷纷适配上线,国内AI产业链加速完善。

推理算力占比超过训练,边缘算力需求爆发

Gartner预测2025年推理集群算力规模将超过训练,将是AI走向普及化的关键之年。IDC预计到2025年用于推理工作负载的芯片占比将达60.8%。DeepSeek低成本模型进一步推升推理算力需求占比。相较于AI训练,推理端对总带宽需求相对降低:推理采用低精度计算(INT8/FP16)减少并行数据传输量;蒸馏后的小模型参数规模降低;推理集群规模以千卡甚至百卡级别为主,流量以低延迟、小批量数据为主,中等带宽即可满足。

国产400G交换机技术成熟,推理侧率先放量

国产中小型交换机(200G/400G)发布时间早、技术成熟、已积累国内互联网客源。华为CloudEngine 16800(400G)发布于2019年,新华三H3C S10500X-G(400G)发布于2022年,锐捷RG-N18000-X(400G)发布于2022年,均已在字节、阿里等智算中心广泛应用。而其800G产品集中于2023-2024年发布,出货规模尚小。伴随AI推理、AI端侧加速落地,200G/400G作为国产交换机已规模商用的速率段,用于算力市场的出货预计将提前加速,国产交换机厂商有望率先受益于推理需求放量。

推理与训练对交换机速率需求对比

| 维度 | AI训练 | AI推理 |

|

|

|

|

| 集群规模 | 万卡级别 | 千卡/百卡级别 |

| 计算精度 | 高精度(FP32/FP16) | 低精度(INT8/FP16) |

| 带宽需求 | 高(800G/1.6T) | 中(200G/400G) |

| 流量特征 | 高并发大吞吐 | 低延迟小批量 |

| 交换机速率 | 800G及以上 | 400G及以下 |

来源:电子工程专辑、架构师技术联盟、国金证券研究所

边缘算力部署拉动中小型交换机增量

DeepSeek通过低成本、高效能部署,降低边缘计算准入门槛,使更多企业能在边缘设备上部署AI应用,直接带动交换机等边缘基础设施需求。同时DeepSeek的快速普及带来海量推理需求,尤其在实时性要求高的场景(自动驾驶、工业物联网),推动边缘侧和推理侧算力基础设施部署。推理端/边缘端更多用到中小型交换机,国产交换机有望在此轮浪潮中深度参与。推理边缘算力起量将为国产交换机行业带来不同于训练侧的增量市场空间。
点击阅读报告原文: 【国金证券】通信行业研究:交换机行业迎巨大变革,国内AI发展带动国产交换机厂商机会显现-250218(24页)
相关报告