DeepSeek-R1的开源发布正在重塑AI算力产业链的价值分配。据AI产品榜统计,DeepSeek应用上线仅21天日活达2215万,7天完成1亿用户增长,无任何广告投放。民生证券计算机团队认为,DeepSeek凭借MLA、MoE等创新架构实现低算力高性能,蒸馏技术让推理速度提升50倍,算力需求从训练端向边缘算力倾斜。云厂商作为DeepSeek能力的“放大器”,正迎来算力重估的历史性机遇。
DeepSeek的“平权效应”——7天破亿用户背后的技术革命
DeepSeek通过在架构设计、训练策略、算法优化及硬件适配等多方面创新实现在低算力条件下性能优异。多头潜注意力(MLA)减少KV矩阵重复计算,大幅降低显存消耗;DeepSeekMoE将模型分解为多个专家模型,智能选择合适专家处理,减少知识冗余,实现相较传统MoE模型40%的计算开销降低。DeepSeek-R1在AIME 2024测评中获得79.8%的pass@1得分,超过OpenAI-o1;在MATH-500上获得97.3%的得分,与OpenAI-o1性能相当。蒸馏技术将671B大模型知识迁移至7B小模型,推理速度提升约50倍。DeepSeek-R1-Distill-Qwen-7B在AIME 2024中实现55.5%的Pass@1,超越QwQ-32B-Preview。轻量化架构配合量化剪枝,使AI推理首次突破硬件限制,部署成本从高端GPU扩展至消费级GPU。
云算力重估——算力“卖铲人”市场全面打开
DeepSeek的出现让AI算力回归平价,海量算力的重新定价将重塑云厂商市场格局。DeepSeek 67B需约140GB显存(推荐4×A100-80G),而DeepSeek 7B仅需14GB(RTX 3090/4090可运行)。算力需求重心从训练往推理侧转移,从训练端的中心算力向边缘算力、消费算力和端侧算力倾斜。2023年中国云计算市场规模达6165亿元,同比增长35.5%,预计2027年将突破2.1万亿元。云计算市场空间有望在DeepSeek助推下进一步打开。据信通院,大模型推动云计算产业开启新一轮增长,云服务商算力租赁及AI服务收入有望快速增长。
云厂商集体拥抱DeepSeek——算力“弹药”与用户覆盖的放大器
云厂商是DeepSeek能力的“放大器”:充足的算力“弹药”与用户覆盖能力。自1月29日起,微软Azure、亚马逊AWS等海外云巨头陆续接入DeepSeek-R1。国内云厂商密集官宣:华为云2月1日联合硅基流动首发昇腾云服务推理,阿里云2月3日PAI Model Gallery支持一键部署,百度智能云千帆平台、腾讯云HAI、火山引擎、京东云、天翼云、联通云、移动云等均在2月上旬完成接入。随着公有云厂商拥抱DeepSeek模型,其背后算力处于同一起跑线,竞争转为考量算力池的深度和用户覆盖的广度。拥有海量GPU资源的边缘侧云服务厂商或是最佳受益者,以顺网科技为代表的边缘云厂商过去业务积累了大量边缘侧中高端消费级GPU云服务资源,DeepSeek低算力要求使其智算云可支持模型部署,成为激活“最后一公里”的最佳云服务厂商。
表:DeepSeek系列模型硬件需求对比| 模型名称 | 参数量 | 推理激活参数 | 显存需求 | 推荐GPU |
|---|
| DeepSeek-V3 | 280B(MoE) | 30B | ~28GB | A100/A10/RTX 4090 |
| DeepSeek-R1 | 15B | 15B | ~30GB | A100/RTX 4090 |
| DeepSeek 67B | 67B | 67B | ~140GB | 4×A100-80G |
| DeepSeek 7B | 7B | 7B | ~14GB | RTX 3090/4090 |