东吴证券计算机行业一季度投资策略报告指出,DeepSeek的出现正在成为国家级风口。2025年1月DeepSeek-R1模型开源发布,以强化学习路径实现大模型底层范式创新,性能比肩OpenAI o1,训练及API调用成本便宜90%-95%。模型平权、推理爆发的产业趋势已然确立,2025年将成为端侧与应用全面落地的元年。
DeepSeek引领中国AI从跟随者走向创新引领者
DeepSeek-R1于2025年1月20日发布并开源,以纯RL(强化学习)路径实现了大模型的底层范式创新,首次验证了无需监督微调即可显著增强推理能力的可行性。DeepSeek-V3在MMLU基准测试中准确率达85.6%,在GSM8K数学任务中准确率达92.3%,DeepSeek-R1在数学任务上的性能与OpenAI-o1-1217相当。降本核心创新点在于DeepSeekMoE架构、FP8混合精度框架、MLA多头潜在注意力机制等,完整训练仅需278.8万H800 GPU小时,训练成本仅557万美元,远低于国内外其他已知模型。东吴证券认为,DeepSeek的底层创新标志着中国AI从跟随者向创新引领者转变,直接引发全球对中国科技资产的重估。
用户增长刷新历史纪录——7天完成1亿用户增长
据AI产品榜数据,2025年1月DeepSeek用户增长达1.25亿(含网站、应用累加不去重),其中80%以上用户来自1月最后一周。DeepSeek在没有任何广告投放的情况下实现7天完成1亿用户增长,成为史上最快达成这一里程碑的超级产品。对比其他头部应用,ChatGPT达到1亿用户用时2个月,TikTok用时9个月,微信用时1年2个月,Instagram用时2.5年。QuestMobile数据显示,DeepSeek在1月28日的日活跃用户数首次超越豆包,随后在2月1日突破3000万大关。用户量的指数级增长直接导致DeepSeek API服务出现算力紧缺,2月6日DeepSeek暂停API服务充值,侧面验证了推理需求的爆发式增长。
模型平权降低应用门槛——垂直模型与Agent迎来井喷期
DeepSeek开源和低成本让模型层面的差距迅速缩小,为推理侧应用的爆发打下基础。参考移动互联网App的爆发受益于流量费用下降,DeepSeek开源模型有望引领全球大模型研究路线创新和成本下降,小型团队不需要重资产投入即可蒸馏出先进小模型。东吴证券指出,模型层面的壁垒打破以后,影响应用效果的决定因素变为了场景和数据积累,利好B端软件服务商。医疗、财税、金融等具备独特数据和场景优势的IT厂商将率先享受AI Agent红利。同时,端侧场景C端属性强,DeepSeek支持端侧本地部署,推动了智能耳机、智能音箱、智能手表等AI硬件能力提升,2025年或是端侧的爆发元年。
训练+推理整体需求乐观——算力投资逻辑从预训练转向推理
DeepSeek的低成本训练模式引发了市场对算力总需求的担忧,但东吴证券认为训练+推理的整体需求依然乐观。未来的AI投入不再盲目“大力出奇迹”,重心将从预训练转向推理侧。参考从2G到4G流量费用不断降低,但因用量指数级提升导致整体市场规模快速增长。DeepSeek用户量爆发已导致算力紧缺,验证了推理需求的强劲。国产芯片厂商和云厂商纷纷适配DeepSeek,华为昇腾、海光、寒武纪、沐曦等芯片厂商均已宣布支持,华为云、优刻得、青云科技等云厂商上线DeepSeek系列模型,算力需求大幅提升有望提升现有IDC厂商的机房上架率。
表1:头部超级产品达到1亿用户所用时间对比| 产品 | 达到1亿用户所用时间 | 发布/上线时间 | 备注 |
|---|
| DeepSeek | 7天 | 2025年1月 | 史上最快,无广告投放 |
| ChatGPT | 2个月 | 2022年11月 | 此前最快纪录 |
| TikTok | 9个月 | 2017年 | - |
| 微信 | 1年2个月 | 2011年 | - |
| Instagram | 2.5年 | 2010年 | - |
| Facebook | 4.5年 | 2004年 | - |