返回顶部
返回首页 会员充值 我的足迹 返回上一页
具身智能
情绪经济
商业航天
十五五
银发经济

国产AI大模型趋势

华龙证券报告指出,DeepSeek的开源、低成本、高性能模式有望助推国内AI技术的普惠化。2025年2月1日DeepSeek DAU突破3000万,成为史上最快达成该里程碑的应用。技术路径上,DeepSeek通过强化学习和冷启动数据结合验证纯RL训练路径,模型蒸馏技术将推理能力迁移至小型模型,显著提升小型模型推理性能。2025年2月16日微信搜一搜正式灰度测试接入DeepSeek,国民级应用接入将形成数据、AI算法、用户量的飞轮效应。报告认为,DeepSeek证明算法优化可在AI产业中取得“后发优势”,其带来的“AI平权”为国内AI应用发展打开想象空间。

DeepSeek后发先至,DAU突破3000万创纪录

DeepSeek-R1发布后,凭借定价低廉、性能比肩全球顶尖模型、开源三大特点迅速走红。2025年2月8日QuestMobile数据显示DeepSeek在1月28日DAU首次超越豆包,2月1日突破3000万大关,成为史上最快达成这一里程碑的应用。

DeepSeek-R1-Zero是完全依赖强化学习训练的大语言模型,AIME 2024精度从15.6%提升至71.0%,采用多数表决时性能升至86.7%超过OpenAI-o1-0912。DeepSeek首次验证纯强化学习路径有效性,通过冷启动数据(高质量长推理链)和多阶段训练流程(冷启动微调、推理强化学习、拒绝采样和监督式微调、全场景强化学习)进一步提升性能。蒸馏实验显示DeepSeek-R1-Distill-Qwen-32B在AIME 2024达72.6%,超越QwQ-32B-Preview和DeepSeek-R1-Zero-Qwen-32B。

开源+低成本验证“后发优势”,AI普惠化加速

DeepSeek开源、低成本、高性能模式是对AI产业的重要推动。API定价仅为OpenAI-o1的三十分之一,将大模型成本大幅降低,实现不同规模公司在AI领域的“平权”。

DeepSeek的“后发优势”体现在算法层面:在算力芯片硬件限制下,通过算法框架更新和系统工程优化实现模型性能明显提升。其带来的“AI平权”为国内AI应用发展打开想象空间,为“后发优势”向国内AI产业下游传导铺平了道路。

微信接入DeepSeek,“国民级”应用探索AI生态

2025年2月16日,微信搜一搜正式灰度测试接入DeepSeek。QuestMobile数据显示,2024年10月微信小程序月活用户规模达9.49亿,月人均使用时长1.7小时,月人均使用次数近70次,月人均使用天数20天。

微信拥有庞大的用户规模、活跃度和用户黏性。基于此,数据、AI算法、用户量将很快形成飞轮效应,大幅提高流量变现效率。微信接入DeepSeek是国内AI生态的一次重要探索,类似“AI+传统应用”的形式有望持续落地开花。

AI Agent与多模态AI是重点发展方向

AI Agent是当前AI应用的重要领域之一。根据DeepMind团队对AGI路径的定义,AI Agent被定义为第五级别自动化(最高级别)。从AI最终形态看,AI在识别、理解、推理基础上参与决策并执行操作是发展AGI的必经之路。

DeepSeek之后,多家上市公司将DeepSeek与AI Agent、软件产品融合。AI Agent与DeepSeek结合在办公、营销、医疗、工业制造等B端场景落地。多模态AI方面,万兴科技旗下视频创意、绘图创意及文档创意软件业务产品均已融合DeepSeek-R1大模型;当虹科技将BlackEye多模态视听大模型与DeepSeek-R1和DeepSeek Janus Pro融合。技术与生态的碰撞有望推动B端业务线优化和C端AI玩法破圈。
DeepSeek蒸馏模型与RL模型推理基准对比
模型AIME 2024 pass@1AIME 2024 cons@64MATH-500GPQA Diamond
QwQ-32B-Preview50.060.090.654.5
DeepSeek-R1-Zero-Qwen-32B47.060.091.655.0
DeepSeek-R1-Distill-Qwen-32B72.683.394.362.1
点击阅读报告原文: TMT行业AI产业系列跟踪专题研究报告:从DeepSeek看国产AI的“后发优势”-250226(21页)
相关报告