国泰君安报告聚焦DeepSeek轻量化技术对AI Agent落地的推动。2025年1月DeepSeek发布R1模型,在AIME 2024测试中达79.8分,性能对标OpenAI o1。DeepSeek-R1采用MIT License并支持模型蒸馏,API价格仅为行业均值的5%——缓存命中输入1元/百万tokens,输出16元/百万tokens,而o1-mini为11/88元,o1为55/438元。Janus-Pro以7B参数量在多模态领域突破,GenEval基准测试达80%,超越DALL-E-3。轻量化成本推动AI Agent从试点走向规模化商业应用。
DeepSeek-R1——开源推理模型的里程碑
2025年1月20日,DeepSeek发布R1模型,通过在后训练阶段大规模应用强化学习技术,在AIME 2024测试中达到79.8的Pass@1分数,MATH-500达到97.3的通过率,在多项推理测试中对标OpenAI o1,标志着开源Agent迈入高级推理时代。DeepSeek-R1采用MIT License并支持模型蒸馏,打破了AI Agent开发的技术垄断格局。
其蒸馏模型在基准测试中也表现优异,基于R1蒸馏的Qwen 32B模型在AIME和MATH-500中分别实现72.6和94.3的Pass@1,证明了技术扩散的可行性。从660B顶级模型到1.5B轻量级模型的完整产品线,为AI Agent产业链的专业化分工奠定了基础。即便是最小的1.5B模型也能在MATH-500中达到83.9的成绩。
Janus-Pro——轻量化多模态的突破
继DeepSeek-R1在对话领域证明小参数量模型的可行性后,1月28日DeepSeek又发布了Janus-Pro,通过解耦式架构设计在多模态领域实现了突破。其7B版本在GenEval基准测试中取得80%准确率,在DPG-Bench获得84.19分,且在MMBench多模态理解测试中达到79.2分,超越DALL-E-3、Emu3-Gen等一众主流生成方法。
轻量化技术路线的普适性得到验证——AI技术的进步不一定依赖于算力规模的无限扩张。多模态小模型的成功可支撑环境感知、物体操控等复杂交互需求,使智能座舱、家庭机器人等消费硬件突破算力约束,打开市场空间。
成本重构——AI Agent商业化的拐点
DeepSeek-R1 API价格仅为竞品o1、o1-mini的不到5%。缓存命中输入1元/百万tokens,输出16元/百万tokens,而o1-mini和o1对应价格分别为11/88元和55/438元。这种普惠性的商业模式创新,将加速AI Agent在各个垂直领域的渗透,推动行业从概念验证阶段迈向规模化商业应用阶段。
低价API与开源策略的组合正改变AI产业投资方向。当基础模型能力可通过低成本API获取,且核心技术栈完全开源时,大量企业将不再需要投入巨资研发底层大模型。行业竞争重心从基础技术研发转向应用场景创新,企业可以将原本用于基础研发的资源投入到AI Agent的场景应用开发中,加速AI技术的产业落地。
DeepSeek-R1 API价格对比(元/百万tokens)| 模型 | 输入价格 | 输出价格 |
|---|
| DeepSeek-R1(缓存命中) | 1 | 16 |
| o1-mini | 11 | 88 |
| o1 | 55 | 438 |