招银国际2025年2月发布的AI主题研究报告指出,DeepSeek案例证明通过优化模型架构和训练算法,训练和推理过程中的计算资源消耗可以进一步降低,大模型使用成本有望持续下探。DeepSeek爆火后,主流基础云服务厂商第一时间上线其最新模型,头部大模型厂商逐步开启降价以维持市场份额,大模型调用成本下降正在推动AI应用生态走向繁荣。
价格对比:DeepSeek-V3输入2元/1M tokens,仅为GPT-4o的11%
招银国际对主流大模型API调用价格的系统梳理显示,开源模型与闭源模型的价差正在持续扩大。DeepSeek-V3输入价格为2元/1M tokens、输出8元/1M tokens,DeepSeek-R1为输入4元、输出16元。对比之下,OpenAI GPT-4o为输入18.3元、输出73元,Claude 3.5 Sonnet为输入21.9元、输出109.5元,Google Gemini 1.5 Pro为免费调用。DeepSeek-V3的输入价格仅为GPT-4o的约11%、输出价格的约11%,降价幅度显著。在小参数模型端,百度ERNIE-Speed-8K、腾讯hunyuan-lite、讯飞Spark Lite均提供免费调用服务,阿里Qwen-vl-plus输入仅0.00075元/1M tokens。调用成本的量级差异将直接影响开发者的模型选择,低成本模型有望在B端应用中获得更广泛的采用。
云厂商快速响应:主流平台第一时间上线DeepSeek
DeepSeek爆火后,国内外主流基础云服务厂商均第一时间宣布上线DeepSeek旗下最新模型。微软Azure AI Foundry、AWS(Amazon Bedrock及SageMaker AI)、百度智能云千帆大模型平台、华为云-硅基流动、阿里云PAI、腾讯云HAI均已上线DeepSeek-R1或DeepSeek-V3。其中百度智能云R1定价为输入2元/1M tokens、输出8元,显著低于官方定价;阿里云PAI限时免费提供1000万Tokens;华为云-硅基流动定价与官方持平。主流云厂商的快速接入反映了AI算力需求的旺盛及云厂商对优质模型资产的争夺。DeepSeek模型在线API调用量的提升将直接利好基础云服务厂商AI相关云服务的营收增长。
AI应用繁荣路径:降价→开发者涌入→生态繁荣→算力需求再提升
招银国际预期行业发展将沿着两条路径并行:1)在真正通用人工智能(AGI)尚未出现前,持续加大对新一代大模型的算力投入进行前沿探索;2)对现有大模型持续优化、降低使用成本,推动AI应用逐步繁荣。调用成本更低且更好用的开源大模型的出现降低了B端软件甚至大模型的开发门槛,更多中小开发者可基于前沿模型二次开发,未来有望推动软件生态进一步繁荣。对于AI应用市场的参与者而言,如何找到优质的细分应用领域和场景、并通过不同API的组合调用来开发出优秀AI应用满足用户需求或逐步成为市场关注重点。这与互联网时代的演进路径高度相似——基础设施成本下降催生应用创新,应用繁荣反过来推动基础设施需求提升(贾维斯悖论)。
主流大模型API调用价格对比(输入/输出,元/1M tokens)| 模型 | 输入价格 | 输出价格 |
|---|
| DeepSeek-V3 | 2.0 | 8.0 |
| DeepSeek-R1 | 4.0 | 16.0 |
| 阿里Qwen-max | 2.4 | 9.6 |
| 百度ERNIE-Speed-8K | 免费 | 免费 |
| 腾讯hunyuan-lite | 免费 | 免费 |
| OpenAI GPT-4o | 18.3 | 73.0 |
| Claude 3.5 Sonnet | 21.9 | 109.5 |
| Google Gemini 1.5 Pro | 免费 | 免费 |