中原证券报告指出,DeepSeek的R1和V3开源标志着开源大模型在先进性上首次超越闭源大模型。DeepSeek采用MIT协议,是目前最为宽松的开源协议之一,未规定用户特定许可条款和地域管辖条款。全球云厂商火速接入——英伟达、亚马逊、微软三大巨头在1月31日同步上线,华为云、腾讯云、阿里云等国内厂商在2月初快速跟进。开源生态的繁荣正在深刻重塑AI产业的竞争格局。
开源大模型首次在先进性上超越闭源阵营
主流大模型厂商在开源方面分为三类路线。一是闭源路线为主的OpenAI、Anthropic,从开源走向闭源,GPT-4后连模型参数都不再公布。二是开源落后或轻量模型的xAI、谷歌,对开源社区贡献有限。三是坚定开源路线的Meta、阿里、DeepSeek,给开源社区带来较大贡献。
DeepSeek从2023年11月首个大语言模型就积极拥抱开源。2024年12月V3性能比肩GPT-4o,训练成本仅为其二十分之一;2025年1月R1性能比肩o1正式版,API成本仅为其三十分之一。DeepSeek的R1和V3不仅追平了最先进闭源模型的能力,同时在成本上形成明显优势。
这意味着开源大模型在先进性上首次超越了闭源大模型。在DeepSeek-R1发布以后,阿里开源了QwQ-32B对标R1,性能在仅32B参数下实现对标;百度宣布将在6月30日开源文心大模型4.5;OpenAI考虑加大开源策略;火山引擎开源"大模型应用实验室"。DeepSeek极大刺激了大模型厂商的开源力度。
MIT协议最宽松开放,全球化部署无政策障碍
DeepSeek使用MIT协议,在开源协议中最为宽松。Meta的Llama系列允许商用但月活超7亿需额外申请许可,受加利福尼亚州法律管辖。阿里的Qwen系列允许商用但需标注贡献,月活超1亿需向阿里云申请许可,争议适用中国法律、杭州法院管辖。DeepSeek未规定用户特定许可条款,未规定法律管辖相关条款。
通过对比,DeepSeek在开源协议上保持了更加开放的精神,对于大型企业更加友好,对于全球被许可人来说可以避免受到国际政治及法律变化的影响。对比手机操作系统,安卓通过开源策略获得约78%的全球智能手机市场份额,开源AI有望复制这一成功路径。
全球云厂商火速接入,国产芯片全面适配
DeepSeek-R1和V3发布后,全球云厂商以极快速度完成接入。海外方面,英伟达NIM、亚马逊AWS、微软Azure在1月31日同步上线DeepSeek-R1。国内方面,华为云与硅基流动联合首发昇腾云服务DeepSeek推理,持平全球高端GPU部署效果;中国电信、腾讯云、阿里云、百度智能云在2月1-3日陆续接入。
国产芯片方面,海光DCU完成适配并正式上线,华为昇腾社区上线DeepSeek系列模型,寒武纪MLU590支撑中国移动青海公司全面部署,飞腾S5000C和D3000实现端到端支持。下游软件厂商快速接入加速应用落地。
全球主要云厂商及芯片厂商接入DeepSeek时间线| 时间 | 公司/平台 | 接入内容 |
|---|
| 1月31日 | 英伟达、亚马逊、微软 | DeepSeek-R1同步上线NIM/AWS/Azure |
| 2月1日 | 华为云+硅基流动 | 昇腾云服务DeepSeek推理首发 |
| 2月2-3日 | 腾讯云、阿里云、百度智能云 | DeepSeek-R1/V3一键部署/上架 |
| 2月4-6日 | 海光、华为、中国移动 | DCU/昇腾适配,智算平台深度集成 |
| 2月8-10日 | 金山云、商汤、飞腾、寒武纪 | 公有云/政务云部署,国产芯片端到端支持 |
开源代码悉数开放,技术推广空前加速
DeepSeek不仅开源模型权重,更将核心代码悉数开源。2025年2月24日启动的"Open Source Week"中,Flash MLA解码内核、DeepEP MoE通信库、DeepGEMM矩阵乘法库、DualPipe流水线并行算法、EPLB负载均衡器、3FS并行文件系统等悉数开源。
DeepSeek在3月1日发布的《DeepSeek-V3/R1推理系统概览》披露了线上系统的实际统计数据,揭示了原厂MaaS服务的真实盈利水平。高达85%的理论毛利率成为效率标杆,将吸引更多厂商加大在DeepSeek相关服务的投入。DeepSeek的开源极大促进了AI技术发展,也借助开源实现群策群力,更快走向AGI。