返回顶部
返回首页 会员充值 我的足迹 返回上一页
具身智能
情绪经济
商业航天
十五五
银发经济

开源大模型生态趋势

中原证券报告指出,DeepSeek的R1和V3开源标志着开源大模型在先进性上首次超越闭源大模型。DeepSeek采用MIT协议,是目前最为宽松的开源协议之一,未规定用户特定许可条款和地域管辖条款。全球云厂商火速接入——英伟达、亚马逊、微软三大巨头在1月31日同步上线,华为云、腾讯云、阿里云等国内厂商在2月初快速跟进。开源生态的繁荣正在深刻重塑AI产业的竞争格局。

开源大模型首次在先进性上超越闭源阵营

主流大模型厂商在开源方面分为三类路线。一是闭源路线为主的OpenAI、Anthropic,从开源走向闭源,GPT-4后连模型参数都不再公布。二是开源落后或轻量模型的xAI、谷歌,对开源社区贡献有限。三是坚定开源路线的Meta、阿里、DeepSeek,给开源社区带来较大贡献。

DeepSeek从2023年11月首个大语言模型就积极拥抱开源。2024年12月V3性能比肩GPT-4o,训练成本仅为其二十分之一;2025年1月R1性能比肩o1正式版,API成本仅为其三十分之一。DeepSeek的R1和V3不仅追平了最先进闭源模型的能力,同时在成本上形成明显优势。

这意味着开源大模型在先进性上首次超越了闭源大模型。在DeepSeek-R1发布以后,阿里开源了QwQ-32B对标R1,性能在仅32B参数下实现对标;百度宣布将在6月30日开源文心大模型4.5;OpenAI考虑加大开源策略;火山引擎开源"大模型应用实验室"。DeepSeek极大刺激了大模型厂商的开源力度。

MIT协议最宽松开放,全球化部署无政策障碍

DeepSeek使用MIT协议,在开源协议中最为宽松。Meta的Llama系列允许商用但月活超7亿需额外申请许可,受加利福尼亚州法律管辖。阿里的Qwen系列允许商用但需标注贡献,月活超1亿需向阿里云申请许可,争议适用中国法律、杭州法院管辖。DeepSeek未规定用户特定许可条款,未规定法律管辖相关条款。

通过对比,DeepSeek在开源协议上保持了更加开放的精神,对于大型企业更加友好,对于全球被许可人来说可以避免受到国际政治及法律变化的影响。对比手机操作系统,安卓通过开源策略获得约78%的全球智能手机市场份额,开源AI有望复制这一成功路径。

全球云厂商火速接入,国产芯片全面适配

DeepSeek-R1和V3发布后,全球云厂商以极快速度完成接入。海外方面,英伟达NIM、亚马逊AWS、微软Azure在1月31日同步上线DeepSeek-R1。国内方面,华为云与硅基流动联合首发昇腾云服务DeepSeek推理,持平全球高端GPU部署效果;中国电信、腾讯云、阿里云、百度智能云在2月1-3日陆续接入。

国产芯片方面,海光DCU完成适配并正式上线,华为昇腾社区上线DeepSeek系列模型,寒武纪MLU590支撑中国移动青海公司全面部署,飞腾S5000C和D3000实现端到端支持。下游软件厂商快速接入加速应用落地。
全球主要云厂商及芯片厂商接入DeepSeek时间线
时间公司/平台接入内容
1月31日英伟达、亚马逊、微软DeepSeek-R1同步上线NIM/AWS/Azure
2月1日华为云+硅基流动昇腾云服务DeepSeek推理首发
2月2-3日腾讯云、阿里云、百度智能云DeepSeek-R1/V3一键部署/上架
2月4-6日海光、华为、中国移动DCU/昇腾适配,智算平台深度集成
2月8-10日金山云、商汤、飞腾、寒武纪公有云/政务云部署,国产芯片端到端支持

开源代码悉数开放,技术推广空前加速

DeepSeek不仅开源模型权重,更将核心代码悉数开源。2025年2月24日启动的"Open Source Week"中,Flash MLA解码内核、DeepEP MoE通信库、DeepGEMM矩阵乘法库、DualPipe流水线并行算法、EPLB负载均衡器、3FS并行文件系统等悉数开源。

DeepSeek在3月1日发布的《DeepSeek-V3/R1推理系统概览》披露了线上系统的实际统计数据,揭示了原厂MaaS服务的真实盈利水平。高达85%的理论毛利率成为效率标杆,将吸引更多厂商加大在DeepSeek相关服务的投入。DeepSeek的开源极大促进了AI技术发展,也借助开源实现群策群力,更快走向AGI。
点击阅读报告原文: 【中原证券】计算机行业深度分析:三大要素齐发力,AI应用步入全面加速期-250307(25页)
相关报告