国产大模型正从追赶者向全球第一梯队快速跃升。群益金鼎证券《国产大模型快速发展,DeepSeek推动AI产业变革》报告显示,字节跳动豆包APP月活达7,116万,位居国内第一、全球第二;阿里巴巴Qwen-Max在客观题评测中位居全球第三;国产大模型在主观题领域甚至超越OpenAI o1。头部互联网企业、创业公司、科技巨头三股势力激烈角逐,行业洗牌加速。本文从用户规模、技术实力、商业模式三个维度,解析国产大模型的竞争格局。
国产大模型三股势力——互联网巨头、创业公司、科技企业各显神通
国产大模型市场已形成三类核心参与者。头部互联网企业(字节、阿里、百度、腾讯)凭借资金、数据和生态优势,模型能力基本达到GPT-4水准,部分场景实现超越,且可通过自有业务场景快速落地。头部创业公司(月之暗面Kimi、深度求索DeepSeek等)模型能力接近或达到互联网企业水平,部分在特定领域(如Kimi长文本、DeepSeek推理)实现突破,但缺乏现成应用场景和渠道资源。其他科技公司(如运营商、垂直行业厂商)主要依托存量B/G端业务接入大模型,规模相对较小。从2024年前三季度大模型公开披露项目看,教科类、通讯(运营商)、能源、政务落地项目数量最多,政务和能源领域项目金额最大,反映B/G端仍是当前大模型商业化的主要付费方。
用户规模与产品矩阵——豆包后来居上,阿里通义构建最强开源生态
字节跳动虽于2023年才正式布局大模型,但凭借全模态能力和应用端的快速迭代,豆包APP已跃居国内第一。2024年12月豆包MAU达7,116万,环比增长18.64%,下载量为国内第二名的3倍。字节还推出了猫箱(虚拟社交,月活688万)、即梦(图像生成,月活275万)等产品,构建了国内最丰富的AI应用矩阵。阿里的通义千问则走出另一条路径——全球最大AI开源社区Hugging Face排名前十的开源大模型,全部是基于Qwen二次训练的衍生模型,表明Qwen已成为全球开发者社区最受欢迎的基础模型之一。阿里还与苹果达成合作,将为iPhone提供AI大模型技术支持,有望进一步扩大用户触达范围。
国产大模型三股势力对比| 类型 | 代表企业 | 模型能力 | 核心优势 | 主要挑战 |
|---|
| 头部互联网 | 字节、阿里、百度、腾讯 | 全面达到GPT-4水准 | 资金、数据、业务场景 | 模型同质化 |
| 创业公司 | DeepSeek、Kimi | 局部超越o1 | 技术创新、开源生态 | 缺乏渠道与场景 |
| 其他科技 | 运营商、垂直厂商 | 行业定制化 | B/G端客户资源 | 规模较小 |
技术实力追赶——主观题国产领先,客观题阿里字节进全球前四
在涵盖2.2万道主客观题的综合性评测中,国产大模型展现出了全球竞争力。主观题(涉及价值判断、自然语言理解、对话质量)方面,字节豆包-pro-32k-preview排名第一,百度Ernie 4.0 Turbo第二,超越OpenAI o1-preview和Anthropic Claude-3.5-Sonnet。客观题(知识准确性、推理能力)方面,阿里Qwen-Max-0919位居第三、字节豆包-pro-32k-preview位居第四,仅次于OpenAI o1和Google Gemini-1.5-pro。这表明国产大模型在基础能力上已进入全球第一梯队,且在中文语境和主观交互体验上具有独特优势。同时,DeepSeek在MATH500、AIME2024等数学推理和Codeforces代码能力测试中得分超越GPT-4o和Claude-3.5-Sonnet,进一步拓宽了国产模型的能力边界。
商业化与竞争趋势——行业洗牌加速,头部互联网+DeepSeek格局初现
DeepSeek等高质量、低价格模型的冲击正在重塑大模型商业格局。百度、OpenAI等国内外厂商已开始大幅降低模型使用费用甚至采取免费策略,大模型商业模式被颠覆。在消费者市场,手机大厂基本选择自研或与头部云厂商合作(如苹果+阿里),倾向于与云基础设施较强的公司合作,头部优势得到强化。单纯模型公司缺乏商业模式,除了头部互联网大厂及DeepSeek,其他大模型企业面临更大的融资压力和运营压力。从腾讯等大厂的资本开支趋势看,腾讯自2024年起连续六个季度资本开支同比增速超30%,2024Q3达170.94亿元(同比+114%),主要投向AI算力和模型产品化落地。大模型行业正从"百花齐放"向"强者恒强"演进,具备资金、场景、算力三位一体优势的头部玩家将最终胜出。