2025年1月,DeepSeek的爆发成为中国AI发展史上的标志性事件。浦银国际研报显示,DeepSeek-R1在数学、编程等能力上超过OpenAI-o1,API定价仅为OpenAI o1的3.65%,大幅降低了AI大模型的使用门槛。DeepSeek登顶全球140个市场App Store下载榜首,微软、英伟达、亚马逊等海外科技巨头相继接入。在DeepSeek的刺激下,中国互联网龙头AI资本开支有望接近翻倍,从2000-3000亿元增至4000-6000亿元,中国AI基建超级周期正式开启。
DeepSeek爆火——中国AI大模型的“奥本海默时刻”
2025年1月20日,DeepSeek正式发布DeepSeek-R1模型,在数学、编程、自然语言推理等方面能力比肩OpenAI-o1,优于较多开源和闭源模型。DeepSeek的APP在1月20日至1月26日实现环比375%的增长,1月27日登顶苹果美国区和中国区下载量双榜第一。1月29日起,英伟达、微软、亚马逊等海外科技巨头相继接入DeepSeek模型。
DeepSeek在三个方面超出市场预期:1)性能与OpenAI等最领先的AI大模型接近;2)成本/价格大幅低于其他模型——R1输出价格2.19美元/百万tokens,OpenAI o1为60美元,便宜96.35%;3)中国本土初创企业实现开源。1月27日,英伟达股价大跌17%、台积电大跌13%,资本市场对DeepSeek的冲击反应剧烈。DeepSeek通过GRPO算法、DeepSeekMoE架构、MLA机制等技术创新,在有限算力下实现全球领先的模型性能,成为中美科技博弈中的关键变量。
性能与成本双优势——DeepSeek的技术突破
DeepSeek在多个技术点实现创新。GRPO算法优化强化学习效率,DeepSeekMoE架构实现参数高效利用,MLA机制降低注意力计算复杂度,FP8精度减少训练成本,MTP方法提升推理能力。V3模型参数量6710亿,在数学、编程等能力上超过GPT-4o。R1模型在数学、编程能力上超过OpenAI-o1,其余能力接近最强模型。
成本方面,AI大模型行业处于发展初期,厂商作为供应端推动成本下行。DeepSeek的出现大大加速了行业成本下行速度。DeepSeek-V3输出价格0.28美元,GPT-4o为10美元,便宜97.2%。近期DeepSeek大幅下调夜间空闲时段API价格,V3降至原价50%、R1低至25%。公司公布运营一天成本87,072美元,理论收入562,027美元,利润率545%。新的技术路径在实现单位算力价格下降的同时,带动真实需求端尤其是企业需求的成本下降,大幅促进AI大模型需求扩张。
中国互联网龙头AI资本开支——从2000亿到6000亿的跃升
浦银国际预测2025年中国将正式开启AI基建超级周期。腾讯2025年资本开支或达1000+亿元,阿里巴巴约1500亿元,字节跳动1500+亿元,主要围绕AI开展基础设施建设。中国互联网巨头整体资本支出有望从原来2000-3000亿元增加到4000-6000亿元,接近翻倍。
美国四大互联网厂商资本开支在经历10个季度下行后,2023Q2见底,2024Q1实现+30%增长,Q2/Q3持续上扬至58%、59%,投向主要集中在AI算力部署。中国头部互联网厂商有望跟随美国在AI的投资路径进入上行期。中国云服务市场预计2023-2027E年均增速达37%,大幅高于全球增速。AI,尤其是DeepSeek的爆发,使各行业对算力、数据存储和处理等云服务需求大增,数据服务商、云计算与软件服务商、网络安全服务商、数据库服务商、AI大数据服务商等将充分受益。
DeepSeek带动一级二级市场AI投资热度
DeepSeek给AI行业带来的创新有望再次引领资本市场的相关行情。此前ChatGPT爆发带动各家巨头入局,也带动OpenAI等初创企业估值水涨船高——2024年9月OpenAI估值已达1570亿美元(较3月800亿增长96%)。Anthropic获亚马逊40亿美元融资估值184亿美元,xAI获60亿美元融资估值180亿美元。国内智谱AI C轮4亿美元估值200亿人民币,月之暗面估值25亿美元。
DeepSeek行情与两年前ChatGPT指数表现类似,有望成为今年的主线行情之一。更重要的是,在DeepSeek的搅动和刺激下,中国互联网龙头的AI资本开支有望加大,进入投入的上行期。AI热潮从资本市场向实体产业链渗透,中国有望迎来AI基建潮。中国国产化AI数据中心将会是本轮中国AI资本支出大幅增长的受益行业,涵盖芯片、服务器、网络设备、软件系统等细分产业。