截至2025年6月底,我国累计备案生成式AI服务已达439款、登记应用233款——国产大模型正从“技术追赶”迈入“规模化落地”阶段。华创证券指出,DeepSeek以0.5元/百万Tokens的极致成本、Kimi K2逼近Claude 4的综合性能、Qwen3 Coder媲美Sonnet 4的代码能力,正在重塑国内AI产业竞争格局。
国产大模型政策与备案进展
截至2025年6月底,我国生成式AI服务与应用备案登记体系规模化落地,累计备案服务439款、登记应用233款。政策推动下,国产大模型商业化进程显著提速。
DeepSeek——极致性价比的突围者
DeepSeek由杭州深度求索于2023年7月17日创立。2025年1月发布DeepSeek-R1并同步开源权重;5月升级R1-0528版本,在后训练投入更多算力;8月19日发布V3.1版本。
DeepSeek-R1-0528在深度逻辑推理与代码解析领域卓越,数学、编程及逻辑推理基准上接近国际顶尖模型o3与Gemini 2.5 Pro。V3.1基于Post-Training优化显著增强Agent能力,在工具使用与智能体任务执行上表现突出。
核心优势:输入成本仅0.5元/百万Tokens,仅为国际旗舰模型数十分之一,极高性价比加速国内AI应用普及。
月之暗面——Kimi K2领跑国产开源
月之暗面于2023年4月17日由前清华大学助理教授杨植麟创立。2023年10月推出Kimi Chat;2025年1月发布K1.5多模态思考模型;7月11日发布Kimi K2(MoE架构)并同步开源。
基准测试:代码生成、工具使用、数学推理、通用理解四大维度全面领跑国内开源模型。SWE-bench Multilingual和Tau2-bench接近Claude 4系列;AceBench与GPT-4.1不相上下;AIME 2025和GPQA-Diamond显著领先。
核心优势:综合性能逼近国际头部水平,输入成本仅GPT-4.1三分之一,性能与成本双重竞争力。
通义千问——阿里开源最强代码模型
阿里巴巴达摩院开发,2023年开源Qwen 1.0;2024年发布Qwen 1.5、Qwen 2及Qwen 2-Math/Audio/VL;2025年4月发布Qwen 3系列(235B-A22B);7月22日升级Instruct-2507;7月23日发布Qwen3 Coder编程模型。
Qwen3 Coder在代理编码、浏览器应用和工具调用三大指标出色,性能媲美Claude Sonnet 4。
国产大模型的核心竞争力
性能追赶:Kimi K2逼近Claude 4,DeepSeek R1接近o3/Gemini 2.5 Pro,Qwen3 Coder媲美Sonnet 4。
成本优势:DeepSeek 0.5元/百万Tokens,Kimi K2为GPT-4.1三分之一,显著降低AI应用门槛。
场景适配:Qwen在中文语义和垂直任务优势明显,国产模型在本地化场景中具备天然竞争力。
开源生态:DeepSeek、Kimi K2、Qwen均实现开源或开放权重,加速开发者生态构建。