2025年春节后,DeepSeek概念以雷霆之势点燃A股计算机板块。金元证券研报显示,计算机行业市占率一度超越电子行业夺得全市场第一,换手率高达14%处于历史极值。DeepSeek-V3以557万美元的训练成本(仅为GPT-4o的约1/21)实现了比肩国际顶尖模型的性能,颠覆了“限制高端GPU就能阻止中国AI发展”的固有认知。DeepSeek的开源与低成本正推动AI技术普惠化,AI一体机成为新兴蓝海,13家伙伴基于昇腾产品打造自有DeepSeek一体机,政务应用效率提升20%以上。计算机行业正从硬件算力向AI应用与服务切换,产业逻辑全面重塑。
行情回顾——计算机行业从冰点到沸点
2024年12月至2025年1月13日,计算机行业指数跌幅16.47%,跑输沪深300近11个百分点,市场一度陷入冰点。然而1月13日后行业逐步由弱转强,春节后DeepSeek概念发酵,行业指数大幅跑赢沪深300近20个百分点。截至2月17日,软件开发子行业年度涨幅24.18%,IT服务业24.15%,计算机设备业9.92%,软件和服务类子行业涨幅显著高于硬件设备。
市场热度指标全面爆发。计算机行业市占率一度超越电子行业夺得全市场第一,达到10年最高点。行业流通股换手率同步上扬至14%,处于历史较高位置。行业内资金由计算机设备业大幅流向IT服务业,幅度变化高达10个百分点,与DeepSeek概念走强正相关。DeepSeek概念板块成交金额迅速超过全部A股成交额的20%,直接扭转了原本处于调整状态的A股市场。计算机行业正经历从“硬件算力”向“AI应用与服务”的逻辑切换。
DeepSeek技术创新——MoE+MLA打破算力封锁
DeepSeek引发全球震动的核心在于其技术创新。公司由幻方量化创始人梁文锋于2023年7月创立,依托“萤火超算”万卡级算力资源(万张A100 GPU)致力于AGI探索。虽然DeepSeek仍基于Transformer框架,但在模型训练和推理过程中实现了开创性创新。
MoE(专家混合模型)突破:DeepSeek实现动态专家选择——仅选择最相关的专家进行计算,降低计算开销;稀疏专家激活——每次输入只激活少数几个专家,大幅减少计算资源消耗;专家权重调整——使不同专家在不同数据场景下更加突出,提高适应性和泛化能力。MLA(元学习算法)突破:任务适应性——从少量样本中学习并快速适应新任务;优化策略——模型在学习过程中自我调整,自动选择最合适优化策略;快速迁移和泛化——从已学习任务迁移知识,快速应用于新任务而不需大量训练数据。MoE与MLA结合后,DeepSeek在多任务学习和大规模数据集应用中表现出极大优势,提升了任务处理速度和效率,改善了模型在处理复杂、多样化任务时的泛化能力。
成本革命——557万美元训练成本的行业颠覆
DeepSeek-V3的训练成本数据令人震撼。总参数量671B,每次处理激活37B参数,训练数据14.8T token。预训练阶段消耗266.4万GPU小时(占比95.5%,532.8万美元),上下文扩展11.9万GPU小时(4.3%,23.8万美元),后训练5万GPU小时(0.2%,1万美元),总计278.8万GPU小时。按2美元/小时计算,训练成本仅557.6万美元,训练周期约55天(2048卡集群)。
对比同类产品,DeepSeek-V3总成本超4000万美元,单位token成本约260美元/token,效能比设为1。Llama 3-405B总成本约2.5亿美元,单位token成本833美元/token,效能比3.2。GPT-4o总成本推测超1亿美元,单位token成本超5400美元/token,效能比超21。DeepSeek成本效能比是GPT-4o的21倍以上。DeepSeek成功降低了对高端GPU的依赖,可以适配国产芯片架构,为国产芯片提供技术验证场景。截至2月7日,华为昇腾、沐曦、天数智芯、摩尔线程、海光信息、壁仞科技等16家国产AI芯片企业相继宣布适配DeepSeek模型服务。DeepSeek和国产算力芯片的适配给予我国AI发展弯道超车的机会,AI产业步入良性循环,迎来国产供应链的价值重估。
AI一体机蓝海——政务应用效率提升20%以上
DeepSeek开源与低成本特性推动AI技术普惠化,AI一体机成为新兴蓝海。AI一体机有别于云端接入,让大模型直接部署在本地,数据计算运行于本地完成,减少数据外泄风险,满足金融、能源、政务、医疗等数据敏感行业对安全和隐私的要求。
四大核心优势:快速交付——3小时完成从开机到推理服务上线;高效利用——硬件利用率提升至92%;极简运维——降低30%宕机风险;数据安全——确保数据在本地处理,避免敏感信息外流。目前已有13家伙伴基于昇腾产品打造自有DeepSeek一体机产品,多家厂商发布基于海光、沐曦、壁仞等国产算力芯片的一体机。
政务领域率先落地。深圳福田区“AI数智员工”用于公文写作、政务服务、社区治理、应急管理、招商引资等11大类240个场景,人机协同下整体效率提高至少20%以上。北京丰台区、上海闵行区、广州、杭州、南京、苏州、无锡等多地政务系统已部署DeepSeek大模型。AI一体机正从概念走向规模化应用,重点关注浪潮信息、中科曙光、紫光股份、拓维信息、科大讯飞、中国长城。