长城证券通信行业周报显示,国产算力芯片迎来关键突破。2025年8月21日DeepSeek-V3.1正式发布,使用UE8M0FP8精度标准(针对下一代国产芯片设计),使国产芯片推理能效比提升40%,沐曦曦云C500运行V3单位算力成本较H100降低35%。同时,英伟达已通知供应商暂停H20芯片生产。截至2025年6月底,中国智能算力规模达788EFLOPS,国产替代需求持续攀升。
DeepSeek-V3.1:性能全面突破,专为国产芯片设计
2025年8月21日DeepSeek-V3.1正式发布,核心改进包括:混合推理架构——一个模型同时支持思考模式与非思考模式;更高思考效率——相比R1-0528在更短时间内给出答案;更强Agent能力——工具使用与智能体任务表现大幅提升。
编程智能体测试中,SWE-bench Verified达66.0%(V3-0324仅45.4%),SWE-bench Multilingual达54.5%(29.3%),Terminal-Bench达31.3%(13.3%)。搜索智能体测试中,Browsecomp达30.0%(R1-0528仅8.9%),Browsecomp_zh达49.2%(35.7%),xbench-DeepSearch达71.2%(55.0%)。经过思维链压缩训练,V3.1-Think在输出token数减少20%-50%的情况下各项任务平均表现与R1-0528持平。
DeepSeek评论区特别提到,V3.1使用了UE8M0FP8 Scale参数精度,而UE8M0FP8是针对即将发布的下一代国产芯片设计。实测显示,在671B参数规模下,沐曦曦云C500运行V3的单位算力成本较H100降低35%,推理延迟缩短至8ms以内。龙芯芯片在适配DeepSeek后也实现了较低功耗和较高性价比。
英伟达H20停产:国产算力替代加速
根据《The Information》援引两名知情人士消息,英伟达已通知部分零部件供应商暂停专为中国市场设计的H20 AI芯片生产。英伟达已通知美国安靠科技停止H20芯片生产,并同步告知韩国三星电子。安靠科技负责该芯片先进封装,三星电子供应高带宽存储芯片(HBM)。
H20是英伟达为符合美国出口管制要求而专门设计的中国特供版AI芯片。H20停产意味着中国AI芯片供应链面临进一步收紧。在地缘政治不确定性下,国产算力芯片的自主化需求更加迫切,华为昇腾、寒武纪思元、壁仞BR100等国产AI芯片将承担更大的市场替代责任。
中国算力规模:智能算力788EFLOPS,国产芯片占比提升
2025年8月23日中国算力大会召开,工信部信息通信发展司副司长赵策表示,截至2025年6月底,我国在用算力中心标准机架数达1085万架,智能算力规模达788EFLOPS。将持续优化全国算力布局,有序引导智能算力基础设施适度超前、动态平衡。
表2:国产AI芯片关键进展| 芯片/平台 | 关键进展 | 应用场景 |
|---|
| 沐曦曦云C500 | 运行V3算力成本较H100降35% | 大模型推理 |
| 华为昇腾系列 | 鹏城云脑等超算规模部署 | 训练+推理 |
| 寒武纪思元 | AI芯片系列持续迭代 | 云端推理 |
| 壁仞BR100 | 部分实现A100级别替代 | 通用GPU |
根据易观分析,截至2024年全国算力总规模超280EFLOPS(全球第二),智能算力达90EFLOPS,占比超30%,比2019年增长近13倍,年均增速约90%。伴随国产大模型持续演进,本土厂商高性能AI芯片性能逐步逼近国际领先水平。九章智算云等新一代云智算平台已实现国产主流GPU/NPU芯片充分适配。
算力自主化投资主线
DeepSeek-V3.1的国产芯片适配验证了国产算力基础设施的可行性,英伟达H20停产强化了算力自主化的紧迫性。建议关注算力自主化核心标的:运营商/国资云(中国移动、中国电信、中国联通、深桑达A);主设备商&服务器(中兴通讯、紫光股份、浪潮信息);光模块(中际旭创、天孚通信、新易盛);IDC(英维克、佳力图、申菱环境、数据港)。全球AI浪潮持续加速叠加地缘政治因素,国产算力需求将持续攀升,算力自主化空间充分。