研报下载就选股票报告网
您好,欢迎来到股票分析报告网!登录   忘记密码   注册
>> 国泰海通证券-电子元器件行业:DeepSeek-V3.2-Exp发布,国产算力需求加速增长-251004
上传日期:   2025/10/4 大小:   737KB
格式:   pdf  共4页 来源:   国泰海通证券
评级:   增持 作者:   舒迪
下载权限:   此报告为加密报告
本报告导读:
  DeepSeek-V3.2-Exp发布,性能不变前提下API费用大幅下调,国产算力需求加速增长。
  投资要点:
  投资建议。根据DeepSeek公众号,其于2025年9月29日正式发布DeepSeek-V3.2-Exp模型。该模型引入DSA机制,在保持性能基本不变的前提下大幅降低API成本。我们认为或将加速国产AI应用渗透,加快国产算力需求增长。推荐标的:寒武纪-U、海光信息、中芯国际、兆易创新、盛科通信-U,相关标的:芯原股份。
  DeepSeek-V3.2-Exp引入DSA机制,API费用大幅下调。根据DeepSeek公众号,其于2025年9月29日正式发布DeepSeek-V3.2-Exp模型。该模型在V3.1-Terminus的基础上引入DeepSeek SparseAttention,针对长文本的训练和推理效率进行优化与验证。其(1)DeepSeek Sparse Attention首次实现细粒度稀疏注意力机制,在几乎不影响模型输出效果前提下实现长文本训练和推理效率大幅提高。并且在各领域公开评测集中,DeepSeek-V3.2-Exp的表现与V3.1-Terminus基本持平;(2)新模型服务成本大幅降低,API价格亦大幅下调。输入(缓存命中)价格由0.5元/百万tokens降至0.2元/百万tokens,输出价格由12元/百万tokens降至3元/百万tokens。我们认为,DeepSeek通过引入DSA机制,在保持性能基本不变的前提下大幅降低API成本,将有效加速国产AI应用渗透,加快算力需求增长。
  国产算力芯片实现Day 0适配,软硬一体加速国产替代。根据寒武纪公众号,其已同步实现对DeepSeek-V3.2-Exp的适配,并开源大模型推理引擎vLLM-MLU源代码。针对本次新模型架构,寒武纪通过Triton算子开发实现快速适配,利用BangC融合算子开发实现极致性能优化,并基于计算与通信的并行策略,达成业界领先的计算效率水平。根据华为计算公众号,昇腾在DeepSeek-V3.2-Exp一发布开源即实现DeepSeek-V3.2-Exp BF16模型部署,并在CANN平台上完成对应的优化适配。针对稀疏DSA结构,叠加实现长序列亲和的CP并行策略,兼顾时延和吞吐,在128K长序列下能够保持TTFT低于2秒、TPOT低于30毫秒的推理生成速度。我们认为寒武纪与昇腾针对DeepSeek-V3.2-Exp的Day 0适配,表明国产算力芯片在性能及软件生态建设方面加速完善,未来或可应用至国产训练场景中。
  催化剂。基于国产算力芯片的一流AI大模型发布;国产高性能AI应用发布。
  风险提示。先进制程产能扩产进度不及预期。
  
 
Copyright © 2005 - 2021 Nxny.com All Rights Reserved 备案号:蜀ICP备15031742号-1