研报下载就选股票报告网
您好,欢迎来到股票分析报告网!登录   忘记密码   注册
>> 华创证券-计算机行业重大事项点评:DeepSeek V3.2发布,推动国产AI生态链崛起-250930
上传日期:   2025/9/30 大小:   636KB
格式:   pdf  共4页 来源:   华创证券
评级:   推荐 作者:   吴鸣远
行业名称:   计算机
下载权限:   此报告为加密报告
事项:
  9月29日,DeepSeek-V3.2-Exp模型正式在Hugging Face平台发布并开源,同日,华为昇腾、寒武纪等国产芯片厂商,均第一时间实现对开源适配。
  评论:
  国产芯片与大模型实现系统联动,引领国内AI发展浪潮。DeepSeek-V3.2-Exp发布并开源,并引入DeepSeek Sparse Attention(一种稀疏注意力机制)。华为昇腾已快速基于vLLM/SGLang等推理框架完成适配部署,实现DeepSeekV3.2-Exp 0day支持,并面向开发者开源所有推理代码和算子实现。寒武纪通过Triton算子开发实现了快速适配,利用BangC融合算子开发实现了极致性能优化,并依托DeepSeek-V3.2-Exp带来的全新DeepSeek Sparse Attention机制,叠加寒武纪的极致计算效率,可大幅降低长序列场景下的训推成本,为客户提供极具竞争力的软硬件解决方案。华为昇腾、寒武纪等国产芯片厂商迅速完成适配,展现了软硬件协同优化的强大效能,这种深度联动不仅通过稀疏注意力机制等技术提升了大模型的计算效率,更推动了国产AI生态的完善,为构建自主可控的产业体系奠定坚实基础,加速我国AI产业从单点突破迈向系统级创新。
  全球开源开放,性能与Terminus对比,DSA验证模型能力。DeepSeek-V3.2-Exp在V3.1-Terminus的基础上引入了DSA架构,这是一项重要的架构创新。它通过实现细粒度稀疏注意力,突破了传统Transformer模型在长文本处理时计算复杂度O(n2)的限制。该机制能显著提升长文本训练和推理效率,在几乎不影响模型输出效果的前提下,实现了长文本训练和推理效率的大幅提升,为下一代大模型的高效发展指明了方向。为了确保评估的严谨性,DeepSeekV3.2-Exp的训练设置与前代V3.1-Terminus进行了严格对齐。测试结果显示,该模型在各大公开评测集上的表现与V3.1-Terminus基本持平,有效性得到了验证。
  成本大幅降低,AI应用商业化落地有望提速推进。基于模型在稀疏注意力架构上的创新,使得计算资源消耗的降低和推理效率的提升,使得新模型服务成本的大幅降低,DeepSeek官方API价格也相应下调,在新的价格政策下,输入方面,缓存命中时价格为0.2元/百万tokens,缓存未命中时价格为2元/百万tokens,输出方面则为3元/百万tokens,开发者调用DeepSeek API的成本将降低50%以上。这一举措显著降低了开发者的使用门槛和创新成本,使得更多的个人和企业能够负担并充分利用先进的AI模型。同时,模型在HuggingFace等平台的开源,也与降价策略相辅相成,共同推动着AI技术的普惠化发展和应用生态的繁荣。
  投资建议:DeepSeek继续引领国产大模型与国产算力发展,建议重点关注:
  1)国产芯片:寒武纪、海光信息(中科曙光);
  2)华为产业链:华丰科技、华工数据、光讯科技等;
  3)AI应用:金山办公、金蝶国际、深信服、科大讯飞、合合信息、用友网络、三六零、第四范式、迈富时、虹软科技、税友股份、卫宁健康等。
  风险提示:技术进展不及预期;模型落地不及预期;商业落地不及预期。
  
 
Copyright © 2005 - 2021 Nxny.com All Rights Reserved 备案号:蜀ICP备15031742号-1