>> 湘财证券-AI行业周报:阿里发布Qwen3-Next,性能与效率双提升-250914
| 上传日期: |
2025/9/15 |
大小: |
586KB |
| 格式: |
pdf 共6页 |
来源: |
湘财证券 |
| 评级: |
增持 |
作者: |
李杰 |
| 下载权限: |
此报告为加密报告 |
|
|
核心要点: 市场表现:上周中证人工智能产业指数上涨5.70% 根据Wind数据,上周(2025.09.08-2025.09.12)中证人工智能产业指数报收2217.92点,上涨5.70%;国证算力基础设施主题指数报收8868.05点,上涨9.83%;万得智能体概念指数报收2053.04点,上涨2.74%。 估值:上周中证人工智能产业指数PE(TTM,剔除负值)为56.60X,PB(LF)为7.48X 根据Wind数据,上周中证人工智能产业指数PE(TTM,,剔除负值)为56.60X,环比上升3.17X,近一年PE最大值为57.84X,最小值为26.05X。上周中证人工智能产业指数PB(LF)为7.48X,环比上升2.92X,近一年PB最大值为7.62X,最小值为3.01X。PE处于近7年以来91.92%分位数,PB处于近7年以来97.08%分位数。 行业动态点评:阿里发布Qwen3-Next,性能与效率双提升 根据智东西9月12日的报道,阿里通义实验室正式发布下一代基础模型架构Qwen3-Next,并训练了基于该架构的Qwen3-Next-80B-A3B-Base模型,该模型拥有800亿个参数,仅激活30亿个参数。Base模型在Qwen3预训练数据的子集上训练,包含15T tokens训练数据,仅需Qwen3-32B 9.3%的GPU计算资源,针对超过32k的上下文,推理吞吐量可达到Qwen3-32B的10倍以上。同时,基于Base模型,阿里开源了Qwen3-Next-80B-A3B的指令模型(Instruct)和思维模型(Thinking),模型支持原生262144个token上下文长度,可扩展至1010000个token。其中,Qwen3-Next-80B-A3BInstruct仅支持指令(非思考)模式,其输出中不生成<think></think>块;Qwen3-Next-80B-A3B-Thinking仅支持思考模式,为了强制模型进行思考,默认聊天模板自动包含<think>。指令模型的性能表现与参数规模更大的Qwen3-235B-A22B-Instruct-2507相当,思维模型优于谷歌闭源模型Gemini2.5-Flash-Thinking。在架构升级方面,相比阿里4月底的Qwen3 MoE模型,新增了混合注意力机制、高稀疏度MoE结构、一系列训练稳定友好的优化,以及提升推理效率的多Token预测(MTP)机制等。新模型已在魔搭社区和Hugging Face开源,开发者也可通过Qwen Chat或阿里云百炼、NVIDIAAPICatalog体验Qwen3-Next。开发者在Qwen的X评论区称赞其新增的多Token预测(MTP)机制,称这是最令人印象深刻的部分。 我们认为,Qwen3-Next的突破点在于同时实现了大规模参数容量、低激活开销、长上下文处理与并行推理加速。此外结合注意力机制、MoE设计等方面的多项创新,阿里通义此次实现仅激活3B参数模型就能对标规模更大模型的性能,使得模型在性能与效率之间找到更佳平衡点,同时为降低模型训练、推理成本提供了有效路径。Qwen3-Next的发布为全球大模型技术的迭代作出了新的探索。 投资建议 2025年以来,消费电子延续复苏态势,人工智能技术的进步推动AI基建需求维持高景气,同时,AI技术在终端上的落地推动端侧硬件升级,推动端侧SOC、散热材料等零部件赛道景气度高企,看好AI基建、端侧SOC的投资机会。在DeepSeek发布后,开源模型能力快速迭代,开源阵营快速扩大,有望推动AI应用加速发展,看好AI应用的投资机会。维持电子行业“增持”评级,AI基建板块建议关注寒武纪、芯原股份、翱捷科技;端侧SOC板块建议关注瑞芯微、恒玄科技、乐鑫科技、中科蓝讯。 风险提示 关税战拖累消费电子需求;AI技术进展不及预期;美国AI芯片管制政策执行力度超预期;AI应用发展不及预期。
|
|