>> 长江证券-软件与服务行业AI产业跟踪:通义Qwen3-Max正式发布,引领“参数革命”,持续关注大模型商业化进展-250929
| 上传日期: |
2025/9/29 |
大小: |
630KB |
| 格式: |
pdf 共5页 |
来源: |
长江证券 |
| 评级: |
看好 |
作者: |
宗建树 |
| 下载权限: |
此报告为加密报告 |
|
|
事件描述 2025年9月24日云栖大会上通义千问重磅发布一揽子模型。其中Qwen3-Max正式发布,系通义迄今为止规模最大、能力最强的模型。模型包含三个主要版本:Base(基础版本)、Instruct(指令优化版本)和Thinking(推理增强版本)。 事件评论 Qwen3-Max正式发布,总参数超万亿,主推Coding和Agent工具调用能力,综合性能超GPT-5、Claude Opus 4等国际顶尖模型。Qwen3-Max定位旗舰模型,(1)数据与参数突破:36T tokens预训练数据量,万亿级参数规模较上一代提升300%,为复杂推理提供底层支撑;(2)Coding与Agent能力增强:HumanEval测评通过率89.7%,Agent工具调用响应速度提升至0.8秒,超越GPT5的1.2秒基准线;SWE-Bench Verified测试(Coding能力)得分69.6分,位列全球第一梯队;Tau2-Bench测试(Agent工具调用能力)得分74.8分,超过Claude Opus4和DeepSeek-V3.1。(3)数学推理能力取得突破性增强。Thinking版本通过集成代码解释器并运用并行测试时计算技术,AIME 25和HMMT均取得满分。我们认为,Qwen3-Max是国产大模型从“跟跑”到“并跑、局部领跑”的拐点,证明了阿里在模型能力最前沿进行单点突破的深度。跻身模型第一梯队有望成功切入海外打开增长空间。 长上下文突破有望加速行业适配深化,推进垂直场景落地。本次模型在长序列训练场景中以ChunkFlow策略获得了相比序列并行方案提升3倍的吞吐收益,支持1M长上下文训练,为金融、法律等垂域产业场景提供直接支撑有望加速落地。 技术核心:(1)训练稳定性提升:Qwen3-Max沿用Qwen3系列MoE结构,使用globalbatchload实现预训练过程无loss尖刺和balancing loss。(2)训练效率显著提升:在PAIFlashMoE的高效多级流水并行策略优化下,Qwen3-Max-Base的MFU(模型浮点运算利用率)相比Qwen2.5-Max-Base提升30%。同时Qwen3-Max在超大规模集群上因硬件故障造成的时间损失下降为Qwen2.5-Max的五分之一。我们认为,Qwen3-Max的性能突破验证Scaling Law仍然成立,从万亿级参数继续向前仍是可行路径,国内模型厂商训练范式不断成熟,掌握“规模化训练工程体系”的核心know-how。 我们认为,Qwen3-Max不仅是技术展示,更是阿里在大模型竞争中“押宝旗舰”级模型的体现。同时在云栖大会上,阿里也强调了AI、云基础设施、Agent平台、模型应用与算力支撑的协同路线,Qwen3-Max是其中重要的底座角色,亦标志着通义体系或开始进新阶段。开源战略下,行业生态整合有望加速,AIAgent落地进一步推进。 持续关注国内AIInfra厂商业务进展与投入,看好Agent商业化及投资机遇,建议关注:1)AIInfra:AIInfra龙头有望核心受益;2)AIAgent相关厂商;3)中国推理算力产业链;4)CSP厂商方面关注推理需求推动;5)IDC,重点关注与头部大厂合作的IDC。 风险提示 1、AI技术发展不及预期; 2、下游应用需求不及预期。
|
|