研报下载就选股票报告网
您好,欢迎来到股票分析报告网!登录   忘记密码   注册
>> 长江证券-软件与服务行业AI产业跟踪:通义发布Qwen3-Max-Thinking早期预览版,关注后续模型演进与商业化进展-251106
上传日期:   2025/11/7 大小:   611KB
格式:   pdf  共5页 来源:   长江证券
评级:   看好 作者:   宗建树
下载权限:   此报告为加密报告
事件描述
  11月3日,阿里发布了Qwen 3系列中旗舰推理模型Qwen3-Max-Thinking的早期预览版,推理模型仍在训练中。该模型为一个训练的中间检查点,当前并未在Hugging Face、魔搭等平台开源,用户可在Qwen Chat和阿里云API中试用,仅支持文本到文本,输出“限时免费”。
  事件评论
  性能实现新突破,在AIME 25和HMMT25测试中达到100%准确率。Qwen3-MaxThinking是Qwen3-Max的推理增强版本,(1)通过集成代码解释器和运用并行测试计算技术,展现出较强的推理能力。(2)实现思考模式与非思考模式的有效融合,思考模式下,在智能体编程、常识推理,以及数学、科学和通用领域的推理能力等方面均有显著提升。(3)实测成绩来看,在当前的Checkpoint,已经能在AIME 25和HMMT25(哈佛MIT数学竞赛)中达到100%的准确率。此前AIME 25的最好成绩由GPT-5系列守擂,GPT-5 Codex(high)的准确率98.7%,GPT-5(high)为94.3%,GPT-OSS-120B为93.4%,而此前Qwen3235B的成绩为91.0%。我们认为本次模型在数学测试的突破,标志着大模型在复杂逻辑推理能力上的质变,模型已经能够深度理解并运用复杂的数学概念和逻辑链条,商业化速度有望加速。
  对token消耗较高,但一定程度可控,关注后续团队在降本方面的技术路线与突破。根据三方媒体体验实测,Qwen3-Max-Thinking早期预览版对token消耗较高,若非输出限免,使用成本或许会较为高昂。以同一智能体编程任务为例,开启深度推理的DeepSeekV3.2-Exp生成的网页相对美观精致,代码源文件中包含787行代码。Qwen3-MaxThinking早期预览版能准确分析用户需求,输出的网页符合基本使用需求,但同时消耗token数量明显偏多,反映到代码数量上为1417行代码。该问题可用自带的思考预算控件解决,用户可在1024-81920个token的思考预算区间内随意切换,直接控制模型的推理长度。
  此前,阿里Qwen3家族已发布十余款模型,形成万亿参数旗舰+开源多模态+垂直工具的完整矩阵。包含旗舰级大模型Qwen3-Max,拥有超万亿参数、百万级上下文,分指令版和推理版;新一代高效架构Qwen3-Next,跟进高稀疏MoE及混合注意力机制新技术范式。此外,还有开源视觉语言模型Qwen3-VL、全模态模型Qwen3-Omni;编程模型Qwen3-Coder、翻译模型Qwen3-LiveTranslate、图像编辑模型Qwen3-Image-Edit(Qwen版Banana)、视频生成模型Wan-2.5、语音识别/合成模型通义百聆等。
  关注Qwen3-Max推理模型的后续发布与开源,中期看好Agent商业化进展。当前时点大模型商业化变现有望加速,考虑到当前成本仍为制约token消耗量的核心因素,需要进一步关注未来模型厂商如何降本以及其将本效果。中期来看继续看好国产AI产业链,重点推荐铲子股和卡位优势显著的巨头本身。
  风险提示
  1、AI技术发展不及预期;
  2、下游应用需求不及预期
  
 
Copyright © 2005 - 2021 Nxny.com All Rights Reserved 备案号:蜀ICP备15031742号-1