>> 长江证券-软件与服务行业AI产业跟踪:DeepSeek-V3.2正式版发布,关注大模型商业化落地进展-251203
| 上传日期: |
2025/12/3 |
大小: |
618KB |
| 格式: |
pdf 共5页 |
来源: |
长江证券 |
| 评级: |
看好 |
作者: |
宗建树 |
| 下载权限: |
此报告为加密报告 |
|
|
事件描述 12月1日,DeepSeek-V3.2和DeepSeek-V3.2-Speciale正式发布。官方网页端、App和API均已更新为V3.2版本。Speciale版本目前仅以临时API服务形式开放,以供社区评测与研究。 事件评论 定位“为Agent构建的推理优先模型”,V3.2包含两个版本:(1)V3.2:是V3.2-Exp的官方继任者,平衡推理能力与生成长度,作为日常主力模型(Daily Driver),提供GPT5级别的性能;(2)V3.2-Speciale:专攻深度推理能力的极限版本,该版本专为解决复杂任务设计,消耗更多Token。 数学编程能力表现突出,Agent评测中达到了当前开源模型的最高水平,大幅缩小了开源模型与闭源模型的差距。技术报告显示,DeepSeek-V3.2-Speciale在2025年国际数学奥林匹克(IMO)、国际信息学奥林匹克(IOI)、ICPC世界总决赛及CMO中均取得了金牌级成绩,在数学编程等多项推理基准上,全面超越GPT-5 High,略次于Gemini 3.0Pro。 V3.2实现了高计算效率与卓越推理、Agent性能的统一,是首个将思考直接整合到工具使用中的模型,同时支持在思考和非思考模式下使用工具。背后的核心能力与技术突破来自:(1)DeepSeek Sparse Attention (DSA):模型结构与Exp版本相同,引入高效注意力机制,大幅降低计算复杂度,并针对长上下文场景进行了优化,引入“思维上下文管理”;(2)可扩展强化学习框架:通过稳健的RL协议与后训练(post-training)算力扩展,实现了高性能表现;(3)大规模Agent任务合成管线:涵盖1800+环境及8.5万+复杂指令,这一合成管线不仅提升了模型在复杂交互环境中的遵循度和泛化能力,更让DeepSeek-V3.2将“思考”直接整合进工具使用(Tool-Use)的模型,同时支持在思考和非思考模式下使用工具。因此,我们认为相比于Exp版(实验版)最大的进化逻辑在于,核心引擎不变,但Agent能力质变。 DSA技术成功落地,实现了速度、成本、智能的均衡。我们认为,DeepSeek从V3.2-Exp到V3.2正式版的迭代,本质上展示了一条区别于行业主流“大模型堆算力扩规模”的第二路径:在算力资源受限的前提下,通过更高效的模型架构、更精细的训练策略以及更开放的开发生态,实现推理能力的跃迁。对产业而言,这一模式的可复制性与成本结构的优化,使其具备“以更低边际成本逼近强智能能力”的潜力,有望在未来的AI原生应用、智能体生态和推理侧市场中形成结构性竞争优势。 2025年DeepSeek已发布7款模型,开源阵营持续扩大。后续展望来看,关注AI产品发布超预期情况与AIAgent落地进展。继续看好国产AI链、国产算力链以及国内AI出海,持续重点推荐铲子股和卡位优势显著的巨头本身。 风险提示 1、AI技术发展不及预期; 2、下游应用需求不及预期。
|
|