研报下载就选股票报告网
您好,欢迎来到股票分析报告网!登录   忘记密码   注册
>> 长江证券-媒体行业AI系列跟踪(83):DeepSeek-V3.2正式发布,可灵AI视频O1模型全量上新-251203
上传日期:   2025/12/3 大小:   624KB
格式:   pdf  共5页 来源:   长江证券
评级:   看好 作者:   高超
下载权限:   此报告为加密报告
事件描述
  12月1日,DeepSeek-V3.2正式版和DeepSeek-V3.2-Speciale发布,目前官方网页端、App和API均已接入正式版DeepSeek-V3.2。同日,可灵AI视频O1模型正式上线。
  事件评论
  DeepSeek-V3.2大幅强化Agent能力,DeepSeek-V3.2-Speciale主打极致推理性能。DeepSeek-V3.2擅长平衡推理能力与输出长度,主要适用于日常问答场景和通用Agent任务场景,其核心亮点在于:1)推理能力比肩GPT-5,兼顾输出长度:在公开的推理类Benchmark测试中,DeepSeek-V3.2推理能力达到了GPT-5水平,仅略低于Gemini3.0-Pro;且DeepSeek-V3.2的输出长度明显小于Kimi-K2-Thinking,显著减少了计算成本以及用户等待时长;2)Agent能力大幅强化,首次将思考融入工具使用:DeepSeekV3.2沿用了Exp版本验证成功的DSA稀疏注意力机制,并提出了大规模Agent训练数据合成方法,即通过生成1800多个环境和85000多条复杂指令,来构造大量“难解答、易验证”的强化学习任务,使得模型在推理过程中能够有机融合工具调用,大幅提升泛化能力;DeepSeek-V3.2在智能体评测中超越了Kimi-K2-Thinking、MiniMax-M2等开源模型,大幅缩小了开源与闭源模型之间的差距。DeepSeek-V3.2-Speciale则主要追求极致推理性能,其在V3.2的基础上结合了DeepSeek-Math-V2的定理证明能力,具备出色的指令跟随、数学证明和逻辑验证能力,并在IMO 2025、CMO 2025等多项国际顶级竞赛中获得金牌。
  可灵上线全球首个统一多模态视频模型O1,其核心亮点在于统一底座、全能指令和强大一致性。1)打破功能割裂,构建统一生成式底座:可灵视频O1模型引入MVL(多模态视觉语言)交互架构,能在输入框内灵活调用、无缝融合多种任务,将参考生视频、文生视频、首尾帧生视频、视频内容增删、视频修改变换、风格重绘、镜头延展等任务纳入统一大模型中,使得用户能一站式完成创作。2)实现多模态指令输入:用户可通过照片、视频、文字等形式输入指令,模型可自动理解影像逻辑并依照指令完成修改,根据可灵内部评测,O1模型在指令变换任务上与Runway Aleph的效果胜负比为230%,位居行业领先水平。3)支持主体参考,显著提升一致性水平:O1模型强化了对文本语义和多模态信号的底层理解能力,支持用户多视角创建主体,保证在镜头流转时主体特征的稳定与一致性。4)价格方面:O1模型目前仅支持高品质模式,在有/无视频输入情况下,生成价格分别为每秒12/8灵感值(在单月黄金会员条件下约对应每秒生成价格1.2 / 0.8元)。
  建议关注以下AI细分赛道:1)优质IP或受益于AI技术演进带来的创作效率和变现价值提升,看好受益于多模态加速的AI漫剧赛道,关注工具型实力领先且AI能力持续迭代升级的快手等;2)大厂具备流量分发、模型、数据等优势,聚焦to CAIAgent打造商业闭环,关注腾讯控股等;3)海外已跑通商业模式,国内有望复制的广告、电商、教育等垂直赛道;4)AI+游戏陆续落地,关注AI布局积极的巨人网络、恺英网络等游戏厂商。
  风险提示
  1、AI技术发展及应用落地不及预期风险;
  2、内容监管风险。
  
 
Copyright © 2005 - 2021 Nxny.com All Rights Reserved 备案号:蜀ICP备15031742号-1