研报下载就选股票报告网
您好,欢迎来到股票分析报告网!登录   忘记密码   注册
>> 西部证券-计算机行业点评:腾讯混元开源原生多模态生图模型,3D生成亦再突破-250929
上传日期:   2025/9/29 大小:   367KB
格式:   pdf  共2页 来源:   西部证券
评级:   -- 作者:   郑宏达,周成
行业名称:   计算机
下载权限:   此报告为加密报告
核心结论
  腾讯混元开源首个工业级原生多模态生图模型,具备强语义理解与知识推理能力。9月28日,腾讯混元正式发布并开源了原生多模态生图模型,即混元图像3.0(HunyuanImage 3.0),参数规模80B。这是首个开源的工业级原生多模态生图模型。在技术架构上,它通过一个模型完成文字、图片、视频与音频等多个模态的输入与输出,而非通过多个模型的组合实现图文理解、图片生成等任务。混元图像3.0以Hunyuan-A13B为基础,基于50亿量级的图文对,视频帧,图文交织数据和6T的语料数据进行了多模态生成、理解和LLM的混合训练,使得模型能够充分融合多任务效果,实现超强的语义理解能力,能够响应复杂的长文本,生成长文本文字,同时具有LLM的世界知识,能够利用世界知识进行推理。这意味着,混元图像3.0不仅拥有生图模型的画画能力,还具备语言模型的思考能力和常识。它就像一个自带“大脑”的画家,可以利用智能去思考图像的布局、构图、笔触,利用世界知识去推理常识性的画面。
  腾讯混元3D再升级。9月26日,腾讯宣布混元3D生成模型家族添加新成员——混元3D-Omni、混元3D-Part发布并开源。这也是腾讯混元在可控3D生成上的新突破,让AI 3D建模更具实用性,加速3D生成模型在游戏、打印和AR/VR等实际生产流程中的落地应用。混元3D-Omni突破传统图像输入的局限性,支持多种模态输入,实现对物体几何结构、拓扑和姿态的精细控制。混元3D-Part则实现了灵活可控的部件拆分和生成,让分解和生成3D模型像玩乐高一样简单。传统3D生成算法通常产生一体化模型,而下游应用需要语义可分解的3D形状。混元3D-Part的创新在于提出了完整的组件化生成新范式。整体框架由P3-SAM(高质量原生3D分割模型)及X-Part(工业级组件生成模型)两大模块构成。与传统方法相比,新方案解决了现有组件式3D生成方法通常缺乏足够可控性、生成部件几何质量不理想、语义连贯性有限的问题,为行业提供了真正可投入生产的高质量解决方案。
  我们认为,腾讯混元图像3.0等多模态模型的推出与免费开放,为产业端带来了高质量图像生成、3D内容生成及API调用能力,将显著提升AI应用开发和落地密度,直接推动腾讯云算力需求的快速增长。未来,腾讯或将继续维持AI基础设施投入,以支撑千行百业和自身全场景AI产品的高速发展。相关标的:IDC(关注科华数据)、服务器(推荐华勤技术)、算力芯片(推荐海光信息)。
  风险提示:产业政策转变、技术进展不及预期、AI商业应用落地不及预期、行业竞争加剧、国际环境变化、关税政策变化。
 
Copyright © 2005 - 2021 Nxny.com All Rights Reserved 备案号:蜀ICP备15031742号-1