研报下载就选股票报告网
您好,欢迎来到股票分析报告网!登录   忘记密码   注册
>> 湘财证券-电子行业点评报告:OpenAI发布Sora,多模态大模型有望加速发展-240227
上传日期:   2024/2/27 大小:   661KB
格式:   pdf  共3页 来源:   湘财证券
评级:   增持 作者:   李杰
下载权限:   此报告为加密报告
OpenAI发布文生视频大模型Sora,表现远超竞品
  近期,OpenAI发布了文生视频大模型Sora,跟此前的文生视频大模型产品相比,Sora可以产出时长达到一分钟的多镜头视频,而其他产品只能生成20s以内的单镜头视频,在拟真度、一致性、稳定性方面,Sora的表现也远远超过其它产品。
  采用Transformer+扩散模型,Sora具备多项优势
  在Sora之前出现的文生视频产品,主要采用扩散模型架构,Pika和Runway均采用了扩散模型架构,Sora则采用了融合架构:Transformer架构的Diffusion扩散模型,用Transformer替代了扩散模型的U-Net结构,与单纯地用扩散模型相比,融合架构的拥有了Transformer的可扩展性。同时,Sora参考了文生文模型中的token原理,在文生文模型中,文本被统一转化为token的数字表示形式,用以训练模型。OpenAI则提出了一种用patch统一表征图像与视频单元的方法,patch可以理解为Sora的基本单元,一个视频可以理解为不同patch按照一定序列组织起来的。GPT-4被训练以处理一串token,并预测出下一个token,Sora遵循相同的逻辑,可以处理一系列的patch,并预测出序列中的下一个patch。从效果来看,Sora具备多项优势:1、能够精确地理解用户提示语;2、接受图或者视频输入;3、场景和物体的一致性和连续性;4、能够为各种设备生成与其原始纵横比完美匹配的内容;5、视频扩展功能;6、准确性和多样性。
  Sora应用潜力巨大,多模态大模型有望加速发展
  Sora有望最先应用于短视频、广告、影视、社交网络等领域。在这些领域利用多模态大模型能力,辅助人类生成视频,既可以提高生产速度又可以提高生产数量,还可以创造全新的视觉感受,能够帮助企业真正实现降本增效、提升用户体验。相比于大语言模型,多模态大模型应用场景更加丰富,能力更加强大,Sora的成功将刺激其他科技巨头加快在文生视频及多模态大模型领域的技术攻关力度和产品发布速度,多模态大模型将成为生成式AI的重点发展方向,进而推动AI行业实现新一轮增长。多模态大模型对AI算力的消耗更高,AI算力需求将继续增长。
  投资建议
  2023年下半年以来,智能手机与PC出货量跌幅收窄,PC库存已到合理水平,智能手机库存即将触底,2024年智能手机与PC有望实现正增长。Sora在文生视频领域实现了突破,刺激其他科技巨头加快在文生视频及多模态大模型领域的技术攻关力度以及产品发布速度,推动AI算力需求继续增长。给予电子行业“增持”评级,看好AI算力相关标的。
  风险提示
  文生视频模型技术迭代不及预期;AI应用不及预期。
  
 
Copyright © 2005 - 2021 Nxny.com All Rights Reserved 备案号:蜀ICP备15031742号-1