>> 财通证券-计算机行业专题报告:视频大模型最新进展如何?-240616
| 上传日期: |
2024/6/17 |
大小: |
2245KB |
| 格式: |
pdf 共15页 |
来源: |
财通证券 |
| 评级: |
看好 |
作者: |
杨烨 |
| 行业名称: |
计算机 |
| 下载权限: |
此报告为加密报告 |
|
|
核心观点 Sora团队的负责人在2024智源大会开幕式分享多模态大模型领域近年来的发展历程以及未来的前进方向。DALL.E:通过压缩数据可以实现学习,但仅仅压缩并不能通向AGI;CLIP:从在视觉世界学习过程中介入自然语言指导,与单纯压缩数据相比计算效率将显著提升;DALL·E 3:增强训练文本的描述性,训练文生图模型的效率也会更高,即使在推理时无法使用具有描述性的文本,也可以使用具有较强描述性的文本作为训练的框架得到更好的无条件模型;视觉上下文学习可能是实现通往所有类型应用的一条可行路径。 视频大模型应用商业化持续推进。Adobe Firefly新增生成式扩展功能,生成音频和视频功能即将推出,Adobe Express发布音频生成动画功能,为C端提供便捷的口播视频制作工具;美图构建AI短片工作流,提升AI生成可控性,加速文生视频商业化落地;Filmora上线13.5版本,AI功能持续更新,携手英伟达开启全新视频视觉体验。6月12日,公司更新了视频创意软件新版本,并上线多个新功能;Luma AI发布Dream Machine,实现较高质量的文生视频、图生视频;快手发布可灵大模型,技术路线类似Sora;Pika再融资5.8亿人民币,已构建起AI视频生成基础模型;Runway更新Gen-2多重运动笔刷功能,提升视频可控性,获得D轮融资,与谷歌合作进一步加深。 投资建议:见正文。 风险提示:视频大模型技术迭代不及预期;商业化落地不及预期;竞争加剧风险;全球宏观经济风险
|
|