>> 国泰君安-计算机行业更新:GPT4发布在即,多模态成为趋势-230314
| 上传日期: |
2023/3/15 |
大小: |
752KB |
| 格式: |
pdf 共6页 |
来源: |
国泰君安 |
| 评级: |
增持 |
作者: |
李沐华,李雪薇 |
| 行业名称: |
计算机 |
| 下载权限: |
此报告为加密报告 |
|
|
本报告导读: GPT4发布在即,模型将不再强调参数规模的扩张,转而向多模态发展;随着多模态的引入,我们预计下游应用空间将显著打开。 摘要: GPT-4即将发布,多模态趋势凸显。2023年3月9日,微软德国CTOAndreas Braun宣布GPT-4将在3.13-3.19日发布,将提供完全不同的可能性——如图像、视频。结合微软3月初发布多模式大型语言模型Kosmos-1,可以推断大模型包括GPT4将向多模态发展,多模态将成为下一波浪潮的核心。 多模态是GPT系列发展的必然趋势,也是多元化应用落地的基础。当下,图像化应用已打开新型市场空间,3月8日微软开源了重量级的ChatGPTAI交互应用Visual ChatGPT,通过调用ChatGPT以及一系列视觉基础模型,实现了在聊天过程中发送和接收图像,以及动态对图像进行处理,在ChatGPT的基础上拥有了VQA(视觉问答)和AI作画的能力。Visual ChatGPT发布后短短一天,在Github就达到了4000星,文本生成图像功能已经如此引发市场追捧,GPT-4按照预期拓展到视频方向,文字生成视频、图像生成视频功能有望进一步奠定视觉方面应用落地,拓展市场格局。 图像端已有应用落地,视频等多模态的引入将打开下游行业应用空间。当前,不论是OpenAI的DALL-E2,还是AIGC领域的StableDiffusion都已在图像领域进行了初步探索,并引起不小的反向。预计多模态短期内将在搜索引擎和聊天机器人上实现落地,为用户使用感带来巨大提升。考虑到当今信息数据有相当部分是以图像和视频的形式呈现,具有图像、视频处理能力的GPT-4对用户的反馈将从更完整的来源获得信息并以多媒体的形式呈现,有效地提高用户体验。远期看,多模态将打开视觉方向,图片生成、视频创作能力,将协助GPT4在各类商业模式上实现进一步的拓宽,从而实现多媒体交互。 投资建议:ChatGPT的应用场景正大幅拓展且已找到可落地的商业模式,我们基于核心应用场景、配套基础设施两个视角,推荐科大讯飞、格灵深瞳;受益标的商汤、云从科技、海天瑞声、拓尔思、寒武纪等。 风险提示:ChatGPT技术商业化落地不及预期、ChatGPT的应用成本过高。
研究报告全文:股票研究TableindustryInfo计算机TableMainInfoTableTitle评级TableInvest增持20230314上次评级增持GPT4发布在即多模态成为趋势TablesubIndustry细分行业评级行业李沐华分析师李雪薇分析师更010-83939797021-38031656limuhuagtjascomlixueweigtjascom新证书编号S0880519080009S0880520120006本报告导读GPT4发布在即模型将不再强调参数规模的扩张转而向多模态发展随着多模态相关报告TableDocReport的引入我们预计下游应用空间将显著打开计算机客户自研影响有限信创依旧机遇摘要广阔20230314TableSummaryGPT-4即将发布多模态趋势凸显2023年3月9日微软德国CTO计算机政府工作报告再提数字经济主线AndreasBraun宣布GPT-4将在313-319日发布将提供完全不明确同的可能性如图像视频结合微软3月初发布多模式大型语言20230305模型Kosmos-1可以推断大模型包括GPT4将向多模态发展多模态计算机2月订单整体有所回落表现分化将成为下一波浪潮的核心20230304计算机隐私计算发展迅猛长期空间大多模态是系列发展的必然趋势也是多元化应用落地的基础GPT20230302当下图像化应用已打开新型市场空间3月8日微软开源了重量级计算机华为计算快速崛起广阔空间大有的ChatGPTAI交互应用VisualChatGPT通过调用ChatGPT以及一可为20230302证系列视觉基础模型实现了在聊天过程中发送和接收图像以及动态券对图像进行处理在ChatGPT的基础上拥有了VQA视觉问答和研AI作画的能力VisualChatGPT发布后短短一天在Github就达到究了4000星文本生成图像功能已经如此引发市场追捧GPT-4按照预期拓展到视频方向文字生成视频图像生成视频功能有望进一步报奠定视觉方面应用落地拓展市场格局告图像端已有应用落地视频等多模态的引入将打开下游行业应用空间当前不论是OpenAI的DALL-E2还是AIGC领域的StableDiffusion都已在图像领域进行了初步探索并引起不小的反向预计多模态短期内将在搜索引擎和聊天机器人上实现落地为用户使用感带来巨大提升考虑到当今信息数据有相当部分是以图像和视频的形式呈现具有图像视频处理能力的GPT-4对用户的反馈将从更完整的来源获得信息并以多媒体的形式呈现有效地提高用户体验远期看多模态将打开视觉方向图片生成视频创作能力将协助GPT-4在各类商业模式上实现进一步的拓宽从而实现多媒体交互投资建议ChatGPT的应用场景正大幅拓展且已找到可落地的商业模式我们基于核心应用场景配套基础设施两个视角推荐科大讯飞格灵深瞳受益标的商汤云从科技海天瑞声拓尔思寒武纪等风险提示ChatGPT技术商业化落地不及预期ChatGPT的应用成本过高请务必阅读正文之后的免责条款部分行业更新目录1GPT-4即将发布多模态趋势凸显32投资建议53风险提示5请务必阅读正文之后的免责条款部分2of6行业更新1GPT-4即将发布多模态趋势凸显GPT-4即将发布多模态趋势凸显3月9日微软德国CTOAndreasBraun宣布GPT-4将在313-319日发布将提供完全不同的可能性如图像视频结合微软3月初发布多模式大型语言模型Kosmos-1可以推断大模型包括GPT4将向多模态发展多模态将成为下一波浪潮的核心Kosmos-1VisualChatGPT已铺垫GPT-4多模态模型微软在多模态模型领域持续发力2月28日发表论文推出了全能型人工智能模型Kosmos-1和局限于纯文本内容LLM的ChatGPT相比Kosmos-1主干基于Transformer的因果语言模型属于多模态大型语言模型MLLM除了自然语言任务能同时理解文字与图像内容未来会整合更多的输入模式如音频视频图1多模态模型Kosmos-1具备理解图像的能力数据来源微软论文LanguageisnotallyouNeedAligningPerceptionwithLanguageModels模型规模上GPT-4不再强调参数规模扩张开始注重模型表现GPT-3采用的参数规模为1750亿个此前业内专家推测GPT-4将具有100万亿个参数网传热图将GPT-3的数据集比作一条线GPT-4拓展成一个圆OpenAI的CEOAltman在采访问答中对这张图进行了辟谣并表示GPT-4接受训练的数据量并不会出现几何级的增长OpenAI在数据规模上决定转型探索怎样让模型发挥更佳效能OpenAI的研究人员们现在意识模型规模扩张的边际回报递减比起在规模上扩张探索如何在学习率批次大小等方面精进成为了突破的重点所以GPT-4不再强调规模扩张在数据规模上不会比GPT-3大很多请务必阅读正文之后的免责条款部分3of6行业更新模型优化需要更多算力挖掘GPT-4的全部潜能Altman在问答中提到GPT-4占用的算力总量要超过GPT-3多模态模型在训练上需要使用图像视频等多媒体数据而此类文件体量大小远超文字举例来说OpenAI的根据文本生成图像的人工智能系统DALL-E2模型在训练时使用了65亿图像数据集模型规模有10到100亿参数量级的不同变体按照平均图片大小估算整体训练数据集大小高达约155TB远超ChatGPT训练的规模再加之视频素材的训练训练数据集体量更是远超现在的纯文本模型大数据规模需求凸显综上多模态大模型的训练对算力芯片数量需求远超纯文本语言类模型在算力市场会迎来新一轮需求激增多模态是GPT系列发展的必然趋势也是多元化应用落地的基础当下图像化应用已打开新型市场空间3月8日微软开源了重量级的ChatGPTAI交互应用VisualChatGPT通过调用ChatGPT以及一系列视觉基础模型实现了在聊天过程中发送和接收图像以及动态对图像进行处理在ChatGPT的基础上拥有了VQA视觉问答和AI作画的能力VisualChatGPT发布后短短一天在Github就达到了4000星文本生成图像功能已经如此引发市场追捧GPT-4按照预期拓展到视频方向文字生成视频图像生成视频功能有望进一步奠定视觉方面应用落地拓展市场格局图2VisualChatGPT集成语言问答看图问答AI绘画能力数据来源微软论文VisualChatGPTTalkingDrawingandEditingwithVisualFoundationModels图像端已有应用落地视频等多模态的引入将打开下游行业应用空间当前不论是OpenAI的DALL-E2还是AIGC领域的StableDiffusion都已在图像领域进行了初步探索并引起不小的反向预计多模态短期内将在搜索引擎和聊天机器人上实现落地为用户使用感带来巨大提升考虑到当今信息数据有相当部分是以图像和视频的形式呈现具有图像视频处理能力的GPT-4对用户的反馈将从更完整的来源获得信息并以多媒体的形式呈现有效地提高用户体验远期看多模态将打开视觉方请务必阅读正文之后的免责条款部分4of6行业更新向图片生成视频创作能力将协助GPT-4在各类商业模式上实现进一步的拓宽从而实现多媒体交互图3DALL-E2可生成类似风格图片数据来源简书2投资建议ChatGPT的应用场景正大幅拓展且已找到可落地的商业模式我们基于核心应用场景配套基础设施两个视角推荐科大讯飞格灵深瞳受益标的商汤云从科技海天瑞声拓尔思寒武纪等表1重点公司估值情况总市值营业收入亿元PS倍股票代码证券名称亿元评级202303142021A2022E2023E2021A2022E2023E002230科大讯飞111857183142005427568611558406增持688207格灵深瞳-U66332947210022256921662增持数据来源wind国泰君安证券研究3风险提示ChatGPT技术商业化落地不及预期虽然目前微软已针对ChatGPT推出订阅化服务但ChatGPT的商业化仍处于初期后续ChatGPT的拓展仍有不及预期的可能ChatGPT的应用成本过高目前ChatGPT整体成本仍处于较高水平若后续成本难以下降行业发展将比较受限请务必阅读正文之后的免责条款部分5of6行业更新本公司具有中国证监会核准的证券投资咨询业务资格分析师声明作者具有中国证券业协会授予的证券投资咨询执业资格或相当的专业胜任能力保证报告所采用的数据均来自合规渠道分析逻辑基于作者的职业理解本报告清晰准确地反映了作者的研究观点力求独立客观和公正结论不受任何第三方的授意或影响特此声明免责声明本报告仅供国泰君安证券股份有限公司以下简称本公司的客户使用本公司不会因接收人收到本报告而视其为本公司的当然客户本报告仅在相关法律许可的情况下发放并仅为提供信息而发放概不构成任何广告本报告的信息来源于已公开的资料本公司对该等信息的准确性完整性或可靠性不作任何保证本报告所载的资料意见及推测仅反映本公司于发布本报告当日的判断本报告所指的证券或投资标的的价格价值及投资收入可升可跌过往表现不应作为日后的表现依据在不同时期本公司可发出与本报告所载资料意见及推测不一致的报告本公司不保证本报告所含信息保持在最新状态同时本公司对本报告所含信息可在不发出通知的情形下做出修改投资者应当自行关注相应的更新或修改本报告中所指的投资及服务可能不适合个别客户不构成客户私人咨询建议在任何情况下本报告中的信息或所表述的意见均不构成对任何人的投资建议在任何情况下本公司本公司员工或者关联机构不承诺投资者一定获利不与投资者分享投资收益也不对任何人因使用本报告中的任何内容所引致的任何损失负任何责任投资者务必注意其据此做出的任何投资决策与本公司本公司员工或者关联机构无关本公司利用信息隔离墙控制内部一个或多个领域部门或关联机构之间的信息流动因此投资者应注意在法律许可的情况下本公司及其所属关联机构可能会持有报告中提到的公司所发行的证券或期权并进行证券或期权交易也可能为这些公司提供或者争取提供投资银行财务顾问或者金融产品等相关服务在法律许可的情况下本公司的员工可能担任本报告所提到的公司的董事市场有风险投资需谨慎投资者不应将本报告作为作出投资决策的唯一参考因素亦不应认为本报告可以取代自己的判断在决定投资前如有需要投资者务必向专业人士咨询并谨慎决策本报告版权仅为本公司所有未经书面许可任何机构和个人不得以任何形式翻版复制发表或引用如征得本公司同意进行引用刊发的需在允许的范围内使用并注明出处为国泰君安证券研究且不得对本报告进行任何有悖原意的引用删节和修改若本公司以外的其他机构以下简称该机构发送本报告则由该机构独自为此发送行为负责通过此途径获得本报告的投资者应自行联系该机构以要求获悉更详细信息或进而交易本报告中提及的证券本报告不构成本公司向该机构之客户提供的投资建议本公司本公司员工或者关联机构亦不为该机构之客户因使用本报告或报告所载内容引起的任何损失承担任何责任评级说明评级说明1投资建议的比较标准增持相对沪深300指数涨幅15以上投资评级分为股票评级和行业评级以报告发布后的12个月内的市场表现为谨慎增持相对沪深300指数涨幅介于515之间比较标准报告发布日后的12个月内的股票投资评级公司股价或行业指数的涨跌幅相对同中性相对沪深300指数涨幅介于-55期的沪深300指数涨跌幅为基准减持相对沪深300指数下跌5以上2投资建议的评级标准增持明显强于沪深300指数报告发布日后的12个月内的公司股价或行业指数的涨跌幅相对同期的沪深行业投资评级中性基本与沪深300指数持平300指数的涨跌幅减持明显弱于沪深300指数国泰君安证券研究所上海深圳北京地址上海市静安区新闸路669号博华广深圳市福田区益田路6003号荣超商北京市西城区金融大街甲9号金融场20层务中心B栋27层街中心南楼18层邮编200041518026100032电话0213867666607552397688801083939888E-mailgtjaresearchgtjascom请务必阅读正文之后的免责条款部分6of6
|
|