研报下载就选股票报告网
您好,欢迎来到股票分析报告网!登录   忘记密码   注册
>> 华西证券-计算机AIGC行业深度报告(4)-ChatGPT:百度文心一言畅想-230302
上传日期:   2023/3/3 大小:   3663KB
格式:   pdf  共41页 来源:   华西证券
评级:   增持 作者:   刘泽晶
行业名称:   计算机
下载权限:   无限制-登录即可下载
国产“ChatGPT”扬帆启航。OpenAI的商业模式为API接口收费。我们认为此种商业模式具有“卡脖子”的风险,因此我国需要发展自主可控的“ChatGPT”。国产生态正在逐步繁荣,百度打响国产ChatGPT领域“第一枪”,其在算法、算力、数据、生态、平台五方面皆有储备;ChatGPT的竞争本质即大模型储备竞赛,大模型是人工智能发展的必然趋势,也是辅助式人工智能向通用性人工智能转变的坚实底座。大模型分为NLP(自然语言处理)、CV(计算机视觉)、多模态和科学计算四类。此外,中美科技巨头已经开启大模型储备“军备赛”。
  百度文心一言,开启国产ChatGPT新征程。百度是少有大模型语言训练能力的公司,模型储备方面,百度实现了全生态布局。1、NLP(自然语言处理),已经具备智能创作、摘要生成、问答、语义检索、情感分析、信息抽取等能力,且可以让机器人像人一样具有逻辑且自由对话;2、CV(计算机视觉),可用于应用于图像分类、目标检测、语义分割等场景,此外还可以应用于文档、卡证、票据等图像文字识别和结构化理解;3、跨境大模型,可实现AI作画、场景融合视觉常识推理、跨模态图像检索、跨模态文本检索等多场景;4、生物计算,应用场景为蛋白结构预测和小分子药物研发等领域。
  百度为国产ChatGPT“领军企业”,具有算力积累和生态优势。平台方面:拥有自主生态的百度百舸· AI异构计算平台,具备高效率、多密度、高易用性、多场景部署、乐高式拼接等能力。算力方面:百度自身具有建设智能算力中心的实力,技术领先且自主可控,已有典型落地案例;服务器方面拥有自研的昆仑芯云服务器;芯片方面,昆仑芯AI芯片是百度自主研发的芯片,2代芯片已量产,具备算力支撑强、高速互联等多重优势。生态:百度大模型赋能千行百业,已有落地应用,合作厂商分别覆盖科技、金融、航天、影视、汽车、电子制造等诸多产业。此外,我们推测ChatGPT有望成为搜索引擎的流量入口,百度搜索引擎有望借助文心一言大模型的能力重回巅峰。此外,目前国产科技巨头已经开启大模型的“军备竞赛”,因此,我们判断,未来AI+有望赋能千行百业,具有AI+能力的厂商有望呈现“百花齐放”的态势。
  投资建议:关注三条投资主线1)具备算力基础的厂商,重点推荐中科曙光,其他受益标的为寒武纪、商汤、海光信息、浪潮信息、景嘉微、拓维信息、神州数码、龙芯中科;2)具备AI算法商业落地的厂商,重点推荐科大讯飞、拓尔思,其他受益标的为海天瑞声;3) AIGC相关技术储备的应用厂商,受益标的为:百度、同花顺、三六零、金山办公。
  风险提示:核心技术水平升级不及预期的风险、AI伦理风险、政策推进不及预期的风险、中美贸易摩擦升级的风险。
研究报告全文:仅供机构投资者使用证券研究报告行业深度研究报告ChatGPT百度文心一言畅想AIGC行业深度报告4华西计算机团队2023年3月2日分析师刘泽晶SACNOS1120520020002邮箱liuzj1hx168comcn请仔细阅读在本报告尾部的重要法律声明核心逻辑国产ChatGPT扬帆启航OpenAI的商业模式为API接口收费我们认为此种商业模式具有卡脖子的风险因此我国需要发展自主可控的ChatGPT国产生态正在逐步繁荣百度打响国产ChatGPT领域第一枪其在算法算力数据生态平台五方面皆有储备ChatGPT的竞争本质即大模型储备竞赛大模型是人工智能发展的必然趋势也是辅助式人工智能向通用性人工智能转变的坚实底座大模型分为NLP自然语言处理CV计算机视觉多模态和科学计算四类此外中美科技巨头已经开启大模型储备军备赛百度文心一言开启国产ChatGPT新征程百度是少有大模型语言训练能力的公司模型储备方面百度实现了全生态布局1NLP自然语言处理已经具备智能创作摘要生成问答语义检索情感分析信息抽取等能力且可以让机器人像人一样具有逻辑且自由对话2CV计算机视觉可用于应用于图像分类目标检测语义分割等场景此外还可以应用于文档卡证票据等图像文字识别和结构化理解3跨境大模型可实现AI作画场景融合视觉常识推理跨模态图像检索跨模态文本检索等多场景4生物计算应用场景为蛋白结构预测和小分子药物研发等领域百度为国产ChatGPT领军企业具有算力积累和生态优势平台方面拥有自主生态的百度百舸AI异构计算平台具备高效率多密度高易用性多场景部署乐高式拼接等能力算力方面百度自身具有建设智能算力中心的实力技术领先且自主可控已有典型落地案例服务器方面拥有自研的昆仑芯云服务器芯片方面昆仑芯AI芯片是百度自主研发的芯片2代芯片已量产具备算力支撑强高速互联等多重优势生态百度大模型赋能千行百业已有落地应用合作厂商分别覆盖科技金融航天影视汽车电子制造等诸多产业此外我们推测ChatGPT有望成为搜索引擎的流量入口百度搜索引擎有望借助文心一言大模型的能力重回巅峰此外目前国产科技巨头已经开启大模型的军备竞赛因此我们判断未来AI有望赋能千行百业具有AI能力的厂商有望呈现百花齐放的态势投资建议关注三条投资主线1具备算力基础的厂商重点推荐中科曙光其他受益标的为寒武纪商汤海光信息浪潮信息景嘉微拓维信息神州数码龙芯中科2具备AI算法商业落地的厂商重点推荐科大讯飞拓尔思其他受益标的为海天瑞声3AIGC相关技术储备的应用厂商受益标的为百度同花顺三六零金山办公风险提示核心技术水平升级不及预期的风险AI伦理风险政策推进不及预期的风险中美贸易摩擦升级的风险2目录01国产ChatGPT扬帆启航02百度文心一言开启国产ChatGPT新征程03投资建议梳理AIGC相关受益厂商04风险提示301国产ChatGPT扬帆启航411ChatGPT为API接口收费我国需自主可控ChatGPTAI的旷世之作持续引爆市场是OpenAI于2022年11月推出的聊天机器人由于其功能强大例如实现文章创作代码创作回答问题等功能我们认为其具有跨时代的意义例如实现勒模糊搜索到精准推送的跨越因此持续引爆市场ChatGPT为AI接口收费我国需自主可控OpenAIChatGPT母公司的商业模式为API接口收费客户可以通过接入OpenAI的API接口获取获取相关图像语言代码调整服务我们认为此种商业模式具有卡脖子的风险一旦海外禁止API接口权限会对我国AIGC生态造成严重影响因此我国需要发展自主可控的ChatGPT国产生态正在逐步繁荣百度打响ChatGPT领域第一枪百度是少有预训练模型大模型语言训练能力的公司其在算法算力数据生态平台五方面皆有储备根据百度官方公众号百度计划于2023年3月16日在北京总部召开新闻发布会围绕国产版ChatGPT文心一言我们认为此举正式意味着我国自主可控的ChatGPT即将问世ChatGPT在回答费马小定理百度官方预告资料来源OpenAI官网百度官方公众号华西证券研究所512ChatGPT的竞争本质即大模型储备竞赛大模型的是人工智能发展的必然趋势大模型即大算力强算法结合的产物大模型通常是在大规模无标注数据上进行训练学习出一种特征和规则基于大模型进行应用开发时将大模型进行微调如在下游特定任务上的小规模有标注数据进行二次训练或者不进行微调就可以完成多个应用场景的任务大模型是辅助式人工智能向通用性人工智能转变的坚实底座大模型增强了人工智能的泛化性通用性生产水平得到质的飞跃过去分散化模型研发下单一AI应用场景需要多个模型支撑每个模型需要算法开发数据处理模型训练参数调优等过程大模型实现了标准化AI研发范式即简单方式规模化生产具有预训练精调等功能显著降低AI开发门槛即低成本和高效率数据平台算力是打造大模型生态的必备基础数据是训练大模型参数的必备我们认为可以理解成燃料算力是训练大模型的底层动力源泉一个优秀的算力底座在大模型AI算法的训练和推理具备效率优势平台是大模型和算力之间的桥梁可针对不同的模型和硬件实现资源的合理分配达到软硬件的最优组合从而大幅提升训练模型的效率数据平台算力算法关系示意图资料来源IDC华西证券研究所613大模型带来的AI技术与应用变革潜能被广泛验证大模型带来的AI技术与应用变革潜能被广泛验证可以分为四类分别是NLP自然语言处理CV计算机视觉多模态和科学计算NLP近年来随着预训练技术大模型算力提升以及NLP海量数据和任务特性大模型预训练在该领域取得显著突破2018年随着BERT谷歌的诞生是利用海量无标注文本的监督学习已经刷新多个AI权威技术榜单3亿参数的BERT模型在权威GLUE的11任务刷新纪录基准值推至804绝对值提升76个点CV目前主要以卷积神经网络CNN和Transformer为支撑的计算机大模型快速发展比如2021年的150亿参数的V-MoE推出在ImageNET准率高达9035此外国内厂商也逐渐发力盘古CV大模型可提供OCR文字识别并在多个场景落地多模态大模型技术推动多模态模型不断迭代升级比如阿里大模型M6模型参数10万亿级别持续拓宽大模型应用广度覆盖电商智能交互等场景此外OpenAI的CLIP文本图像匹配以及DALLE2文生图持续落地科学计算AI科学计算持续引发大变革比如生物制药气象预报地震探查材料等领域例如Deep-Mind推出的AlphaFold2能够覆盖985的人类蛋白质组并对20种其他生物蛋白结构进行预测NLP和CV的发展现状与挑战对比科学计算中药物发现和合成化合物示意图NLPCV分别在语言理解与生成智能创2D数据工业质检智慧城市落地完善作机器翻译智能对话知识应用场景多可商业化市场大拥有现状图谱和定制化语言解决方案落地最佳实践人脸OCR识别发展较为应用整体算法发展顺利数据成熟源可获得性较强3D4D数据识别面临变形光照遮语言的歧义文化差异及多样化挡等可以依靠大规模预训练模型解决挑战情感分析困难部分痛点的问题数字人数字孪生的数据获取困难算法处理复杂预期未来以多个数据信息维度约束来验证打通数据融合以突破3D4D获取瓶颈发展情感分析及文本分析的准确性资料来源IDCCSDN华西证券研究所714中美科技巨头厂商开启大模型储备军备赛国内外科技公司部分模型储备及应用场景美国科技巨头公司开启AI大模型军备赛厂商AI大模型参数领域应用场景谷歌谷歌推出聊天机器人Bard底层代码为LaMDA我们认BERT4810亿NLP语言理解与生成LaMDANLP对话系统为LaMDA与ChatGPT算法具备一战之力此外BERT算法具备库语言理解与生成推理谷歌PaLM5400亿NLP时代的意义代码生成Imagen110亿多模态语言理解与图像生成微软目前根据智东西报道微软推移动版Bing语音接入Parti200亿多模态语言理解与图像生成AINLPCVFlorence64亿CV视觉识别群聊等功能此外微软本身也有在相关大模型的微软技术储备Turing-NLG170亿NLP语言理解生成OPT-175B1750亿NLP语言模型Facebook其他例如FaceBook亚马逊DeepMind英伟达等厂商已经M2M-100150亿NLP100种语言互译加入大模型的军备赛并分别在NLPCV或多模态方面已Gato12亿多模态多面手的智能体DeepMindGopher2800亿NLP语言理解与生成有相应的技术储备应用在语言生成推理代码生成跨模AlphaCode414亿NLP代码生成态搜索等领域中CLIPDALL-E120亿NLP图像生成跨模态检索OpenAICodex120亿多模态代码生成我国需有自主可控AI大模型生态正逐渐繁荣ChatGPT-NLP语言理解与生成推理等百度是少有预训练模型大模型语言训练能力的公司已经NLP大模型NLP语言理解生成CV大模型CV图像试别经历多次迭代目前已覆盖众多方向目前已有近百万开发者跨模态计算大模百度千亿级别多模态语言理解与图像生成使用文心大模型生态正在逐步繁荣合作厂商覆盖科技教型化合物表征学习分子结育工业媒体金融等诸多产业生物计算大模型CV构预测阿里根据钛媒体数据M6模型是中文多模态模型参数规模阿里巴巴M6万亿级别多模态语言理解与图像生成40高达万亿已在超个场景中应用可以实现剧本创作等功能腾讯混元大模型-NLP语言理解与生成语言理解与生成推理其他例如腾讯京东科大讯飞字节跳动网易等纷纷加京东K-PLUG-NLPAI代码生成入军备赛分别拥有独特技术架构应用在智慧音效三六零--NLP智能搜索视频创作AI语音AI作文AI搜索等应用场景中字节跳动DA-NLP语言理解语言理解与生成语言互科大讯飞中文预训练模型-NLP译资料来源公开资料整理腾讯AIGC发展趋势报告2023华西证券研究所802百度文心一言开启国产ChatGPT新征程921百度文心一言开启国产ChatGPT新征程百度是少有大模型语言训练能力的公司其文心大模型和OpenAI的GPT模型类似在2019年就已经推出并且已经迭代了多代从单一的自然语言理解延伸到多模态包括视觉文档文图语音等多模态多功能因此文心一言所基于的ERNIE系列模型也已经具备较强泛化能力和性能我们认为百度作为国产ChatGPT领军企业符合数据平台算力大模型生态多重要素需求算力方面百度拥有自主生态的算力底座比如百度智算中心AI芯片方面坐拥昆仑芯加速器实现了核心自主可控且性能优异平台方面百度具备百度百舸AI异构计算平台具有高性能高弹性等优势大模型储备方面百度实现了全生态的布局其中包括NLPCV大模型生物计算等领域且在不同场景中已有较多应用数据方面根据IDC数据其拥有5500亿条知识且已经应用于百度搜索信息流智能驾驶百度地图小度等产品百度文心全景图百度文心全景图资料来源百度文心一言官网华西证券研究所10221百度文心一言大模型储备齐全NLP自然语言处理百度文心一言NLP方向算法储备齐全其中著名的ERNIE系列是基于知识增强的千亿模型用于智能创作摘要生成问答语义检索情感分析信息抽取文本匹配文本纠错等各类自然语言理解和生成任务并且模型已经可应用于医疗金融图语言编程跨模态信息抽取等各个方面此外PLATO模型是全球首个超百亿参数规模的中英文对话训练模型可以让机器人像人一样具有逻辑且自由对话百度文心一言NLP功能强大例如ERNIE系列ERNIE30基于知识增强的多范式统一预训练框架深入融合的千亿级知识具备强大的语言理解能力与小说摘要文案创意歌词诗歌等文学创作能力其中与鹏城实验室合作发布了知识增强千亿大模型鹏城-百度文心目前文心ERNIE已经刷新93个中文NLP任务基准并多次登顶SuperGLUE全球榜已在机器阅读理解文本分类语义相似度计算等60多项任务中实际应用ERNIE30Zeus算法框架ERNIE30Zeus在公开数据集上零样本小样本学习的效果资料来源百度文心一言官网IDC华西证券研究所11222百度文心一言大模型储备齐全CV计算机视觉百度文心一言CV具有颠覆性VIMER-CAE为视觉自监督预训练大模型创新性地提出在隐含的编码表征空间完成掩码预测任务的预训练框架在图像分类目标检测语义分割等经典下游任务上刷新SOTA结果VIMER-UFO20多任务学习模型行业最大170亿参数视觉多任务模型覆盖人脸人体车辆商品食物细粒度分类等20CV基础任具备支持各类任务各类硬件的灵活部署等优势可以有效解决大模型参数量大推理性能差等问题OCR-VIMER-StrucTexT20为表征学习预训练模型解决了训练数据匮乏和传统OCRNLP链路过长导致的模型表达能力不足优化效率偏低等问题能够广泛应用于文档卡证票据等图像文字识别和结构化理解例如泛卡证票据信息抽取应用政务办公文档还原应用等场景VIMER-UMS是行业首个统一视觉单模态与多源图文模态表征的商品多模态预训练模型可实现统一图文表征预训练同时覆盖商品视觉单模态多模态识别与检索任务可以显著改善商品视觉检索和商品多模态检索体验OCR-VIMER-StrucTexT20典型应用场景百度CV大模型VIMER-UMS功能介绍统一商品视觉与图文表征资料来源百度文心一言官网IDC华西证券研究所12223百度文心一言大模型储备齐全跨模态生物计算文心跨境大模型优势显著ERNIE-ViLG20是知识增强的AI作画大模型在公开权威评测集MS-COCO上取得了当前该领域的领先效果在语义可控性图像清晰度中国文化理解等方面均展现出了显著优势跨模态文档智能大模型ERNIE-Layout基于布局知识增强技术融合文本图像布局等信息进行联合建模在文档抽取布局理解等5类11项任务刷新业界SOTAERNIE-VIL是首个只是业界首个融合场景图知识的多模态预训练模型在视觉常识推理跨模态图像检索跨模态文本检索等典型多模态任务中刷新了世界记录文心生物计算大模型在全球具有领先优势HelixFold-Single是秒级别的蛋白结构预测大模型从近3亿的无标注蛋白质数据中隐式的学习MSA信息在90的单体蛋白场景上预测效果持平AF2在抗体结构预测场景下比AlphaFold2预测结果更优HelixGEM-2为小分子药物研发模型在量子化学属性预测和虚拟筛选双场景上达到领先效果其上个版本是业界首个基于几何构象增强的化合物表征模型引入化合物的三维空间信息在14个药物属性预测相关的benchmarks上效果达到业界最优HelixFold模型可以端到端地学习蛋白质结构在国产DCU环境下训练千万级别蛋白仅需到26天在GPU上相同硬件环境配置下训练性能和部分场景效果显著优AlphaFold2文心ERNIE-ViLG20自动生成创意图片百度HelixFold蛋白质结构模型与世界经典模型训练性能对比资料来源公开资料整理腾讯AIGC发展趋势报告2023华西证券研究所13231百度底层算力技术实力强劲百度智算中心百度智算中心是数字经济的重要底座百度自身具有建设智能算力中心的实力百度智算中心面向人工智能应用场景为政府和行业客户提供普惠算力算法模型和数据服务的人工智能基础设施可面对人工智能应用场景支持大规模部署的同时满足高并发高弹性高精度等不同计算需求可支撑城市大脑产业金融自动驾驶等各个垂直化行业方案优势强大具备多重领先优势1技术领先现有千卡并行环境下实现加速比90可支持大规模模型训练场景2绿色低碳数据中PUE可以低至108左到低能耗高性能运行3自主可控AI芯片AI框架开发平台大模型层面可以做到全栈自研自主可控4开放生态飞桨已累计凝聚477万开发者等目前已在江苏盐城湖北宜昌等地落地建设内容包括智算中心城市级视频中台数据中台系统核心物联网通信系统大规模图谱分析体系以及超过270类不同人工智能算法模型百度智算中心架构资料来源百度智能云官网华西证券研究所14232百度底层算力技术实力强劲百度百舸AI异构计算平台百度AI异构计算平台技术积累浓厚包含AI计算AI存储AI加速AI容器四大核心套件具有高性能高弹性高速互联高性价比等特性其中平台已经充分汲取了百度多年技术积累具备深度融合推荐无人驾驶生命科学NLP等场景的实践经验能为AI场景提供软硬一体解决方案加速AI工程化落地百度智能计算平台具备多重优势1高效率提供AI超级服务器RDMA网络大吞吐低延时的并行文件系统可大幅提升训练速度和推理效率2高密度支持GPU资源共享与隔离架构感知调度提升异构资源的容器化部署密度提升资源利用率3良好易用性支持PaddlePaddleTensorFlowPytorch等多种主流深度学习框架4多场景部署可根据业务需求在不同场景部署落地公有云IDC等场景5乐高式拼接AI计算AI存储AI容器三大核心产品均可各自独立提供服务应用场景广泛可用于营销广告无人驾驶生物科技语音语义计算机视觉等场景中的训练及推理百度百舸AI异构计算平台架构百度百舸AI异构计算平台AI计算示意图资料来源百度智能云官网华西证券研究所15233百度底层算力技术实力强劲昆仑芯云服务器百度昆仑云服务器服务器专为AI算力而生昆仑芯云服务器是一种弹性按需提供高性能通用AI算力的云服务器应用于AI推理和AI训练加速昆仑芯云服务器是搭载昆仑芯的云服务器支持K100和R200型号其中昆仑芯为自主研发的AI通用处理器芯片其中R200AI芯片采用7nm制成广泛应用于计算机视觉自然语言处理大规模语音识别大规模推荐等场景昆仑芯云服务器技术壁垒浓厚1领先的AI计算能力基于7nm制程单卡算力达到128TFLOPS支持推理和训练2生态兼容支持主流深度学习开发框架例如TensorflowPytorchPaddlePaddle等3具备硬件虚拟化能力优化了加速芯片的利用率在保证延时和吞吐量的情况下支持推理和训练等混合工作负载4易开发支持多种开发组件工具编译引擎支持C和C编程典型案例1互联网搜索可支持搜索系统对高并发要求提高NLP推理的效率2超算中心实现人工智能算力大规模高密度部署3工业质检利用深度学习技术替代人工质检大大节省了人力成本提高整厂的智能化水平帮助企业降低损耗提升约10的良品率4智慧城市全方位支撑智慧政务综合治理等智慧城市核心板块百度昆仑芯云服务器架构百度昆仑芯云服务器架构互联网搜索应用场景资料来源百度智能云官网华西证券研究所16234百度底层算力技术实力强劲昆仑芯AI芯片百度自身AI芯片技术实力浓厚昆仑芯AI芯片是百度自主研发的芯片昆仑芯科技前身是百度智能芯片及架构部昆仑芯科技深耕AI加速领域已十余年是一家在体系结构芯片实现软件系统和场景应用均有积累的AI芯片企业昆仑芯1代是百度自妍的第一一代昆仑芯片2020年底实现量产昆仑芯2代也已于2021年8月量产根据百度集团执行副总裁沈抖透露昆仑芯3代将于2024年初量产昆仑芯2代AI芯片可提供庞大算力支撑具有性能优势采用7nm架构对比上一代R200全面提升AI负载的运行效率巅峰算力可达256TOPSINT8昆仑芯2代具备多重优势1创新架构通用和专用指令集融合支持训练推理虚拟化2算力支撑强大通用计算能力明显增强可灵活支持AI算法的演进3高速互联高性能分布式AI系统加速AI数据和模型并行中的数据交换此外昆仑芯在著名算法的功耗比已有显著优势昆仑芯1-2代产品差异昆仑芯2代芯片与主流芯片对比型号型号K100加速卡型号R200加速卡精度INT4816XFP1632INT81632FP1632INT8128TOPSFP16INT8256TOPSFP16算力32TOPsFP328TOPS128TOPSFP3232TOPS显存8GB16GB访存带宽256GBs512GBsPCI-EGen4x8兼容PCI-EGen4x8兼容系统互联302010302010功耗75W150W资料来源百度智能云官网昆仑芯官网百度百科华西证券研究所1724百度文心一言生态愈发繁荣百度模型评估结果属于第一梯队彰显其强大技术实力根据IDC的数据评估先实百度文心大模型在市场格局中处于第一梯队产品能力生态能力达到L4水平应用能力达到L3水平产品能力呈现出较强技术实力和平台积累文心大模型深度学习平台创新了人工智能研发应用范式达到行业前端水平应用能力方面百度已在金融能源制造城市传媒互联网等行业拥有实际落地的标杆案例截止目前文心已累计发布11个行业大模型在生态能力方面百度文心大模型在社区用户的基础上可以实现与开发者行业用户上下游产业的正向互动在评估厂商中处于行业领先位置百度大模型赋能千行百业已有落地应用目前百度文心在能源金融航天制造传媒城市社科以及影视等领域与国网浦发吉利TCL人民网哈尔滨上海辞书出版社等均有案例应用的行业大模型这些行业大模型作为重要AI底座在各行业的技术效果突破产品创新生产流程变革降本增效等维度产生价值百度文心行业大模型全景图百度文心大模型评估结果资料来源IDC华西证券研究所1824百度文心一言生态愈发繁荣百度文心一言场景愈发繁荣目前已有诸多厂商开展合作我们认为其商业模式同样为API接口收费属于SAAS商业模式合作厂商分别覆盖科技金融航天影视汽车电子制造等诸多产业百度文心一言合作部分场景资料来源百度文心大模型官网华西证券研究所1925百度文心一言五大要素齐全开启全新篇章我们认为大模型成功必备的五要素分别是数据算力平台模型和生态而百度作为国产ChatGPT的领头羊五大要素皆已配备海量数据即训练大参数模型的燃料根据IDC数据其拥有5500亿条知识且已经应用于百度搜索信息流智能驾驶百度地图小度等产品模型储备百度实现了全生态的布局其中包括NLPCV跨境大模型生物计算等领域NLP领域ERNIE系列是基于知识增强的千亿模型用于智能创作摘要生成问答语义检索情感分析信息抽取等能力PLATO模型是全球首个超百亿参数规模的中英文对话训练模型可以让机器人像人一样具有逻辑且自由对话的功能CV领域VIMER-CAE应用于图像分类目标检测语义分割等场景VIMER-UFO拥有170亿参数覆盖人脸人体车辆商品食物细粒度分类等20的视觉多任务模型OCR-VIMER-StrucTexT广泛应用于文档卡证票据等图像文字识别和结构化理解VIMER-UMS业内首发多源图文模态表征的商品多模态预训练模型跨境大模型可实现AI作画场景融合视觉常识推理跨模态图像检索跨模态文本检索等多场景生物计算应用场景为蛋白结构预测和小分子药物研发等领域平台方面拥有自主生态的百度百舸AI异构计算平台具备高效率多密度高易用性多场景部署乐高式拼接等能力算力底座百度自身具有建设智能算力中心的实力技术领先且自主可控已有典型落地案例服务器方面拥有自妍的昆仑芯云服务器具有AI计算能力领先生态兼容兼具硬件虚拟化易开发等能力芯片方面昆仑芯AI芯片是百度自主研发的芯片2代芯片已量产具备算力支撑强高速互联等多重优势生态百度大模型赋能千行百业已有落地应用合作厂商分别覆盖科技金融航天影视汽车电子制造等诸多产业资料来源华西证券研究所20
 
Copyright © 2005 - 2021 Nxny.com All Rights Reserved 备案号:蜀ICP备15031742号-1