研报下载就选股票报告网
您好,欢迎来到股票分析报告网!登录   忘记密码   注册
>> 中信证券-产业策略独角兽系列报告-独角兽十问十答系列18:高性能通用计算领军者登临科技-230412
上传日期:   2023/4/12 大小:   474KB
格式:   pdf  共6页 来源:   中信证券
评级:   -- 作者:   连一席,沈思越
下载权限:   此报告为加密报告
登临科技成立于2017年底,专注于高性能通用计算平台的芯片研发与技术创新,致力于打造云边端一体、软硬件协同、训练推理融合的高性能通用GPU芯片产品和平台化基础系统软件。公司自主研发GPU+架构,采用软件定义的片内异构体系,相比国际主流通用GPU产品,通过架构创新实现更高的能效比。目前,公司首款基于GPU+的创新AI计算加速器Goldwasser(高凛)已规模化应用于边缘至云计算各场景,在智慧城市、互联网等多行业领军企业实现商业化落地,新一代Goldwasser产品针对基于Transformer网络及生成式AI大模型应用实现性能的大幅提升,公司于2022年1月完成B轮融资。我们就近日与公司管理层的电话会交流,结合公司介绍情况汇总为十问十答。
  ▍Q1:公司的核心竞争力包括哪些方面?公司认为:
  1)团队:深厚产业背景+专利技术布局,打造通用计算专业团队。公司创始人兼董事长李建文本科毕业于清华大学微电子所,并于清华无线电系获硕士学位,曾任图芯科技副总裁,负责GPU/GPGPUIP产品。联合创始人王平本科毕业于清华大学电子工程系,并于清华微电子研究所获硕士学位,曾任图芯科技GPU首席架构师,拥有超15年芯片架构设计及管理经验。全球运营副总裁杨剑拥有超25年供应链运营及战略管理经验,曾任华为全球供应链副总裁。公司核心团队成员人均拥有GPU研发和商业产品化经验超20年。公司在上海、成都、杭州、北京、苏州、深圳和西安等地设立研发中心。此外,公司重视专利技术储备,截至2023年2月,已申请专利90件,其中发明专利86件、实用新型专利4件、PCT国际专利申请9件、美国专利4件,拥有基于芯片固件与工具软件获得软件著作权登记40件、集成电路布图登记7件等。
  2)技术:基础IP自研,创新GPU+架构提升能效。公司坚持核心技术的自主创新研发,通过软件定义片内异构体系打破传统GPU架构,同时采用硬件直接兼容CUDA等主流生态,最大化提高AI计算的密度和效率,实现硬件性能和能效的最大化,此外亦能显著降低客户的整体拥有成本(total cost of ownership,TCO)。公司产品采用基于GPGPU的软件定义片内异构架构,兼具GPU通用性及ASIC高效率,针对AI深度优化,可提供传统GPU产品3倍以上能效,并支持无缝接入CUDA/OpenCL软件生态。
  3)产品:打造边缘至云端全系列解决方案,Goldwasser系列加速卡实现规模化量产。公司基于GPU+打造Goldwasser(高凛)系列产品,包括单插槽标准半高PCIe板卡或BTB连接器板卡Goldwasser UL,功率10-15W,INT8算力为32-64TOPS,FP16算力为8-16TFLOPS;单插槽标准PCIe Gen3板卡Goldwasser L,功耗25-45W,可提供128-256TOPSIN8算力及32-64TFLOPSFP16算力;全高全长标准PCIe Gen3板卡Goldwasser XL,功耗120W,可输出512TOPSIN8算力及128TFLOPSFP16算力。其中Goldwasser UL主要面向边缘计算,而XL及UL系列则主要面向数据中心。公司已经于2022年底前开始第一代产品的量产和备货,同时也在进行第二代产品生产。
  4)落地:积极与客户合作布局,共推AI产业应用落地。Goldwasser已在智慧城市、互联网等领域实现规模化商业落地,并与客户在边缘至云端的不同应用场景中进行产品开发、测试。此外,公司积极与上下游合作伙伴沟通协作,目前已与国内外主流框架、CPU、OEM厂商完成适配。公司典型合作客户包括博观智能、趋动科技、易华录、四维向量、壹合原码、合芯科技、忆芯科技等。
  ▍Q2:公司GPU+产品的设计思路如何?
  公司GPU+产品继承GPUSIMT在易用性和生态上的优势,并引入更高效、更高计算密度的计算单元。登临科技表示,其GPU+产品的超异构结构可根据不同的计算密度需求,使用不同计算引擎处理,并且在应用和算法演变过程中,支持不断拓展和增强。公司产品的执行模型是基于算子而非指令,因此可实现计算效率和密度更高的计算。此外,登临科技还针对结构化的AI计算设计高效的辅助单元,提高计算效率。
  具有更高效的内存子系统,充分降低外部带宽需求,且支持CUDA、OpenCL等多种编程语言。登临科技使用更高效的数据交换网络连接计算单元,提高吞吐、降低延迟,并且支持更高容量的片上存储,可大幅减少外部吞吐量与存储需求。此外,公司采用片内生产者和消费者模型,实现中间数据即时生产与消费。因此,公司CPU+产品对外部带宽需求较小,可大幅提高整体利用率、降低功耗。公司在电话会中表示,相比英伟达GPU,登临科技GPU+带宽仅为英伟达GPU的1/5-1/6。
  ▍Q3:公司GPU相比其他通用GPU芯片有何优势?
  算力方面,具备高效内存子系统、计算密度、并行度及整体算力利用率高。英伟达V100引入Tensor Core,实现计算密度的数量级提升,但仍受传统GPU执行模型、内存子系统和寄存器文件带宽等方面限制。因此,登临科技专注于大矩阵计算。此外,并行度对计算效率存在重要影响,除矩阵计算外,还有Softmax等非矩阵计算方式。在传统GPU中,此类计算需通过不同层之间的kernel运行,
 
Copyright © 2005 - 2021 Nxny.com All Rights Reserved 备案号:蜀ICP备15031742号-1