>> 广发证券-电子行业“AI的iPhone时刻”系列9:NVLink + NVSwitch,实现GPU间高速互联-230405
| 上传日期: |
2023/4/5 |
大小: |
2283KB |
| 格式: |
pdf 共19页 |
来源: |
广发证券 |
| 评级: |
-- |
作者: |
王亮,耿正,栾玉民 |
| 行业名称: |
电子 |
| 下载权限: |
此报告为加密报告 |
|
|
NVLink:实现GPU间高速直联。NVLink是一种GPU之间的直接互联,可扩展服务器内的多GPU输入/输出。2016年,第一代NVLink搭载基于Pascal架构的Nvidia GP100 GPU发布,其传输速率可达160GB/s;目前NVLink已迭代至第四代,第四代NVIDIANVLink总带宽为900GB/s,是PCIe 5.0带宽的7倍。一代NVLink共有4个链路,单链路传输速率40GB/s;第二代、第三代、第四代NVLink分别有6、12、18个链路,单链路传输速率均为50GB/s。NVLink不仅可实现NVIDIAGPU间互联,也可以实现GPU与CPU之间的互联(CPU需要支持NVLink协议,如IBMPOWER9)。第一至第三代NVLink传输信号为NRZ调制的电信号,第四代NVLink传输信号为PAM4调制电信号;在信号传输过程,由NVLink控制器+PHY构成的组合实现信号的收发控制,其中NVLink控制器按照功能又可分为三层:Physical Layer(PL)、Data Link Layer(DL)、TransactionLayer(TL)。 NVSwitch:实现服务器内更高带宽、更低延迟、更多GPU间通信。NVIDIA在2018 GTC大会发布了首款节点交换架构——第一代NVSwitch,其上有18个NVLink端口,在单服务器节点内通过12个NVSwitch可以实现16个V100以NVLink能够达到的最高速度进行多对多GPU通信;基于NVLink +NVSwitch实现服务器节点内16颗V100互联的一台DGX-2与两台通过IB互联的DGX-1(每台内有8个V100)相比,前者AI运算速度是后者的两倍以上。目前NVSwitch已经迭代到第三代,单芯片上共有64个第四代NVLink端口,支持GPU间900GB/s的通信速度,这些通过NVLink Switch互联的GPU可用作单个高性能加速器,拥有高达15petaFLOPS的深度学习计算性能。 服务器之间的NVLink与NVSwitch:实现服务器节点间通信拓展。基于第三代NVSwitch,通过在服务器外部添加第二层NVSwitch,NVLink网络可以连接多达32个服务器、256个GPU,并提供57.6TB/s的多对多带宽,实现GPU在服务器节点间通信扩展,形成数据中心大小的GPU。基于第三代NVSwitch实现节点间互联的DGXH100256 SuperPOD与前代通过IB网络实现节点间互联的DGXA100256 SuperPOD相比,前者对分带宽(Bisection Bandwidth)、全规约吞吐量(AllReduce Throughput)分别是后者的9倍、4.5倍。 投资建议。AIGC推动AI服务器需求增长,建议关注GPGPU/ASIC/CPU厂商:海光信息(与计算机组联合覆盖)、龙芯中科、芯原股份等;服务器芯片厂商:澜起科技、源杰科技、杰华特、裕太微、聚辰股份、帝奥微等;服务器硬件厂商:工业富联、沪电股份、胜宏科技等;AIGC应用:海康威视、大华股份等。 风险提示。AIGC发展不及预期的风险;AI服务器出货量不及预期的风险;国产厂商技术和产品进展不及预期的风险。
|
|