>> 西部证券-计算机行业周观点第18期:数据中心低碳化趋势明确,国产算力有望加速渗透-240727
| 上传日期: |
2024/7/27 |
大小: |
297KB |
| 格式: |
pdf 共2页 |
来源: |
西部证券 |
| 评级: |
-- |
作者: |
郑宏达 |
| 行业名称: |
计算机 |
| 下载权限: |
此报告为加密报告 |
|
|
核心结论 为训练出更强大的模型,抢占AI应用高地,海外AI巨头正竞相构建10万卡GPU集群。从GPT-4发布到现在,全球大模型都没有出现明显的能力跃升,原因之一就是现在AI巨头没有大幅增加在单一模型上投入的算力,目前主流大模型投入的训练算力基本都是GPT-4水平。2024年7月22日,ElonMusk宣布由xAI、X和英伟达等合力打造的由10万块H100组成的孟菲斯超级集群开始投入训练,而OpenAI/ Microsoft、Meta等AI巨头也正在努力打造10万卡的GPU集群。 根据SemiAnalysis测算,为了支持服务器、存储设备、网络设备这些核心IT设备,一个10万块H100组成的集群所需的功耗大约是150MW。要建造10万块H100的超大型训练集群,不仅需要至少40亿美元的资本支出,还需要解决电力供应等问题。单个GPU的功率为700W,加上每个H100服务器内还有CPU、NIC(网络接口卡)、PSU(电源供应单元)等等部件,所以每块GPU还要额外消耗大概575W。在集群内,还需要存储服务器、网络交换机、光模块等等,这些设备会额外再占用大概10%的功耗。所以,一个10万块H100集群的功耗超过150MW,一年的消耗就是1.59TWh(15.9亿度电),约等于15万个家庭一年的用电量,按$0.078/Kwh的单价来计算,这个集群每年在电力这一项上的支出就高达1.239亿美元。作为对比,美国最大的国家实验室的超级计算机El Capitan只需要30MW的关键IT电力,大概只有一个10万块H100集群功耗的1/5。 为推动国内数据中心绿色低碳发展,多部门近日联合印发专项行动计划,提出数据中心应采用达到能效标准的服务器。7月23日,由国家发展改革委、工业和信息化部、国家能源局、国家数据局等共同制定的《数据中心绿色低碳发展专项行动计划》(以下简称《行动计划》)正式发布。《行动计划》提出:新建及改扩建数据中心应采用能效达到《塔式和机架式服务器能效限定值及能效等级》(GB43630-2023)和《服务器和数据存储设备能效“领跑者”评价要求》(T/CECA-G 0284-2024)规定的节能水平及以上服务器产品。 《服务器和数据存储设备能效“领跑者”评价要求》(以下简称《评价要求》)对服务器能效水平提出了评价标准,其中:配置小于14nm设备制造的通用图形处理器作为辅助处理加速器的服务器,其能效应符合:先进水平≥1.00TFLOPS/W,节能水平≥0.50 TFLOPS/W。 我们认为《行动计划》的发布,有利于推动国产算力向绿色低碳的目标发展,促进符合相关《评价要求》的国产算力加速渗透。 风险提示:产业政策转变、技术进展不及预期、应用落地不及预期、行业竞争加剧、国际环境发生变化。
|
|