研报下载就选股票报告网
您好,欢迎来到股票分析报告网!登录   忘记密码   注册
>> 国海证券-计算机行业专题研究:计算需求演进,超节点成为AI基础设施共识-250923
上传日期:   2025/9/24 大小:   1406KB
格式:   pdf  共19页 来源:   国海证券
评级:   推荐 作者:   刘熹
行业名称:   计算机
下载权限:   无限制-登录即可下载
投资要点:
  本篇报告解决了以下核心问题:1、超节点的演进与特征;2、AI算力需求空间与趋势;3、国产芯片加速推进超节点布局。
  计算需求演进,超节点成为AI基建共识
  计算基础设施需求转向搭建高带宽、低时延、持续数据供给的均衡系统。钦奇拉法则(Chinchilla Law)在规模定律(Scaling Law)基础上进一步要求参数与数据按比例协同扩展,即对高带宽、低时延的数据传输能力提出了刚性要求。而面对AI算力需求迅速增长,单芯片性能提升幅度却在逐年收窄。在此背景下,基础设施的挑战从过去的“纯算力”问题,升级为“算力×数据供给×系统编排”的综合性工程难题。
  超高带宽互联与内存统一编址是超节点的基础技术特征。(1)超大带宽和超低时延互联:超节点借助高效的互联协议打破传统架构限制,支持更大规模AI处理器的高效协同,实现更大范围、更高流量的数据传输,从而突破系统性能。(2)内存统一编址:超节点内所有互联设备的内存地址需全局唯一,基于全局内存可实现任意设备间的灵活访问。这使得大模型训练中频繁的参数同步操作,无需经过传统的“序列化-网络传输-反序列化”流程,直接通过内存语义通信完成,提升小包数据传输及离散随机访存通信效率。
  多级缓存池化、资源灵活配比以及高可靠性是未来产品能力持续优化的方向。(1)资源池化:将分散的计算、存储、网络资源抽象为统一逻辑资源池,以集中化管控的方式消除资源孤岛,实现动态弹性调度。(2)资源灵活配比:通过资源池化与软件定义架构的深度融合,将CPU、NPU、内存、存储等物理资源解耦为可独立调度的资源池,根据任务特征自动调整各类型资源的配比比例。(3)高可靠性:稳定性是决定系统计算效率及成本的重要指标之一,最大程度保障训练任务不中断,训练数据和和结果不丢失。
  未来五年全球AI资本开支3-4万亿美元,AI推理需求将远超训练
  英伟达预计未来五年全球AI资本支出将达3-4万亿美元。下游互联网、主权国家、原生AI厂商、AI推理等环节需求持续增长。
  (1)CSP:谷歌将2025年CapEx预期从750亿美元上调至850亿美元,主要用于AI基础设施建设;微软Q2的CapEx为242亿美元,预计Q3的CapEx将超300亿美元;Meta调整2025年CapEx区间为660-720亿美元,并表示2026年CapEx仍将显著增长;甲骨文FY2026Q1的Capex为85.02亿美元,同比增长269.17%,预计2026财年CapEx将达约350亿美元;阿里巴巴-W在2025Q2财报电话会上重申三年3800亿元人民币AI资本开支计划。
  (2)主权AI、推理AI需求正在崛起。腾讯表示,大模型产业重心从训练到推理的转变,已成行业共识。甲骨文也强调,AI推理市场将“远大于”AI训练市场,为了在AI推理市场占据主导地位。另外,主权AI正在崛起,英伟达认为今年有望实现200亿美元的主权AI收入,鸿海预计未来五年主权AI领域投资有望超1万亿美元。
  国产芯片加速推进超节点布局
  华为以开创的超节点互联技术,引领AI基础设施新范式。2025年3月,华为正式推出满配384颗Ascend 910C芯片的Atlas 900超节点CloudMatrix384。2025年9月18日,华为发布满配8192颗Ascend950DT芯片的Atlas 950超节点以及满配15488颗Ascend 960芯片的Atlas 960超节点;并发布Atlas 950 SuperCluster 50万卡集群和Atlas960 SuperCluster百万卡集群;同时,开放面向超节点的互联协议——灵衢2.0技术规范;还推出全球首个通用计算超节点TaiShan 950超节点。
  中科曙光发布国内首个基于AI计算开放架构设计的曙光AI超集群系统。中科曙光2025年9月5日发布国内首个基于AI计算开放架构设计的产品——曙光AI超集群系统。除了紧耦合设计,该集群系统还支持多品牌AI加速卡以及兼容CUDA等主流软件生态,为用户提供更多开放性选择,大幅降低硬件成本和软件开发适配成本。
  浪潮信息发布面向万亿参数大模型的超节点AI服务器“元脑SD200”。根据元脑服务器公众号,8月7日,浪潮信息发布面向万亿参数大模型的超节点AI服务器“元脑SD200”。该产品基于自主研发的开放总线交换技术首创多主机三维网格系统架构,实现64路本土GPU芯片高速互连;通过创新远端GPU虚拟映射技术,突破多主机交换域统一编址难题,实现显存统一地址空间扩增8倍,单机可以提供最大4TB显存和64TB内存,为万亿参数、超长序列大模型提供充足键值缓存空间。
  沐曦股份发布多种超节点形态。目前,沐曦已联合上百家合作伙伴构建起覆盖芯片设计、制造封测、系统集成到数据中心的完整产业生态,推出40余款标准机架式服务器、近10款工作站/一体机,并创新多种超节点形态:包括光互连超节点(16-64x GPU)、耀龙3DMesh超节点(32/64x GPU)、Shanghai Cube国产高密度液冷整机柜(128x GPU)以及高密度液冷算力POD。
  曦智科技发布国内首个光互连光交换GPU超节点光跃LightSphere X。曦智科技今年7月发布了国内首个光互连
 
Copyright © 2005 - 2021 Nxny.com All Rights Reserved 备案号:蜀ICP备15031742号-1