研报下载就选股票报告网
您好,欢迎来到股票分析报告网!登录   忘记密码   注册
>> 招商证券-通信行业Grok 4大模型发布点评:大模型竞速与迭代持续,算力旺盛需求延续-250710
上传日期:   2025/7/10 大小:   794KB
格式:   pdf  共4页 来源:   招商证券
评级:   推荐 作者:   梁程加,孙嘉擎,罗嘉成
行业名称:   通信
下载权限:   此报告为加密报告
美国当地7月9日晚,xAI正式发布最新的大模型Grok 4。根据Artificial Analysis对比,Grok 4综合分数达73分,超越OpenAI o3-pro(71分)和谷歌Gemini 2.5Pro(70分),成为当前性能最强的AI模型。Grok 4反映AI大模型的迭代持续,更大规模的算力集群仍是趋势,对扁平化、低延迟的网络也形成新需求。
  Grok 4具备推理、多模态、网络搜索、语音等多种能力,在多项基准测试中领先。Grok 4类似Grok 3支持256k tokens的上下文窗口,配备DeepSearch工具,具有实时网络访问能力。Grok 4还是xAI首个具备图文多模态能力的大模型,语音功能也进一步优化;发布会对Grok 4与ChatGPT的语音功能进行现场对比,Grok 4的回答速度与语调表现更为突出。此外,xAI同步推出多智能体(multi agents)Grok 4 Heavy,支持4个智能体同时工作,在“人类最后考试”(HLE)基准测试中得分达44.4分,高于Grok 4(38.6分)、Gemini 2.5 Pro(26.9分)、o3(24.9分)。
  Grok 4推出订阅版本加速商业闭环,定价相对更高体现xAI信心。据xAI发布会,Grok 4的订阅费为30美元/月,多智能体版本的Grok 4 Heavy的费用为300美元/月,Grok 3则维持免费开放,两档订阅费用均高于OpenAI与Gemini(OpenAIPlus/Gemini Pro为20美元/月,OpenAIPro/Gemini Ultra为200美元/月)。API定价上,Grok 4与Grok 3一致,即每100万Tokens输入/输出为3/15美元,也高于Gemini 2.5 Pro与OpenAI o3的定价。
  Grok 4反映Scaling Law仍然有效,十万卡集群的建设或将是主流趋势。在xAI 20万张H100超算集群的算力支持下,Grok 3预训练(Pre-training)的效果较Grok 2提升10倍。尽管Grok 4预训练的算力与Grok 3近似,但训练中强化学习(Reinforcement Learning)投入算力是Grok 3的10倍。据发布会示意图,Grok 4强化学习投入算力已超过预训练。因此,尽管预训练规模已趋极限,但更大规模算力投入到强化学习训练中,仍能推动大模型的能力、特别是推理能力的持续提升。集群规模的扩张、数据中心的互联将促进网络架构升级、光互连渗透率提升等趋势,利好光模块、CPO、DCI等环节。
  大模型训练从预训练向强化学习转移的结构下,低延时高速互联通信呈现更高需求。预训练基于静态的大规模数据集,训练核心是“大规模并行计算+海量数据吞吐”,GPU的吞吐量是训练效率的瓶颈(性能要求:GPU>光模块>交换机)。强化学习的数据实时生成,大模型持续开展“推理-反馈-更新”的探索过程,核心是“闭环反馈+高频参数同步”,需要更扁平化的网络架构,也对交换机和光模块的低延时要求更高(性能要求:交换机>光模块>GPU)。
  AI大模型竞速持续,xAI下半年拟加速布局AI生态。根据SimilarWeb统计,ChatGPT 6月的周访问量已稳定在12亿人次,Gemini的周访问量也从4月底的1亿人次增至6月末的1.5亿人次;而Grok、Claude等大模型的周访问量仍在4千万人次以下波动。随着AI能力的成熟与用户黏性的养成,大模型的竞争格局已现雏形,各厂商正加大投入、争取成为大模型领域的有力竞争者。xAI在发布会提出8月将上线专业编码模型,9月推出多模态智能体,10月发布视频生成模型,在三个月内实现图文、代码、视频及复杂代理任务AI的全覆盖。与此同时,OpenAI已明确GTP 5将在今年夏季发布;7月9日Gemini 3.0 Pro beta版的名称则在官方GitHub仓库意外公开,或表明谷歌内部正测试下一代Gemini 3.0系列模型,有望近期发布。大模型的竞速与迭代持续,算力需求仍将保持旺盛水平。
  风险提示:AI发展不及预期、下游资本开支不及预期、全球贸易摩擦加剧
 
Copyright © 2005 - 2021 Nxny.com All Rights Reserved 备案号:蜀ICP备15031742号-1