>> 西部证券-计算机行业周观点第46期:英伟达部分收编Groq,或为补全推理芯片拼图-251228
| 上传日期: |
2025/12/28 |
大小: |
236KB |
| 格式: |
pdf 共2页 |
来源: |
西部证券 |
| 评级: |
-- |
作者: |
郑宏达,卢可欣 |
| 行业名称: |
计算机 |
| 下载权限: |
此报告为加密报告 |
|
|
12月25日,据Business insider、CNBC等外媒报道,英伟达已经同意以约200亿美元的现金,收购成立9年的AI芯片公司Groq的核心资产。英伟达此次并非采取传统的收购标的公司100%股权的方式。根据Groq官方博客与英伟达的说法,这是一项非排他性授权协议,其主要内容包括:1)业务分割:英伟达将获得Groq的所有资产与技术授权,但Groq旗下的GroqCloud云端业务并不在交易范围内,将维持独立运作。2)人才吸纳:作为该协议的一部分,Groq的创始人Jonathan Ross、Groq的总裁Sunny Madra以及Groq团队的其他成员将加入英伟达,以帮助推进和扩大授权技术的规模。3)公司独立性:Groq将继续作为一家“独立公司”运作,由原首席财务官Simon Edwards出任新任首席执行官,GroqCloud将继续正常运营,不会中断。 Groq成立于2016年,其AI芯片产品旨在实现高吞吐量、低成本的推理,而不是训练。Groq核心团队来自谷歌TPU工程团队,创始人Jonathan Ross是谷歌TPU项目的核心研发人员。在成立之初,Groq就确定了“编译器优先”的策略,即由官方提供一个帮助客户拆分计算任务、最大化并行计算的软件,提升推理效率。Groq还提出“LPU芯片”概念,即“语言处理单元”,专门用于大语言模型推理任务。Groq表示,LPU芯片速度比H100快10倍,成本仅为其十分之一,以满足全球企业对“实时、低延迟”的AI推理服务的渴求。值得注意的是,在芯片内存设计方面,LPU架构摒弃了外部HBM,直接采用片上SRAM,可以有效较低推理成本及延迟,Groq披露的数据显示,Groq芯片的片上内存带宽高达80TB/s以上,而目前顶尖GPU采用的HBM带宽仅约为8TB/s。 大模型推理需求高增,英伟达收编Groq或为补全推理芯片拼图。2025年,各大厂日均tokens高速增长,12月18日,在Force大会现场,火山引擎总裁谭待宣布:截至今年12月,豆包大模型日均token使用量突破50万亿,较去年同期增长超过10倍。市场上对于专门处理推理工作负载的专用芯片需求正在不断增长。推理芯片侧,由于对成本和能效的极致追求,技术路线呈现出百花齐放的态势,Cerebras、Groq以及各大云厂商自研芯片与英伟达差距并没有训练端大。通过部分“收编”Groq,英伟达不仅可以整合了一个潜在强力技术对手,规避反垄断风险,还有望在未来的AI产能大战中,开辟一条不依赖HBM供应链的新战线,专门针对高频、低延迟推理市场。 推荐:1)推理芯片:寒武纪、海光信息;2)服务器:中科曙光、浪潮信息、神州数码、华勤技术。 风险提示:AI技术进展不及预期、行业竞争加剧、国际环境发生变化。
|
|