>> 申万宏源-机器人行业点评报告:Google DeepMind加大布局机器人项目,软硬件同步发力-251128
| 上传日期: |
2025/11/28 |
大小: |
457KB |
| 格式: |
pdf 共3页 |
来源: |
申万宏源 |
| 评级: |
看好 |
作者: |
王珂,胡书捷 |
| 下载权限: |
此报告为加密报告 |
|
|
Google DeepMind加大机器人布局,软硬件同步发力。DeepMind CEOHassabis在采访中谈到,希望构建一个以Gemini为基础的通用AI系统,能配置各种物理形态,包括人形、四足、轮式等;即把Gemini做成机器人界的安卓,他预测,AI驱动的机器人技术将在未来几年内迎来突破性时刻。当前机器人软硬件技术尚未解耦,软件的开发脱离不了硬件,为此,Google DeepMind聘请波士顿动力前CTOAaron Saunders担任硬件工程副总裁。Saunders表示,他将致力于解决在物理世界中实现AGI全部潜力的基础硬件问题。 DeepMind内部已启动Gemini Robotics项目,目标是用多模态大模型直接输出动作token。25年3月,谷歌推出让机器人拥有多模态理解能力的Gemini Robotics系列,6月推出Gemini Robotics On-Device,9月发布新一代通用机器人基座模型——Gemini Robotics 1.5系列。 Gemini Robotics 1.5系统由两个模型协同工作:①协调器- Gemini Robotics-ER1.5,具身推理模型,负责上层思考,包括处理复杂指令,规划任务步骤,调用代步工具,根据环境反馈动态调整计划;②动作模型- Gemini Robotics 1.5,负责将协调器的自然语言指令转化为机器人的底层动作轨迹,控制机器人执行。 Gemini Robotics 1.5有三大技术创新:①运动迁移,模型能从不同形态的机器人数据中学习,无需额外训练;②“思考再行动”的VLA:在执行动作前生成思考轨迹和具体的动作步骤,提升多步骤任务的成功率、可解释现象和错误恢复能力;③推理升级:强化对物理世界的视觉-空间-时间推理能力。在实际测试中,模型的多形态和多任务泛化能力,以及长周期任务的能力,明显优于其他同类模型。 Google DeepMind一直以来都是具身智能领域的引领者,但此前更偏科研层面,对商业化涉足较少:2022年发布RT-1,首个面向机器人的Transformer模型;2023年发布RT-2,整合大语言模型(LLM)与视觉模型;并基于两个模型推出RT-X,该模型具有一定的泛化能力、多模态和跨平台能力。Gemini3的亮眼表现意味着AI多模态的架构的根本性进步,证明了通用模型的可行性,也能够为具身智能的训练及应用赋能。此次DeepMind引入波士顿动力前CTO,标志着谷歌对具身智能模型的信心和对产业趋势拐点来临的判断。我们认为机器人主机厂商及相关产业链将直接受益,包括优必选、越疆、极智嘉等主机厂,及恒立液压、浙江荣泰、汇川技术、伟创电气、美湖股份等零部件公司。 风险提示:行业处于早期阶段,技术路线和商业化进展存在高度不确定性;短期估值较高带来的股价波动风险
|
|