>> 中邮证券-AI动态汇总:谷歌推出Gemini Robotics On-Device大模型,快手开源keye-VL多模态模型-250702
| 上传日期: |
2025/7/2 |
大小: |
1761KB |
| 格式: |
pdf 共24页 |
来源: |
中邮证券 |
| 评级: |
-- |
作者: |
肖承志 |
| 下载权限: |
无限制-登录即可下载 |
|
|
谷歌推出Gemini Robotics On-Device大模型 谷歌DeepMind于2025年6月25日正式发布的Gemini RoboticsOn-Device模型,标志着机器人控制技术迈入了一个全新的时代。这一视觉-语言-动作(VLA)模型基于Gemini 2.0架构开发,首次实现了多模态大模型在机器人设备上的完全本地化运行,无需依赖云端计算即可完成复杂任务,如折叠衣物、拉开拉链或精准装配工业零件。 快手开源keye-VL多模态模型 快手于2025年6月26日开源的Kwai Keye-VL多模态大模型,标志着国产多模态技术在视频理解与复杂推理领域的重大突破。该模型基于Qwen3-8B语言模型架构,融合了SigLIP初始化的视觉编码器,通过创新的3DRoPE(旋转位置编码)技术实现对文本、图像和视频信息的统一处理,尤其擅长捕捉视频时序变化与动态分辨率输入,成为全球首个在高考数学卷中取得140分成绩的多模态模型。 谷歌开源AIAgent框架Gemini CLI 谷歌于2025年6月25日开源的Gemini CLI,标志着AIAgent技术与开发者工作流的深度融合。这一命令行框架将Gemini 2.5 Pro模型的百亿级参数能力无缝嵌入终端环境,通过自然语言交互重构了开发者的生产力范式,其技术内核与生态策略展现出谷歌在AI普惠化与开发者生态建设上的战略野心。 用不等式检验大模型推理能力,推理正确率下降65.5% 斯坦福大学、加州大学伯克利分校和麻省理工学院的研究团队联合发表题为《Solving Inequality Proofs with Large LanguageModels》的论文,聚焦于大语言模型在数学不等式证明领域的性能评估与方法创新。研究通过构建首个奥林匹克竞赛级不等式数据集INEQMATH,揭示了当前LLMs在严格数学推理上的显著缺陷,并提出了创新的评估框架与改进路径。 风险提示: 以上内容基于历史数据完成,在政策、市场环境发生变化时存在失效的风险;历史信息不代表未来
|
|