写点什么

谷歌推出基于 Gemini 2.0 的机器人 AI 模型

作者:qife
  • 2025-07-31
    福建
  • 本文字数:422 字

    阅读完需:约 1 分钟

Gemini Robotics 将 AI 带入物理世界

谷歌 DeepMind 正式推出基于 Gemini 2.0 的两款机器人 AI 模型:


  1. Gemini Robotics:先进的视觉-语言-动作(VLA)模型,新增物理动作输出模态,可直接控制机器人

  2. Gemini Robotics-ER:具备空间理解能力的增强模型,支持开发者调用其具身推理(ER)能力

核心技术突破

通用性

  • 利用 Gemini 的世界理解能力处理未见过的任务/物体/环境

  • 在泛化基准测试中性能达到其他 SOTA 模型的两倍以上

交互性

  • 基于 Gemini 2.0 的自然语言理解

  • 支持多语言即时指令响应

  • 实时环境监测与动态调整能力

灵巧性

  • 完成折纸、食品包装等精细操作

  • 支持多步骤复杂任务执行

多形态适配

  • 兼容 ALOHA 2 双臂平台

  • 适配 Franka 机械臂

  • 正在开发人形机器人 Apollo 的专用版本

安全架构

  • 底层运动控制安全机制(防碰撞/接触力限制)

  • 高层语义安全理解

  • 发布 ASIMOV 数据集推进安全研究

  • 采用数据驱动的"机器人宪法"框架

合作伙伴

  • Apptronik(人形机器人开发)

  • 波士顿动力等机构参与测试


查看技术报告更多精彩内容 请关注我的个人公众号 公众号(办公 AI 智能小助手)公众号二维码


办公AI智能小助手


用户头像

qife

关注

还未添加个人签名 2021-05-19 加入

还未添加个人简介

评论

发布
暂无评论
谷歌推出基于Gemini 2.0的机器人AI模型_人工智能_qife_InfoQ写作社区