ITBear旗下自媒体矩阵:

谷歌推出三AI模型助力机器人进化:全身智控、多机协作,解锁多样任务新场景

   时间:2026-08-01 03:58:40 来源:互联网编辑:快讯 IP:北京 发表评论无障碍通道
 

谷歌旗下DeepMind团队近日宣布,其人工智能模型Gemini的机器人专用版本Robotics 2正式面世。这款升级后的系统具备智能全身控制能力,可驱动包括人形机器人在内的多种设备自主适应复杂环境,完成从清理垃圾到操作洒水壶等多样化任务。相较于初代系统仅能通过机械臂完成封袋、折纸等精细操作,新版本实现了从桌面任务到全身动作控制的跨越式发展。

技术突破体现在三大核心升级:智能全身控制系统使机器人能理解"将水壶放入绿色箱子"等复杂指令,并自主规划行动路径;高级灵巧操作模块赋予五指机械手完成打结、拧灯泡等精细动作的能力;多机器人协作功能则支持不同型号设备协同工作。测试数据显示,全身操控任务成功率达45.7%-76.3%,抓取任务成功率最高达89.6%,多指操作成功率跨度较大,最低为32%,最高达92%。

该系统采用模块化架构设计,包含三个协同工作的AI模型:视觉-语言-动作(VLA)主模型负责将人类指令转化为全身运动控制;具身推理模型ER 2承担任务规划与团队协作功能,可处理数百个决策步骤并具备自我修正能力;设备端专用模型On-Device 2则通过运动迁移技术,使系统能在数小时内适应不同硬件配置,包括传感器布局和自由度差异显著的机器人本体。

在安全性方面,研发团队引入ASIMOV-Agentic基准测试体系,重点评估机器人在不确定环境下的决策能力。通过增强的具身推理功能,ER 2模型在安全约束遵循和人类接近检测方面表现突出,当监测到人员靠近时会自动暂停操作,待人员离开后恢复工作。这种主动安全机制使其成为该系列中首个通过协作安全标准认证的模型。

值得关注的是,谷歌此次升级聚焦软件层面,未涉及机器人本体制造。这与当前国际机器人产业格局形成微妙呼应——虽然美国近期加强了对中国制造机器人的进口限制,但Gemini Robotics 2系统理论上可适配包括中国厂商在内的多种硬件平台。目前ER 2模型已通过Google AI Studio开放,企业级平台进入私人预览阶段,完整系统则仅向早期合作伙伴提供。

演示视频显示,搭载新系统的Apptronik Apollo 2人形机器人能准确执行"取水壶-行走-放置"的多步骤指令,Franka Duo平台则展示了密封夹链袋等精细操作。与某些需要远程操控的竞品不同,谷歌强调所有演示均为实时自主运行。不过研发团队也承认,当前系统仍需针对特定任务进行专门训练,尚未实现完全通用化。

 
 
更多>同类资讯
全站最新
热门内容
网站首页  |  关于我们  |  联系方式  |  版权声明  |  争议稿件处理  |  English Version