谷歌发布新一代机器人AI模型谷歌DeepMind发布了一款全新的、面向机器人的人工智能模型,声称可使人形机器人能够协调全身动作。
这是谷歌将Gemini人工智能技术进一步拓展至机器人领域的最新举措,旨在让机器人具备推理能力、规划多步骤任务,并适应人类生活环境。
新系统名为Gemini Robotics 2,能够让机器人在执行任务时完成行走、下蹲、操控物体等动作,并结合推理能力自主完成任务。
谷歌表示,与此前主要控制机器人上半身动作的模型不同,Gemini Robotics 2可以实现对整个人形机器人的全身控制。
在一段预录演示中,DeepMind的新模型操控Apptronik公司的人形机器人Apollo完成了一系列动作,包括穿过房间、拿起洒水壶并将其放到架子上,同时还能避开途中障碍物。
与此同时,DeepMind还发布了另外两款机器人AI模型,它们既可以协同工作,也可以独立运行。
其中,Gemini Robotics 2负责将摄像头画面和自然语言指令转换为机器人电机控制指令;而Gemini Robotics ER 2则充当机器人的“推理系统”,负责规划多步骤任务,并协调多个机器人共同完成同一目标。
谷歌还展示了机器人灵巧性的提升。研究人员表示,在测试中,系统完成“拧下灯泡”这一任务的成功率达到92%。不过,在扎垃圾袋、封好Ziplock密封袋等更加复杂的操作中,成功率仍然相对较低。(财联社
