众力资讯网

小米发布具身领域首个统一生成模型 如果说过去几年,小米一直在造机器人,那么从今

小米发布具身领域首个统一生成模型 如果说过去几年,小米一直在造机器人,那么从今天开始,小米开始造的是机器人操作系统。

机器人行业一直存在一个最大的难题。过去,每学习一个动作,都需要重新训练一次模型。

抓苹果,需要一套模型,开抽屉,需要另一套模型,整理桌子,又是另一套套模型。甚至换了一个厨房、换了一个摄像头、换了一个灯光环境,机器人都有可能不会工作。

所以机器人一直被认为"很聪明,又很笨"。

聪明,是因为它可以完成复杂动作。笨,是因为它几乎不会举一反三。而 Xiaomi-Robotics-UIO 的出现,就是为了彻底改变这一点。

它采用的是目前机器人行业最热门的 Vision + Language + Action(VLA) 架构,让机器人第一次拥有了像大模型一样的统一理解能力。

以前机器人是看到苹果——识别苹果——规划动作——控制机械臂抓取。每一步都是不同模型。

而现在变成一句指令——理解环境——理解目标——规划动作——完成操作。整个过程交给一个统一模型完成。

所以业内喜欢把它称为人形机器人「小脑」的GPT时刻。