小米提出Xiaomi-Robotics-1视觉-语言-动作模型,使用UMI设备采集的超过10万小时真实操作轨迹进行预训练,并通过自动标注生成描述场景状态变化的自然语言。模型在后训练阶段适配机器人本体和指令,在RoboCasa365取得57.6%成功率,高于此前46.6%;RoboDojo平均得分20.07,高于13.07。
最近 24 小时暂无可用热度快照。