RoboTALES提出单阶段机器人策略学习框架,用层级LLM规划器将复杂任务拆为子目标,再由VLM评论器评估视频生成模型想象的未来并提供奖励反馈,使模拟轨迹更贴合任务意图与动作条件。论文在RoboCasa和LIBERO10操作任务上评估,称其在长时程任务中持续优于既有方法,并公开代码与模型。
最近 24 小时暂无可用热度快照。