论文研究多个机器人在持久共享环境中连续执行任务时的长期规划问题。作者提出礼貌式预见规划,由模型驱动规划器生成候选方案,并结合即时成本与面向所有机器人的预期未来成本进行选择。该方法用独立的机器人级学习估计器避免联合 rollout 的组合爆炸,在家庭和餐厅两个 PDDL 环境中分别实现最高10.43%和17.41%的总成本下降。
最近 24 小时暂无可用热度快照。