TOUR针对离线强化学习中的轨迹级数据删除,提出结合轨迹分区、匹配非成员控制、重训练参考、保留性能锚点和多攻击审计的评测基准。在D4RL运动控制及探索性AntMaze实验中,研究显示单一似然型成员分数可能高估遗忘效果,结论需同时考察隐私、效用、攻击类型与重训练校准。
最近 24 小时暂无可用热度快照。