论文重新解释 Sophisticated Inference 的计算优势:关键不一定是递归树搜索,而是让未来动作依赖未来状态与观测,从而形成规划时域内的闭环控制。作者在 Reactivity Maze 中比较多种变分目标,发现认识论驱动与状态条件化的联合后验缺一不可;完整的认识论先验主动推断同样能够解决环境。
最近 24 小时暂无可用热度快照。