论文指出,大推理模型的长推理轨迹中普遍存在无关步骤与重复步骤,这些噪声会削弱幻觉检测信号。作者提出REDE,利用最终答案注意力作为自动监督,学习步骤级表示并过滤噪声轨迹,再接入不同幻觉检测器;在多个推理基准上较竞争基线持续提升检测性能。
最近 24 小时暂无可用热度快照。