论文分析 LLaDA 2.0 的扩散式解码轨迹,发现局部 token 置信度可能与整体数学推理正确性脱钩,形成“置信度陷阱”。作者将失败分为采样敏感型与采样一致型,并提出无需训练的 Evolutionary Decoding,通过逐步选择和块级变异探索更可靠的推理路径。
最近 24 小时暂无可用热度快照。