这篇论文研究持久记忆个性化LLM的“过度推断”(OI):模型在证据不足时编造用户属性。MirageBench评测12个模型、143,616条判断声明,发现各模型有35%—49%的声明过度推断,平均41.6%;模型自评OI与外部评审结果反向相关,说明自我报告并不适合用于模型比较。
最近 24 小时暂无可用热度快照。