阅读原文
HuggingFace 每日论文Yushi Sun论文89

当记忆说谎:VLM智能体空间记忆陈旧性的实证研究

原标题:When Memory Lies: An Empirical Study of Spatial Memory Staleness in VLM Agents

论文在动态 FrozenLake 环境中研究视觉语言模型智能体如何处理过时空间记忆与新观测的冲突,覆盖 3 个闭源模型和 3 个开放权重 VLM。实验显示,文本中的陈旧性判断并不等于视觉定位能力;在 GPT-4o 设置中,直接信任原始记忆的智能体死亡率超过无记忆基线两倍,而审计过滤只能部分缓解风险。

为什么值得读

随着智能体开始依赖持久记忆,这项研究直接量化了记忆过时、视觉落地失败与导航安全事故之间的联系。

标签

VLM智能体记忆视觉落地空间导航安全FrozenLake记忆陈旧性