论文提出ENTRAP-VL,用于系统研究视觉语言模型中的上下文牵引现象:模型可能被输入中的无关、错误甚至无意义信息带偏。数据集含1,500个人工整理条目、8类条件,并分别测试文本和视觉上下文;作者强调该工具用于测量与诊断,不宣称已评估具体模型。
最近 24 小时暂无可用热度快照。