南京大学团队提出VIABench,用视障人士录制或分享的第一视角视频评估多模态大模型在真实辅助场景中的能力,涵盖主动提醒、视觉问答和视觉引导交互,并同时支持在线实时与离线评测。摘要称现有模型尤其难以完成需要提前预判和快速响应的主动提醒任务。
最近 24 小时暂无可用热度快照。