论文研究大语言模型多智能体系统中的故障定位问题,提出 AgentLocate,同时识别应负责的智能体与轨迹中最早的决定性错误步骤。方法结合基于 LLM 的评审、多视角独立验证、置信度聚合与轻量微调,并在两个覆盖不同任务、配置和轨迹长度的基准上进行评估。摘要称其在定位准确性、token 使用和运行时间方面优于现有方法,但未披露具体数值。
最近 24 小时暂无可用热度快照。