该研究将多智能体探索形式化为部分可观测随机博弈,发现现代LLM智能体在相互协作时常表现出短视、两极化的互动模式,导致协调次优与更高遗憾。作者提出MACE,通过结构化选择协作伙伴促进探索,并报告其在上下文和参数多样性设置下改善了探索行为与下游任务表现。
最近 24 小时暂无可用热度快照。