论文借鉴Holmström团队道德风险模型,提出Dialogue Moral Hazard Game,测试语言模型是否愿意承担查询成本、传递隐藏安全信息并牺牲局部奖励以提升团队结果。作者评估9个开放权重模型和1个前沿API模型,并显示仅看团队成功率可能掩盖查询、信息传递与真实合作机制的缺失。
最近 24 小时暂无可用热度快照。