该论文研究多智能体 AI 发展竞赛中的安全策略,先审计游戏引擎、规则回忆、状态追踪、收益计算及等价描述下的稳定性,再比较七个模型端点与进化博弈理论及人类数据。结果显示,模型可能记住规则却无法稳定追踪状态或计算收益;动作序列、对手反应和多人竞赛行为存在显著模型差异。
最近 24 小时暂无可用热度快照。