论文将用AI智能体预估实验结果形式化为“模拟随机对照试验”(S-RCT),并把误差拆分为智能体近似误差与抽样误差。在67个历史营销A/B测试上,基础模型达到0.70的方向一致率但高估效果;两阶段前期校准将去除不可约测量噪声后的平方预测误差降低约77倍,组内设计使标准误降低约2.4倍。
最近 24 小时暂无可用热度快照。