论文将医学诊断形式化为迭代证据寻求任务,利用带可验证奖励的强化学习训练模型主动选择检查,并提出基于检索增强生成的RAGES检查模拟器,为模型提供知识约束且更符合生物学的后续临床证据。作者称,该方法在多类数据集上可媲美更大或具推理增强的基线。
最近 24 小时暂无可用热度快照。