研究调查了四个学科的84名论文导师,对35项论文评价标准进行权重排序,并将导师权重用于校准RubiSCoT系统。在80篇德语论文上,最佳配置仅将AI与人工评分的平均相对偏差从11.18%降至10.85%,且无统计显著性;导师之间偏差为4.44%,说明仅调整标准权重难以显著提升自动评估与人类判断的一致性。
最近 24 小时暂无可用热度快照。