论文提出推理时共识解码,用多个来源数据分别微调参考模型,再聚合其下一词分布,阻断仅由部分来源引入的中毒行为、潜意识学习和涌现失配。方法包括逐词最小概率与基于基座模型的相对共识,并支持部分来源达成共识。
最近 24 小时暂无可用热度快照。