论文提出一种无需训练的扩散语言模型解码方法:先生成完整草稿,再用双向扩散进行全局或局部精炼。基于LLaDA2.1-Flash与Mini,Flash-Flash在GSM8K-384上将准确率从0.848提升至0.899且速度提高1.20倍;Mini-Flash在MATH-384上以0.294接近Flash的0.300,同时快2.17倍。
最近 24 小时暂无可用热度快照。