HPD-Parsing针对统一视觉语言模型文档解析中的整页自回归瓶颈,提出层级并行解码:主分支负责全局布局分析并动态分派区块内容,多个分支并行生成,同时结合渐进式多Token预测。论文报告其吞吐量达4,752 tokens/s,是最快现有模型的2.62倍、原生自回归基线的3.06倍,并保持有竞争力的解析准确率。
最近 24 小时暂无可用热度快照。