OvisOCR2 是一个 0.8B 参数的端到端文档解析模型,可从页面图像按自然阅读顺序生成 Markdown,覆盖文本、公式、表格和视觉区域。其训练结合真实标注、HTML 合成数据、4B 分支强化学习、在线蒸馏与模型融合,在 OmniDocBench v1.6 获得 96.58 分,在 PureDocBench 获得 75.06 的 Avg3,模型已在 Hugging Face 发布。
最近 24 小时暂无可用热度快照。