论文指出,逐字转录与意译式转录在异构标注数据中常被模型混为不可控的潜变量,风格错配最多可解释60%的报告词错误率。作者以覆盖感知任务标记和英德平行数据训练解码器,使德语口语不流利度F1从10%升至79%,并改善逐字模式的词级时间戳,还提出verbatimize以扩展语料构建。
最近 24 小时暂无可用热度快照。