论文

何时使用额外上下文:同步语音翻译的循证术语适应

When to Use Extra Context: Evidence-Grounded Terminology Adaptation for Simultaneous Speech Translation

上下文与知识上下文工程

摘要

额外的上下文对于技术演讲的同步语音翻译很有价值,但将整个文档上下文注入每个流片段通常过于粗糙。通过诊断实验,我们发现上下文增益主要来自论文特定的术语恢复,而不是统一的语义增强。因此,我们提出了 EGTA,一种基于证据的术语适应框架,它构建文档术语存储器,选择以当前流状态为条件的紧凑候选术语,并仅使用所选术语来适应 ASR/语音端和解码器端决策空间。 EGTA 可以在级联、端到端和仅生成 SimulST 设置中实例化,无需完整模型 微调。我们在由 MCIF-dev 和 ACL60/60-dev 组成的 ACL 技术演讲 SimulST 评估套件上评估 EGTA。在 MCIF-dev 上,EGTA-RG 在 En$\rightarrow$Zh 和 En$\rightarrow$De 上将 BLEU 提高了 +1.05/+0.59,将 XCOMET-XL 提高了 +0.019/+0.006,相对命名实体召回率提高了 +79\%/+73\%,缩写词召回率提高了 +0.099/+0.171。在 MCIF-dev 延迟设置中,EGTA 持续改进 XCOMET-XL、命名实体召回和首字母缩写词召回。 ACL60/60-dev 上的外部验证进一步显示了一致的术语回忆增益,无需额外的 微调。混洗内存控制和激活审核提供的证据表明,改进与特定于纸张的证据对齐而不是通用上下文提示相关。