论文

人机文学翻译中的流利度和 忠实性

Fluency and Faithfulness in Human and Machine Literary Translation

应用与实践机器翻译

摘要

文学翻译需要通过 忠实性 平衡目标语言与源语言的流畅性。最近的大语言模型(LLM)经常产生流畅的翻译,但尚不清楚流畅性是否对应于文学文本中的语义保留。我们使用 16 种源语言的 106 部小说中的 130,486 个翻译段落(包括人工翻译、Google 翻译和 TranslateGemma 翻译)来检查这种关系。流畅性是通过在段落词性 n 元语法上训练的翻译分类器和 忠实性 与自动翻译评估指标 COMET-KIWI 来衡量的。我们控制段落长度并发现流畅性和 忠实性 之间存在一致的负相关关系。该模式在人类翻译和谷歌翻译中都会出现,但对于 TranslateGemma 来说较弱且通常不重要。这些结果表明,片段长度对于自动评估很重要,并建议在文学翻译中在流畅性和 忠实性 之间进行权衡。