Oct, 2020

神经机器翻译在不做特别处理时不能正确翻译性别指代

TL;DR本文提出了一种将显式词级别的性别标记融入 NMT 中的方案,并探讨了在确定性别特征来源以及在目标语言中实现类似非二元词汇变化的情况下的性别标记控制翻译。该文发现了一些现有方法可能出现性别特征推广至句子中的多个实体,并提出了有效的替代方案,包括标记共指适应数据。