COLINGApr, 2024

一种隐私保护冒犯性语言识别的联邦学习方法

TL;DR通过引入联邦学习(FL)在辱骂语言识别中的上下文中,我们提出了一种保护用户隐私的去中心化架构,用于辨别网上的辱骂语言。在四个公开可用的英语基准数据集(AHSD、HASOC、HateXplain、OLID)上,我们对多个深度学习模型进行了训练,并进行了详细的性能评估。同时,我们也展示了初步的英语和西班牙语跨语言实验。我们证明了所提出的模型融合方法在所有数据集上优于基准方法,并且能够保护隐私。