Oct, 2023

评估差分隐私合成数据对表格数据的效用和公平性在端到端机器学习流程中

TL;DR对比真实数据,研究调查了采用差分隐私合成数据可以替代机器学习流程中的真实数据,并确定了训练和评估机器学习模型的最有效的合成数据生成技术。结果显示,基于边缘分布的合成数据生成器能够获取与真实数据相似的实用性和公平性特征。