跳到正文
arXiv cs.SE· Anna Mazhar, Sainyam Galhotra·· 4 小时前AI 评分24

CAFÉ:机器遗忘的因果黑盒测试方法

CAF\'E: Causal Black-Box Testing of Machine Unlearning

AI 导读

研究者提出 CAFÉ,一种仅依赖已部署模型预测结果的机器遗忘黑盒测试方法,通过干预特征并将变化传播至下游特征,检测预测是否仍受目标特征影响。在两个因果网络基准、四种遗忘方法上,CAFÉ 以 0.92–0.93 的成对准确率对残余影响排序,现有检查最高仅 0.71。在真实人口普查数据上,CAFÉ 还发现了能通过重训练却未被直接输入检查察觉的残余影响。

来源:arXiv cs.SE · arxiv.org