CheckMIABench: Firm Foundations For Membership Inference Attacks on Language Models
CheckMIABench: 语言模型成员推理攻击的坚实基础
机构 * Harvard University(哈佛大学) ; Harvard Business School(哈佛商学院)
专题命中 效率与部署 :language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.LG
AI总结 为解决成员推理攻击评估中的分布偏移问题,提出基于训练中固定点前后数据同分布的基准框架,在Pythia和OLMo模型上评估多种攻击,并开源模块化库。