Data-Free Privacy-Preserving for LLMs via Model Inversion and Selective Unlearning
无需数据的隐私保护:通过模型反向和选择性遗忘
Xinjie Zhou, Zhihui Yang, Lechao Cheng, Sai Wu, Gang Chen
机构
*
School of Software Technology, Zhejiang University(浙江大学软件技术学院)
;
Zhejiang University(浙江大学)
;
Hefei University of Technology(合肥工业大学)
;
Institute of Fundamental and Transdisciplinary Research, Zhejiang University(浙江大学基础与交叉学科研究院)
;
Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and Data Security(杭州高新技术区(滨江区)区块链与数据安全研究院)
;
The State Key Laboratory of Blockchain and Data Security(区块链与数据安全国家重点实验室)
;
Zhejiang Key Laboratory of Big Data Intelligent Computing(浙江省大数据智能计算重点实验室)
专题命中
预训练与数据
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
机构
*
Zhejiang University(浙江大学)
;
Binjiang Institute of Zhejiang University(浙江大学滨江学院)
;
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
China University of Petroleum (Beijing)(中国石油大学(北京))
;
Guangzhou University(广州大学)
专题命中
预训练与数据
:large language model(abstract);language model(abstract);post-training(abstract);分类 cs.CL、cs.AI
Preconditioning Benefits of Spectral Orthogonalization in Muon
谱正交化在缪子中的预条件化优势
Jianhao Ma, Yu Huang, Yuejie Chi, Yuxin Chen
机构
*
Penn Department of Statistics and Data Science, Wharton School, University of Pennsylvania(宾夕法尼亚大学统计与数据科学系,沃顿商学院,宾夕法尼亚大学)
;
Yale Department of Statistics and Data Science, Yale University(耶鲁大学统计与数据科学系,耶鲁大学)
;
Department of Electrical and Systems Engineering, University of Pennsylvania(宾夕法尼亚大学电气与系统工程系,宾夕法尼亚大学)
专题命中
预训练与数据
:large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.AI、cs.LG
Towards Compositional Generalization of LLMs via Skill Taxonomy Guided Data Synthesis
通过技能分类引导的数据合成实现大语言模型的组合泛化
Yifan Wei, Li Du, Xiaoyan Yu, Yang Feng, Angsheng Li
机构
*
State Key Laboratory of Complex & Critical Software Environment, Beihang University(复杂与关键软件环境国家重点实验室,北京航空航天大学)
;
Beijing Academy of Artificial Intelligence(北京人工智能研究院)
;
Beijing Institute of Technology(北京理工大学)
;
Institute of Computing Technology, CAS(中国科学院计算技术研究所)
专题命中
预训练与数据
:large language model(abstract);language model(abstract);post-training(abstract);分类 cs.CL、cs.AI
机构
*
AnnLab(安实验室)
;
Institute of Semiconductors, Chinese Academy of Sciences(半导体研究所,中国科学院)
;
Zhongguancun Academy(中关村学院)
;
State Key Laboratory of Multimodal Artificial Intelligence Systems(多模态人工智能系统国家重点实验室)
;
Institute of Automation, Chinese Academy of Sciences(自动化研究所,中国科学院)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Computer Network Information Center(计算机网络信息中心)
专题命中
预训练与数据
:large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.AI、cs.LG
机构
*
Institute for AI Industry Research (AIR), Tsinghua University(人工智能产业研究院(AIR)、清华大学)
;
ByteDance Seed(字节跳动种子)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
School of Informatics, Xiamen University(厦门大学信息学院)
;
SIA-Lab of Tsinghua AIR and ByteDance Seed(清华大学AIR实验室和字节跳动种子)
专题命中
预训练与数据
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
Ground Truth Generation for Multilingual Historical NLP using LLMs
Clovis Gladstone, Zhao Fang, Spencer Dean Stewart
机构
*
ARTFL Project, Romance Languages and Literatures, University of Chicago(ARTFL项目, Romance语言与文学系,芝加哥大学)
;
Department of History, University of Chicago(历史系,芝加哥大学)
;
Libraries and School of Information Studies, Purdue University(图书馆与信息科学学院,普渡大学)
专题命中
预训练与数据
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI