机构
*
School of Computer Science, National Engineering Research Center for Multimedia Software and Hubei Key Laboratory of Multimedia and Network Communication Engineering, Wuhan University, China(计算机学院,国家多媒体软件工程技术研究中心和湖北多媒体与网络通信工程重点实验室,武汉大学,中国)
;
Alibaba Group, Hangzhou, China(阿里巴巴集团,杭州,中国)
;
Independent Researcher(独立研究者)
;
Department of Machine Learning, Mohamed bin Zayed University of Artificial Intelligence, United Arab Emirates(机器学习系,Mohamed bin Zayed人工智能大学,阿拉伯联合酋长国)
机构
*
Harvard University(哈佛大学)
;
University of Southern California(南加州大学)
;
Brown University(布朗大学)
;
Pennsylvania State University(宾夕法尼亚州立大学)
;
Texas A&M University(德克萨斯阿姆大学)
;
Purdue University(普渡大学)
;
University of California, Irvine(加州大学 Irvine 分校)
;
Massachusetts Institute of Technology(麻省理工学院)
机构
*
Shanghai University of Engineering Science(上海工程技术大学)
;
Tencent YouTu Lab(腾讯优图实验室)
;
Clinical Research Unit, Zhongshan Hospital of Fudan University(复旦大学中山医院临床研究部)
机构
*
Center for Data Science, New York University Shanghai(纽约大学上海数据科学中心)
;
Courant Institute of Mathematical Sciences, New York University(纽约大学Courant数学科学研究所)
;
School of Data Science, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)数据科学学院)
机构
*
Key Laboratory of Big Data & Artificial Intelligence in Transportation (Beijing Jiaotong University), Ministry of Education(大数据与人工智能在交通运输中的关键实验室(北京交通大学),教育部)
;
School of Computer Science and Technology, Beijing Jiaotong University(计算机科学与技术学院,北京交通大学)
;
Tsinghua University(清华大学)
;
Peking University(北京大学)
;
University of Montreal(蒙特利尔大学)
Diagnosing and Repairing Unsafe Channels in Vision-Language Models via Causal Discovery and Dual-Modal Safety Subspace Projection
通过因果发现和双模态安全子空间投影诊断和修复视觉-语言模型中的不安全通道
Jinhu Fu, Yihang Lou, Qingyi Si, Shudong Zhang, Yan Bai, Sen Su
机构
*
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Huawei Technologies Ltd.(华为技术有限公司)
;
Peking University(北京大学)
;
Chongqing University of Posts and Telecommunications(重庆邮电大学)
机构
*
Beijing Institute of AI Safety and Governance(北京人工智能安全与治理研究院)
;
Beijing Key Laboratory of Safe AI and Super Alignment(北京安全人工智能与超对齐重点实验室)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
CSE, The Chinese University of Hong Kong(香港中文大学电子工程系)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Department of Mathematics, The Chinese University of Hong Kong(香港中文大学数学系)
;
Long-term AI(长期人工智能)
机构
*
State Key Laboratory of AI Safety(人工智能安全国家重点实验室)
;
Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)