Jon Saad-Falcon, Avanika Narayan, Robby Manihani, Tanvir Bhathal, Herumb Shandilya, Hakki Orhun Akengin, Gabriel Bo, Andrew Park, Matthew Hart, Caia Costello, Chuan Li, Christopher Ré, Azalia Mirhoseini
机构
*
Department of Computer Science, University of Virginia, USA(弗吉尼亚大学计算机科学系)
;
National Library of Medicine, National Institutes of Health, USA(美国国立卫生研究院国家医学图书馆)
;
Department of Computer Science, University of Illinois Urbana–Champaign, USA(伊利诺伊大学厄巴纳-香槟分校计算机科学系)
;
Medical Oncology, Dana–Farber Cancer Institute, USA(达纳-法伯癌症研究所医学肿瘤科)
;
Surgery, University of Alabama at Birmingham, USA(阿拉巴马大学伯明翰分校外科系)
;
Department of Neurology, Yale School of Medicine, USA(耶鲁医学院神经病学系)
Evolve the Method, Not the Prompts: Evolutionary Synthesis of Jailbreak Attacks on LLMs
改进方法而非提示:针对大语言模型的进化式 jailbreak 攻击合成
Yunhao Chen, Xin Wang, Juncheng Li, Yixu Wang, Jie Li, Yan Teng, Yingchun Wang, Xingjun Ma
机构
*
Department of XXX, University of YYY, Location, Country(XXX系,YYY大学,地点,国家)
;
School of ZZZ, Institute of WWW, Location, Country(ZZZ学院,WWW研究所,地点,国家)
Why We Look Where We Look: Emergent Human-like Fixations of a Foveated Visual Language Model Maximizing Scene Understanding
为什么我们看那里:一种最大化场景理解的视网膜视觉语言模型表现出的人类样注视模式
Shravan Murlidaran, Ziqi Wen, Sana Shehabi, Miguel P. Eckstein
机构
*
Psychological & Brain Sciences, University of California, Santa Barbara(加州大学圣芭芭拉分校心理学与脑科学系)
;
Electrical and Computer Engineering, University of California, Santa Barbara(加州大学圣芭芭拉分校电气与计算机工程系)
;
Computer Science, University of California, Santa Barbara(加州大学圣芭芭拉分校计算机科学系)