Rank-and-Reason: Multi-Agent Collaboration Accelerates Zero-Shot Protein Mutation Prediction
Rank-and-Reason: 多智能体协作加速零样本蛋白质突变预测
Yang Tan, Yuanxi Yu, Can Wu, Bozitao Zhong, Mingchen Li, Guisheng Fan, Jiankang Zhu, Yafeng Liang, Nanqing Dong, Liang Hong
机构
*
Shanghai Jiao Tong University(上海交通大学)
;
Shanghai Innovation Institute(上海创新研究院)
;
Southern University of Science(南方大学(科学))
;
East China University of Science and Technology(东中国科学与技术大学)
机构
*
University of Alabama(阿拉巴马大学)
;
University of Maryland, College Park(马里兰大学学院公园分校)
;
Stony Brook University(石溪大学)
;
University of Florida(佛罗里达大学)
;
Johns Hopkins University(约翰霍普金斯大学)
Are language models aware of the road not taken? Token-level uncertainty and hidden state dynamics
Amir Zur, Atticus Geiger, Ekdeep Singh Lubana, Eric Bigelow
机构
*
Department of Linguistics, Stanford University(斯坦福大学语言学系)
;
Department of Psychology, Harvard University(哈佛大学心理学系)
;
Center for Brain Science, Harvard University(哈佛大学脑科学中心)
;
Physics of Intelligence Group, NTT Research(NTT研究物理智能小组)
Medical Hallucinations in Foundation Models and Their Impact on Healthcare
Yubin Kim, Hyewon Jeong, Shan Chen, Shuyue Stella Li, Chanwoo Park, Mingyu Lu, Kumail Alhamoud, Jimin Mun, Cristina Grau, Minseok Jung, Rodrigo Gameiro, Lizhou Fan, Eugene Park, Tristan Lin, Joonsik Yoon, Wonjin Yoon, Maarten Sap, Yulia Tsvetkov, Paul Liang, Xuhai Xu, Xin Liu, Chunjong Park, Hyeonhoon Lee, Hae Won Park, Daniel McDuff, Samir Tulebaev, Cynthia Breazeal
机构
*
Massachusetts Institute of Technology(麻省理工学院)
;
Harvard Medical School(哈佛医学院)
;
University of Washington(华盛顿大学)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Seoul National University Hospital(首尔国立大学医院)
;
Google Research(谷歌研究)
;
Google DeepMind(谷歌DeepMind)
;
Columbia University(哥伦比亚大学)
;
Johns Hopkins University(约翰霍普金斯大学)
CommentsThe paper contains a critical error in Section 3.1, leading to invalid results in Section 3.3. This undermines the main conclusion of the paper. The authors are working on a corrected version, but in the meantime, there is not a quick fix/replacement/update available
Exploring the Vulnerability of the Content Moderation Guardrail in Large Language Models via Intent Manipulation
Jun Zhuang, Haibo Jin, Ye Zhang, Zhengjian Kang, Wenbin Zhang, Gaby G. Dagher, Haohan Wang
机构
*
Boise State University(博伊州立大学)
;
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
University of Pittsburgh(匹兹堡大学)
;
New York University(纽约大学)
;
Florida International University(佛罗里达国际大学)
CommentsAccepted for EMNLP'25 Findings. TL;DR: We propose a new two-stage intent-based prompt-refinement framework, IntentPrompt, that aims to explore the vulnerability of LLMs' content moderation guardrails by refining prompts into benign-looking declarative forms via intent manipulation for red-teaming purposes
机构
*
Red Note Hi-Lab(红笔记高研实验室)
;
Shanghai Jiaotong University(上海交通大学)
;
Nanjing University(南京大学)
;
Zhejiang University(浙江大学)
;
Chinese University of Hong Kong(香港中文大学)