Zhi Li, Songkun Yan, Jie Cao, Mofan Zhang, Anjiang Wei, Jinwoong Yoo, Yang Hong
机构
*
Civil, Environmental, and Architectural Engineering, University of Colorado Boulder(科罗拉多大学波尔德分校土木、环境与建筑工程系)
;
Civil Engineering and Environmental Sciences, University of Oklahoma(俄克拉荷马大学土木工程与环境科学系)
;
Department of Computer Science, University of Oklahoma(俄克拉荷马大学计算机科学系)
;
Civil and Environmental Engineering, Stanford University(斯坦福大学土木与环境工程系)
;
Department of Computer Science, Stanford University(斯坦福大学计算机科学系)
;
NASA Goddard Space Flight Center(美国国家航空航天局戈达德空间飞行中心)
QQJ: Quantifying Qualitative Judgment for Scalable and Human-Aligned Evaluation of Generative AI
QQJ: 量化定性判断以实现可扩展且与人类对齐的生成AI评估
Marjan Veysi, Pirooz Shamsinejadbabaki, Mohammad Zare, Mohammad Sabouri
机构
*
AI Lab, Arioobarzan Engineering Team(艾伊罗巴赞工程团队人工智能实验室)
;
Department of Computer Engineering and Information Technology(计算机工程与信息科技系)
;
Department of Informatics, Bioengineering, Robotics and Systems Engineering(信息学、生物工程、机器人与系统工程系)
;
University of Genoa(热那亚大学)
Auditing Multimodal LLM Raters: Central Tendency Bias in Clinical Ordinal Scoring
对多模态大语言模型评分者的审计:临床顺序评分中的中间倾向偏差
Jiaqing Zhang, Sandeep Elluri, Bhanu Cherukuvada, Yonah Joffe, Jessica Sena, Miguel Contreras, Scott Siegel, Subhash Nerella, Catherine Price, Parisa Rashidi
机构
*
Department of Electrical & Computer Engineering(电气与计算机工程系)
;
Department of Computer and Information Science and Engineering(计算机与信息科学与工程系)
;
Department of Clinical and Health Psychology(临床与健康心理学系)
;
Department of Biomedical Engineering(生物医学工程系)
专题命中
幻觉与鲁棒性
:multimodal large language model(abstract);分类 cs.CV
Probing Cross-modal Information Hubs in Audio-Visual LLMs
探测音频-视觉大语言模型中的跨模态信息枢纽
Jihoo Jung, Chaeyoung Jung, Ji-Hoon Kim, Joon Son Chung
机构
*
Department of Electrical Engineering, Korea Advanced Institute of Science
;
The Graduate School of Advanced Imaging Science, Multimedia \& Film, Chung-Ang University, Seoul, Republic of Korea
专题命中
幻觉与鲁棒性
:vision language model(abstract);分类 cs.AI
Vocabulary Hijacking in LVLMs: Unveiling Critical Attention Heads by Excluding Inert Tokens to Mitigate Hallucination
LVLMs中的词汇劫持:通过排除惰性标记来揭示关键注意力头以缓解幻觉
Yangneng Chen, Junlin Li, Weijun Yao, Xilai Ma, Guodong Du, Wenya Wang, Jing Li
机构
*
Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))
;
Huawei Technologies Co., Ltd.(华为技术有限公司)
;
The Hong Kong Polytechnic University(香港理工大学)
;
Nanyang Technological University(南洋理工大学)
机构
*
University of Science and Technology of China(中国科学技术大学)
;
Hefei University of Technology(合肥工业大学)
;
The Hong Kong University of Science and Technology(香港科学与技术大学)
;
Institute of Intelligent Machines, Chinese Academy of Sciences(中国科学院智能 Machines 研究所)
专题命中
幻觉与鲁棒性
:multimodal large language model(abstract);分类 cs.AI
Uncovering Entity Identity Confusion in Multimodal Knowledge Editing
揭示多模态知识编辑中的实体身份混淆
Shu Wu, Xiaotian Ye, Xinyu Mou, Dongsheng Liu, Xiaohan Wang, Mengqi Zhang
机构
*
New Laboratory of Pattern Recognition (NLPR)(模式识别新实验室)
;
State Key Laboratory of Multimodal Artificial Intelligence Systems (MAIS)(多模态人工智能系统国家重点实验室)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences(中国科学院大学先进交叉学科学院)
;
Huazhong University of Science and Technology(华中科技大学)
;
Shandong University(山东大学)