ClueTracer: Question-to-Vision Clue Tracing for Training-Free Hallucination Suppression in Multimodal Reasoning
ClueTracer: 问题到视觉线索追踪用于无训练 hallucination 抑制在多模态推理
Gongli Xi, Kun Wang, Zeming Gao, Huahui Yi, Haolang Lu, Ye Tian, Wendong Wang
机构
*
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Nanyang Technological University(南洋理工大学)
;
West China Biomedical Big Data Center(西京生物大数据中心)
AlphaFace: High Fidelity and Real-time Face Swapper Robust to Facial Pose
AlphaFace: 高保真和实时的面部交换器,对面部姿态具有鲁棒性
Jongmin Yu, Hyeontaek Oh, Zhongtian Sun, Angelica I Aviles-Rivero, Moongu Jeon, Jinhong Yang
机构
*
University of Cambridge(剑桥大学)
;
University of Kent(肯特大学)
;
Tsinghua University(清华大学)
;
Gwangju Institute of Science and Technology(全州科学技术院)
;
Inje University(庆北大学)
机构
*
College of Computer Science and Technology, Key Laboratory of Symbolic Computation and Knowledge Engineering, Ministry of Education, Jilin University(吉林大学计算机科学与技术学院,符号计算与知识工程重点实验室,教育部,吉林大学)
;
College of Software, Jilin University(吉林大学软件学院)
;
Facemind Group(FaceMind集团)
;
School of Computer Science and Information Engineering, Hefei University of Technology(合肥工业大学计算机科学与信息工程学院)
机构
*
University of Science and Technology of China(中国科学技术大学)
;
Shanghai AI Laboratory(上海人工智能实验室)
;
National University of Singapore(新加坡国立大学)
;
The Hong Kong University of Science and Technology(香港科学与技术大学)
;
The University of Hong Kong(香港大学)
;
CUHK MMLab(香港中文大学MMLab)
;
Xi’an Jiaotong University(西安交通大学)
;
Nanjing University(南京大学)
;
Harbin Institute of Technology(哈尔滨工业大学)
Hao Cheng, Erjia Xiao, Jing Shao, Yichi Wang, Le Yang, Chao Shen, Philip Torr, Jindong Gu, Renjing Xu
机构
*
Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
University of Oxford(牛津大学)
;
Xi’an Jiaotong University(西安交通大学)
;
Hong Kong University of Science and Technology(香港科技大学)
;
Northeastern University(东北大学)
;
Beijing University of Technology(北京理工大学)
专题命中
幻觉与鲁棒性
:multimodal large language model(abstract);分类 cs.AI、cs.LG
Vision-Language Introspection: Mitigating Overconfident Hallucinations in MLLMs via Interpretable Bi-Causal Steering
视觉-语言反思:通过可解释的双因果引导减轻大语言模型中的过度自信幻觉
Shuliang Liu, Songbo Yang, Dong Fang, Sihang Jia, Yuqi Tang, Lingfeng Su, Ruoshui Peng, Yibo Yan, Xin Zou, Xuming Hu
机构
*
The Hong Kong University of Science and Technology (Guangzhou)(香港理工大学(广州))
;
The Hong Kong University of Science and Technology(香港理工大学)
;
LIGHTSPEED
专题命中
幻觉与鲁棒性
:multimodal large language model(abstract);分类 cs.CV、cs.AI
The Forgotten Shield: Safety Grafting in Parameter-Space for Medical MLLMs
被遗忘的盾牌:参数空间中的医疗大语言模型安全性移植
Jiale Zhao, Xing Mou, Jinlin Wu, Hongyuan Yu, Mingrui Sun, Yang Shi, Xuanwu Yin, Zhen Chen, Zhen Lei, Yaohua Wang
机构
*
National University of Defense Technology(国防科技大学)
;
Multimodal Artificial Intelligence Systems (MAIS), Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所多模态人工智能系统(MAIS))
;
Multimedia Department, Xiaomi Inc(小米公司多媒体部门)
;
Centre for Artificial Intelligence and Robotics, Hong Kong Institute of Science and Innovation, Chinese Academy of Sciences, Hong Kong(香港科学院人工智能与机器人中心)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences, UCAS(中国科学院大学人工智能学院)
专题命中
幻觉与鲁棒性
:multimodal large language model(abstract);分类 cs.AI、cs.LG
Scanner-Induced Domain Shifts Undermine the Robustness of Pathology Foundation Models
扫描诱导的域偏移损害病理基础模型的鲁棒性
Erik Thiringer, Fredrik K. Gustafsson, Kajsa Ledesma Eriksson, Mattias Rantalainen
机构
*
Department of Medical Epidemiology and Biostatistics, Karolinska Institutet(卡罗林斯卡研究所医学流行病学与生物统计学系)
;
Department of Engineering Science, University of Oxford(牛津大学工程科学系)
Benchmark Success, Clinical Failure: When Reinforcement Learning Optimizes for Benchmarks, Not Patients
基准成功,临床失败:当强化学习优化于基准,而非患者
Armin Berger, Manuela Bergau, Helen Schneider, Saad Ahmad, Tom Anglim Lagones, Gianluca Brugnara, Martha Foltyn-Dumitru, Kai Schlamp, Philipp Vollmuth, Rafet Sifa
机构
*
Fraunhofer IAIS(弗劳恩霍夫人工智能研究所)
;
University of Bonn(波恩大学)
;
Lamarr Institute(拉马尔研究所)
;
Department of Health Queensland(昆士兰健康部)
;
Griffith University(格里菲斯大学)
;
University Hospital Bonn(波恩大学医院)
MM-SpuBench: Towards Better Understanding of Spurious Biases in Multimodal LLMs
MM-SpuBench:迈向更好地理解多模态大语言模型中伪偏差的深入研究
Wenqian Ye, Bohan Liu, Guangtao Zheng, Di Wang, Yunsheng Ma, Xu Cao, Bolin Lai, James M. Rehg, Aidong Zhang
机构
*
University of Virginia(弗吉尼亚大学)
;
Purdue University(普渡大学)
;
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
Georgia Institute of Technology(佐治亚理工学院)
专题命中
幻觉与鲁棒性
:multimodal large language model(abstract);分类 cs.CV、cs.LG
RoboSafe: Safeguarding Embodied Agents via Executable Safety Logic
RoboSafe: 通过可执行的安全逻辑保障具身智能体
Le Wang, Zonghao Ying, Xiao Yang, Quanchen Zou, Zhenfei Yin, Tianlin Li, Jian Yang, Yaodong Yang, Aishan Liu, Xianglong Liu
机构
*
Beihang University(北航大学)
;
AI Security Lab(360AI安全实验室)
;
The University of Sydney(悉尼大学)
;
Nanyang Technological University(南洋理工大学)
;
Peking University(北京大学)
;
Beijing Academy of Artificial Intelligence(北京人工智能研究院)
MIMIR: Masked Image Modeling for Mutual Information-based Adversarial Robustness
MIMIR:基于互信息的对抗鲁棒性图像建模
Xiaoyun Xu, Shujian Yu, Zhuoran Liu, Stjepan Picek
机构
*
Radboud University Nijmegen(拉德博德大学尼姆维根分校)
;
Vrije Universiteit Amsterdam(自由大学阿姆斯特丹)
;
University of Zagreb Faculty of Electrical Engineering and Computing(Zagreb大学电子工程与计算学院)
SAVE: Sparse Autoencoder-Driven Visual Information Enhancement for Mitigating Object Hallucination
SAVE:基于稀疏自编码器的视觉信息增强用于缓解物体幻觉
Sangha Park, Seungryong Yoo, Jisoo Mok, Sungroh Yoon
机构
*
Department of Electrical and Computer Engineering, Seoul National University(电子与计算机工程系,首尔国立大学)
;
Daegu Gyeongbuk Institute of Science and Technology(大邱庆州科学技术院)
;
IPAI, AIIS, ASRI, INMC, and ISRC, Seoul National University(IPAI、AIIS、ASRI、INMC 和 ISRC,首尔国立大学)
专题命中
幻觉与鲁棒性
:multimodal large language model(abstract);分类 cs.CV、cs.AI