Beyond the Global Scores: Fine-Grained Token Grounding as a Robust Detector of LVLM Hallucinations
超越全局评分:细粒度令牌接地作为检测LVLM幻觉的稳健检测器
Tuan Dung Nguyen, Minh Khoi Ho, Qi Chen, Yutong Xie, Nguyen Cam-Tu, Minh Khoi Nguyen, Dang Huy Pham Nguyen, Anton van den Hengel, Johan W. Verjans, Phi Le Nguyen, Vu Minh Hieu Phan
机构
*
Hanoi University of Science and Technology(河内科技大学)
;
Australian Institute for Machine Learning, University of Adelaide(澳大利亚机器学习研究所,阿德莱德大学)
;
Nanjing University(南京大学)
;
Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)
;
Hanoi-Amsterdam High School for the Gifted(河内阿姆斯特丹天才高中)
A Patch-based Cross-view Regularized Framework for Backdoor Defense in Multimodal Large Language Models
基于补丁的跨视图正则化框架用于多模态大语言模型中的后门防御
Tianmeng Fang, Yong Wang, Zetai Kong, Zengzhen Su, Jun Wang, Chengjin Yu, Wei Wang
机构
*
Singapore Management University(新加坡管理大学)
;
China University of Mining and Technology(中国矿业大学)
;
The University of Melbourne(墨尔本大学)
;
Anhui University(安徽大学)
;
Xi’an Jiaotong University(西安交通大学)
;
Sun Yat-sen University(中山大学)
专题命中
VLM训练与架构
:multimodal large language model(title,abstract);分类 cs.CV、cs.LG