When Looking Is Not Enough: Visual Attention Structure Reveals Hallucination in MLLMs
当观察不足时:视觉注意结构揭示大语言模型中的幻觉
Fanpu Cao, Xin Zou, Xuming Hu, Hui Xiong
机构
*
Thrust of Artificial Intelligence, HKUST (Guangzhou)(人工智能前沿 thrust,香港科技大学(广州))
;
Department of Computer Science and Engineering, HKUST(计算机科学与工程系,香港科技大学)
Interpreting Context-Aware Human Preferences for Multi-Objective Robot Navigation
解释情境感知的人类偏好以实现多目标机器人导航
Tharun Sethuraman, Subham Agrawal, Nils Dengler, Jorge de Heuvel, Teena Hassan, Maren Bennewitz
机构
*
Hochschule Bonn-Rhein-Sieg, Germany(波恩-莱茵-锡格应用科学大学,德国)
;
University of Bonn, Germany(波恩大学,德国)
;
Lamarr Institute for Machine Learning and Artificial Intelligence, Germany(拉马尔机器学习与人工智能研究所,德国)
VIMCAN: Visual-Inertial 3D Human Pose Estimation with Hybrid Mamba-Cross-Attention Network
VIMCAN: 基于混合Mamba-交叉注意力网络的视觉-惯性3D人体姿态估计
Zepeng Yang, Junxuan Bai, Hao Li, Ju Dai, Junjun Pan, Yongfeng Yin, Bin Li
机构
*
Beihang University(北航)
;
Peng Cheng Laboratory(鹏城实验室)
;
Capital University of Physical Education and Sports(首都体育学院)
;
Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院)
LoopUS: Recasting Pretrained LLMs into Looped Latent Refinement Models
LoopUS: 将预训练大语言模型转换为循环潜在细化模型
Taekhyun Park, Yongjae Lee, Dohee Kim, Hyerim Bae
机构
*
Department of Data Science(数据科学系)
;
Department of Industrial Engineering(工业工程系)
;
Pusan National University(釜山国立大学)
;
Changwon National University(昌原国立大学)
Coevolutionary Continuous Discrete Diffusion: Make Your Diffusion Language Model a Latent Reasoner
连续离散扩散:使你的扩散语言模型成为潜在推理器
Cai Zhou, Chenxiao Yang, Yi Hu, Chenyu Wang, Chubin Zhang, Muhan Zhang, Lester Mackey, Tommi Jaakkola, Stephen Bates, Dinghuai Zhang
机构
*
Massachusetts Institute of Technology(麻省理工学院)
;
Microsoft Research(微软研究院)
;
Toyota Technological Institute at Chicago(丰田技术研究所(芝加哥))
;
Peking University(北京大学)
;
Tsinghua University(清华大学)
Deep Reasoning in General Purpose Agents via Structured Meta-Cognition
通过结构化元认知实现通用代理中的深度推理
Dean Light, Michael Theologitis, Kshitish Ghate, Shuyue Stella Li, Benjamin Newman, Chirag Shah, Aylin Caliskan, Pang Wei Koh, Dan Suciu, Yulia Tsvetkov
机构
*
Indiana University(印第安纳大学)
;
The University of New South Wales(新南威尔士大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
University of California San Diego(加州大学圣地亚哥分校)
;
Adobe Research(Adobe研究院)
VulTriage: Triple-Path Context Augmentation for LLM-Based Vulnerability Detection
VulTriage:基于LLM的漏洞检测三路径上下文增强
Wenxin Tang, Xiang Zhang, Junliang Liu, Jingyu Xiao, Xi Xiao, Jinlong Yang, Yuehe Ma, Zhenyu Liu, Zhengheng Li, Zicheng Wang, Wang Luo, Qing Li, Lei Wang, Peng Xiangli
机构
*
Tsinghua University(清华大学)
;
Henan University(河南大学)
;
Dalian Maritime University(大连海事大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
Northwestern Polytechnical University(西北工业大学)
;
BNU-HKBU United International College(北京理工大学-香港大学联合国际学院)
;
Southeast University(东南大学)
;
Jilin University(吉林大学)
;
Sun Yat-sen University(中山大学)
;
Peng Cheng Laboratory(鹏城实验室)
;
Guangzhou Intelligence Communications Technology Co., Ltd.(广州智能通信技术有限公司)
;
The Fifth Electronic Research Institute of MIIT(信息产业部第五电子研究所)