VOPE: Revisiting Hallucination of Vision-Language Models in Voluntary Imagination Task
VOPE:重新审视视觉语言模型在自愿想象任务中的幻觉现象
Xingming Long, Jie Zhang, Shiguang Shan, Xilin Chen
机构
*
Key Laboratory of AI Safety of CAS, Institute of Computing Technology, Chinese Academy of Sciences (CAS)(中国科学院人工智能安全重点实验室,计算技术研究所,中国科学院)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Zhongguancun Academy(中关村学院)
机构
*
Singapore University of Technology and Design(新加坡科技设计大学)
;
Agency for Science, Technology and Research (A*STAR)(新加坡科技研究局)
;
Nanyang Technological University(南洋理工大学)
;
Chongqing University(重庆大学)
专题命中
幻觉与鲁棒性
:grounding(abstract);multimodal large language model(abstract);分类 cs.AI、cs.LG
From Sign Language Generation to Humanoid Execution: Vision-Language Guided Retargeting with Collision Mitigation
从手语生成到仿人执行:具有碰撞缓解功能的视觉语言引导重定向
Nabeela Khan, Bowen Wu, Runwu Shi, Benjamin Yen, Takeshi Ashizawa, Carlos Toshinori Ishi, Takashi Minato, Kazuhiro Nakadai
机构
*
Department of Systems and Control Engineering, Institute of Science Tokyo(东京科学大学系统与控制工程系)
;
RIKEN Guardian Robot Project(理化学研究所守护机器人项目)
;
ATR Hiroshi Ishiguro Laboratories(ATR石黑浩实验室)
;
RIKEN Center for Biosystems Dynamics Research(理化学研究所生物系统动力学研究中心)
机构
*
Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)
;
Khalifa University(哈里发大学)
;
Indian Institute of Technology Delhi(印度理工学院德里分校)