Beyond Textual Knowledge-Leveraging Multimodal Knowledge Bases for Enhancing Vision-and-Language Navigation
超越文本知识的多模态知识库用于增强视觉-语言导航
Dongsheng Yang, Yinfeng Yu, Liejun Wang
机构
*
School of Computer Science and Technology, Xinjiang University(新疆大学计算机科学与技术学院)
;
Joint International Research Laboratory of Silk Road Multilingual Cognitive Computing(丝绸之路多语言认知计算联合国际研究实验室)
Cerebra: A Multidisciplinary AI Board for Multimodal Dementia Characterization and Risk Assessment
Cerebra:一个多学科AI平台用于多模态痴呆症特征化和风险评估
Sheng Liu, Long Chen, Zeyun Zhao, Qinglin Gou, Qingyue Wei, Arjun Masurkar, Kevin M. Spiegler, Philip Kuball, Stefania C. Bray, Megan Bernath, Deanna R. Willis, Jiang Bian, Lei Xing, Eric Topol, Kyunghyun Cho, Yu Huang, Ruogu Fang, Narges Razavian, James Zou
机构
*
Department of Biomedical Data Science, Stanford University(斯坦福大学生物医学数据科学系)
;
Department of Radiation Oncology, Stanford University(斯坦福大学放射肿瘤科)
;
Center for Data Science, New York University(纽约大学数据科学中心)
;
J. Crayton Pruitt Family Department of Biomedical Engineering, University of Florida(佛罗里达大学杰·克雷顿·普瑞特家庭生物医学工程系)
;
Department of Biomedical Engineering and Informatics, Indiana University Indianapolis(印第安纳大学印第安纳波利斯分校生物医学工程与信息学系)
;
Department of Neurology, NYU Grossman School of Medicine(纽约大学格罗斯曼医学院神经科)
;
Department of Neuroscience, NYU Grossman School of Medicine(纽约大学格罗斯曼医学院神经科学系)
;
UF Health Family Medicine – Haile Plantation(佛罗里达大学健康家庭医学-海莱种植园)
;
Department of Family Medicine, Indiana University School of Medicine(印第安纳大学医学院家庭医学系)
;
Department of Biostatistics and Health Data Science, Indiana University School of Medicine(印第安纳大学医学院生物统计学与健康数据科学系)
;
Scripps Research Translational Institute(斯克里普斯研究转化研究所)
;
Courant Institute, New York University(纽约大学柯朗研究所)
;
Center for Biomedical Informatics, Regenstrief Institute(再生斯蒂夫研究所生物医学信息中心)
;
Center for Cognitive Aging and Memory, McKnight Brain Institute, University of Florida(佛罗里达大学麦金托神经研究所认知衰老与记忆中心)
;
Population Health Department, NYU Langone Health(纽约大学兰戈恩健康人口健康部)
;
Radiology Department, NYU Langone Health(纽约大学兰戈恩健康放射科)
专题命中
多模态评测
:multimodal(title,abstract);multimodal foundation model(abstract);分类 cs.CV、cs.AI
Cross-Modal Rationale Transfer for Explainable Humanitarian Classification on Social Media
跨模态推理迁移用于社交媒体上可解释的人道主义分类
Thi Huyen Nguyen, Koustav Rudra, Wolfgang Nejdl
机构
*
L3S Research Center \ University Hannover Hannover Germany
;
Indian Institute of Technology Kharagpur Kharagpur India
;
L3S Research Center\ University Hannover Hannover Germany
;
L3S Research Center \ University Hannover
;
Indian Institute of Technology Kharagpur
;
L3S Research Center\ University Hannover
MER-Bench: A Comprehensive Benchmark for Multimodal Meme Reappraisal
MER-Bench:多模态表情包再解释的综合基准
Yiqi Nie, Fei Wang, Junjie Chen, Kun Li, Yudi Cai, Dan Guo, Chenglong Li, Meng Wang
机构
*
School of Artificial Intelligence, Anhui University(安徽大学人工智能学院)
;
Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(合肥综合性国家科学中心人工智能研究院)
;
School of Computer Science and Information Engineering, Hefei University of Technology(合肥工业大学计算机科学与信息工程学院)
;
College of Information Technology, United Arab Emirates University(阿拉伯联合酋长国大学信息学院)
;
Institute of Advanced Technology, University of Science and Technology of China(中国科学技术大学先进技术研究院)
机构
*
University of Science and Technology of China(中国科学技术大学)
;
State Key Laboratory of Cognitive Intelligence(认知智能国家重点实验室)
;
iFLYTEK AI Research(iFLYTEK人工智能研究院)
;
Hong Kong University of Science and Technology(香港科学与技术大学)
机构
*
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
;
School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院)
EHWGesture -- A dataset for multimodal understanding of clinical gestures
EHWGesture -- 一个用于多模态理解临床手势的数据集
Gianluca Amprimo, Alberto Ancilotto, Alessandro Savino, Fabio Quazzolo, Claudia Ferraris, Gabriella Olmo, Elisabetta Farella, Stefano Di Carlo
机构
*
Department of Control and Computer Engineering, Politecnico di Torino(控制与计算机工程系,都灵理工大学)
;
Fondazione Bruno Kessler(布鲁诺·凯斯勒基金会)
;
CNR-IEIIT(意大利国家研究委员会-IEIIT)
机构
*
Peking University(北京大学)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Nankai University(南开大学)
;
Beijing Institute of Technology(北京理工大学)
;
Baichuan Inc.(百度文心)
Human-Aligned MLLM Judges for Fine-Grained Image Editing Evaluation: A Benchmark, Framework, and Analysis
面向细粒度图像编辑评估的人类对齐MLLM评判:一个基准、框架和分析
Runzhou Liu, Hailey Weingord, Sejal Mittal, Prakhar Dungarwal, Anusha Nandula, Bo Ni, Samyadeep Basu, Hongjie Chen, Nesreen K. Ahmed, Li Li, Jiayi Zhang, Koustava Goswami, Subhojyoti Mukherjee, Branislav Kveton, Puneet Mathur, Franck Dernoncourt, Yue Zhao, Yu Wang, Ryan A. Rossi, Zhengzhong Tu, Hongru Du
机构
*
University of Virginia(弗吉尼亚大学)
;
Columbia University(哥伦比亚大学)
;
Vanderbilt University(范德比大学)
;
Adobe Research(Adobe研究)
;
Dolby Laboratories(杜比实验室)
;
Cisco Research(思科研究)
;
University of Southern California(南加州大学)
;
University of Wisconsin-Madison(威斯康星大学麦迪逊分校)
;
University of Oregon(俄勒冈大学)
;
Texas A&M University(德克萨斯大学)
机构
*
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Southeast University(东南大学)
;
School of Computing, National University of Singapore(新加坡国立大学计算机学院)
OmniMER: Auxiliary-Enhanced LLM Adaptation for Indonesian Multimodal Emotion Recognition
OmniMER: 增辅增强的LLM适应用于印度尼西亚多模态情感识别
Xueming Yan, Boyan Xu, Yaochu Jin, Lixian Xiao, Wenlong Ye, Runyang Cai, Zeqi Zheng, Jingfa Liu, Aimin Yang, Yongduan Song
机构
*
School of Information Science and Technology, Guangdong University of Foreign Studies(广东外语外贸大学信息科学与技术学院)
;
School of Computer Science, Guangdong University of Technology(广东工业大学计算机学院)
;
Faculty of Asian Languages and Cultures, Guangdong University of Foreign Studies(广东外语外贸大学亚洲语言文化学院)
;
School of Engineering, Westlake University(西湖大学工程学院)
;
School of Computer Science and Intelligence Education, Lingnan Normal University(岭南师范学院计算机科学与智能教育学院)
;
School of Automation, Chongqing University(重庆大学自动化学院)
Adaptive Multimodal Person Recognition: A Robust Framework for Handling Missing Modalities
自适应多模态人物识别:一种处理缺失模态的稳健框架
Aref Farhadipour, Teodora Vukovic, Volker Dellwo, Petr Motlicek, Srikanth Madikeri
机构
*
Department of Computational Linguistics, University of Zurich(苏黎世大学计算语言学系)
;
Faculty of Information Technology, Brno University of Technology(布拉格技术大学信息学院)
;
Idiap Research Institute(Idiap研究机构)
机构
*
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
Shanghai Jiao Tong University(上海交通大学)
;
Peking University(北京大学)
;
Sun Yat-Sen University(中山大学)
;
Chinese University of Hong Kong(香港中文大学)