VLC Fusion: Vision-Language Conditioned Sensor Fusion for Robust Object Detection
VLC Fusion:面向鲁棒目标检测的视觉-语言条件传感器融合
Aditya Taparia, Noel Ngu, Mario Leiva, Joshua Shay Kricheli, John Corcoran, Nathaniel D. Bastian, Gerardo Simari, Paulo Shakarian, Ransalu Senanayake
机构
*
Arizona State University(亚利桑那州立大学)
;
Department of Computer Science and Engineering, Universidad Nacional del Sur and Institute for Computer Science and Engineering(计算机科学与工程系,国家南方大学和计算机科学与工程研究所)
;
U.S. Department of Defense(美国国防部)
;
United States Military Academy(美国军事学院)
;
Syracuse University(雪城大学)
HMVLA: Hyperbolic Multimodal Fusion for Vision-Language-Action Models
HMVLA:超几何多模态融合用于视觉-语言-动作模型
Kun Wang, Xiao Feng, Mingcheng Qu, Tonghua Su
机构
*
Harbin Institute of Technology(哈尔滨工业大学)
;
Chongqing Research Institute of HIT(重庆HIT研究 institute)
;
Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东人工智能与数字经济实验室(深圳))
Conflict-Aware Multimodal Fusion for Ambivalence and Hesitancy Recognition
具有冲突意识的多模态融合用于矛盾与犹豫识别
Salah Eddine Bekhouche, Hichem Telli, Azeddine Benlamoudi, Salah Eddine Herrouz, Abdelmalik Taleb-Ahmed, Abdenour Hadid
机构
*
University of the Basque Country UPV/EHU(巴斯克大学UPV/EHU)
;
Laboratory of LESIA, University of Biskra(贝斯克拉大学LESIA实验室)
;
Lab. de Génie Electrique (LAGE), University Kasdi Merbah Ouargla(奥尔加拉大学LAGE实验室)
;
Institute of Electronics, Microelectronics and Nanotechnology (IEMN), Polytechnic University of Hauts-de-France, University of Lille(电子、微电子与纳米技术研究所(IEMN),法国 Hauts-de-France 工业大学,里尔大学)
;
Sorbonne Center for Artificial Intelligence, Sorbonne University Abu Dhabi, UAE(索邦人工智能中心,索邦大学阿布扎比校区,阿联酋)
Trifuse: Enhancing Attention-Based GUI Grounding via Multimodal Fusion
Trifuse: 通过多模态融合增强基于注意力的GUI定位
Longhui Ma, Di Zhao, Siwei Wang, Zhao Lv, Miao Wang
机构
*
College of Computer Science and Technology, National University of Defense Technology(计算机科学与技术学院,国防科技大学)
;
Intelligent Game and Decision Lab, Academy of Military Sciences(智能游戏与决策实验室,军事科学院)
Frequency-domain Multi-modal Fusion for Language-guided Medical Image Segmentation
Bo Yu, Jianhua Yang, Zetao Du, Yan Huang, Chenglong Li, Liang Wang
机构
*
School of Computer Science and Technology, Anhui University(安徽大学计算机科学与技术学院)
;
NLPR, MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
School of Information Science and Technology, ShanghaiTech University(上海科技大学信息科学与技术学院)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
School of Artificial Intelligence, Anhui University(安徽大学人工智能学院)
Probing Multimodal Fusion in the Brain: The Dominance of Audiovisual Streams in Naturalistic Encoding
Hamid Abdollahi, Amir Hossein Mansouri Majoumerd, Amir Hossein Bagheri Baboukani, Amir Abolfazl Suratgar, Mohammad Bagher Menhaj
机构
*
Distributed and Intelligent Optimization Research Laboratory(分布式智能优化研究实验室)
;
Electrical Engineering Department(电气工程系)
;
Amirkabir University of Technology(阿米尔卡比尔技术大学)
机构
*
School of Automation Science and Engineering, Xi’an Jiaotong University, Xi’an, China(自动化科学与工程学院,西安交通大学,西安,中国)
;
School of Software Engineering, Xi’an Jiaotong University, Xi’an, China(软件工程学院,西安交通大学,西安,中国)
Dissecting RGB-D Learning for Improved Multi-modal Fusion
Hao Chen, Haoran Zhou, Yunshu Zhang, Zheng Lin, Yongjian Deng
机构
*
School of Computer Science and Engineering, Southeast University(东南大学计算机科学与工程学院)
;
Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications (Southeast University), Ministry of Education, China(新一代人工智能技术及跨学科应用国家重点实验室(东南大学))
;
Tsinghua University(清华大学)
;
College of Computer Science, Beijing University of Technology(北京理工大学计算机学院)
A Joint Cross-Attention Model for Audio-Visual Fusion in Dimensional Emotion Recognition
R. Gnana Praveen, Wheidima Carneiro de Melo, Nasib Ullah, Haseeb Aslam, Osama Zeeshan, Théo Denorme, Marco Pedersoli, Alessandro Koerich, Simon Bacon, Patrick Cardinal, Eric Granger
Hierarchical Audio-Visual Information Fusion with Multi-label Joint Decoding for MER 2023
Haotian Wang, Yuxuan Xi, Hang Chen, Jun Du, Yan Song, Qing Wang, Hengshun Zhou, Chenxi Wang, Jiefeng Ma, Pengfei Hu, Ya Jiang, Shi Cheng, Jie Zhang, Yuzhe Weng