CommentsAccepted to the IEEE ICRA 2026 International Joint Workshop on Ontologies, Semantic Maps and Autonomous Robotics Standardization (J-WOSMARS 2026), Vienna, 2026
Zheng Tang, Shuo Wang, David C. Anastasiu, Ming-Ching Chang, Anuj Sharma, Quan Kong, Munkhjargal Gochoo, Jun-Wei Hsieh, Tomasz Kornuta, Zhedong Zheng, Renran Tian, Judah Goldfeder, Fulgencio Navarro, Yuxing Wang, Yizhou Wang, Sameer Satish Pusegaonkar, Anqi Li, Nalin Dadhich, Ridham Kachhadiya, Dhanishtha Patil, Haoquan Liang, Jiajun Li, Han Zhang, Yilin Zhao, Zaid Pervaiz Bhat, Shuyu Yang, Ashutosh Kumar, Rong Wang, Rafael Martin Nieto, Peter Christiansen, Ahmed Abduljawad, Mohanrasu Shanmugam, Nadeem Shaik, Sujit Biswas, Xunlei Wu, Vidya Murali, Rama Chellappa
机构
*
Santa Clara University(圣克拉拉大学)
;
University at Albany, SUNY(纽约州立大学奥尔巴尼分校)
;
Iowa State University(爱荷华州立大学)
;
Woven by Toyota(丰田编织公司)
;
United Arab Emirates University(阿拉伯联合酋长国大学)
;
National Yang Ming Chiao Tung University(国立阳明交通大学)
;
University of Macau(澳门大学)
;
North Carolina State University(北卡罗来纳州立大学)
;
Columbia University(哥伦比亚大学)
;
Milestone Systems(里程碑系统公司)
;
Xi’an Jiaotong University(西安交通大学)
;
Johns Hopkins University(约翰斯·霍普金斯大学)
机构
*
University of Monastir(莫纳斯提尔大学)
;
St. Mildred’s-Lightbourn School(圣米尔德雷德-莱特本学校)
;
Cornell University(康奈尔大学)
;
Carnegie Mellon University(卡内基梅隆大学)
;
Silverstream AI(银流人工智能公司)
;
Mila -- Quebec AI Institute(米拉-魁北克人工智能研究所)
Why Vision Fails as a Universal Bridge: Rectifying Modality Asynchrony in Multilingual MLLMs
为何视觉无法作为通用桥梁:修正多语言多模态大语言模型(MLLMs)中的模态异步性
Yihang Du, Juhao Liang, Zhengzhao Lai, Siyu Li, Yan Hu
机构
*
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
;
Shenzhen Loop Area Institute(深圳河套学院)
;
National Health Data Institute (Shenzhen)(国家健康数据研究院(深圳))
Heterogeneous Vision-Language Ensemble with Disagreement-Aware Reranking for Text-Based Person Anomaly Retrieval
用于基于文本的行人异常检索的、带分歧感知重排序的异构视觉语言集成方法
Huu-An Vu, Cam Tu Tran Thi, Thanh Toan Le Ngo, Hoang Vo, Do Trung Hieu, Hieu Dinh Trung Pham, Khang Minh Le, Huy Minh Nhat Nguyen
机构
*
Hanoi University of Science and Technology(河内科技大学)
;
University of Information Technology, VNU-HCM(胡志明市国家大学信息技术大学)
;
Vietnam National University, Ho Chi Minh City(胡志明市国家大学)
;
VinUniversity
;
Vietnamese-German University(越南德国大学)
A Neighborhood Attention Transformer Network for Enhanced 3D Segmentation of the Left Anterior Descending Artery
用于增强左前降动脉三维分割的邻域注意力Transformer网络
Rafi Ibn Sultan, Chengyin Li, Yiannos Demetriou, Ahmed I. Ghanem, Joshua P. Kim, Justine Cunningham, Hassan Bagher-Ebadian, Dongxiao Zhu, Kundan S. Thind
机构
*
Wayne State University(韦恩州立大学)
;
Henry Ford Health(亨利福特医疗集团)
;
Alexandria University(亚历山大大学)
;
Michigan State University(密歇根州立大学)
;
Oakland University(奥克兰大学)
;
Institute for AI and Data Science, Wayne State University(韦恩州立大学人工智能与数据科学学院)
机构
*
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Beijing Normal University(北京师范大学)
Corrupting Attention: Evasion-Based Adversarial Attacks on Encoder Attention in Detection Transformers
破坏注意力:对检测 Transformer 中编码器注意力的基于规避的对抗攻击
Ridma Jayasundara, Shaheer Mohamed, Tharindu Fernando, Harshala Gammulle, Basura Fernando, Sanka Rasnayake, A V Subramanyam, Sridha Sridharan, Clinton Fookes
机构
*
Queensland University of Technology(昆士兰科技大学)
;
Agency for Science, Technology and Research, Singapore(新加坡科技研究局)
;
National University of Singapore(新加坡国立大学)
;
Indraprastha Institute of Information Technology, Delhi(英迪拉普拉斯塔信息技术学院(德里))
CommentsThis is the accepted version of a paper to be presented at the 2026 IEEE Frontiers in Education Conference (FIE). The final version will be available via IEEE Xplore