CommentsPreprint. Accepted at NeurIPS 2025 Workshops on SPACE in Vision, Language, and Embodied AI (SpaVLE) as Oral, Embodied World Models for Decision Making (EWM), Aligning Reinforcement Learning Experimentalists and Theorists (ARLET), and Scaling Environments for Agents (SEA)
机构
*
Department of Control Science and Engineering, College of Electronic and Information Engineering, and Shanghai Institute of Intelligent Science and Technology, Tongji University(同济大学电子与信息工程学院控制科学与工程系,以及上海智能科学与技术研究院)
;
Department of Electronic Engineering, Faculty of Engineering, The Chinese University of Hong Kong(香港中文大学工程学院电子工程系)
;
Shanghai Operation Robot Co., Ltd.(上海微创医疗机器人(集团)股份有限公司)
SEDualVLN: A Spatially-Enhanced Dual-System for Vision-Language Navigation
SEDualVLN:一种空间增强的双系统用于视觉语言导航
Jingzhi Huang, Junkai Huang, Wenxuan Song, Haoyang Yang, Hailong Huang, Haoang Li, Yi Wang
机构
*
Hong Kong Polytechnic University(香港理工大学)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
CommentsAccepted in the NAACL Fourth Workshop on Intelligent and Interactive Writing Assistants (In2Writing), Albuquerque, New Mexico, May 2025, https://in2writing.glitch.me
Efficient Adaptation For Remote Sensing Visual Grounding
Hasan Moughnieh, Mohamad Chalhoub, Hasan Nasrallah, Cristiano Nattero, Paolo Campanella, Giovanni Nico, Ali J. Ghandour
机构
*
American University of Beirut(贝鲁特美国大学)
;
Lebanese University(黎巴嫩大学)
;
RASID SARL
;
WASDI
;
Institute for Applied Mathematics, CNR Bari(应用数学研究所,CNR巴里)
;
National Center for Remote Sensing, CNRS(遥感国家中心,CNRS)