机构
*
Nanjing University(南京大学)
;
Beihang University(北京航空航天大学)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
BMW (Nanjing) Information Technology Co., Ltd.(宝马(南京)信息技术有限公司)
;
University of Rochester(罗切斯特大学)
专题命中
GUI与屏幕智能体
:multimodal large language model(abstract);MLLM(abstract_cn);分类 cs.CV
How You Move Tells What You'll Do: Trajectory-Conditioned Egocentric Prediction
如何移动决定了将来的行动:轨迹条件的自身视角预测
Sejoon Jun, Hai Nguyen-Truong, Luigi Seminara, Lorenzo Torresani
机构
*
Khoury College of Computer Sciences, Northeastern University, Boston(北德文斯克学院,东北大学,波士顿)
;
Korea Advanced Institute of Science and Technology, Daejeon(韩国科学技术院,大田)
;
Department of Mathematics and Computer Science, University of Catania, Italy(卡塔尼亚大学数学与计算机科学系,意大利)
Robo-Cortex: A Self-Evolving Embodied Agent via Dual-Grain Cognitive Memory and Autonomous Knowledge Induction
Robo-Cortex: 通过双粒认知记忆和自主知识诱导实现自我进化具身智能体
Nga Teng Chan, Yi Zhang, Yechi Liu, Renwen Cui, Fanhu Zeng, Zeyuan Ding, Xiancong Ren, Zhang Zhang, Qifeng Chen, Jian Liu, Yong Dai, Xiaozhu Ju
机构
*
The Hong Kong University of Science and Technology(香港科学与技术大学)
;
X-Humanoid
;
Institute of Automation, CAS(中国科学院自动化研究所)
;
Beijing University of Aeronautics and Astronautics(北京航空航天大学)
SpaAct: Spatially-Activated Transition Learning with Curriculum Adaptation for Vision-Language Navigation
SpaAct:基于课程适应的空间激活转换学习用于视觉语言导航
Pengna Li, Kangyi Wu, Shaoqing Xu, Fang Li, Hanbing Li, Lin Zhao, Kailin Lyu, Long Chen, Zhi-Xin Yang, Nanning Zheng
机构
*
National Key Laboratory of Human-Machine Hybrid Augmented Intelligence(人机混合增强智能国家重点实验室)
;
National Engineering Research Center for Visual Information and Applications(视觉信息与应用国家工程研究中心)
;
Institute of Artificial Intelligence and Robotics(人工智能与机器人研究所)
;
The State Key Laboratory of Internet of Things for Smart City(智能城市物联网国家重点实验室)
;
Centre for Artificial Intelligence and Robotics(人工智能与机器人中心)
;
University of Macau(澳门大学)
;
Xiaomi EV(小i EV)
;
School of Automation(自动化学院)
;
Beijing Institute of Technology(北京理工大学)
;
Institute of Automation(自动化研究所)
;
Chinese Academy of Sciences(中国科学院)
Vision-Language-Action in Robotics: A Survey of Datasets, Benchmarks, and Data Engines
机器人中的视觉-语言-动作:数据集、基准和数据引擎的综述
Ziyao Wang, Bingying Wang, Hanrong Zhang, Tingting Du, Tianyang Chen, Guoheng Sun, Yexiao He, Zheyu Shen, Wanghao Ye, Ang Li
机构
*
University of Maryland, College Park(马里兰大学学院公园分校)
;
University of Utah(犹他大学)
;
Northeastern University(东北大学)
;
University of Wisconsin–Madison(威斯康星大学麦迪逊分校)
ROSClaw: A Hierarchical Semantic-Physical Framework for Heterogeneous Multi-Agent Collaboration
ROSClaw:一种用于异构多智能体协作的分层语义-物理框架
Rongfeng Zhao, Xuanhao Zhang, Zhaochen Guo, Xiang Shao, Zhongpan Zhu, Bin He, Jie Chen
机构
*
Shanghai Research Institute for Intelligent Autonomous Systems(上海智能自主系统研究院)
;
National Key Laboratory of Autonomous Intelligent Unmanned Systems (Tongji University)(自主智能无人系统全国重点实验室(同济大学))
;
Frontiers Science Center for Intelligent Autonomous Systems(智能自主系统前沿科学中心)
;
Tongji University(同济大学)
;
College of Electronics and Information Engineering, Tongji University(同济大学电子与信息工程学院)
RANGER: A Monocular Zero-Shot Semantic Navigation Framework through Visual Contextual Adaptation
RANGER:通过视觉上下文适应的单目零样本语义导航框架
Ming-Ming Yu, Yi Chen, Börje F. Karlsson, Wenjun Wu
机构
*
Beihang University(北京航空航天大学)
;
Beijing Academy of Artificial Intelligence(北京人工智能研究院)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Hangzhou International Innovation Institute, Beihang University(北京航空航天大学杭州国际创新研究院)