机构
*
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
School of Artifcial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
State Key Laboratory of Brain Cognition and Brain-inspired Intelligence Technology(脑认知与脑启智技术国家重点实验室)
;
Beijing Academy of Artificial Intelligence(北京人工智能研究院)
;
National Key Laboratory for Multimedia Information Processing, Peking University(北京大学多媒体信息处理国家重点实验室)
RoboPCA: Pose-centered Affordance Learning from Human Demonstrations for Robot Manipulation
RoboPCA:基于姿态的从人类示范中学习空间可及性的方法用于机器人操作
Zhanqi Xiao, Ruiping Wang, Xilin Chen
机构
*
Key Laboratory of AI Safety of CAS, Institute of Computing Technology, Chinese Academy of Sciences(中国科学院人工智能安全重点实验室、计算技术研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
机构
*
Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)
;
Hangzhou Institute for Advanced Study, University of Chinese Academy of Sciences(中国科学院大学杭州高等研究院)
CommentsThis revision improves clarity and consistency throughout the paper. We refine terminology to more precisely describe the vertex extraction optimization, add motivational context to the edge feature encoding section, and clarify the overall inference pipeline. We also add an Acknowledgments section
Taming Modality Entanglement in Continual Audio-Visual Segmentation
驯服持续音频-视觉分割中的模态纠缠
Yuyang Hong, Qi Yang, Tao Zhang, Zili Wang, Zhaojin Fu, Kun Ding, Bin Fan, Shiming Xiang
机构
*
School of Artificial Intelligence, UCAS(人工智能学院,UCAS)
;
MAIS, Institute of Automation(自动化研究所MAIS)
;
School of Intelligent Science and Technology, University of Science and Technolog Beijing(智能科学与技术学院,北京理工大学)
MTVCraft: Tokenizing 4D Motion for Arbitrary Character Animation
MTVCraft: 4D运动分词用于任意角色动画
Yanbo Ding, Xirui Hu, Zhizhi Guo, Yan Zhang, Xinrui Wang, Zhixiang He, Chi Zhang, Yali Wang, Xuelong Li
机构
*
Shenzhen Key Laboratory of Computer Vision and Pattern Recognition, Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences, Shenzhen, China(深圳计算机视觉与模式识别重点实验室,深圳先进技术研究院,中国科学院,深圳,中国)
;
Institute of Artificial Intelligence (TeleAI), China Telecom, Beijing, China(人工智能研究所(TeleAI),中国电信,北京,中国)
;
School of Computer Science and Technology, Xi’an Jiaotong University, Xi’an, China(计算机科学与技术学院,西安交通大学,西安,中国)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences, Beijing, China(人工智能学院,中国科学院大学,北京,中国)
;
Shanghai Artificial Intelligence Laboratory, Shanghai, China(上海人工智能实验室,上海,中国)
Small Target Detection Based on Mask-Enhanced Attention Fusion of Visible and Infrared Remote Sensing Images
基于可见与红外遥感图像的掩码增强注意力融合的小目标检测
Qianqian Zhang, Xiaolong Jia, Ahmed M. Abdelmoniem, Li Zhou, Junshe An
机构
*
National Space Science Center, Chinese Academy of Sciences(中国科学院国家空间科学中心)
;
School of Computer Science and Technology, University of Chinese Academy of Sciences(中国科学院大学计算机科学与技术学院)
;
School of Electronic Engineering and Computer Science, Queen Mary University of London(伦敦大学玛丽女王学院电子工程与计算机科学学院)
;
School of Astronomy and Space Science, University of Chinese Academy of Sciences(中国科学院大学天文学与空间科学学院)
DLRMamba: Distilling Low-Rank Mamba for Edge Multispectral Fusion Object Detection
DLRMamba: 低秩Mamba用于边缘多光谱融合目标检测
Qianqian Zhang, Leon Tabaro, Ahmed M. Abdelmoniem, Junshe An
机构
*
National Space Science Center, Chinese Academy of Sciences(中国科学院国家空间科学中心)
;
School of Computer Science and Technology, University of Chinese Academy of Sciences(中国科学院大学计算机科学与技术系)
;
School of Electronic Engineering and Computer Science, Queen Mary University of London(伦敦大学Queen Mary电子工程与计算机科学学院)
;
School of Astronomy and Space Science, University of Chinese Academy of Sciences(中国科学院大学天文与空间科学系)
机构
*
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
机构
*
State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(人工智能安全国家重点实验室,计算技术研究所,中国科学院)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
ETH Zürich(苏黎世联邦理工学院)
;
City College of New York, City University of New York, USA(纽约城市学院,纽约城市大学,美国)
;
Shanghai Jiao Tong University(上海交通大学)
机构
*
State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(中国科学院人工智能安全国家重点实验室,计算技术研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
ETH Zürich(苏黎世联邦理工学院)
;
City College of New York, City University of New York, USA(纽约城市学院,纽约城市大学,美国)
;
Shanghai Jiao Tong University(上海交通大学)
S$^2$Q-VDiT: Accurate Quantized Video Diffusion Transformer with Salient Data and Sparse Token Distillation
S$^2$Q-VDiT: 精确量化视频扩散变换器与显著数据和稀疏令牌蒸馏
Weilun Feng, Haotong Qin, Chuanguang Yang, Xiangqi Li, Han Yang, Yuqi Li, Zhulin An, Libo Huang, Michele Magno, Yongjun Xu
机构
*
State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(人工智能安全国家重点实验室,计算技术研究所,中国科学院)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
ETH Zürich(苏黎世联邦理工学院)
OTAD: An Optimal Transport-Induced Robust Model for Agnostic Adversarial Attack
OTAD: 一种基于最优传输的鲁棒模型用于无偏对抗攻击
Kuo Gai, Sicong Wang, Shihua Zhang
机构
*
Shanghai Institute for Mathematics and Interdisciplinary Sciences(上海数学与交叉科学研究院)
;
Academy of Mathematics and Systems Science(数学系统科学学院)
;
University of Chinese Academy of Sciences(中国科学院大学)