机构
*
Division of Applied Chemistry, Faculty of Engineering, Hokkaido University(北海道大学工学部应用化学科)
;
Graduate School of Chemical Sciences and Engineering, Hokkaido University(北海道大学研究生院化学科学和工程学系)
;
Graduate School of Information Science and Technology, Hokkaido University(北海道大学研究生院信息科学和技术学系)
;
Quantum Nexus, Inc.
机构
*
The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))
;
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
机构
*
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
Alibaba Group(阿里巴巴集团)
;
Guangdong Laboratory of Artificial Intelligence and Digital Economy (Shenzhen)(广东人工智能与数字经济实验室(深圳))
ViBE: Visual-to-M/EEG Brain Encoding via Spatio-Temporal VAE and Distribution-Aligned Projection
ViBE:通过时空VAE和分布对齐投影实现视觉到M/EEG脑编码
Ganxi Xu, Zhao-Rong Lai, Yuting Tang, Yonghao Song, Shuyan Zhou, Guoxu Zhou, Boyu Wang, Jian Zhu, Jinyi Long
机构
*
Jinan University(济南大学)
;
The First Affiliated Hospital of Jinan University(济南大学第一附属医院)
;
Western University(西方大学)
;
Guangdong University of Technology(广东工业大学)
;
Tsinghua University(清华大学)
机构
*
RMIT University(皇家墨尔本理工大学)
;
Monash University(墨尔本大学)
;
Adelaide University(阿德莱德大学)
;
The University of Hong Kong(香港大学)
;
ESPOL University(ESPOL大学)
机构
*
Department of Computer Science and Engineering, The Chinese University of Hong Kong, Hong Kong(香港中文大学计算机科学与工程系)
;
SkyReels, Skywork AI(SkyReels与Skywork AI)
;
Independent Researcher(独立研究者)
Vision-Language-Action in Robotics: A Survey of Datasets, Benchmarks, and Data Engines
机器人中的视觉-语言-动作:数据集、基准和数据引擎的综述
Ziyao Wang, Bingying Wang, Hanrong Zhang, Tingting Du, Tianyang Chen, Guoheng Sun, Yexiao He, Zheyu Shen, Wanghao Ye, Ang Li
机构
*
University of Maryland, College Park(马里兰大学学院公园分校)
;
University of Utah(犹他大学)
;
Northeastern University(东北大学)
;
University of Wisconsin–Madison(威斯康星大学麦迪逊分校)
机构
*
Shanghai Jiao Tong University(上海交通大学)
;
Ant Group(蚂蚁集团)
;
Visual Geometry Group, University of Oxford(牛津大学视觉几何组)
;
Ningbo Institute of Digital Twin, Eastern Institute of Technology, Ningbo(宁波数字孪生研究院,东部技术研究院,宁波)
;
Zhejiang Key Laboratory of Industrial Intelligence and Digital Twin(浙江工业智能与数字孪生重点实验室)
TimeOmni-1: Incentivizing Complex Reasoning with Time Series in Large Language Models
TimeOmni-1:通过时间序列激励大型语言模型的复杂推理
Tong Guan, Zijie Meng, Dianqi Li, Shiyu Wang, Chao-Han Huck Yang, Qingsong Wen, Zuozhu Liu, Sabato Marco Siniscalchi, Ming Jin, Shirui Pan
机构
*
Griffith University(格里菲斯大学)
;
Zhejiang University(浙江大学)
;
NVIDIA(英伟达)
;
Squirrel Ai Learning
;
University of Palermo(帕尔米奥大学)
;
Norwegian University of Science and Technology(挪威科学技术大学)
Denoise and Align: Diffusion-Driven Foreground Knowledge Prompting for Open-Vocabulary Temporal Action Detection
去噪与对齐:基于扩散的前景知识提示用于开放词汇时序动作检测
Sa Zhu, Wanqian Zhang, Lin Wang, Jinchao Zhang, Cong Wang, Bo Li
机构
*
Institute of Information Engineering, Chinese Academy of Sciences School of Cyber Security, University of Chinese Academy of Sciences State Key Laboratory of Cyberspace Security Defense Beijing China
;
Institute of Information Engineering, Chinese Academy of Sciences Beijing China
;
Hangzhou Dianzi University Hangzhou China
;
Institute of Information Engineering, Chinese Academy of Sciences\ Key Laboratory of Cyberspace Security Defense Beijing China
;
Engineering, Zhejiang University Hangzhou China
;
Institute of Information Engineering, Chinese Academy of Sciences State Key Laboratory of Cyberspace Security Defense Beijing China
;
Institute of Information Engineering, Chinese Academy of Sciences School of Cyber Security, University of Chinese Academy of Sciences State Key Laboratory of Cyberspace Security Defense
;
Institute of Information Engineering, Chinese Academy of Sciences
;
Hangzhou Dianzi University
;
Institute of Information Engineering, Chinese Academy of Sciences\ Key Laboratory of Cyberspace Security Defense
;
Engineering, Zhejiang University
;
Institute of Information Engineering, Chinese Academy of Sciences State Key Laboratory of Cyberspace Security Defense
ST-$π$: Structured SpatioTemporal VLA for Robotic Manipulation
ST-$π$: 结构化时空VLA用于机器人操作
Chuanhao Ma, Hanyu Zhou, Shihan Peng, Yan Li, Tao Gu, Luxin Yan
机构
*
School of Artificial Intelligence and Automation, Huazhong University of Science and Technology(华中科技大学人工智能与自动化学院)
;
School of Computing, National University of Singapore(新加坡国立大学计算机学院)
;
School of Computing, Macquarie University(麦考瑞大学计算机学院)
Chuanyu Qin, Chenxu Yang, Qingyi Si, Naibin Gu, Dingyu Yao, Zheng Lin, Peng Fu, Nan Duan, Jiaqi Wang
机构
*
Institute of Information Engineering, Chinese Academy of Sciences, Beijing, China(中国科学院信息工程研究所)
;
School of Cyber Security, University of Chinese Academy of Sciences, Beijing, China(中国科学院大学网络安全学院)
A Contextual Analysis of Driver-Facing and Dual-View Video Inputs for Distraction Detection in Naturalistic Driving Environments
面向驾驶员和双视角视频输入在自然驾驶环境中的干扰检测情境分析
Anthony Dontoh, Stephanie Ivey, Armstrong Aboah
机构
*
Environmental Engineering The University of Memphis Memphis, TN, USA Email(环境工程 明尼苏达大学 内华达州法戈 邮箱)
;
Environmental Engineering North Dakota State University Fargo, ND, USA Email(环境工程 内华达州立大学 内华达州法戈 邮箱)
AutoDrive-R$^2$: Incentivizing Reasoning and Self-Reflection Capacity for VLA Model in Autonomous Driving
AutoDrive-R$^2$: 促进自动驾驶VLA模型的推理与自反思能力
Zhenlong Yuan, Chengxuan Qian, Jing Tang, Rui Chen, Zijian Song, Lei Sun, Xiangxiang Chu, Yujun Cai, Dapeng Zhang, Shuo Li
机构
*
AMAP, Alibaba Group(阿里集团AMAP)
;
Sun Yat-sen University(中山大学)
;
University of Queensland(昆士兰大学)
;
Lanzhou University(兰州大学)
;
Case Western Reserve University(凯斯西储大学)
Large Vision Model-Guided Masked Low-Rank Approximation for Ground-Roll Attenuation
大视觉模型引导的掩码低秩近似用于地面滚动生成消减
Jiacheng Liao, Feng Qian, Ziyin Fan, Yongjian Guo
机构
*
School of Information and Communication Engineering, Center for Information Geoscience, University of Electronic Science and Technology of China(信息与通信工程学院,信息科学研究院,电子科学与技术大学)