Self-supervised Learning Matters: A Simple Ensemble Solution for Micro-Gesture Recognition
自监督学习至关重要:一种用于微手势识别的简单集成方案
Tingyi Liu, Kun Li, Fei Wang, Junjie Chen, Zhiliang Wu, Jihao Gu, Haixu Liu, Dan Guo
机构
*
Hefei University of Technology(合肥工业大学)
;
United Arab Emirates University(阿拉伯联合酋长国大学)
;
Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(合肥综合性国家科学中心人工智能研究院)
;
Anhui Evolution Technology Co., Ltd.(安徽进化科技有限公司)
;
Nanyang Technological University(南洋理工大学)
;
University College London(伦敦大学学院)
;
The University of Sydney(悉尼大学)
;
Beijing QBoson Quantum Technology Co., Ltd.(北京量子芯科技有限公司)
机构
*
University of Science and Technology of China(中国科学技术大学)
;
Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(合肥综合性国家科学中心人工智能研究院)
;
Harbin Institute of Technology (Weihai)(哈尔滨工业大学(威海))
TraRA: Trajectory-level Recognition Aggregation for Video Text Spotting in Urban Surveillance
TraRA: 面向城市监控视频文本识别的轨迹级识别聚合方法
Duc Tri Tran, Trung Thanh Nguyen, Vijay John, Phi Le Nguyen, Yasutomo Kawanishi
机构
*
RIKEN(日本理化学研究所)
;
Hanoi University of Science and Technology(河内科学技术大学)
;
Nagoya University(名古屋大学)
;
Lawrence Technological University(劳伦斯技术大学)
;
Ritsumeikan University(立命馆大学)
VTI-CoT: Visual-Textual Interleaved Chain of Thought for Video Reasoning
VTI-CoT: 用于视频推理的视觉-文本交织思维链
Shufan Zhang, Ziyue Lin, Bairun Wang, Lei Jin, Xuanding Ding, Xinzhu Ma, Kunlin Yang
机构
*
Beijing University of Posts and Telecommunications(北京邮电大学)
;
University of Hong Kong(香港大学)
;
Beijing Shanwei Zhixing Technology Co., Ltd.(北京尚维智行科技有限公司)
;
Tsinghua University(清华大学)
;
Beihang University(北航)
Ritabrata Roy Choudhury, Arkajyoti Karmakar, Rudra Pratap Mitra
机构
*
School of Computer Engineering, Kalinga Institute of Industrial Technology(计算机工程学院,凯林加工业技术学院)
;
School of Electronics Engineering, Kalinga Institute of Industrial Technology(电子工程学院,凯林加工业技术学院)
A Systematic Evaluation of Positional Bias in Multi-Video Summarization with MLLMs
多视频摘要中位置偏差的系统评估:基于多模态大语言模型
Huangchen Xu, Yuan Wu, Yi Chang
机构
*
School of Artificial Intelligence, Jilin University(吉林大学人工智能学院)
;
Engineering Research Center of Knowledge-Driven Human-Machine Intelligence, Jilin University(知识驱动人机智能工程研究中心)
;
International Center of Future Science, Jilin University(未来科学国际中心)
WALL-WM: Carving World Action Modeling at the Event Joints
WALL-WM:在事件关节处雕刻世界动作建模
Shalfun Li, Victor Yao, Charles Yang, Truth Qu, Regis Cheng, Ryan Yu, Howard Lu, Newton Von, Vincent Chen, Yohann Tang, Maeve Zhang, Ellie Ma, Gody Li, Sage Yang, Lorien Shu, J. W. Gao, Ethan Chen, Colin Ye, Yu Sun, Elise Mon, PS Zhang, Neo Li, Lily Li, James Wang, Ping Yang, Chris Pan, Lucy Liang, Hang Su, Roy Gan, Hao Wang, Qian Wang
Temporal Evidence Routing with Structured Visual Evidence for TimeLogicQA
基于结构化视觉证据的时间证据路由用于TimeLogicQA
Yuyang Sun, Yongliang Wu, Xingyu Zhu, Yuxia Chen, Zhenxiang Jiang, Yangguang Ji, Wenbo Zhu, Yanxi Shi, Jay Wu, Shuo Wang, Xu Yang
机构
*
Southeast University(东南大学)
;
National University of Singapore(新加坡国立大学)
;
Independent Researcher(独立研究员)
;
Opus AI Research(Opus AI研究院)
;
University of Science and Technology of China(中国科学技术大学)
Seq-DeepIPC: Sequential Sensing for End-to-End Control in Legged Robot Navigation
Seq-DeepIPC:足式机器人导航中用于端到端控制的顺序感知
Oskar Natan, Jun Miura
机构
*
Department of Computer Science and Electronics, Universitas Gadjah Mada(计算机科学与电子系,加查马达大学)
;
Department of Computer Science and Engineering, Toyohashi University of Technology(计算机科学与工程系,东福冈技术大学)