BriMA: Bridged Modality Adaptation for Multi-Modal Continual Action Quality Assessment
BriMA:基于多模态适应的持续动作质量评估
Kanglei Zhou, Chang Li, Qingyi Pan, Liyuan Wang
机构
*
Department of Psychological and Cognitive Sciences, 2 Department of Statistics and Data Science, Tsinghua University(1 心理学与认知科学系,2 统计学与数据科学系,清华大学)
LinVideo: A Post-Training Framework towards O(n) Attention in Efficient Video Generation
LinVideo: 一种面向高效视频生成的O(n)注意力后训练框架
Yushi Huang, Xingtong Ge, Ruihao Gong, Chengtao Lv, Jun Zhang
机构
*
Hong Kong University of Science and Technology(香港科技大学)
;
Beihang University(北航)
;
Sensetime Research(商汤科技研究院)
;
Nanyang Technological University(南洋理工大学)
机构
*
State Key Laboratory of Networking and Switching Technology, Beijing University of Posts and Telecommunications, China(网络与交换技术国家重点实验室,北京邮电大学,中国)
;
Midea Group, China(美的集团,中国)
;
School of Computer Science, Beijing University of Posts and Telecommunications, China(计算机科学学院,北京邮电大学,中国)
CommentsHaowen Wang and Zhengping Che are with equal contributions. Paper accepted by IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI). An earlier version has been accepted by CVPR 2022 (arXiv:2203.10856). arXiv admin note: text overlap with arXiv:2203.10856
Journal refIEEE Transactions on Pattern Analysis and Machine Intelligence (Volume: 46, Issue: 11, November 2024)
Frame2Freq: Spectral Adapters for Fine-Grained Video Understanding
Frame2Freq: 用于细粒度视频理解的频谱适配器
Thinesh Thiyakesan Ponbagavathi, Constantin Seibold, Alina Roitberg
机构
*
Institute for Artificial Intelligence, University of Stuttgart(斯图加特大学人工智能研究所)
;
University Hospital Heidelberg, Diagnostic and Interventional Radiology(海德堡大学医院放射诊断与介入科)
;
Intelligent Assistive Systems Lab, University of Hildesheim(希尔德斯海姆大学智能辅助系统实验室)
Learning Multi-Modal Prototypes for Cross-Domain Few-Shot Object Detection
跨域少样本目标检测中的多模态原型学习
Wanqi Wang, Jingcai Guo, Yuxiang Cai, Zhi Chen
机构
*
University of Chinese Academy of Sciences(中国科学院大学)
;
The Hong Kong Polytechnic University(香港理工大学)
;
Zhejiang University(浙江大学)
;
The University of Southern Queensland(昆士兰大学)
机构
*
University of Tokyo(东京大学)
;
Tohoku University(东北大学)
;
University of California at Merced(加州默塞德大学)
;
Google DeepMind(谷歌DeepMind)
;
RIKEN AIP(理化学研究所AIP)
Car-1000: A New Large Scale Fine-Grained Visual Categorization Dataset
Car-1000:一个新的大规模细粒度视觉分类数据集
Yutao Hu, Sen Li, Jincheng Yan, Wenqi Shao, Xiaoyan Luo
机构
*
Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications (Southeast University), Ministry of Education(新一代人工智能技术及交叉应用国家重点实验室(东南大学))
;
School of Astronautics, Beihang University(北航航天学院)
;
Shanghai AI Laboratory(上海人工智能实验室)