Representation Learning for Compressed Video Action Recognition via Attentive Cross-modal Interaction with Motion Enhancement
专题命中 视频多模态 :cross-modal(title,abstract);分类 cs.CV、cs.AI
Comments Accepted to IJCAI 2022
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 视频多模态 :cross-modal(title,abstract);分类 cs.CV、cs.AI
Comments Accepted to IJCAI 2022
机构 * ADAPT SFI Research Centre, School of Computer Science, University College Dublin(ADAPT SFI研究所以及计算机科学学院,都柏林大学学院)
专题命中 视频多模态 :multi-modal(title,abstract);分类 cs.CV、cs.AI
Comments This paper is submitted to IEEE Transactions on Geoscience and Remote Sensing for reviewing
机构 * Mohamed bin Zayed University of Artificial Intelligence(莫德赫·本·扎耶德人工智能大学) ; University of Central Florida(中央佛罗里达大学) ; Islamic University of Technology(伊斯兰技术大学) ; Air University(空军大学) ; ETH Zurich(苏黎世联邦理工学院) ; Technische Universität München(慕尼黑技术大学) ; National Institute of Informatics(国家信息研究所) ; Australian National University(澳大利亚国立大学) ; Linköping University(利尔贝里大学)
专题命中 视频多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL
机构 * National Rehabilitation Center, Ministry of Health and Welfare, Korea(韩国卫生福利部国家康复中心) ; Gachon University(高丽大学)
专题命中 视频多模态 :multi-modal(title);multimodal(abstract);分类 cs.CV、cs.AI
Comments 9 pages, 9 figures
机构 * Meta Reality Labs(Meta现实实验室)
专题命中 视频多模态 :multimodal(title,abstract);分类 cs.CL、cs.AI
机构 * SETLabs Resarch GmbH(SETL实验室)
专题命中 视频多模态 :multimodal(title,abstract);分类 cs.CV、cs.AI
Comments 11 pages, 3 figures
机构 * University of Virginia(弗吉尼亚大学) ; The Pennsylvania State University(宾夕法尼亚州立大学) ; Northeastern University(东北大学) ; Stanford University(斯坦福大学)
专题命中 视频多模态 :multimodal(title,abstract);分类 cs.CV、cs.AI
专题命中 视频多模态 :multimodal(title,abstract);分类 cs.CV、cs.AI
Comments 14 pages, 6 figures
机构 * Hong Kong Institute of Science & Innovation(香港科学与工业创新研究院) ; CAMP, Technische Universität München(CAMP,慕尼黑技术大学) ; Department of Surgery, Faculty of Medicine, The Chinese University of Hong Kong(香港中文大学医学院外科部)
专题命中 视频多模态 :multimodal(title,abstract);分类 cs.CV、cs.AI
机构 * University of Waterloo(滑铁卢大学) ; Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)
专题命中 视频多模态 :multimodal(title,abstract);分类 cs.CV、cs.AI
Comments Accepted for the IEEE/CVF International Conference on Computer Vision (ICCV), Honolulu, Hawaii, USA. 1st MSLR Workshop 2025
机构 * Multimodal Intelligence Lab(多模态智能实验室) ; Department of Computer Science(计算机科学系) ; University of Exeter(埃克塞特大学) ; University of Birmingham(伯明翰大学)
专题命中 视频多模态 :multimodal(title,abstract);分类 cs.CV、cs.AI
机构 * National University of Singapore(新加坡国立大学) ; Peking University(北京大学) ; University of Science and Technology of China(中国科学技术大学) ; Estates Pte Ltd(6Estates私人有限公司)
专题命中 视频多模态 :multi-modal(title,abstract);分类 cs.AI、cs.MM
Comments Accepted by MM 2025
机构 * Departmrnt of computer science(计算机科学系) ; Texas Tech University(得克萨斯科技大学)
专题命中 视频多模态 :multimodal(title,abstract);分类 cs.CV、cs.AI
Comments Accepted in IEEE 3rd International Conference on Artificial Intelligence, Blockchain, and Internet of Things (AIBThings 2025)
机构 * Technical University of Munich(慕尼黑技术大学)
专题命中 视频多模态 :multimodal(title,abstract);分类 cs.CL、cs.AI
机构 * Duke University(杜克大学) ; Emory University(埃默里大学)
专题命中 视频多模态 :multi-modal(title,abstract);分类 cs.CV、cs.AI
Comments In Review for MICCAI 2025
机构 * College of Computer Science and Technology, Jilin University(吉林大学计算机科学与技术学院) ; College of Software, Jilin University(吉林大学软件学院) ; School of Computer and Artificial Intelligence, Liaoning Normal University(辽宁师范大学计算机与人工智能学院) ; School of Computer Science and Technology, Soochow University(苏州大学计算机科学与技术学院) ; Department of Computer Science, Swansea University(斯旺西大学计算机科学系)
专题命中 视频多模态 :multimodal(title,abstract);分类 cs.CL、cs.MM
Comments Accepted by ACM MM 2025. 10 pages, 6 figures. Code: https://github.com/wangbing1416/DAEDCMD
机构 * Department of Computer Science(计算机科学系) ; School of Computing(计算学院) ; National University of Singapore(新加坡国立大学)
专题命中 视频多模态 :multimodal(title,abstract);分类 cs.CV、cs.AI
Comments B.Comp. dissertation
机构 * University of Strasbourg, CNRS, INSERM, ICube, UMR7357, Strasbourg, France(斯特拉斯堡大学,法国国家科学研究中心,法国国家卫生研究院,ICube,UMR7357,法国斯特拉斯堡) ; University Digestive Health Care Center – Clarunis, 4002 Basel, Switzerland(消化健康研究中心–Clarunis,瑞士巴塞尔)
专题命中 视频多模态 :multi-modal(title,abstract);分类 cs.CV、cs.AI
Comments Accepted by Medical Image Analysis (MedIA), 2025
机构 * College of Computer and Information Engineering, Tianjin Normal University(天津师范大学计算机与信息工程学院) ; College of Computer Science and Software Engineering, Shenzhen University(深圳大学计算机科学与软件工程学院) ; Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东人工智能与数字经济实验室(深圳)) ; College of Intelligence and Computing, Tianjin University(天津大学智能科学与计算学院) ; The State Key Laboratory of Blockchain and Data Security, Zhejiang University(浙江省区块链与数据安全国家重点实验室) ; Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and Data Security, Hangzhou(杭州高新技术区(滨江)区块链与数据安全研究院)
专题命中 视频多模态 :multimodal(title,abstract);分类 cs.CV、cs.AI
Comments IJCAI 2025, the 34th International Joint Conference on Artificial Intelligence
机构 * Utrecht University(乌特雷赫大学)
专题命中 视频多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL
Comments 27 pages, 14 figures. Accepted to ACL 2025
机构 * Northwestern University(西北大学) ; IEEE Member(IEEE会员)
专题命中 视频多模态 :multi-modal(title,abstract);分类 cs.CV、cs.AI
机构 * ETH Zurich(苏黎世联邦理工学院) ; Magic Leap(Magic Leap公司)
专题命中 视频多模态 :multimodal(title,abstract);分类 cs.CV、cs.AI
Comments Accepted as an extended abstract at the Second Joint Egocentric Vision (EgoVis) Workshop, 2025
专题命中 视频多模态 :multimodal(title,abstract);分类 cs.CV、cs.AI
机构 * SimulaMet and OsloMet, Norway(SimulaMet和OsloMet,挪威) ; Forzasys, Norway(Forzasys,挪威) ; SimulaMet, Norway(SimulaMet,挪威) ; SimulaMet, OsloMet, and Forzasys, Norway(SimulaMet、OsloMet和Forzasys,挪威) ; University of Central Florida, USA(佛罗里达中央大学)
专题命中 视频多模态 :multimodal(title,abstract);分类 cs.CV、cs.AI
机构 * Giant NetworkChina(巨网中国) ; The East China University of Science and TechnologyChina(东华大学) ; Northwestern Polytechnical UniversityChina(西北工业大学)
专题命中 视频多模态 :multi-modal(title,abstract);分类 cs.CV、cs.MM
Comments 5 pages, 4 figures, accepted by Interspeech 2025
机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) ; The Chinese University of Hong Kong(香港中文大学) ; Shanghai Jiao Tong University(上海交通大学) ; Nanjing University(南京大学) ; Fudan University(复旦大学) ; Nanyang Technological University(南洋理工大学)
专题命中 视频多模态 :multi-modal(title,abstract);分类 cs.CV、cs.CL
Comments ACL 2025 Findings
专题命中 视频多模态 :multi-modal(title,abstract);分类 cs.CV、cs.CL
Comments Best Student Paper Award at IEEE International Conference on Computer Supported Cooperative Work in Design, 2025
机构 * Fudan University(复旦大学) ; Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
专题命中 视频多模态 :multimodal(title,abstract);分类 cs.CV、cs.AI
机构 * George Mason University(乔治·马歇尔大学) ; Amazon(亚马逊公司)
专题命中 视频多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL
Comments Accepted at NLDB 2025
机构 * University of Southern California(南加州大学)
专题命中 视频多模态 :multimodal(title,abstract);分类 cs.CV、cs.AI