Parameter-free Video Segmentation for Vision and Language Understanding
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV
Comments 11 pages, 4 figures
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV
专题命中 视频多模态 :multimodal(abstract);分类 eess.AS
Journal ref Reviews in Aquaculture, 17(1), e13001 (2025)
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV
Comments ACM CHI 2025
专题命中 视频多模态 :cross-modal(abstract);分类 cs.CV
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV
Comments Accepted by CVPR2025
专题命中 视频多模态 :cross-modal(abstract);分类 cs.CV
Comments Accepted to WACV 2025
专题命中 视频多模态 :multi-modal(abstract);分类 cs.AI
Comments This work has been accepted for publication in IEEE Robotics and Automation Letters (RA-L). The final published version is available in IEEE Xplore (DOI: 10.1109/LRA.2024.3504239)
Journal ref IEEE Robotics and Automation Letters, vol. 10, no. 1, pp. 72-79, Jan. 2025
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV
Comments Short paper (5 pages)
专题命中 视频多模态 :multimodal(abstract);分类 cs.MM
专题命中 视频多模态 :multi-modal(abstract);分类 cs.AI
Journal ref Communications Medicine, 2023
专题命中 视频多模态 :cross-modal(abstract);分类 cs.CV
Comments accepted by IJCV
专题命中 视频多模态 :multimodal(abstract);分类 cs.AI
Comments Accepted at RLDM 2025
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV
专题命中 视频多模态 :image-text(abstract);分类 cs.CV
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV
Comments 22 pages, 5 figures, and 6 tables
专题命中 视频多模态 :cross-modal(abstract);分类 cs.CV
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV
Comments A training-free test-time optimisation approach for long video understanding
专题命中 视频多模态 :multi-modal(abstract);分类 cs.AI
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV
Comments ICPR2024, MMVPR, 12 pages
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV
Comments Accepted to AAAI Conference on Artificial Intelligence 2025, 10 pages, 6 figures
专题命中 视频多模态 :audio-visual(abstract);分类 cs.CV
Comments Accepted at 2025 IEEE International Conference on Acoustics, Speech, and Signal Processing (ICASSP 2025)
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV
专题命中 视频多模态 :multi-modal(abstract);分类 cs.CV
专题命中 视频多模态 :cross-modal(abstract);分类 cs.CV