MASSV: Multimodal Adaptation and Self-Data Distillation for Speculative Decoding of Vision-Language Models
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL
Comments Main paper: 11 pages, 4 figures, 3 tables. Supplementary: 1 page
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL
Comments Main paper: 11 pages, 4 figures, 3 tables. Supplementary: 1 page
机构 * University of California, Berkeley, USA(加州大学伯克利分校)
专题命中 图文多模态 :cross-modal(title,abstract);分类 cs.CV、cs.CL
Comments ICML 2025
机构 * Department of Mathematics, Korea University(数学系,韩国大学)
专题命中 图文多模态 :multi-modal(title);multimodal(abstract);分类 cs.CV、cs.AI
Comments 10 pages, 2 figures
机构 * School of Cyber Science and Technology, Hubei University(湖北大学计算机科学与技术学院) ; Department of Electrical Automation Design, Beijing Shougang International Engineering Technology(北京首钢国际工程技术部) ; School of Computer Science and Engineering, University of Electronic Science and Technology of China(电子科技大学计算机科学与工程学院) ; Department of Computer Science, Hong Kong Baptist University(香港 Baptist 大学计算机科学部) ; School of Computer Science and Technology, Harbin University of Science and Technology(哈尔滨理工大学计算机科学与技术学院)
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.MM
Comments Accepted by ICMR 2025 Main track. Code is available at https://github.com/Wenyuzhy/DeepSPG
机构 * Laboratory for Artificial Intelligence in Design(人工智能设计实验室) ; School of Fashion and Textiles(时尚与纺织学院)
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.AI
机构 * Fudan University(复旦大学) ; Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) ; Shanghai Jiaotong University(上海交通大学) ; Nankai University(南开大学) ; Shanghai University(上海大学) ; Nanyang Technological University(南洋理工大学) ; Hong Kong Polytechnic University(香港理工大学) ; Tongji University(同济大学) ; Nanjing University(南京大学) ; University of California, Merced(加州大学梅德福分校) ; Chinese University of Hong Kong(香港中文大学)
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL
Comments 16 pages, 11 figures
机构 * Google DeepMind(谷歌DeepMind) ; Stanford University(斯坦福大学)
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.AI、cs.MM
Comments ICRA 2025
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.AI、cs.MM
Comments Accepted at CVPR Workshop NEXD 2025. 21 pages, Project: https://github.com/Lum1104/EIBench
专题命中 图文多模态 :multimodal(title);cross-modal(abstract);分类 cs.CL、cs.AI
Comments Withdraw for new experiments
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.AI
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.AI
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.AI
Comments 11 pages, 3 figures
专题命中 图文多模态 :multi-modal(title,abstract);分类 cs.CV、cs.CL
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.AI
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.AI
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.AI
专题命中 图文多模态 :multi-modal(title,abstract);分类 cs.CV、cs.AI
Comments Accepted at AAAI 2025; Project Page: https://github.com/czhhzc/CoMT
专题命中 图文多模态 :image-text(title,abstract);分类 cs.CV、cs.CL
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.AI
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL
Journal ref https://aclanthology.org/2024.wmt-1.80/
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CL、cs.AI
Journal ref NAACL 2025
专题命中 图文多模态 :image-text(title,abstract);分类 cs.CV、cs.CL
Comments Published as a conference paper at ECIR 2025
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL
Comments 28 pages, 9 figures
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.AI
专题命中 图文多模态 :cross-modal(title,abstract);分类 cs.CL、cs.MM
Comments Accepted for publication in: European Conference on Information Retrieval (ECIR) 2025
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CL、cs.AI
Comments Submitted to the International AAAI Conference on Web and Social Media (ICWSM) 2025
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.AI
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CL、cs.AI
Comments technical report, 55 pages