UniMS: A Unified Framework for Multimodal Summarization with Knowledge Distillation
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CL
Comments Accepted at AAAI2022
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CL
Comments Accepted at AAAI2022
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV
Comments Accepted to EMNLP 2021 Findings
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV
Comments Published in ICCV 2021; Project webpage: https://www.cs.cornell.edu/projects/babel/
专题命中 图文多模态 :image-text(title,abstract);分类 cs.CV
专题命中 图文多模态 :image-text(title,abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CL
Comments Final version, accepted at ACL 2016. New section on Human Evaluation
专题命中 图文多模态 :image-text(title,abstract);分类 cs.CV
Comments Accepted by ECCV 2020, Code is publicly available at: https://github.com/BruceW91/CVSE
专题命中 图文多模态 :image-text(title,abstract);分类 cs.CV
Comments Accepted by ECCV 2020. Code is available at https://github.com/sunnychencool/AOQ
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV
Journal ref WACV 2020
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CL
Comments Accepted in ECAI-2020, 8 pages, 6 tables, 6 figures
专题命中 图文多模态 :image-text(title,abstract);分类 cs.CV
Comments Accepted by CVPR2020
专题命中 图文多模态 :image-text(title,abstract);分类 cs.CV
Comments Accepted by AAAI-20
专题命中 图文多模态 :cross-modal(title,abstract);分类 cs.CV
Comments AAAI-2020
专题命中 图文多模态 :multi-modal(title,abstract);分类 cs.CL
专题命中 图文多模态 :image-text(title,abstract);分类 cs.CV
Comments Accepted to ICCV 2019 (Oral)
专题命中 图文多模态 :multi-modal(title,abstract);分类 cs.CV
Comments 17 pages, 8 figures, 6 tables
专题命中 图文多模态 :image-text(title,abstract);分类 cs.CL
Comments Accepted by IJCAI 2019
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CL
Comments ACL 2019 - System demonstrations
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV
Comments submitted to a journal
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV
Comments 6 pages, 4 figures, accepted by IEEE International Conference on Multimedia and Expo (ICME) 2019
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CL
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CL
Comments Accepted to GLU 2017. arXiv admin note: text overlap with arXiv:1707.00995
Journal ref Proc. GLU 2017 International Workshop on Grounding Language Understanding
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CL
Comments 5, WMT 2017
专题命中 图文多模态 :multi-modal(title,abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CL
Comments 8 pages; Camera-ready submission to WMT17
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CL
Comments Submitted to ICLR Workshop 2017
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CL
Comments 10 pages, under review COLING 2016
CCRC:面向图像变化描述与分割的变化感知描述与推理链
机构 * College of Computer Science and Electronic Engineering, Hunan University, China(湖南大学计算机科学与电子工程学院,中国) ; Guangxi Minzu University, China(广西民族大学,中国) ; National University of Defense Technology, China(国防科学技术大学,中国)
专题命中 图文多模态 :MLLM(abstract,abstract_cn);multimodal(abstract);分类 cs.CV、cs.AI
AI总结 提出变化感知描述与推理链(CCRC),通过双链框架解耦语义推理与空间分割,实现图像变化描述与分割(ICCS)任务,在合成和真实基准上达到最优性能。