InfoCausalQA:Can Models Perform Non-explicit Causal Reasoning Based on Infographic?
专题命中 图文多模态 :multimodal(abstract);分类 cs.CL、cs.AI
Comments 14 pages, 9 figures
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 图文多模态 :multimodal(abstract);分类 cs.CL、cs.AI
Comments 14 pages, 9 figures
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.MM
机构 * University of Chinese Academy of Sciences(中国科学院大学) ; Dept. of Comp. Sci. and Tech., Institute for AI, Tsinghua University(计算机科学与技术系,人工智能研究院,清华大学) ; Gaoling School of Artificial Intelligence, Renmin University of China(人工智能学院,中国人民大学) ; Kuaishou Technology Inc.(快手科技有限公司) ; Shanghai Key Laboratory of Multi. Info. Processing, East China Normal University(多信息处理重点实验室,华东师范大学)
专题命中 图文多模态 :multi-modal(abstract);分类 cs.CV、cs.CL
机构 * IIIT Hyderabad
专题命中 图文多模态 :multi-modal(abstract);分类 cs.CV、cs.AI
机构 * Department of Engineering Science, University of Oxford(牛津大学工程科学系) ; Department of Electrical Engineering, Imperial College London(伦敦帝国学院电子工程系)
专题命中 图文多模态 :multi-modal(abstract);分类 cs.CV、cs.CL
Comments 8 pages, 4 figures
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.AI
Comments Accepted by TPAMI2025
Journal ref IEEE Transactions on Pattern Analysis and Machine Intelligence, Jul. 2025, pp. 5672-5689, vol. 47
机构 * Heilongjiang University of Science and Technology(黑龙江科技大学) ; University of Padua(帕多瓦大学)
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.CL
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.AI
机构 * Department of Intelligent Systems and Robotics, University of West Florida(智能系统与机器人系,西佛罗里达大学) ; Florida Institute For Human and Machine Cognition (IHMC)(佛罗里达人类与机器认知研究所) ; Center for Cybersecurity, University of West Florida(网络安全中心,西佛罗里达大学)
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.AI
Journal ref Computers, Materials & Continua, 2025
机构 * Project Leader(项目负责人) ; Corresponding Author(通讯作者)
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.AI
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.AI
Comments 19 pages, 6 figures, 4 tables
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.AI
机构 * Columbia University(哥伦比亚大学)
专题命中 图文多模态 :image-text(abstract);分类 cs.CV、cs.CL
机构 * Mohamed Bin Zayed University of Artificial Intelligence(莫兹哈德大学人工智能大学) ; Technical University of Munich(慕尼黑技术大学)
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.AI
Comments Accepted by ICCV2025
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.AI
Comments The paper needs major revisions, so it is being withdrawn
机构 * DLUT(大连理工大学) ; BAAI(北京人工智能研究院) ; PKU(北京大学) ; BUPT(北京邮电大学) ; UCAS(中国科学院大学) ; CASIA(中国科学院自动化研究所)
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.AI
Comments 20 pages, 10 figures, Accepted by ICCV2025 (highlight)
机构 * Leiden Institute of Advanced Computer Science (LIACS), Leiden University, The Netherlands(莱顿先进计算机科学研究所(LIACS)、莱顿大学、荷兰)
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.AI
Comments LUHME: 2nd Workshop on Language Understanding in the Human-Machine Era
机构 * University of Chinese Academy of Sciences(中国科学院大学) ; The University of Hong Kong(香港大学) ; Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.AI
Comments Accepted by ICCV 2025
机构 * University of Washington(华盛顿大学)
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.CL
Comments ACL 2025; 19 pages, 3 figures
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.AI
Comments Modified the abstract and reformatted it using latex
机构 * Indraprastha Institute of Information Technology(印度理工学院信息技术研究所)
专题命中 图文多模态 :image-text(abstract);分类 cs.CV、cs.AI
机构 * School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院) ; Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
专题命中 图文多模态 :image-text(abstract);分类 cs.CV、cs.AI
Comments Accepted by ICCV 2025; Project Page: https://haoningwu3639.github.io/MRGen/
机构 * Hong Kong University of Science and Technology(香港理工大学) ; University of Massachusetts Amherst(马萨诸塞大学阿姆赫斯特分校) ; University of Copenhagen(哥本哈根大学)
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.CL
Comments 25 pages, COLM 2025
机构 * School of Computer Science & Engineering, Key Lab of New Generation Artificial Intelligence Technology & Its Interdisciplinary Applications (Ministry of Education), Southeast University, China(计算机科学与工程学院,新一代人工智能技术及跨学科应用重点实验室,东南大学,中国) ; Faculty of IT, Monash University, Australia(信息科技学院,墨尔本大学,澳大利亚) ; School of Computer Science & Engineering, Southeast University, China(计算机科学与工程学院,东南大学,中国)
专题命中 图文多模态 :multimodal(abstract);分类 cs.CL、cs.AI
Comments 16 pages, 11 figures
机构 * School of Automation Science and Engineering, South China University of Technology(自动化科学与工程学院,华南理工大学) ; Thrust of Artificial Intelligence, The Hong Kong University of Science and Technology (Guangzhou)(人工智能方向,香港科学与技术大学(广州))
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.AI
Comments PRCV
机构 * Institute for Transport Studies, Faculty of Environment, Computer Vision and Machine Learning Group, University of Leeds(运输研究学院、环境学院、计算机视觉与机器学习小组、莱斯特大学) ; AI Centre, Department of Computer Science, University College London(人工智能中心、计算机科学系、伦敦大学学院)
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.AI
专题命中 图文多模态 :cross-modal(abstract);分类 cs.CV、cs.AI
机构 * Carnegie Mellon University(卡内基梅隆大学)
专题命中 图文多模态 :multi-modal(abstract);分类 cs.CV、cs.CL
Comments Accepted by ICCV 2025. Project page: https://zifuwan.github.io/ONLY/
机构 * University of Maryland, College Park(马里兰大学学院公园分校) ; Microsoft(微软公司)
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.CL
机构 * Hefei University of Technology(合肥工业大学) ; Tsinghua University(清华大学) ; Academy of Cyber(网络学院)
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV、cs.AI