arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

ACM International Conference on Multimedia · 会议 · Multimedia

共收录 1944
2508.13921 2025-08-20 cs.CV

DIME-Net: A Dual-Illumination Adaptive Enhancement Network Based on Retinex and Mixture-of-Experts

Ziang Wang, Xiaoqin Wang, Dingyi Wang, Qiang Li, Shushan Qiao

机构 * Institute of Microelectronics of the Chinese Academy of Sciences(中国科学院微电子研究所)

Comments Accepted at ACM Multimedia 2025 (ACM MM 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13756 2025-08-20 cs.MM

INDS: Incremental Named Data Streaming for Real-Time Point Cloud Video

Ruonan Chai, Yixiang Zhu, Xinjiao Li, Jiawei Li, Zili Meng, Dirk Kutscher

Comments 9 pages, 9 figures, 2 tables. To appear in Proc. of the 33rd ACM International Conference on Multimedia (MM '25), October 27--31, 2025, Dublin, Ireland

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13745 2025-08-20 cs.IR

Refining Contrastive Learning and Homography Relations for Multi-Modal Recommendation

Shouxing Ma, Yawen Zeng, Shiqing Wu, Guandong Xu

Comments This paper has been accepted as a full paper at ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13633 2025-08-20 cs.LG

Text2Weight: Bridging Natural Language and Neural Network Weight Spaces

Bowen Tian, Wenshuo Chen, Zexi Li, Songning Lai, Jiemin Wu, Yutao Yue

机构 * Deep Interdisciplinary Intelligence Lab(深度跨学科智能实验室) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) The University of Cambridge(剑桥大学) Zhejiang University(浙江大学) Institute of Deep Perception Technology(深度感知技术研究所) Jiangsu Industrial Technology Research Institute(江苏省工业技术研究所)

Comments Accepted By ACM MM 2025 Main Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13402 2025-08-20 cs.MM eess.IV

Robust Live Streaming over LEO Satellite Constellations: Measurement, Analysis, and Handover-Aware Adaptation

Hao Fang, Haoyuan Zhao, Jianxin Shi, Miao Zhang, Guanzhen Wu, Yi Ching Chou, Feng Wang, Jiangchuan Liu

Comments Accepted by ACM Multimedia 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12992 2025-08-20 cs.MM

MAGNeT: Multimodal Adaptive Gaussian Networks for Intent Inference in Moving Target Selection across Complex Scenarios

Xiangxian Li, Yawen Zheng, Baiqiao Zhang, Yijia Ma, Xianhui Cao, Juan Liu, Yulong Bian, Jin Huang, Chenglei Yang

Comments Accepted by ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12854 2025-08-19 cs.AI cs.CL cs.CV cs.HC cs.MM

E3RG: Building Explicit Emotion-driven Empathetic Response Generation System with Multimodal Large Language Model

Ronghao Lin, Shuai Shen, Weipeng Hu, Qiaolin He, Aolin Xiong, Li Huang, Haifeng Hu, Yap-peng Tan

机构 * Sun Yat-sen University(中山大学) Nanyang Technological University(南洋理工大学) Desay SV Automotive Co., Ltd(德赛西威汽车有限公司) Pazhou Laboratory(琶洲实验室)

Comments Accepted at ACM MM 2025 Grand Challenge

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12842 2025-08-19 cs.CV cs.MM

Multi-source Multimodal Progressive Domain Adaption for Audio-Visual Deception Detection

Ronghao Lin, Sijie Mai, Ying Zeng, Qiaolin He, Aolin Xiong, Haifeng Hu

机构 * Sun Yat-Sen University(中山大学) Nanyang Technological University(南洋理工大学) South China Normal University(华南师范大学)

Comments Accepted at ACM MM 2025 SVC Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09693 2025-08-19 cs.CV

ExpStar: Towards Automatic Commentary Generation for Multi-discipline Scientific Experiments

Jiali Chen, Yujie Jia, Zihan Wu, Jinyu Yang, Jianpeng Chen, Xusen Hei, Jiayuan Xie, Yi Cai, Qing Li

机构 * South China University of Technology(南方科技大学) The Hong Kong Polytechnic University(香港理工大学) Key Laboratory of Big Data and Intelligent Robot Ministry of Education(教育部大数据与智能机器人重点实验室)

Comments Accepted by ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04630 2025-08-19 cs.CV

Learn 3D VQA Better with Active Selection and Reannotation

Shengli Zhou, Yang Liu, Feng Zheng

机构 * Southern University of Science and Technology(南方科技大学) Wangxuan Institute of Computer Technology, Peking University(北京大学王瑄计算机技术研究所)

Comments 13 pages, 16 figures, accepted by ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17728 2025-08-19 cs.CV cs.GR cs.MM

Casual3DHDR: Deblurring High Dynamic Range 3D Gaussian Splatting from Casually Captured Videos

Shucheng Gong, Lingzhe Zhao, Wenpu Li, Hong Xie, Yin Zhang, Shiyu Zhao, Peidong Liu

机构 * Westlake University(西湖大学) Wuhan University(武汉大学) Zhejiang University(浙江大学)

Comments Accepted to ACM Multimedia 2025. Project page: https://lingzhezhao.github.io/CasualHDRSplat/

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10905 2025-08-19 cs.CV cs.HC

InterAnimate: Taming Region-aware Diffusion Model for Realistic Human Interaction Animation

Yukang Lin, Yan Hong, Zunnan Xu, Xindi Li, Chao Xu, Chuanbiao Song, Ronghui Li, Haoxing Chen, Jun Lan, Huijia Zhu, Weiqiang Wang, Jianfu Zhang, Xiu Li

机构 * Tsinghua University(清华大学) Zhejiang University(浙江大学) Shanghai Jiao Tong University(上海交通大学)

Comments Accept to ACMMM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.08331 2025-08-19 cs.CV

SLGaussian: Fast Language Gaussian Splatting in Sparse Views

Kangjie Chen, BingQuan Dai, Minghan Qin, Dongbin Zhang, Peihao Li, Yingshuang Zou, Haoqian Wang

机构 * Tsinghua Shenzhen International Graduate School(清华大学深圳国际研究生院)

Comments Accepted by ACM MM 2025. Project page: https://chenkangjie1123.github.io/SLGaussian.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11673 2025-08-19 cs.LG cs.AI cs.CV cs.MM

Contrastive Regularization over LoRA for Multimodal Biomedical Image Incremental Learning

Haojie Zhang, Yixiong Liang, Hulin Kuang, Lihui Cen, Zhe Qu, Yigang Cen, Min Zeng, Shichao Kan

机构 * School of Computer Science and Engineering, Central South University(计算机科学与工程学院,中南大学) School of Automation, Central South University(自动化学院,中南大学) School of Computer Science and Technology, Beijing Jiaotong University(计算机科学与技术学院,北京交通大学)

Comments 10 pages, 3 figures, submitted to ACM Multimedia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11058 2025-08-18 cs.CV cs.MM

Advancing 3D Scene Understanding with MV-ScanQA Multi-View Reasoning Evaluation and TripAlign Pre-training Dataset

Wentao Mo, Qingchao Chen, Yuxin Peng, Siyuan Huang, Yang Liu

机构 * Wangxuan Institute of Computer Technology, Peking University(计算机技术王先院,北京大学) National Institute of Health Data Science, Peking University(健康数据科学国家研究院,北京大学) State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,BIGAI)

Comments Accepeted to ACM MM 25

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10942 2025-08-18 cs.CV cs.HC cs.MM

Topological Structure Description for Artcode Detection Using the Shape of Orientation Histogram

Liming Xu, Dave Towey, Andrew P. French, Steve Benford

机构 * University of Nottingham(诺丁汉大学) University of Cambridge(剑桥大学) University of Nottingham Ningbo(诺丁汉大学宁波分校)

Comments This work is an extension of an ACM MM'17 workshop paper (Xu et al, 2017), which was completed in late 2017 and early 2018 during the first author's doctoral studies at the University of Nottingham. This paper includes 42 pages, 25 figures, 7 tables, and 13,536 words

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09057 2025-08-18 cs.CL

MVISU-Bench: Benchmarking Mobile Agents for Real-World Tasks by Multi-App, Vague, Interactive, Single-App and Unethical Instructions

Zeyu Huang, Juyuan Wang, Longfeng Chen, Boyi Xiao, Leng Cai, Yawen Zeng, Jin Xu

机构 * South China University of Technology(华南理工大学) Pazhou Lab(Pazhou 实验室)

Comments ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18932 2025-08-18 cs.MM cs.CL

MMESGBench: Pioneering Multimodal Understanding and Complex Reasoning Benchmark for ESG Tasks

Lei Zhang, Xin Zhou, Chaoyue He, Di Wang, Yi Wu, Hong Xu, Wei Liu, Chunyan Miao

机构 * Nanyang Technological University(南洋理工大学) University College London(伦敦大学学院) Alibaba Group(阿里巴巴集团)

Comments Accepted at ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11334 2025-08-18 cs.AI cs.RO

CogDDN: A Cognitive Demand-Driven Navigation with Decision Optimization and Dual-Process Thinking

Yuehao Huang, Liang Liu, Shuangming Lei, Yukai Ma, Hao Su, Jianbiao Mei, Pengxiang Zhao, Yaqing Gu, Yong Liu, Jiajun Lv

机构 * Zhejiang University(浙江大学) vivo AI Lab(vivo AI实验室)

Comments Accepted by ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11301 2025-08-18 cs.AI

Learning to Be A Doctor: Searching for Effective Medical Agent Architectures

Yangyang Zhuang, Wenjia Jiang, Jiayu Zhang, Ze Yang, Joey Tianyi Zhou, Chi Zhang

机构 * AGI Lab, Westlake University(西拉雅大学AGI实验室) Henan University(河南大学) Affiliated Hospital of Xuzhou Medical University(徐州医科大学附属医院) Xuzhou Medical University(徐州医科大学) Nanyang Technological University(南洋理工大学) IHPC, Agency for Science, Technology and Research, Singapore(新加坡科技研究局IHPC) CFAR, Agency for Science, Technology and Research, Singapore(新加坡科技研究局CFAR)

Comments Accepted at ACM MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10771 2025-08-15 cs.CV cs.AI

AEGIS: Authenticity Evaluation Benchmark for AI-Generated Video Sequences

Jieyu Li, Xin Zhang, Joey Tianyi Zhou

机构 * National University of Singapore(新加坡国立大学) Agency for Science, Technology and Research(科技研究局)

Comments Proceedings of the 33rd ACM International Conference on Multimedia

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10655 2025-08-15 cs.CV cs.AI

Serial Over Parallel: Learning Continual Unification for Multi-Modal Visual Object Tracking and Benchmarking

Zhangyong Tang, Tianyang Xu, Xuefeng Zhu, Chunyang Cheng, Tao Zhou, Xiaojun Wu, Josef Kittler

机构 * Jiangnan University(江南大学) Nanjing University of Science and Technology(南京理工大学) University of Surrey(萨里大学)

Comments ACMMM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09785 2025-08-14 cs.CV

DSS-Prompt: Dynamic-Static Synergistic Prompting for Few-Shot Class-Incremental Learning

Linpu He, Yanan Li, Bingze Li, Elvis Han Cui, Donghui Wang

机构 * Department of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术系) Research Center for Frontier Fundamental Studies, Zhejiang Lab(浙江实验室前沿基础研究中心) Department of Neurology, University of California, Irvine(加州大学伊市医学院神经科)

Comments Accepted to ACMMM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06564 2025-08-14 cs.CV

Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC

Guanyu Hu, Dimitrios Kollias, Xinyu Yang

机构 * Xi'an Jiaotong University(西安交通大学) Queen Mary University of London(伦敦女王玛丽大学) Center for Multimodal AI(多模态人工智能中心) Digital Environment Research Institute(数字环境研究院)

Comments accepted for publication at ACM Multimedia (ACM MM) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12867 2025-08-14 eess.AS cs.AI cs.CL

EmoVoice: LLM-based Emotional Text-To-Speech Model with Freestyle Text Prompting

Guanrou Yang, Chen Yang, Qian Chen, Ziyang Ma, Wenxi Chen, Wen Wang, Tianrui Wang, Yifan Yang, Zhikang Niu, Wenrui Liu, Fan Yu, Zhihao Du, Zhifu Gao, ShiLiang Zhang, Xie Chen

机构 * Shanghai Jiao Tong University(上海交通大学) Tongyi Speech Lab(通义语音实验室) Tianjin University(天津大学) Zhejiang University(浙江大学) Shanghai Jiao Tong University, Shanghai Innovation Institute(上海交通大学上海创新研究院)

Comments Accepted at ACMMM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05296 2025-08-14 cs.AI cs.HC cs.SD eess.AS

Revisiting Your Memory: Reconstruction of Affect-Contextualized Memory via EEG-guided Audiovisual Generation

Joonwoo Kwon, Heehwan Wang, Jinwoo Lee, Sooyoung Kim, Shinjae Yoo, Yuewei Lin, Jiook Cha

机构 * Michigan State University(密歇根州立大学) Seoul National University(首尔国立大学) Rutgers University(罗格斯大学) Brookhaven National Laboratory(布鲁赫斯国家实验室)

Comments Accepted at the ACM MM 2025 - The 1st CogMAEC Workshop (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09404 2025-08-14 cs.CV cs.MM

Waymo-3DSkelMo: A Multi-Agent 3D Skeletal Motion Dataset for Pedestrian Interaction Modeling in Autonomous Driving

Guangxun Zhu, Shiyu Fan, Hang Dai, Edmond S. L. Ho

机构 * University of Glasgow(格拉斯哥大学) Wuhan University(武汉大学)

Comments ACM Multimedia 2025 (Dataset Track) Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09500 2025-08-14 cs.CV

Advancing Reliable Test-Time Adaptation of Vision-Language Models under Visual Variations

Yiwen Liang, Hui Chen, Yizhe Xiong, Zihan Zhou, Mengyao Lyu, Zijia Lin, Shuaicheng Niu, Sicheng Zhao, Jungong Han, Guiguang Ding

机构 * Tsinghua University(清华大学) Nanyang Technological University(南洋理工大学)

Comments Accepted at the 33rd ACM International Conference on Multimedia(ACM MM 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09009 2025-08-13 cs.CV

Towards Perfection: Building Inter-component Mutual Correction for Retinex-based Low-light Image Enhancement

Luyang Cao, Han Xu, Jian Zhang, Lei Qi, Jiayi Ma, Yinghuan Shi, Yang Gao

机构 * Nanjing University(南京大学) Wuhan University(武汉大学)

Comments This article has been accepted by ACMMM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08939 2025-08-13 cs.CV

MADPromptS: Unlocking Zero-Shot Morphing Attack Detection with Multiple Prompt Aggregation

Eduarda Caldeira, Fadi Boutros, Naser Damer

机构 * Fraunhofer IGD and Department of Computer Science, TU Darmstadt(弗劳恩霍夫研究所(IGD)和图宾根大学计算机科学系)

Comments Accepted at ACM Multimedia Workshops

详情

展开后加载摘要…

URL PDF HTML 收藏