arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

ACM International Conference on Multimedia · 会议 · Multimedia

共收录 1966
2306.16736 2023-08-21 cs.CV cs.AI

GraMMaR: Ground-aware Motion Model for 3D Human Motion Reconstruction

Sihan Ma, Qiong Cao, Hongwei Yi, Jing Zhang, Dacheng Tao

Comments Accepted to ACM Multimedia 2023. The code will be available at https://github.com/xymsh/GraMMaR

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.08256 2023-08-17 cs.CV cs.HC

MultiMediate'23: Engagement Estimation and Bodily Behaviour Recognition in Social Interactions

Philipp Müller, Michal Balazia, Tobias Baur, Michael Dietz, Alexander Heimerl, Dominik Schiller, Mohammed Guermal, Dominike Thomas, François Brémond, Jan Alexandersson, Elisabeth André, Andreas Bulling

Comments ACM MultiMedia'23

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.08088 2023-08-17 cs.CV cs.IR cs.MM

Pro-Cap: Leveraging a Frozen Vision-Language Model for Hateful Meme Detection

Rui Cao, Ming Shan Hee, Adriel Kuek, Wen-Haw Chong, Roy Ka-Wei Lee, Jing Jiang

Comments Camera-ready for 23, ACM MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.07578 2023-08-17 cs.MM

Understanding User Behavior in Volumetric Video Watching: Dataset, Analysis and Prediction

Kaiyuan Hu, Haowen Yang, Yili Jin, Junhua Liu, Yongting Chen, Miao Zhang, Fangxin Wang

Comments Accepted by ACM MM'23

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.04043 2023-08-17 cs.LG cs.AI

Echoes: Unsupervised Debiasing via Pseudo-bias Labeling in an Echo Chamber

Rui Hu, Yahan Tu, Jitao Sang

Comments Accepted by ACM Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.07733 2023-08-16 eess.IV cs.CV cs.MM

Dynamic Low-Rank Instance Adaptation for Universal Neural Image Compression

Yue Lv, Jinxi Xiang, Jun Zhang, Wenming Yang, Xiao Han, Wei Yang

Comments Accepted by ACM MM 2023, 13 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.07605 2023-08-16 cs.CV cs.AI cs.MM

SGDiff: A Style Guided Diffusion Model for Fashion Synthesis

Zhengwentai Sun, Yanghong Zhou, Honghong He, P. Y. Mok

Comments Accepted by ACM MM'23

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.07316 2023-08-15 cs.CV cs.MM

Jurassic World Remake: Bringing Ancient Fossils Back to Life via Zero-Shot Long Image-to-Image Translation

Alexander Martin, Haitian Zheng, Jie An, Jiebo Luo

Comments 9 pages, 10 figures, ACM Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.07202 2023-08-15 cs.CV

Towards Robust Real-Time Scene Text Detection: From Semantic to Instance Representation Learning

Xugong Qin, Pengyuan Lyu, Chengquan Zhang, Yu Zhou, Kun Yao, Peng Zhang, Hailun Lin, Weiping Wang

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.07102 2023-08-15 cs.CV cs.CL cs.MM

Temporal Sentence Grounding in Streaming Videos

Tian Gan, Xiao Wang, Yan Sun, Jianlong Wu, Qingpei Guo, Liqiang Nie

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.07026 2023-08-15 cs.CV

AdvCLIP: Downstream-agnostic Adversarial Examples in Multimodal Contrastive Learning

Ziqi Zhou, Shengshan Hu, Minghui Li, Hangtao Zhang, Yechao Zhang, Hai Jin

Comments This paper has been accepted by the ACM International Conference on Multimedia (ACM MM '23, October 29-November 3, 2023, Ottawa, ON, Canada)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.06998 2023-08-15 cs.CV

Mutual Information-driven Triple Interaction Network for Efficient Image Dehazing

Hao Shen, Zhong-Qiu Zhao, Yulun Zhang, Zhao Zhang

Comments Accepted in ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.06897 2023-08-15 cs.CV cs.MM

Orthogonal Temporal Interpolation for Zero-Shot Video Recognition

Yan Zhu, Junbao Zhuo, Bin Ma, Jiajia Geng, Xiaoming Wei, Xiaolin Wei, Shuhui Wang

Journal ref Proceedings of the 31st ACM International Conference on Multimedia (MM '23), October 29-November 3, 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.04067 2023-08-15 cs.IR

Online Distillation-enhanced Multi-modal Transformer for Sequential Recommendation

Wei Ji, Xiangyan Liu, An Zhang, Yinwei Wei, Yongxin Ni, Xiang Wang

Comments 11 pages, 7 figures, accepted in ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.00847 2023-08-15 cs.CV

MAFW: A Large-scale, Multi-modal, Compound Affective Database for Dynamic Facial Expression Recognition in the Wild

Yuanyuan Liu, Wei Dai, Chuanxu Feng, Wenbin Wang, Guanghao Yin, Jiabei Zeng, Shiguang Shan

Comments This paper has been accepted by ACM MM'22

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.06749 2023-08-15 cs.CV eess.IV

FastLLVE: Real-Time Low-Light Video Enhancement with Intensity-Aware Lookup Table

Wenhao Li, Guangyang Wu, Wenyi Wang, Peiran Ren, Xiaohong Liu

Comments 11pages, 9 Figures, and 6 Tables. Accepted by ACMMM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.05095 2023-08-15 cs.CV cs.AI

LayoutLLM-T2I: Eliciting Layout Guidance from LLM for Text-to-Image Generation

Leigang Qu, Shengqiong Wu, Hao Fei, Liqiang Nie, Tat-Seng Chua

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.05081 2023-08-15 cs.CV cs.CL

Constructing Holistic Spatio-Temporal Scene Graph for Video Semantic Role Labeling

Yu Zhao, Hao Fei, Yixin Cao, Bobo Li, Meishan Zhang, Jianguo Wei, Min Zhang, Tat-Seng Chua

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.04733 2023-08-15 cs.CV

TextPainter: Multimodal Text Image Generation with Visual-harmony and Text-comprehension for Poster Design

Yifan Gao, Jinpeng Lin, Min Zhou, Chuanbin Liu, Hongtao Xie, Tiezheng Ge, Yuning Jiang

Comments Accepted to ACM MM 2023. Dataset Link: https://tianchi.aliyun.com/dataset/160034

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.04502 2023-08-15 cs.CL

Revisiting Disentanglement and Fusion on Modality and Context in Conversational Multimodal Emotion Recognition

Bobo Li, Hao Fei, Lizi Liao, Yu Zhao, Chong Teng, Tat-Seng Chua, Donghong Ji, Fei Li

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.06161 2023-08-14 cs.CV

Rethinking the Localization in Weakly Supervised Object Localization

Rui Xu, Yong Luo, Han Hu, Bo Du, Jialie Shen, Yonggang Wen

Comments Accepted by ACM International Conference on Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.06101 2023-08-14 cs.CV

Taming the Power of Diffusion Models for High-Quality Virtual Try-On with Appearance Flow

Junhong Gou, Siyu Sun, Jianfu Zhang, Jianlou Si, Chen Qian, Liqing Zhang

Comments Accepted by ACMMM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.05447 2023-08-11 cs.CV eess.IV

A Generalized Physical-knowledge-guided Dynamic Model for Underwater Image Enhancement

Pan Mu, Hanning Xu, Zheyuan Liu, Zheng Wang, Sixian Chan, Cong Bai

Comments Accepted by ACMMM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.05421 2023-08-11 cs.CV cs.MM

Progressive Spatio-temporal Perception for Audio-Visual Question Answering

Guangyao Li, Wenxuan Hou, Di Hu

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.04132 2023-08-11 cs.MM cs.NI

Optimizing Adaptive Video Streaming with Human Feedback

Tianchi Huang, Rui-Xiao Zhang, Chenglei Wu, Lifeng Sun

Comments ACM Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.05112 2023-08-11 cs.CV cs.GR

Explicifying Neural Implicit Fields for Efficient Dynamic Human Avatar Modeling via a Neural Explicit Surface

Ruiqi Zhang, Jie Chen, Qiang Wang

Comments 8 pages, accepted by ACMMM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.07304 2023-08-11 cs.CV cs.AI

CLIP-Count: Towards Text-Guided Zero-Shot Object Counting

Ruixiang Jiang, Lingbo Liu, Changwen Chen

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.04828 2023-08-10 cs.CV

Seeing in Flowing: Adapting CLIP for Action Recognition with Motion Prompts Learning

Qiang Wang, Junlong Du, Ke Yan, Shouhong Ding

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.04805 2023-08-10 cs.IR cs.SD eess.AS

DiVa: An Iterative Framework to Harvest More Diverse and Valid Labels from User Comments for Music

Hongru Liang, Jingyao Liu, Yuanxin Xiang, Jiachen Du, Lanjun Zhou, Shushen Pan, Wenqiang Lei

Comments 11 pages, 5 figures, published to ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.04767 2023-08-10 cs.CV cs.AI cs.MM cs.SD eess.AS

Induction Network: Audio-Visual Modality Gap-Bridging for Self-Supervised Sound Source Localization

Tianyu Liu, Peng Zhang, Wei Huang, Yufei Zha, Tao You, Yanning Zhang

Comments Accepted to ACM Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏