arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

ACM International Conference on Multimedia · 会议 · Multimedia

共收录 1966
2309.11131 2023-09-21 cs.CV

Locate and Verify: A Two-Stream Network for Improved Deepfake Detection

Chao Shuai, Jieming Zhong, Shuang Wu, Feng Lin, Zhibo Wang, Zhongjie Ba, Zhenguang Liu, Lorenzo Cavallaro, Kui Ren

Comments 10 pages, 8 figures, 60 references. This paper has been accepted for ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.09709 2023-09-21 cs.CV

CATR: Combinatorial-Dependence Audio-Queried Transformer for Audio-Visual Video Segmentation

Kexin Li, Zongxin Yang, Lei Chen, Yi Yang, Jun Xiao

Comments accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.09122 2023-09-19 cs.CV cs.AI

FDCNet: Feature Drift Compensation Network for Class-Incremental Weakly Supervised Object Localization

Sejin Park, Taehyung Lee, Yeejin Lee, Byeongkeun Kang

Comments ACM Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.08919 2023-09-19 cs.CV

Pixel Adapter: A Graph-Based Post-Processing Approach for Scene Text Image Super-Resolution

Wenyu Zhang, Xin Deng, Baojun Jia, Xingtong Yu, Yifan Chen, jin Ma, Qing Ding, Xinming Zhang

Journal ref ACM Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.07958 2023-09-19 cs.CV cs.GR

RecolorNeRF: Layer Decomposed Radiance Fields for Efficient Color Editing of 3D Scenes

Bingchen Gong, Yuehao Wang, Xiaoguang Han, Qi Dou

Comments To appear in ACM Multimedia 2023. Project website is accessible at https://sites.google.com/view/recolornerf

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.08372 2023-09-18 cs.CV cs.MM

Beyond Domain Gap: Exploiting Subjectivity in Sketch-Based Person Retrieval

Kejun Lin, Zhixiang Wang, Zheng Wang, Yinqiang Zheng, Shin'ichi Satoh

Comments ACM Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.07925 2023-09-18 eess.AS cs.AI cs.MM cs.SD

Hierarchical Audio-Visual Information Fusion with Multi-label Joint Decoding for MER 2023

Haotian Wang, Yuxuan Xi, Hang Chen, Jun Du, Yan Song, Qing Wang, Hengshun Zhou, Chenxi Wang, Jiefeng Ma, Pengfei Hu, Ya Jiang, Shi Cheng, Jie Zhang, Yuzhe Weng

Comments 5 pages, 4 figures

Journal ref The 31st ACM International Conference on Multimedia (MM'23), 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.07753 2023-09-15 cs.CV

Co-Salient Object Detection with Semantic-Level Consensus Extraction and Dispersion

Peiran Xu, Yadong Mu

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.06526 2023-09-15 cs.CV cs.GR

AvatarFusion: Zero-shot Generation of Clothing-Decoupled 3D Avatars Using 2D Diffusion

Shuo Huang, Zongxin Yang, Liangting Li, Yi Yang, Jia Jia

Comments Accepted by ACM Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.07051 2023-09-14 cs.HC cs.AI cs.MM

UnifiedGesture: A Unified Gesture Synthesis Model for Multiple Skeletons

Sicheng Yang, Zilin Wang, Zhiyong Wu, Minglei Li, Zhensong Zhang, Qiaochu Huang, Lei Hao, Songcen Xu, Xiaofei Wu, changpeng yang, Zonghong Dai

Comments 16 pages, 11 figures, ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.06877 2023-09-14 cs.CV cs.MM

Video Infringement Detection via Feature Disentanglement and Mutual Information Maximization

Zhenguang Liu, Xinyang Yu, Ruili Wang, Shuai Ye, Zhe Ma, Jianfeng Dong, Sifeng He, Feng Qian, Xiaobo Zhang, Roger Zimmermann, Lei Yang

Comments This paper is accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.06285 2023-09-13 cs.CV cs.AI

Jersey Number Recognition using Keyframe Identification from Low-Resolution Broadcast Videos

Bavesh Balaji, Jerrin Bright, Harish Prakash, Yuhao Chen, David A Clausi, John Zelek

Comments Accepted in the 6th International Workshop on Multimedia Content Analysis in Sports (MMSports'23) @ ACM Multimedia

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.06105 2023-09-13 cs.CV cs.CL

Towards Visual Taxonomy Expansion

Tinghui Zhu, Jingping Liu, Jiaqing Liang, Haiyun Jiang, Yanghua Xiao, Zongyu Wang, Rui Xie, Yunsen Xian

Comments ACMMM accepted paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.06004 2023-09-13 cs.CV

TSSAT: Two-Stage Statistics-Aware Transformation for Artistic Style Transfer

Haibo Chen, Lei Zhao, Jun Li, Jian Yang

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.04734 2023-09-12 cs.CV cs.CL cs.MM

Towards Better Multi-modal Keyphrase Generation via Visual Entity Enhancement and Multi-granularity Image Noise Filtering

Yifan Dong, Suhang Wu, Fandong Meng, Jie Zhou, Xiaoli Wang, Jianxin Lin, Jinsong Su

Comments Accepted In Proceedings of the 31st ACM International Conference on Multimedia (MM' 23)

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.04682 2023-09-12 cs.CV

DeNoising-MOT: Towards Multiple Object Tracking with Severe Occlusions

Teng Fu, Xiaocong Wang, Haiyang Yu, Ke Niu, Bin Li, Xiangyang Xue

Comments ACM Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.12006 2023-09-12 cs.CV

Multi-stage Factorized Spatio-Temporal Representation for RGB-D Action and Gesture Recognition

Yujun Ma, Benjia Zhou, Ruili Wang, Pichao Wang

Comments ACM MM'23

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.05880 2023-09-11 cs.CL cs.AI

TikTalk: A Video-Based Dialogue Dataset for Multi-Modal Chitchat in Real World

Hongpeng Lin, Ludan Ruan, Wenke Xia, Peiyu Liu, Jingyuan Wen, Yixin Xu, Di Hu, Ruihua Song, Wayne Xin Zhao, Qin Jin, Zhiwu Lu

Comments Accepted to ACM Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.03575 2023-09-08 cs.CV

Toward High Quality Facial Representation Learning

Yue Wang, Jinlong Peng, Jiangning Zhang, Ran Yi, Liang Liu, Yabiao Wang, Chengjie Wang

Comments ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.02335 2023-09-08 cs.LG cs.AI cs.CV cs.IR cs.SI

RAHNet: Retrieval Augmented Hybrid Network for Long-tailed Graph Classification

Zhengyang Mao, Wei Ju, Yifang Qin, Xiao Luo, Ming Zhang

Comments Accepted by the ACM International Conference on Multimedia (MM) 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.02224 2023-09-06 cs.CV cs.AI

Dense Object Grounding in 3D Scenes

Wencan Huang, Daizong Liu, Wei Hu

Comments ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.01366 2023-09-06 cs.MM

Target-Guided Composed Image Retrieval

Haokun Wen, Xian Zhang, Xuemeng Song, Yinwei Wei, Liqiang Nie

Journal ref ACM Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.01339 2023-09-06 cs.CL cs.AI cs.CV cs.MM

UniSA: Unified Generative Framework for Sentiment Analysis

Zaijing Li, Ting-En Lin, Yuchuan Wu, Meng Liu, Fengxiao Tang, Ming Zhao, Yongbin Li

Comments Accepted to ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.01075 2023-09-06 cs.CV

Muti-Stage Hierarchical Food Classification

Xinyue Pan, Jiangpeng He, Fengqing Zhu

Comments accepted for ACM MM 2023 Madima

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.01010 2023-09-06 cs.CV cs.AI

Mitigating Motion Blur for Robust 3D Baseball Player Pose Modeling for Pitch Analysis

Jerrin Bright, Yuhao Chen, John Zelek

Comments Accepted in the 6th International Workshop on Multimedia Content Analysis in Sports (MMSports'23) @ ACM Multimedia

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.00007 2023-09-06 cs.CV cs.CR cs.LG

When Measures are Unreliable: Imperceptible Adversarial Perturbations toward Top-$k$ Multi-Label Learning

Yuchen Sun, Qianqian Xu, Zitai Wang, Qingming Huang

Comments 22 pages, 7 figures, accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.09221 2023-09-06 cs.NI cs.CV

Moby: Empowering 2D Models for Efficient Point Cloud Analytics on the Edge

Jingzong Li, Yik Hong Cai, Libin Liu, Yu Mao, Chun Jason Xue, Hong Xu

Comments Accepted to ACM International Conference on Multimedia (MM) 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.00199 2023-09-04 cs.CV cs.AI cs.LG

Diffusion Model with Clustering-based Conditioning for Food Image Generation

Yue Han, Jiangpeng He, Mridul Gupta, Edward J. Delp, Fengqing Zhu

Comments Accepted for 31st ACM International Conference on Multimedia: 8th International Workshop on Multimedia Assisted Dietary Management (MADiMa 2023)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.12538 2023-09-04 cs.CV

Mutual-Guided Dynamic Network for Image Fusion

Yuanshen Guan, Ruikang Xu, Mingde Yao, Lizhi Wang, Zhiwei Xiong

Comments ACMMM 2023 accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.16739 2023-09-01 cs.CV

Parsing is All You Need for Accurate Gait Recognition in the Wild

Jinkai Zheng, Xinchen Liu, Shuai Wang, Lihao Wang, Chenggang Yan, Wu Liu

Comments 16 pages, 14 figures, ACM MM 2023 accepted, project page: https://gait3d.github.io/gait3d-parsing-hp

详情

展开后加载摘要…

URL PDF HTML 收藏