arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

ACM International Conference on Multimedia · 会议 · Multimedia

共收录 1966
2308.16635 2023-09-01 cs.CV

MFR-Net: Multi-faceted Responsive Listening Head Generation via Denoising Diffusion Model

Jin Liu, Xi Wang, Xiaomeng Fu, Yesheng Chai, Cai Yu, Jiao Dai, Jizhong Han

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.16383 2023-09-01 cs.CV cs.MM

Separate and Locate: Rethink the Text in Text-based Visual Question Answering

Chengyang Fang, Jiangnan Li, Liang Li, Can Ma, Dayong Hu

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.16110 2023-08-31 cs.CV

Improving Few-shot Image Generation by Structural Discrimination and Textural Modulation

Mengping Yang, Zhe Wang, Wenyi Feng, Qian Zhang, Ting Xiao

Comments To appear in ACM MM 2023, code is available at https://github.com/kobeshegu/SDTM-GAN-ACMMM-2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.10799 2023-08-31 cs.CV

SelfTalk: A Self-Supervised Commutative Training Diagram to Comprehend 3D Talking Faces

Ziqiao Peng, Yihao Luo, Yue Shi, Hao Xu, Xiangyu Zhu, Jun He, Hongyan Liu, Zhaoxin Fan

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.15004 2023-08-30 cs.CV

PBFormer: Capturing Complex Scene Text Shape with Polynomial Band Transformer

Ruijin Liu, Ning Lu, Dapeng Chen, Cheng Li, Zejian Yuan, Wei Peng

Comments 9 pages, 8 figures, accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2301.00135 2023-08-30 cs.CV

TeViS:Translating Text Synopses to Video Storyboards

Xu Gu, Yuchong Sun, Feiyue Ni, Shizhe Chen, Xihua Wang, Ruihua Song, Boyuan Li, Xiang Cao

Comments Accepted to ACM Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.14686 2023-08-29 cs.CV

360-Degree Panorama Generation from Few Unregistered NFoV Images

Jionghao Wang, Ziyu Chen, Jun Ling, Rong Xie, Li Song

Comments Accepted to ACM Multimedia 2023 (MM' 23). Code is available: https://github.com/shanemankiw/Panodiff

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.14395 2023-08-29 cs.MM cs.CV

UMMAFormer: A Universal Multimodal-adaptive Transformer Framework for Temporal Forgery Localization

Rui Zhang, Hongxia Wang, Mingshan Du, Hanqing Liu, Yang Zhou, Qiang Zeng

Comments 11 pages, 8 figures, 66 references. This paper has been accepted for ACM MM 2023

Journal ref Proceedings of the 31st ACM International Conference on Multimedia (MM '23), October 29-November 3, 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.14052 2023-08-29 cs.CV

MM-AU:Towards Multimodal Understanding of Advertisement Videos

Digbalay Bose, Rajat Hebbar, Tiantian Feng, Krishna Somandepalli, Anfeng Xu, Shrikanth Narayanan

Comments Accepted to ACM Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.06725 2023-08-29 cs.CV cs.AI cs.MM

CLE Diffusion: Controllable Light Enhancement Diffusion Model

Yuyang Yin, Dejia Xu, Chuangchuang Tan, Ping Liu, Yao Zhao, Yunchao Wei

Comments Accepted In Proceedings of the 31st ACM International Conference on Multimedia (MM' 23)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.12845 2023-08-25 cs.CV

Implicit Obstacle Map-driven Indoor Navigation Model for Robust Obstacle Avoidance

Wei Xie, Haobo Jiang, Shuo Gu, Jin Xie

Comments 9 pages, 7 figures, 43 references. This paper has been accepted for ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.12712 2023-08-25 cs.CV

Ground-to-Aerial Person Search: Benchmark Dataset and Approach

Shizhou Zhang, Qingchun Yang, De Cheng, Yinghui Xing, Guoqiang Liang, Peng Wang, Yanning Zhang

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.12599 2023-08-25 cs.SD cs.LG eess.AS

Exploiting Time-Frequency Conformers for Music Audio Enhancement

Yunkee Chae, Junghyun Koo, Sungho Lee, Kyogu Lee

Comments Accepted by ACM Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.04706 2023-08-25 cs.IR cs.LG

Pareto Invariant Representation Learning for Multimedia Recommendation

Shanshan Huang, Haoxuan Li, Qingsong Li, Chunyuan Zheng, Li Liu

Comments ACM MM 2023 full paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.12163 2023-08-24 cs.CV

NPF-200: A Multi-Modal Eye Fixation Dataset and Method for Non-Photorealistic Videos

Ziyu Yang, Sucheng Ren, Zongwei Wu, Nanxuan Zhao, Junle Wang, Jing Qin, Shengfeng He

Comments Accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.12045 2023-08-24 cs.CV cs.AI cs.CL cs.MM

CgT-GAN: CLIP-guided Text GAN for Image Captioning

Jiarui Yu, Haoran Li, Yanbin Hao, Bin Zhu, Tong Xu, Xiangnan He

Comments Accepted at ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.11822 2023-08-24 cs.LG cs.CR cs.CV

PatchBackdoor: Backdoor Attack against Deep Neural Networks without Model Modification

Yizhen Yuan, Rui Kong, Shenghao Xie, Yuanchun Li, Yunxin Liu

Comments accepted by ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.11646 2023-08-24 cs.LG cs.AI cs.GT

Joint Local Relational Augmentation and Global Nash Equilibrium for Federated Learning with Non-IID Data

Xinting Liao, Chaochao Chen, Weiming Liu, Pengyang Zhou, Huabin Zhu, Shuheng Shen, Weiqiang Wang, Mengling Hu, Yanchao Tan, Xiaolin Zheng

Comments To appear in ACM International Conference on Multimedia (ACM MM23)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.02237 2023-08-24 cs.CV

MSECNet: Accurate and Robust Normal Estimation for 3D Point Clouds by Multi-Scale Edge Conditioning

Haoyi Xiu, Xin Liu, Weimin Wang, Kyoung-Sook Kim, Masashi Matsuoka

Comments Accepted for ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.01095 2023-08-24 cs.CV

AutoPoster: A Highly Automatic and Content-aware Design System for Advertising Poster Generation

Jinpeng Lin, Min Zhou, Ye Ma, Yifan Gao, Chenxi Fei, Yangjian Chen, Zhang Yu, Tiezheng Ge

Comments Accepted for ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.06924 2023-08-24 cs.IR cs.MM

A Tale of Two Graphs: Freezing and Denoising Graph Structures for Multimodal Recommendation

Xin Zhou, Zhiqi Shen

Comments Accepted to ACM Multimedia (MM) 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.11084 2023-08-23 cs.SD eess.AS

PMVC: Data Augmentation-Based Prosody Modeling for Expressive Voice Conversion

Yimin Deng, Huaizhen Tang, Xulong Zhang, Jianzong Wang, Ning Cheng, Jing Xiao

Comments Accepted by the 31st ACM International Conference on Multimedia (MM2023)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.10601 2023-08-22 cs.CV cs.CR cs.LG eess.IV

Improving the Transferability of Adversarial Examples with Arbitrary Style Transfer

Zhijin Ge, Fanhua Shang, Hongying Liu, Yuanyuan Liu, Liang Wan, Wei Feng, Xiaosen Wang

Comments 10 pages, 2 figures, accepted by the 31st ACM International Conference on Multimedia (MM '23)

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.05186 2023-08-22 cs.CV cs.AI

Suspected Object Matters: Rethinking Model's Prediction for One-stage Visual Grounding

Yang Jiao, Zequn Jie, Jingjing Chen, Lin Ma, Yu-Gang Jiang

Comments Accepted to ACM MM 23

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.10257 2023-08-22 cs.CV

Make-It-4D: Synthesizing a Consistent Long-Term Dynamic Scene Video from a Single Image

Liao Shen, Xingyi Li, Huiqiang Sun, Juewen Peng, Ke Xian, Zhiguo Cao, Guosheng Lin

Comments accepted by ACM MM'23

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.09983 2023-08-22 cs.CV

Prototypical Cross-domain Knowledge Transfer for Cervical Dysplasia Visual Inspection

Yichen Zhang, Yifang Yin, Ying Zhang, Zhenguang Liu, Zheng Wang, Roger Zimmermann

Comments accepted in ACM Multimedia 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.08306 2023-08-22 cs.MM cs.LG

Towards Balanced Active Learning for Multimodal Classification

Meng Shen, Yizheng Huang, Jianxiong Yin, Heqing Zou, Deepu Rajan, Simon See

Comments 12 pages, accepted by ACMMM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.09611 2023-08-21 cs.CV

Language-guided Human Motion Synthesis with Atomic Actions

Yuanhao Zhai, Mingzhen Huang, Tianyu Luan, Lu Dong, Ifeoma Nwogu, Siwei Lyu, David Doermann, Junsong Yuan

Comments Accepted to ACM MM 2023, code: https://github.com/yhZhai/ATOM

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.06087 2023-08-21 cs.MM cs.AI cs.CV

Audio-Visual Spatial Integration and Recursive Attention for Robust Sound Source Localization

Sung Jin Um, Dongjin Kim, Jung Uk Kim

Comments Camera-Ready, ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.08881 2023-08-21 cs.CV

Text-Only Training for Visual Storytelling

Yuechen Wang, Wengang Zhou, Zhenbo Lu, Houqiang Li

Comments ACM MM 2023

详情

展开后加载摘要…

URL PDF HTML 收藏