arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

ACM International Conference on Multimedia · 会议 · Multimedia

共收录 1944
2408.06596 2024-08-14 cs.CV

GeoFormer: Learning Point Cloud Completion with Tri-Plane Integrated Transformer

Jinpeng Yu, Binbin Huang, Yuxuan Zhang, Huaxia Li, Xu Tang, Shenghua Gao

Comments accepted by the 32nd ACM International Conference on Multimedia (MM'24)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.06360 2024-08-14 cs.IR cs.CV

Modality-Balanced Learning for Multimedia Recommendation

Jinghao Zhang, Guofan Liu, Qiang Liu, Shu Wu, Liang Wang

Comments ACM Multimedia 2024 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.05974 2024-08-13 cs.CV

Unseen No More: Unlocking the Potential of CLIP for Generative Zero-shot HOI Detection

Yixin Guo, Yu Liu, Jianghao Li, Weimin Wang, Qi Jia

Comments Accepted by ACM MM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.05955 2024-08-13 cs.CV

Probabilistic Vision-Language Representation for Weakly Supervised Temporal Action Localization

Geuntaek Lim, Hyunwoo Kim, Joonsoo Kim, Yukyung Choi

Comments Accepted to ACM MM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.05706 2024-08-13 cs.CV

Decoder Pre-Training with only Text for Scene Text Recognition

Shuai Zhao, Yongkun Du, Zhineng Chen, Yu-Gang Jiang

Comments Accepted by ACM MM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.05674 2024-08-13 cs.CV

PS-TTL: Prototype-based Soft-labels and Test-Time Learning for Few-shot Object Detection

Yingjie Gao, Yanan Zhang, Ziyue Huang, Nanqing Liu, Di Huang

Comments Accepted to ACM MM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.05492 2024-08-13 cs.CV

ZePo: Zero-Shot Portrait Stylization with Faster Sampling

Jin Liu, Huaibo Huang, Jie Cao, Ran He

Comments Accepted by ACM MM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.03468 2024-08-13 cs.MM cs.AI cs.CV

MultiHateClip: A Multilingual Benchmark Dataset for Hateful Video Detection on YouTube and Bilibili

Han Wang, Tan Rui Yang, Usman Naseem, Roy Ka-Wei Lee

Comments 10 pages, 3 figures, ACM Multimedia 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.01038 2024-08-13 cs.CL

UNER: A Unified Prediction Head for Named Entity Recognition in Visually-rich Documents

Yi Tu, Chong Zhang, Ya Guo, Huan Chen, Jinyang Tang, Huijia Zhu, Qi Zhang

Comments accepted by ACM Multimedia 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.21335 2024-08-13 cs.CV

On-the-fly Point Feature Representation for Point Clouds Analysis

Jiangyi Wang, Zhongyao Cheng, Na Zhao, Jun Cheng, Xulei Yang

Comments Accepted by ACM MM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.16501 2024-08-13 cs.CV

Context-Aware Indoor Point Cloud Object Generation through User Instructions

Yiyang Luo, Ke Lin, Chao Gu

Comments Accepted by ACMMM'24

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.10858 2024-08-13 cs.CV

Multi-Granularity Hand Action Detection

Ting Zhe, Jing Zhang, Yongqian Li, Yong Luo, Han Hu, Dacheng Tao

Comments Accepted by ACM MM'2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.04962 2024-08-12 cs.CV

DAFT-GAN: Dual Affine Transformation Generative Adversarial Network for Text-Guided Image Inpainting

Jihoon Lee, Yunhong Min, Hwidong Kim, Sangtae Ahn

Comments ACM MM'2024. 9 pages, 3 tables, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.14037 2024-08-12 cs.CV cs.MM

GaussianTalker: Speaker-specific Talking Head Synthesis via 3D Gaussian Splatting

Hongyun Yu, Zhan Qu, Qihang Yu, Jianchuan Chen, Zhonghua Jiang, Zhiwen Chen, Shengyu Zhang, Jimin Xu, Fei Wu, Chengfei Lv, Gang Yu

Comments Accepted by ACM MM 2024. Project page: https://yuhongyun777.github.io/GaussianTalker/

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.07622 2024-08-12 cs.MM

EMID: An Emotional Aligned Dataset in Audio-Visual Modality

Jialing Zou, Jiahao Mei, Guangze Ye, Tianyu Huai, Qiwei Shen, Daoguo Dong

Comments Accepted by ACM MM workshop McGE 2023: Proceedings of the 1st International Workshop on Multimedia Content Generation and Evaluation: New Methods and Practice

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.04158 2024-08-09 eess.IV cs.CV

Efficient Single Image Super-Resolution with Entropy Attention and Receptive Field Augmentation

Xiaole Zhao, Linze Li, Chengxing Xie, Xiaoming Zhang, Ting Jiang, Wenjie Lin, Shuaicheng Liu, Tianrui Li

Comments Accepted to ACM MM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.04013 2024-08-09 cs.MM cs.HC

MetaDragonBoat: Exploring Paddling Techniques of Virtual Dragon Boating in a Metaverse Campus

Wei He, Xiang Li, Shengtian Xu, Yuzheng Chen, Chan-In Sio, Ge Lin Kan, Lik-Hang Lee

Comments 10 pages, accepted at ACM MM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.19429 2024-08-09 cs.LG cs.SI

FTF-ER: Feature-Topology Fusion-Based Experience Replay Method for Continual Graph Learning

Jinhui Pang, Changqing Lin, Xiaoshuai Hao, Rong Yin, Zixuan Wang, Zhihui Zhang, Jinglin He, Huang Tai Sheng

Comments Accepted by ACM Multimedia 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.08389 2024-08-09 cs.CV cs.MM

Edit As You Wish: Video Caption Editing with Multi-grained User Control

Linli Yao, Yuanmeng Zhang, Ziheng Wang, Xinglin Hou, Tiezheng Ge, Yuning Jiang, Xu Sun, Qin Jin

Comments Accepted by ACM MM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.03913 2024-08-08 cs.CV cs.LG

AdapMTL: Adaptive Pruning Framework for Multitask Learning Model

Mingcan Xiang, Steven Jiaxun Tang, Qizheng Yang, Hui Guan, Tongping Liu

Comments 13 pages, 9 figures, Published at ACM Multimedia (ACM MM) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.03748 2024-08-08 cs.CV

Data Generation Scheme for Thermal Modality with Edge-Guided Adversarial Conditional Diffusion Model

Guoqing Zhu, Honghu Pan, Qiang Wang, Chao Tian, Chao Yang, Zhenyu He

Comments accepted by ACM MM 2024/ACM MM24

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.03637 2024-08-08 cs.CV cs.MM

TALE: Training-free Cross-domain Image Composition via Adaptive Latent Manipulation and Energy-guided Optimization

Kien T. Pham, Jingye Chen, Qifeng Chen

Comments The 32nd ACM Multimedia Conference (MM '24)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.03598 2024-08-08 cs.CV

PRISM: PRogressive dependency maxImization for Scale-invariant image Matching

Xudong Cai, Yongcai Wang, Lun Luo, Minhang Wang, Deying Li, Jintao Xu, Weihao Gu, Rui Ai

Comments 15 pages, 8 figures, ACM MM 2024. Supplementary materials are included

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.11317 2024-08-08 cs.CV cs.AI

Improving Composed Image Retrieval via Contrastive Learning with Scaling Positives and Negatives

Zhangchi Feng, Richong Zhang, Zhijie Nie

Comments Accepted to ACM MM 2024 Regular Papers

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.11956 2024-08-08 cs.CV

Subjective-Aligned Dataset and Metric for Text-to-Video Quality Assessment

Tengchuan Kou, Xiaohong Liu, Zicheng Zhang, Chunyi Li, Haoning Wu, Xiongkuo Min, Guangtao Zhai, Ning Liu

Comments Accepted by ACMMM 24

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.03006 2024-08-07 cs.CV

Dual-path Collaborative Generation Network for Emotional Video Captioning

Cheng Ye, Weidong Chen, Jingyu Li, Lei Zhang, Zhendong Mao

Comments Acccepted by ACM Multimedia 2024, oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.12794 2024-08-07 cs.CV cs.MM cs.RO eess.IV

MambaMOS: LiDAR-based 3D Moving Object Segmentation with Motion-aware State Space Model

Kang Zeng, Hao Shi, Jiacheng Lin, Siyu Li, Jintao Cheng, Kaiwei Wang, Zhiyong Li, Kailun Yang

Comments Accepted to ACM MM 2024. The source code is publicly available at https://github.com/Terminal-K/MambaMOS

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.14972 2024-08-07 cs.AI cs.CL cs.MA cs.MM

A Picture Is Worth a Graph: A Blueprint Debate Paradigm for Multimodal Reasoning

Changmeng Zheng, Dayong Liang, Wengyu Zhang, Xiao-Yong Wei, Tat-Seng Chua, Qing Li

Comments Accepted by ACM Multimedia 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.01988 2024-08-07 cs.CL

FKA-Owl: Advancing Multimodal Fake News Detection through Knowledge-Augmented LVLMs

Xuannan Liu, Peipei Li, Huaibo Huang, Zekun Li, Xing Cui, Jiahao Liang, Lixiong Qin, Weihong Deng, Zhaofeng He

Comments Accepted by ACM MM 2024.Project page: https://liuxuannan.github.io/FKA_Owl.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.16907 2024-08-07 eess.IV cs.CV cs.LG

Diffusion Posterior Proximal Sampling for Image Restoration

Hongjie Wu, Linchao He, Mingqin Zhang, Dongdong Chen, Kunming Luo, Mengting Luo, Ji-Zhe Zhou, Hu Chen, Jiancheng Lv

Comments ACM Multimedia 2024 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏