arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

ACM International Conference on Multimedia · 会议 · Multimedia

共收录 1966
2209.00355 2022-09-02 cs.CV

Gait Recognition in the Wild with Multi-hop Temporal Switch

Jinkai Zheng, Xinchen Liu, Xiaoyan Gu, Yaoqi Sun, Chuang Gan, Jiyong Zhang, Wu Liu, Chenggang Yan

Comments 10 pages, 6 figures; Accepted by ACM MM 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.00277 2022-09-02 cs.CV cs.CL cs.SD eess.AS

Video-Guided Curriculum Learning for Spoken Video Grounding

Yan Xia, Zhou Zhao, Shangwei Ye, Yang Zhao, Haoyuan Li, Yi Ren

Comments Accepted by ACM MM 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.14704 2022-09-01 cs.CV

ELMformer: Efficient Raw Image Restoration with a Locally Multiplicative Transformer

Jiaqi Ma, Shengyuan Yan, Lefei Zhang, Guoli Wang, Qian Zhang

Comments ACM Multimedia 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.14607 2022-09-01 cs.CV

SIM-Trans: Structure Information Modeling Transformer for Fine-grained Visual Categorization

Hongbo Sun, Xiangteng He, Yuxin Peng

Comments 9 pages, ACM MM 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.07917 2022-08-30 cs.CV

SPTS: Single-Point Text Spotting

Dezhi Peng, Xinyu Wang, Yuliang Liu, Jiaxin Zhang, Mingxin Huang, Songxuan Lai, Shenggao Zhu, Jing Li, Dahua Lin, Chunhua Shen, Xiang Bai, Lianwen Jin

Comments Accepted by ACM MM 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.13016 2022-08-30 cs.CV

AesUST: Towards Aesthetic-Enhanced Universal Style Transfer

Zhizhong Wang, Zhanjie Zhang, Lei Zhao, Zhiwen Zuo, Ailin Li, Wei Xing, Dongming Lu

Comments Accepted by ACM MM 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.12934 2022-08-30 cs.CV

xCloth: Extracting Template-free Textured 3D Clothes from a Monocular Image

Astitva Srivastava, Chandradeep Pokhariya, Sai Sagar Jinka, Avinash Sharma

Comments Accepted at ACM Multimedia-2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.12526 2022-08-29 cs.CV cs.MM

Cross-Lingual Cross-Modal Retrieval with Noise-Robust Learning

Yabing Wang, Jianfeng Dong, Tianxiang Liang, Minsong Zhang, Rui Cai, Xun Wang

Comments Accepted by ACM MM 2022. Code and data are available at https://github.com/HuiGuanLab/nrccr

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.09646 2022-08-23 cs.SD cs.AI eess.AS

An Initial Investigation for Detecting Vocoder Fingerprints of Fake Audio

Xinrui Yan, Jiangyan Yi, Jianhua Tao, Chenglong Wang, Haoxin Ma, Tao Wang, Shiming Wang, Ruibo Fu

Comments Accepted by ACM Multimedia 2022 Workshop: First International Workshop on Deepfake Detection for Audio Multimedia

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.00380 2022-08-19 cs.CV

Less is More: Consistent Video Depth Estimation with Masked Frames Modeling

Yiran Wang, Zhiyu Pan, Xingyi Li, Zhiguo Cao, Ke Xian, Jianming Zhang

Comments Accepted by ACM MM 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.06103 2022-08-19 cs.CV eess.IV

Learnability Enhancement for Low-light Raw Denoising: Where Paired Real Data Meets Noise Modeling

Hansen Feng, Lizhi Wang, Yuzhi Wang, Hua Huang

Comments 9 pages, 8 figures, to be published in ACMMM 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.08090 2022-08-18 cs.CV cs.MM

Progressive Cross-modal Knowledge Distillation for Human Action Recognition

Jianyuan Ni, Anne H. H. Ngu, Yan Yan

Comments ACM MM 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.10400 2022-08-18 cs.CV

Correspondence Matters for Video Referring Expression Comprehension

Meng Cao, Ji Jiang, Long Chen, Yuexian Zou

Comments Accepted by ACM MM 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.07870 2022-08-17 cs.CV cs.AI

Language-guided Semantic Style Transfer of 3D Indoor Scenes

Bu Jin, Beiwen Tian, Hao Zhao, Guyue Zhou

Comments Accepted to ACM Multimedia PIES-ME 2022. Code: https://github.com/AIR-DISCOVER/LASST

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.05220 2022-08-17 cs.CV

Dual Domain-Adversarial Learning for Audio-Visual Saliency Prediction

Yingzi Fan, Longfei Han, Yue Zhang, Lechao Cheng, Chen Xia, Di Hu

Comments Accepted by ACM MM workshop 2022(HCMA2022)

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.06866 2022-08-16 cs.CV cs.LG

HyP$^2$ Loss: Beyond Hypersphere Metric Space for Multi-label Image Retrieval

Chengyin Xu, Zenghao Chai, Zhengzhuo Xu, Chun Yuan, Yanbo Fan, Jue Wang

Comments Accepted by ACM International Conference on Multimedia (ACM MM) 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.06674 2022-08-16 cs.CV

DS-MVSNet: Unsupervised Multi-view Stereo via Depth Synthesis

Jingliang Li, Zhengda Lu, Yiqun Wang, Ying Wang, Jun Xiao

Comments Accepted by ACM MM 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.05577 2022-08-16 cs.CV cs.HC cs.MM

Learning from Label Relationships in Human Affect

Niki Maria Foteinopoulou, Ioannis Patras

Comments Accepted at ACM Multimedia (ACMMM) 2022, 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.02976 2022-08-16 cs.CV cs.IR

Semi-supervised Human Pose Estimation in Art-historical Images

Matthias Springstein, Stefanie Schneider, Christian Althaus, Ralph Ewerth

Comments Accepted at ACM MM 2022 as a conference paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.12772 2022-08-16 cs.CV cs.MM cs.SD eess.AS

Exploiting Transformation Invariance and Equivariance for Self-supervised Sound Localisation

Jinxiang Liu, Chen Ju, Weidi Xie, Ya Zhang

Comments Camera-ready Version for ACMMM 2022, Project page is https://jinxiang-liu.github.io/SSL-TIE/

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.05647 2022-08-12 cs.CV cs.MM

PPMN: Pixel-Phrase Matching Network for One-Stage Panoptic Narrative Grounding

Zihan Ding, Zi-han Ding, Tianrui Hui, Junshi Huang, Xiaoming Wei, Xiaolin Wei, Si Liu

Comments Accepted by ACM MM 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.04921 2022-08-10 cs.CV

TSRFormer: Table Structure Recognition with Transformers

Weihong Lin, Zheng Sun, Chixiang Ma, Mingze Li, Jiawei Wang, Lei Sun, Qiang Huo

Comments Accepted by ACM MultiMedia 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.04517 2022-08-10 cs.CV

Attribute Controllable Beautiful Caucasian Face Generation by Aesthetics Driven Reinforcement Learning

Xin Jin, Shu Zhao, Le Zhang, Xin Zhao, Qiang Deng, Chaoen Xiao

Comments 13 pages, 5 figures. ACM Multimedia 2022 Technical Demos and Videos Program

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.04215 2022-08-10 cs.CV

Boosting Video-Text Retrieval with Explicit High-Level Semantics

Haoran Wang, Di Xu, Dongliang He, Fu Li, Zhong Ji, Jungong Han, Errui Ding

Comments Accepted by ACMMM 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.04079 2022-08-09 cs.MM

Where Are You Looking?: A Large-Scale Dataset of Head and Gaze Behavior for 360-Degree Videos and a Pilot Study

Yili Jin, Junhua Liu, Fangxin Wang, Shuguang Cui

Comments Accepted by ACM MM 2022. Dataset is available at https://cuhksz-inml.github.io/head_gaze_dataset

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.03644 2022-08-09 cs.CV

Label-Efficient Domain Generalization via Collaborative Exploration and Generalization

Junkun Yuan, Xu Ma, Defang Chen, Kun Kuang, Fei Wu, Lanfen Lin

Comments Accepted by ACM MM 2022 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.03431 2022-08-09 cs.CV cs.AI

IVT: An End-to-End Instance-guided Video Transformer for 3D Pose Estimation

Zhongwei Qiu, Qiansheng Yang, Jian Wang, Dongmei Fu

Comments ACM Multimedia 2022, oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.11341 2022-08-09 cs.CV

Dynamic Graph Reasoning for Multi-person 3D Pose Estimation

Zhongwei Qiu, Qiansheng Yang, Jian Wang, Dongmei Fu

Comments ACM Multimedia 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.07468 2022-08-08 eess.AS cs.MM cs.SD

SingGAN: Generative Adversarial Network For High-Fidelity Singing Voice Generation

Rongjie Huang, Chenye Cui, Feiyang Chen, Yi Ren, Jinglin Liu, Zhou Zhao, Baoxing Huai, Zhefeng Wang

Comments Accepted by ACM Multimedia 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.02080 2022-08-04 cs.CV

A Feature-space Multimodal Data Augmentation Technique for Text-video Retrieval

Alex Falcon, Giuseppe Serra, Oswald Lanz

Comments Accepted for presentation at 30th ACM International Conference on Multimedia (ACM MM)

详情

展开后加载摘要…

URL PDF HTML 收藏