arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 4211 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 4211 篇

2410.06044 2024-10-10 cs.CV 57%

HyperDet: Generalizable Detection of Synthesized Images by Generating and Merging A Mixture of Hyper LoRAs

Huangsen Cao, Yongwei Wang, Yinfeng Liu, Sixian Zheng, Kangtao Lv, Zhimeng Zhang, Bo Zhang, Xin Ding, Fei Wu

专题命中 可控生成 :generative vision(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05791 2024-10-10 cs.GR cs.AI cs.SD eess.AS 57%

FürElise: Capturing and Physically Synthesizing Hand Motions of Piano Performance

Ruocheng Wang, Pei Xu, Haochen Shi, Elizabeth Schumann, C. Karen Liu

专题命中 可控生成 :diffusion(abstract);分类 cs.GR

Comments SIGGRAPH Asia 2024. Project page: https://for-elise.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.07875 2024-10-10 cs.RO cs.AI cs.CL cs.CV cs.LG 57%

Generative Image as Action Models

Mohit Shridhar, Yat Long Lo, Stephen James

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments CoRL 2024. Website, code, checkpoints: https://genima-robot.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.09964 2024-10-10 cs.CV 57%

KPNDepth: Depth Estimation of Lane Images under Complex Rainy Environment

Zhengxu Shi

专题命中 可控生成 :image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04965 2024-10-08 cs.CV 57%

Revealing Directions for Text-guided 3D Face Editing

Zhuo Chen, Yichao Yan, Sehngqi Liu, Yuhao Cheng, Weiming Zhao, Lincheng Li, Mengxiao Bi, Xiaokang Yang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04671 2024-10-08 cs.CV 57%

CAR: Controllable Autoregressive Modeling for Visual Generation

Ziyu Yao, Jialin Li, Yifeng Zhou, Yong Liu, Xi Jiang, Chengjie Wang, Feng Zheng, Yuexian Zou, Lei Li

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Code available at: https://github.com/MiracleDance/CAR

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04511 2024-10-08 cs.CV cs.CL 57%

Realizing Video Summarization from the Path of Language-based Semantic Understanding

Kuan-Chen Mu, Zhi-Yi Chin, Wei-Chen Chiu

专题命中 可控生成 :text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04298 2024-10-08 cs.CV 57%

Test-Time Adaptation for Keypoint-Based Spacecraft Pose Estimation Based on Predicted-View Synthesis

Juan Ignacio Bravo Pérez-Villar, Álvaro García-Martín, Jesús Bescós, Juan C. SanMiguel

专题命中 可控生成 :image synthesis(abstract);分类 cs.CV

Comments Preprint

Journal ref IEEE Transactions on Aerospace and Electronic Systems (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.04148 2024-10-04 cs.CV 57%

Representation Synthesis by Probabilistic Many-Valued Logic Operation in Self-Supervised Learning

Hiroki Nakamura, Masashi Okada, Tadahiro Taniguchi

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments Accepted to the IEEE Open Journal of Signal Processing (ICIP2024 track)

Journal ref IEEE Open Journal of Signal Processing, vol. 5, pp. 831-840, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.00464 2024-10-02 cs.CV 57%

Enabling Synergistic Full-Body Control in Prompt-Based Co-Speech Motion Generation

Bohong Chen, Yumeng Li, Yao-Xiang Ding, Tianjia Shao, Kun Zhou

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Project Page: https://robinwitch.github.io/SynTalker-Page

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.00337 2024-10-02 cs.CV 57%

SyntheOcc: Synthesize Geometric-Controlled Street View Images through 3D Semantic MPIs

Leheng Li, Weichao Qiu, Yingjie Cai, Xu Yan, Qing Lian, Bingbing Liu, Ying-Cong Chen

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.00309 2024-10-02 cs.CV cs.AI cs.LG 57%

Ask, Pose, Unite: Scaling Data Acquisition for Close Interactions with Vision Language Models

Laura Bravo-Sánchez, Jaewoo Heo, Zhenzhen Weng, Kuan-Chieh Wang, Serena Yeung-Levy

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Project webpage: https://laubravo.github.io/apu_website/

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19946 2024-10-01 cs.CV 57%

Illustrious: an Open Advanced Illustration Model

Sang Hyun Park, Jun Young Koh, Junha Lee, Joy Song, Dongha Kim, Hoyeon Moon, Hyunju Lee, Min Song

专题命中 可控生成 :text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19580 2024-10-01 cs.CV 57%

High Quality Human Image Animation using Regional Supervision and Motion Blur Condition

Zhongcong Xu, Chaoyue Song, Guoxian Song, Jianfeng Zhang, Jun Hao Liew, Hongyi Xu, You Xie, Linjie Luo, Guosheng Lin, Jiashi Feng, Mike Zheng Shou

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.17486 2024-10-01 cs.CV 57%

TextGaze: Gaze-Controllable Face Generation with Natural Language

Hengfei Wang, Zhongqun Zhang, Yihua Cheng, Hyung Jin Chang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments ACM MM2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.16538 2024-10-01 cs.CV 57%

OpenDlign: Open-World Point Cloud Understanding with Depth-Aligned Images

Ye Mao, Junpeng Jing, Krystian Mikolajczyk

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments 17 pages (Accepted by NeurIPS 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.18964 2024-09-30 cs.CV cs.AI cs.LG 57%

PhysGen: Rigid-Body Physics-Grounded Image-to-Video Generation

Shaowei Liu, Zhongzheng Ren, Saurabh Gupta, Shenlong Wang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted to ECCV 2024. Project page: https://stevenlsw.github.io/physgen/

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.06164 2024-09-30 cs.CV 57%

Platypose: Calibrated Zero-Shot Multi-Hypothesis 3D Human Motion Estimation

Paweł A. Pierzchlewicz, Caio O. da Silva, R. James Cotton, Fabian H. Sinz

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16042 2024-09-27 eess.IV cs.CV 57%

Enhanced Unsupervised Image-to-Image Translation Using Contrastive Learning and Histogram of Oriented Gradients

Wanchen Zhao

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments Critical Errors in Data or Analysis

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.17251 2024-09-27 cs.CV 57%

GenWarp: Single Image to Novel Views with Semantic-Preserving Generative Warping

Junyoung Seo, Kazumi Fukuda, Takashi Shibuya, Takuya Narihira, Naoki Murata, Shoukang Hu, Chieh-Hsin Lai, Seungryong Kim, Yuki Mitsufuji

专题命中 可控生成 :text-to-image(abstract);分类 cs.CV

Comments Accepted to NeurIPS 2024 / Project page: https://GenWarp-NVS.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.14579 2024-09-27 cs.CV 57%

Synthesizing Environment-Specific People in Photographs

Mirela Ostrek, Carol O'Sullivan, Michael J. Black, Justus Thies

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments Accepted at ECCV 2024, Project: https://esp.is.tue.mpg.de

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16709 2024-09-26 cs.CV 57%

Pose-Guided Fine-Grained Sign Language Video Generation

Tongkai Shi, Lianyu Hu, Fanhua Shang, Jichao Feng, Peidong Liu, Wei Feng

专题命中 可控生成 :image synthesis(abstract);分类 cs.CV

Comments ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.15061 2024-09-26 cs.CV cs.RO 57%

The RoboDepth Challenge: Methods and Advancements Towards Robust Depth Estimation

Lingdong Kong, Yaru Niu, Shaoyuan Xie, Hanjiang Hu, Lai Xing Ng, Benoit R. Cottereau, Liangjun Zhang, Hesheng Wang, Wei Tsang Ooi, Ruijie Zhu, Ziyang Song, Li Liu, Tianzhu Zhang, Jun Yu, Mohan Jing, Pengwei Li, Xiaohua Qi, Cheng Jin, Yingfeng Chen, Jie Hou, Jie Zhang, Zhen Kan, Qiang Ling, Liang Peng, Minglei Li, Di Xu, Changpeng Yang, Yuanqi Yao, Gang Wu, Jian Kuai, Xianming Liu, Junjun Jiang, Jiamian Huang, Baojun Li, Jiale Chen, Shuang Zhang, Sun Ao, Zhenyu Li, Runze Chen, Haiyong Luo, Fang Zhao, Jingze Yu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Technical Report; 65 pages, 34 figures, 24 tables; Code at https://github.com/ldkong1205/RoboDepth

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.15739 2024-09-25 cs.CV 57%

Teaching Tailored to Talent: Adverse Weather Restoration via Prompt Pool and Depth-Anything Constraint

Sixiang Chen, Tian Ye, Kai Zhang, Zhaohu Xing, Yunlong Lin, Lei Zhu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted by ECCV'2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.09231 2024-09-25 cs.CV cs.LG 57%

Reliability in Semantic Segmentation: Can We Use Synthetic Data?

Thibaut Loiseau, Tuan-Hung Vu, Mickael Chen, Patrick Pérez, Matthieu Cord

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted at ECCV 2024, Project Page: https://valeoai.github.io/publications/genval/ , Code: https://github.com/valeoai/GenVal

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.13843 2024-09-25 cs.CV 57%

CompoNeRF: Text-guided Multi-object Compositional NeRF with Editable 3D Scene Layout

Haotian Bai, Yuanhuiyi Lyu, Lutao Jiang, Sijia Li, Haonan Lu, Xiaodong Lin, Lin Wang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.10504 2024-09-20 cs.CV 57%

Multi-scale Semantic Prior Features Guided Deep Neural Network for Urban Street-view Image

Jianshun Zeng, Wang Li, Yanjie Lv, Shuai Gao, YuChu Qin

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09149 2024-09-17 cs.CV 57%

Adaptive Multi-Modal Control of Digital Human Hand Synthesis Using a Region-Aware Cycle Loss

Qifan Fu, Xiaohang Yang, Muhammad Asad, Changjae Oh, Shanxin Yuan, Gregory Slabaugh

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments This paper has been accepted by the ECCV 2024 HANDS workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.03018 2024-09-17 cs.CV 57%

DreamVideo: High-Fidelity Image-to-Video Generation with Image Retention and Text Guidance

Cong Wang, Jiaxi Gu, Panwen Hu, Songcen Xu, Hang Xu, Xiaodan Liang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.08207 2024-09-13 cs.CV 57%

VI3DRM:Towards meticulous 3D Reconstruction from Sparse Views via Photo-Realistic Novel View Synthesis

Hao Chen, Jiafu Wu, Ying Jin, Jinlong Peng, Xiaofeng Mao, Mingmin Chi, Mufeng Yao, Bo Peng, Jian Li, Yun Cao

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏