arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 4215 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 4215 篇

2407.14570 2024-07-24 cs.CV 57%

Are handcrafted filters helpful for attributing AI-generated images?

Jialiang Li, Haoyue Wang, Sheng Li, Zhenxing Qian, Xinpeng Zhang, Athanasios V. Vasilakos

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.14949 2024-07-23 q-bio.NC cs.CV cs.HC 57%

CoCoG-2: Controllable generation of visual stimuli for understanding human concept representation

Chen Wei, Jiachen Zou, Dietmar Heinke, Quanying Liu

专题命中 可控生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.14936 2024-07-23 cs.MM 57%

EidetiCom: A Cross-modal Brain-Computer Semantic Communication Paradigm for Decoding Visual Perception

Linfeng Zheng, Peilin Chen, Shiqi Wang

专题命中 可控生成 :image generation(abstract);分类 cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.09988 2024-07-22 eess.IV cs.CV 57%

Towards Architecture-Agnostic Untrained Network Priors for Image Reconstruction with Frequency Regularization

Yilin Liu, Yunkui Pang, Jiang Li, Yong Chen, Pew-Thian Yap

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments Accepted at ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14582 2024-07-19 cs.CV cs.AI 57%

PoseCrafter: One-Shot Personalized Video Synthesis Following Flexible Pose Control

Yong Zhong, Min Zhao, Zebin You, Xiaofeng Yu, Changwang Zhang, Chongxuan Li

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.18211 2024-07-19 cs.CV cs.LG 57%

NeuroPictor: Refining fMRI-to-Image Reconstruction via Multi-individual Pretraining and Multi-level Modulation

Jingyang Huo, Yikai Wang, Xuelin Qian, Yun Wang, Chong Li, Jianfeng Feng, Yanwei Fu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted by ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.12739 2024-07-18 cs.CV cs.HC 57%

GroundUp: Rapid Sketch-Based 3D City Massing

Gizem Esra Unlu, Mohamed Sayed, Yulia Gryaditskaya, Gabriel Brostow

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted to ECCV2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.05547 2024-07-18 cs.CV 57%

LaSe-E2V: Towards Language-guided Semantic-Aware Event-to-Video Reconstruction

Kanghao Chen, Hangyu Li, JiaZhou Zhou, Zeyu Wang, Lin Wang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Project Page: https://vlislab22.github.io/LaSe-E2V/

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.10179 2024-07-18 cs.CV 57%

Animate Your Motion: Turning Still Images into Dynamic Videos

Mingxiao Li, Bo Wan, Marie-Francine Moens, Tinne Tuytelaars

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted at European Conference on Computer Vision (ECCV 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.03244 2024-07-18 eess.IV cs.CV cs.LG 57%

EGIC: Enhanced Low-Bit-Rate Generative Image Compression Guided by Semantic Segmentation

Nikolai Körber, Eduard Kromer, Andreas Siebert, Sascha Hauke, Daniel Mueller-Gritschneder, Björn Schuller

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments ECCV 2024 Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.11494 2024-07-17 cs.CV 57%

Learning Semantic Latent Directions for Accurate and Controllable Human Motion Prediction

Guowei Xu, Jiale Tao, Wen Li, Lixin Duan

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted to ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.08733 2024-07-16 cs.CV 57%

GaussCtrl: Multi-View Consistent Text-Driven 3D Gaussian Splatting Editing

Jing Wu, Jia-Wang Bian, Xinghui Li, Guangrun Wang, Ian Reid, Philip Torr, Victor Adrian Prisacariu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments ECCV2024, Project Website: https://gaussctrl.active.vision/

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.03913 2024-07-16 cs.CV 57%

Controllable Human-Object Interaction Synthesis

Jiaman Li, Alexander Clegg, Roozbeh Mottaghi, Jiajun Wu, Xavier Puig, C. Karen Liu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments ECCV 2024, project webpage: https://lijiaman.github.io/projects/chois/

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.08209 2024-07-12 cs.CV 57%

Enriching Information and Preserving Semantic Consistency in Expanding Curvilinear Object Segmentation Datasets

Qin Lei, Jiang Zhong, Qizhu Dai

专题命中 可控生成 :image synthesis(abstract);分类 cs.CV

Comments ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.07564 2024-07-12 cs.CV 57%

Trainable Highly-expressive Activation Functions

Irit Chelly, Shahaf E. Finder, Shira Ifergane, Oren Freifeld

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments Accepted to ECCV 2024 on July 1st, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.07667 2024-07-11 cs.CV eess.IV 57%

VEnhancer: Generative Space-Time Enhancement for Video Generation

Jingwen He, Tianfan Xue, Dongyang Liu, Xinqi Lin, Peng Gao, Dahua Lin, Yu Qiao, Wanli Ouyang, Ziwei Liu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.14121 2024-07-11 cs.CV 57%

External Knowledge Enhanced 3D Scene Generation from Sketch

Zijie Wu, Mingtao Feng, Yaonan Wang, He Xie, Weisheng Dong, Bo Miao, Ajmal Mian

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted by ECCV2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.17214 2024-07-11 cs.CV 57%

CharacterGen: Efficient 3D Character Generation from Single Images with Multi-View Pose Canonicalization

Hao-Yang Peng, Jia-Peng Zhang, Meng-Hao Guo, Yan-Pei Cao, Shi-Min Hu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.06304 2024-07-10 cs.CV cs.AI cs.CL 57%

VIMI: Grounding Video Generation through Multi-modal Instruction

Yuwei Fang, Willi Menapace, Aliaksandr Siarohin, Tsai-Shien Chen, Kuan-Chien Wang, Ivan Skorokhodov, Graham Neubig, Sergey Tulyakov

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.03980 2024-07-10 cs.CV 57%

Continual Learning for LiDAR Semantic Segmentation: Class-Incremental and Coarse-to-Fine strategies on Sparse Data

Elena Camuffo, Simone Milani

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Journal ref International Conference on Computer Vision and Pattern Recognition (CVPR) Workshops, 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.16849 2024-07-09 cs.CV 57%

Sync4D: Video Guided Controllable Dynamics for Physics-Based 4D Generation

Zhoujie Fu, Jiacheng Wei, Wenhao Shen, Chaoyue Song, Xiaofeng Yang, Fayao Liu, Xulei Yang, Guosheng Lin

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Our project page: https://sync4dphys.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14868 2024-07-08 cs.CV cs.AI cs.LG cs.RO 57%

Generative Camera Dolly: Extreme Monocular Dynamic Novel View Synthesis

Basile Van Hoorick, Rundi Wu, Ege Ozguroglu, Kyle Sargent, Ruoshi Liu, Pavel Tokmakov, Achal Dave, Changxi Zheng, Carl Vondrick

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted to ECCV 2024. Project webpage is available at: https://gcd.cs.columbia.edu/

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.03355 2024-07-08 cs.CV cs.AI cs.LG 57%

SegGen: Supercharging Segmentation Models with Text2Mask and Mask2Img Synthesis

Hanrong Ye, Jason Kuen, Qing Liu, Zhe Lin, Brian Price, Dan Xu

专题命中 可控生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.01456 2024-07-04 cs.CV 57%

ColorizeDiffusion: Adjustable Sketch Colorization with Reference Image and Text

Dingkun Yan, Liang Yuan, Erwin Wu, Yuma Nishioka, Issei Fujishiro, Suguru Saito

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.19796 2024-07-01 eess.IV cs.CV 57%

Comprehensive Generative Replay for Task-Incremental Segmentation with Concurrent Appearance and Semantic Forgetting

Wei Li, Jingyang Zhang, Pheng-Ann Heng, Lixu Gu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted by MICCAI24

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.18570 2024-06-28 cs.HC cs.AI cs.CV 57%

It's a Feature, Not a Bug: Measuring Creative Fluidity in Image Generators

Aditi Ramaswamy, Melane Navaratnarajah, Hana Chockler

专题命中 可控生成 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.18198 2024-06-27 cs.CV 57%

VDG: Vision-Only Dynamic Gaussian for Driving Simulation

Hao Li, Jingfeng Li, Dingwen Zhang, Chenming Wu, Jieqi Shi, Chen Zhao, Haocheng Feng, Errui Ding, Jingdong Wang, Junwei Han

专题命中 可控生成 :image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.17541 2024-06-26 cs.CV 57%

Principal Component Clustering for Semantic Segmentation in Synthetic Data Generation

Felix Stillger, Frederik Hasecke, Tobias Meisen

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments This is a technical report for a submission to the CVPR "SyntaGen - Harnessing Generative Models for Synthetic Visual Datasets" workshop challenge. The report is already uploaded to the workshop's homepage https://syntagen.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.03443 2024-06-25 cs.CV stat.ML 57%

Data-driven Crop Growth Simulation on Time-varying Generated Images using Multi-conditional Generative Adversarial Networks

Lukas Drees, Dereje T. Demie, Madhuri R. Paul, Johannes Leonhardt, Sabine J. Seidel, Thomas F. Döring, Ribana Roscher

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments 26 pages, 16 figures, code available at https://github.com/luked12/crop-growth-cgan

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.11293 2024-06-25 cs.CV eess.IV 57%

Beyond the Field-of-View: Enhancing Scene Visibility and Perception with Clip-Recurrent Transformer

Hao Shi, Qi Jiang, Kailun Yang, Xiaoting Yin, Ze Wang, Kaiwei Wang

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

Comments Accepted to IEEE Transactions on Intelligent Vehicles (T-IV). The source code and dataset are made publicly available at https://github.com/MasterHow/FlowLens

详情

展开后加载摘要…

URL PDF HTML 收藏