arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 4211 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 4211 篇

2410.05470 2025-03-04 cs.CR cs.AI cs.CV 57%

Image Watermarks are Removable Using Controllable Regeneration from Clean Noise

Yepeng Liu, Yiren Song, Hai Ci, Yu Zhang, Haofan Wang, Mike Zheng Shou, Yuheng Bu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments ICLR2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.02112 2025-03-04 cs.CV 57%

S-NeRF++: Autonomous Driving Simulation via Neural Reconstruction and Generation

Yurui Chen, Junge Zhang, Ziyang Xie, Wenye Li, Feihu Zhang, Jiachen Lu, Li Zhang

专题命中 可控生成 :image editing(abstract);分类 cs.CV

Comments IEEE TPAMI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.03168 2025-03-03 cs.CV 57%

LivePortrait: Efficient Portrait Animation with Stitching and Retargeting Control

Jianzhu Guo, Dingyun Zhang, Xiaoqiang Liu, Zhizhou Zhong, Yuan Zhang, Pengfei Wan, Di Zhang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19868 2025-02-28 cs.CV 57%

C-Drag: Chain-of-Thought Driven Motion Controller for Video Generation

Yuhao Li, Mirana Claire Angel, Salman Khan, Yu Zhu, Jinqiu Sun, Yanning Zhang, Fahad Shahbaz Khan

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.04989 2025-02-26 cs.CV cs.LG 57%

SG-I2V: Self-Guided Trajectory Control in Image-to-Video Generation

Koichi Namekata, Sherwin Bahmani, Ziyi Wu, Yash Kant, Igor Gilitschenski, David B. Lindell

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments ICLR 2025. Project page: https://kmcode1.github.io/Projects/SG-I2V/

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09349 2025-02-26 cs.CV 57%

DisPose: Disentangling Pose Guidance for Controllable Human Image Animation

Hongxiang Li, Yaowei Li, Yuhang Yang, Junjie Cao, Zhihong Zhu, Xuxin Cheng, Long Chen

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10126 2025-02-26 cs.CV 57%

Training-free Camera Control for Video Generation

Chen Hou, Zhibo Chen

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17258 2025-02-25 cs.CV 57%

VideoGrain: Modulating Space-Time Attention for Multi-grained Video Editing

Xiangpeng Yang, Linchao Zhu, Hehe Fan, Yi Yang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments ICLR 2025, code and demos are available at https://knightyxp.github.io/VideoGrain_project_page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17056 2025-02-25 cs.CV 57%

SpecDM: Hyperspectral Dataset Synthesis with Pixel-level Semantic Annotations

Wendi Liu, Pei Yang, Wenhui Hong, Xiaoguang Mei, Jiayi Ma

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16475 2025-02-25 cs.CV cs.AI 57%

Dragen3D: Multiview Geometry Consistent 3D Gaussian Generation with Drag-Based Control

Jinbo Yan, Alan Zhao, Yixin Hu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.02309 2025-02-25 cs.CV 57%

Decoupling Layout from Glyph in Online Chinese Handwriting Generation

Min-Si Ren, Yan-Ming Zhang, Yi Chen

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted by ICLR2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.06141 2025-02-25 cs.CV 57%

CHAMP: Conformalized 3D Human Multi-Hypothesis Pose Estimators

Harry Zhang, Luca Carlone

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13894 2025-02-20 cs.RO cs.CV 57%

NavigateDiff: Visual Predictors are Zero-Shot Navigation Assistants

Yiran Qin, Ao Sun, Yuze Hong, Benyou Wang, Ruimao Zhang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted to ICRA2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11642 2025-02-18 cs.CV 57%

GaussianMotion: End-to-End Learning of Animatable Gaussian Avatars with Pose Guidance from Text

Gyumin Shim, Sangmin Lee, Jaegul Choo

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10606 2025-02-18 cs.CV cs.RO 57%

HIPPo: Harnessing Image-to-3D Priors for Model-free Zero-shot 6D Pose Estimation

Yibo Liu, Zhaodong Jiang, Binbin Xu, Guile Wu, Yuan Ren, Tongtong Cao, Bingbing Liu, Rui Heng Yang, Amir Rasouli, Jinjun Shan

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10444 2025-02-18 cs.CV 57%

A Survey of Representation Learning, Optimization Strategies, and Applications for Omnidirectional Vision

Hao Ai, Zidong Cao, Lin Wang

专题命中 可控生成 :image generation(abstract);分类 cs.CV

Comments 37 pages, 24 figures, accepted by IJCV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.08639 2025-02-13 cs.CV 57%

CineMaster: A 3D-Aware and Controllable Framework for Cinematic Text-to-Video Generation

Qinghe Wang, Yawen Luo, Xiaoyu Shi, Xu Jia, Huchuan Lu, Tianfan Xue, Xintao Wang, Pengfei Wan, Di Zhang, Kun Gai

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07711 2025-02-12 eess.AS cs.MM 57%

RenderBox: Expressive Performance Rendering with Text Control

Huan Zhang, Akira Maezawa, Simon Dixon

专题命中 可控生成 :diffusion(abstract);分类 cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07323 2025-02-12 cs.CV 57%

Semantic to Structure: Learning Structural Representations for Infringement Detection

Chuanwei Huang, Zexi Jia, Hongyan Fei, Yeshuang Zhu, Zhiqiang Yuan, Jinchao Zhang, Jie Zhou

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.02929 2025-02-12 cs.CV cs.LG 57%

ZeroDiff: Solidified Visual-Semantic Correlation in Zero-Shot Learning

Zihan Ye, Shreyank N. Gowda, Xiaowei Huang, Haotian Xu, Yaochu Jin, Kaizhu Huang, Xiaobo Jin

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments Accepted to ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06338 2025-02-11 cs.CV 57%

Zero-shot Depth Completion via Test-time Alignment with Affine-invariant Depth Prior

Lee Hyoseok, Kyeong Seon Kim, Kwon Byung-Ki, Tae-Hyun Oh

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments AAAI 2025, Project page: https://hyoseok1223.github.io/zero-shot-depth-completion/

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.09981 2025-02-11 cs.CV 57%

Controllable Text-to-3D Generation via Surface-Aligned Gaussian Splatting

Zhiqi Li, Yiming Chen, Lingzhe Zhao, Peidong Liu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments 3DV-2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04299 2025-02-07 cs.CV 57%

MotionCanvas: Cinematic Shot Design with Controllable Image-to-Video Generation

Jinbo Xing, Long Mai, Cusuh Ham, Jiahui Huang, Aniruddha Mahapatra, Chi-Wing Fu, Tien-Tsin Wong, Feng Liu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments It is best viewed in Acrobat. Project page: https://motion-canvas25.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03836 2025-02-07 cs.CV 57%

Adapting Human Mesh Recovery with Vision-Language Feedback

Chongyang Xu, Buzhen Huang, Chengfang Zhang, Ziliang Feng, Yangang Wang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments 6 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03493 2025-02-07 eess.IV cs.CV 57%

MetaFE-DE: Learning Meta Feature Embedding for Depth Estimation from Monocular Endoscopic Images

Dawei Lu, Deqiang Xiao, Danni Ai, Jingfan Fan, Tianyu Fu, Yucong Lin, Hong Song, Xujiong Ye, Lei Zhang, Jian Yang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03072 2025-02-06 cs.RO cs.CV 57%

RoboGrasp: A Universal Grasping Policy for Robust Robotic Control

Yiqi Huang, Travis Davies, Jiahuan Yan, Xiang Chen, Yu Tian, Luhui Hu

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02676 2025-02-06 cs.CV cs.CR cs.LG 57%

Blind Visible Watermark Removal with Morphological Dilation

Preston K. Robinette, Taylor T. Johnson

专题命中 可控生成 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.08948 2025-02-06 cs.CV cs.CL 57%

Mojito: Motion Trajectory and Intensity Control for Video Generation

Xuehai He, Shuohang Wang, Jianwei Yang, Xiaoxia Wu, Yiping Wang, Kuan Wang, Zheng Zhan, Olatunji Ruwase, Yelong Shen, Xin Eric Wang

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01675 2025-02-05 cs.CV cs.AI cs.LG 57%

Semantic Communication based on Generative AI: A New Approach to Image Compression and Edge Optimization

Francesco Pezone

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments PhD thesis

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.06006 2025-02-03 cs.CV 57%

CamCtrl3D: Single-Image Scene Exploration with Precise 3D Camera Control

Stefan Popov, Amit Raj, Michael Krainin, Yuanzhen Li, William T. Freeman, Michael Rubinstein

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

Comments To be published in 3DV 2025. Project page at https://camctrl3d.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏