arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 1780 信号源:cs.CV, cs.GR, cs.MM

1. 图像修复 1780 篇

2402.01779 2026-06-12 eess.IV cs.CV cs.LG stat.ML 版本更新 70%

Plug-and-Play image restoration with Stochastic deNOising REgularization

即插即用图像恢复:随机去噪正则化

Marien Renaud, Jean Prost, Arthur Leclaire, Nicolas Papadakis

专题命中 图像修复 :diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 提出SNORE框架,仅在适当噪声水平图像上应用去噪器,结合随机正则化与梯度下降求解逆问题,在去模糊和修复任务上达到SOTA。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08125 2026-05-26 eess.IV cs.CV 70%

FlowSteer: Conditioning Flow Field for Consistent Image Restoration

FlowSteer: 条件化流场以实现一致图像恢复

Tharindu Wickremasinghe, Chenyang Qi, Harshana Weligampola, Zhengzhong Tu, Stanley H. Chan

机构 * Purdue University(普渡大学) HKUST(香港科技大学) Texas A&M University(德克萨斯农工大学)

专题命中 图像修复 :image generation(abstract);text-to-image(abstract);分类 cs.CV

AI总结 提出FlowSteer,一种算子感知的条件化方案,通过在采样路径中注入测量先验,将冻结流的隐式引导与显式测量约束耦合,在零样本设置下实现超分辨率、去模糊、去噪和着色等任务的一致图像恢复。

Comments Accepted by CVPRF 2026. Camera Ready version. Project page is \href{https://tharindu-nirmal.github.io/FlowSteer/}{in this link}

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10077 2026-05-25 cs.CV 70%

DocRevive: A Unified Pipeline for Document Text Restoration

DocRevive:文档文本恢复的统一流水线

Kunal Purkayastha, Ayan Banerjee, Josep Llados, Umapada Pal

机构 * Computer Vision Center(计算机视觉中心) Indian Statistical Institute(印度统计研究所)

专题命中 图像修复 :diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 提出DocRevive统一流水线,结合OCR、图像分析、掩码语言建模和扩散模型,用于恢复受损文档文本并保持视觉完整性,同时提出UCSM评估指标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16396 2026-05-19 cs.CV cs.LG 70%

Beyond MMSE: Enhancing PnP Restoration with ProxiMAP

超越MMSE:通过ProxiMAP增强PnP修复

Kenta Vert, Giacomo Meanti, Scott Pesme, Michael Arbel, Julien Mairal

机构 * Univ. Grenoble Alpes(格勒诺布尔阿尔卑斯大学) Inria(法国国家科学研究中心) CNRS(法国国家科学研究中心) Grenoble INP(格勒诺布尔理工大学) LJK(实验室) MaLGa Centre(MaLGa中心) DIBRIS(DIBRIS研究所) Università di Genova(热那亚大学) MMS(MMS机构) Italian Institute of Technology(意大利理工学院)

专题命中 图像修复 :diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 本文提出ProxiMAP,通过调整噪声调度使去噪器保持分布内,实现更稳定的图像重建,适用于去模糊、补全、超分辨率和相位恢复等任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15921 2026-05-18 cs.CV 70%

AdaEraser: Training-Free Object Removal via Adaptive Attention Suppression

AdaEraser:通过自适应注意力抑制实现无训练对象去除

Dingming Liu

机构 * School of Computer Science, Peking University(北京大学计算机科学学院)

专题命中 图像修复 :image generation(abstract);inpainting(abstract);分类 cs.CV

AI总结 本文提出AdaEraser框架,通过动态调节注意力机制实现对象去除,解决无训练方法中盲目抑制注意力导致生成质量下降的问题,实验表明其在对象去除任务中表现优异。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08640 2026-05-12 cs.CV 70%

FlowADMM: Plug-and-play ADMM with Flow-based Renoise-Denoise Priors

FlowADMM:基于流的重噪-去噪先验的即插即用ADMM

Hendrik Sommerhoff, Michael Moeller

机构 * Computer Vision Group, University of Siegen(Siegen大学计算机视觉组)

专题命中 图像修复 :diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 本文提出FlowADMM算法,通过将重噪-去噪操作整合到经典ADMM框架中,解决了基于流的即插即用方法的收敛性问题,并在逆问题中取得了最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14648 2026-04-17 cs.CV cs.AI cs.LG 70%

Seen-to-Scene: Keep the Seen, Generate the Unseen for Video Outpainting

视见过境:保留已见,生成未见以实现视频外推画布

Inseok Jeon, Minhyeok Lee, Seunghoon Lee, Minseok Kang, Suhwan Cho, Sangyoun Lee

机构 * Yonsei University(延世大学) GenGenAI

专题命中 图像修复 :diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 本文提出Seen-to-Scene框架,结合传播和生成方法提升视频外推画布的时空一致性与视觉真实性,通过流传播和参考引导的潜在传播提高效率和可靠性。

Comments 8 pages, 8 figures (main paper); 9 pages, 10 figures (supplementary). Accepted to the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2026, Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11376 2026-04-14 cs.CV cs.AI 70%

From Redaction to Restoration: Deep Learning for Medical Image Anonymization and Reconstruction

从遮蔽到重建:深度学习在医学图像匿名化与重建中的应用

Adrienne Kline, Abhijit Gaonkar, Daniel Pittman, Chris Kuehn, Nils Forkert

机构 * Center for Artificial Intelligence, BCVI, Northwestern Medicine(西北医学BCVI人工智能中心) Department of Electrical and Computer Engineering, Northwestern University(西北大学电气与计算机工程系) Department of Surgery, Northwestern University(西北大学外科学系) Xtasis Inc.(Xtasis公司) Medtronic(美敦力公司) Departments of Radiology and Clinical Neurosciences, University of Calgary(卡尔加里大学放射学与临床神经科学系)

专题命中 图像修复 :diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 本文提出一种端到端的深度学习框架,用于将原始临床图像转换为去标识、适合分析的数据集,同时减少患者重新识别的风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03225 2026-04-06 cs.CV 70%

VOSR: A Vision-Only Generative Model for Image Super-Resolution

VOSR:一种仅基于视觉的生成模型用于图像超分辨率

Rongyuan Wu, Lingchen Sun, Zhengqiang Zhang, Xiangtao Kong, Jixin Zhao, Shihao Wang, Lei Zhang

机构 * The Hong Kong Polytechnic University(香港理工大学) OPPO Research Institute(OPPO研究院)

专题命中 图像修复 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 本文提出VOSR,一种仅基于视觉的生成模型,通过视觉语义指导提取低分辨率输入的语义丰富特征,并采用恢复导向的指导策略,实现高效且高质量的图像超分辨率。

Comments Accepted by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22048 2026-04-03 cs.CV cs.AI 70%

ICM-SR: Image-Conditioned Manifold Regularization for Image Super-Resolution

ICM-SR:基于图像的流形正则化用于图像超分辨率

Junoh Kang, Donghun Ryou, Bohyung Han

专题命中 图像修复 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 本文提出ICM-SR,通过结合颜色映射和边缘信息的流形正则化提升超分辨率质量,解决传统方法中正则化流形不足的问题,增强图像生成的稳定性和感知质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08915 2026-03-31 eess.IV cs.CV 70%

Reconstruct Anything Model: a lightweight general model for computational imaging

重建任何模型:一种轻量级通用模型用于计算成像

Matthieu Terris, Samuel Hurault, Maxime Song, Julian Tachella

机构 * Université Paris-Saclay, Inria, CEA(巴黎-萨克雷大学,法国国家信息与自动化研究所,法国原子能委员会) Blur Labs(Blur 实验室) ENS Paris, PSL, CNRS(巴黎高等师范学院,巴黎文理研究大学,法国国家科学研究中心) CNRS UAR 851, Université Paris-Saclay(法国国家科学研究中心 UAR 851,巴黎-萨克雷大学) ENSL, CNRS UMR 5672(里昂高等师范学院,法国国家科学研究中心 UMR 5672)

专题命中 图像修复 :diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 本文提出一种非迭代轻量级架构,通过整合前向算子知识解决多种逆问题,无需展开训练,可适应各种图像尺寸和通道。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18047 2026-03-26 cs.CV cs.AI 70%

RestoreVAR: Visual Autoregressive Generation for All-in-One Image Restoration

RestoreVAR:用于全图像修复的视觉自回归生成

Sudarshan Rajagopalan, Kartik Narayan, Vishal M. Patel

机构 * Johns Hopkins University(约翰霍普金斯大学)

专题命中 图像修复 :image generation(abstract);diffusion(abstract);分类 cs.CV

AI总结 RestoreVAR通过视觉自回归模型提升全图像修复性能,实现比扩散模型快10倍的推理速度,并在修复效果和泛化能力上达到新高。

Comments Project page: https://sudraj2002.github.io/restorevarpage/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14850 2026-03-17 cs.CV cond-mat.mes-hall 70%

From Artefact to Insight: Efficient Low-Rank Adaptation of BrushNet for Scanning Probe Microscopy Image Restoration

从 artefact 到洞察:为扫描探针显微镜图像修复的高效低秩适应 BrushNet

Ziwei Wei, Yao Shen, Wanheng Lu, Ghim Wei Ho, Kaiyang Zeng

专题命中 图像修复 :diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 本文提出基于扩散的修复框架,通过低秩适应对BrushNet进行微调,有效去除SPM图像中的结构化artefacts,提升PSNR并降低LPIPS,实现高效图像修复。

Comments 37 pages, 7 figures, 7 tables, jounral paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00589 2026-03-06 cs.CV cs.AI 70%

AlignVAR: Towards Globally Consistent Visual Autoregression for Image Super-Resolution

AlignVAR: 向图像超分辨率的全局一致视觉自回归模型

Cencen Liu, Dongyang Zhang, Wen Yin, Jielei Wang, Tianyu Li, Ji Guo, Wenbo Jiang, Guoqing Wang, Guoming Lu

机构 * University of Electronic Science and Technology of China(电子科技大学) Ubiquitous Intelligence and Trusted Services Key Laboratory of Sichuan Province(四川省 ubiquitous intelligence and trusted services 重点实验室)

专题命中 图像修复 :image generation(abstract);diffusion(abstract);分类 cs.CV

AI总结 AlignVAR 通过空间一致性自回归和层次一致性约束提升图像超分辨率的全局一致性与效率。

Comments Accepted to CVPR 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01339 2026-03-03 cs.CV stat.ML 70%

LVTINO: LAtent Video consisTency INverse sOlver for High Definition Video Restoration

LVTINO:用于高清视频修复的潜在视频一致性逆求解器

Alessio Spagnoletti, Andrés Almansa, Marcelo Pereyra

专题命中 图像修复 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 LVTINO是一种基于视频一致性模型的高清视频修复逆求解器,通过无需自动微分的条件机制实现高效高质量的视频重建。

Comments 30 pages, 16 figures. The Fourteenth International Conference on Learning Representations, ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12742 2026-02-16 cs.CV cs.LG 70%

Synthetic Craquelure Generation for Unsupervised Painting Restoration

无监督绘画修复中的合成裂纹生成

Jana Cuch-Guillén, Antonio Agudo, Raül Pérez-Gonzalo

机构 * Universitat de Barcelona(巴塞罗那大学) Institut de Robòtica i Informàtica Industrial(机器人与信息技术研究所)

专题命中 图像修复 :diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 本文提出一种无标注的合成裂纹生成框架,结合形态检测与学习细化模块,通过各向异性扩散修复实现高质量绘画修复。

Comments Accepted to CAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06790 2026-02-12 cs.CV cs.AI eess.IV 70%

GenDR: Lighten Generative Detail Restoration

GenDR:轻量级生成细节修复

Yan Wang, Shijie Zhao, Kexin Zhang, Junlin Li, Li Zhang

机构 * MMLab, ByteDance(字节dance实验室)

专题命中 图像修复 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 GenDR通过单步扩散模型和改进的蒸馏技术,实现高效且高质量的生成细节修复。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06413 2026-01-13 cs.CV 70%

GlobalPaint: Spatiotemporal Coherent Video Outpainting with Global Feature Guidance

GlobalPaint: 基于全局特征引导的时空一致视频外推

Yueming Pan, Ruoyu Feng, Jianmin Bao, Chong Luo, Nanning Zheng

机构 * State Key Laboratory of Human-Machine Hybrid Augmented Intelligence, Institute of Artificial Intelligence and Robotics, Xi’an Jiaotong University(人机混合增强智能国家重点实验室,人工智能与机器人研究院,西安交通大学) Microsoft Research Asia(微软亚洲研究院) University of Science and Technology of China(中国科学技术大学)

专题命中 图像修复 :diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 GlobalPaint提出一种基于扩散的视频外推框架,通过增强的空间-时间模块和全局特征引导,提升视频外推的时空一致性与重建质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21618 2025-12-29 cs.CV cs.RO 70%

SymDrive: Realistic and Controllable Driving Simulator via Symmetric Auto-regressive Online Restoration

SymDrive: 通过对称自回归在线修复实现逼真且可控的驾驶模拟器

Zhiyuan Liu, Daocheng Fu, Pinlong Cai, Lening Wang, Ying Liu, Yilong Ren, Botian Shi, Jianqiang Wang

机构 * School of Vehicle and Mobility, Tsinghua University(清华大学车辆与移动系统学院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) State Key Lab of Intelligent Transportation System, Beihang University(北航智能交通系统国家重点实验室)

专题命中 图像修复 :diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 SymDrive通过对称自回归在线修复技术,实现了逼真可控的驾驶模拟,解决了高保真渲染与交互式交通编辑的难题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15119 2025-12-19 cs.CV cs.LG 70%

Deep generative priors for 3D brain analysis

深度生成先验用于3D脑分析

Ana Lawry Aguila, Dina Zemlyanker, You Cheng, Sudeshna Das, Daniel C. Alexander, Oula Puonti, Annabel Sorby-Adams, W. Taylor Kimberly, Juan Eugenio Iglesias

机构 * Athinoula A. Martinos Center for Biomedical Imaging, Massachusetts General Hospital and Harvard Medical School(阿提诺拉A.马丁诺斯生物医学成像中心、麻省总医院和哈佛医学院) Department of Neurology, Massachusetts General Hospital(麻省总医院神经科) Hawkes Institute, University College London(霍克斯研究所、伦敦大学学院) Danish Research Centre for Magnetic Resonance Department of Radiology and Nuclear Medicine, Copenhagen University Hospital – Amager and Hvidovre(丹麦磁共振研究中心放射科和核医学科、哥本哈根大学医院-阿马格和赫维多雷) Computer Science & Artificial Intelligence Laboratory (CSAIL), Massachusetts Institute of Technology(计算机科学与人工智能实验室(CSAIL)、麻省理工学院)

专题命中 图像修复 :diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 本文提出利用扩散模型作为先验,解决多种医学影像逆问题,通过训练和灵活的正向模型提升解剖结构的保真度,实现高质量的3D脑分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11252 2025-12-17 cs.CV eess.IV 70%

MFGDiffusion: Mask-Guided Smoke Synthesis for Enhanced Forest Fire Detection

MFGDiffusion:基于掩码的烟雾合成以提升森林火灾检测

Guanghao Wu, Yunqing Shang, Chen Xu, Hai Song, Chong Wang, Qixing Zhang

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 图像修复 :image generation(abstract);inpainting(abstract);分类 cs.CV

AI总结 MFGDiffusion通过掩码引导的烟雾合成提升森林火灾检测性能

Comments 14 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14213 2025-11-19 cs.CV 70%

Measurement-Constrained Sampling for Text-Prompted Blind Face Restoration

Wenjie Li, Yulun Zhang, Guangwei Gao, Heng Guo, Zhanyu Ma

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Shanghai Jiao Tong University(上海交通大学) Nanjing University of Science and Technology(南京理工大学)

专题命中 图像修复 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05604 2025-10-28 cs.CV eess.IV 70%

Kernel Density Steering: Inference-Time Scaling via Mode Seeking for Image Restoration

Yuyang Hu, Kangfu Mei, Mojtaba Sahraee-Ardakan, Ulugbek S. Kamilov, Peyman Milanfar, Mauricio Delbracio

机构 * Google(谷歌) Washington University in St. Louis(圣路易斯华盛顿大学)

专题命中 图像修复 :diffusion(abstract);inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18851 2025-10-22 cs.CV cs.AI 70%

DP$^2$O-SR: Direct Perceptual Preference Optimization for Real-World Image Super-Resolution

Rongyuan Wu, Lingchen Sun, Zhengqiang Zhang, Shihao Wang, Tianhe Wu, Qiaosi Yi, Shuai Li, Lei Zhang

机构 * The Hong Kong Polytechnic University(香港理工大学) OPPO Research Institute(OPPO研究院) City University of Hong Kong(香港城市大学)

专题命中 图像修复 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments Accept by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13649 2025-10-16 cs.CV 70%

Local-Global Context-Aware and Structure-Preserving Image Super-Resolution

Sanchar Palit, Subhasis Chaudhuri, Biplab Banerjee

机构 * Indian Institute of Technology Bombay(印度班加罗尔理工学院)

专题命中 图像修复 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

Comments 10 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00820 2025-10-02 cs.CV 70%

NSARM: Next-Scale Autoregressive Modeling for Robust Real-World Image Super-Resolution

Xiangtao Kong, Rongyuan Wu, Shuaizheng Liu, Lingchen Sun, Lei Zhang

机构 * The Hong Kong Polytechnic University(香港理工大学) OPPO Research Institute(OPPO研究院)

专题命中 图像修复 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18619 2025-09-24 cs.CV 70%

Prompt-Guided Dual Latent Steering for Inversion Problems

Yichen Wu, Xu Liu, Chenxuan Zhao, Xinyu Wu

机构 * Nanjing University of Posts and Telecommunications(南京邮电大学) University of Washington(华盛顿大学) University of Alberta(阿尔伯塔大学)

专题命中 图像修复 :diffusion(abstract);inpainting(abstract);分类 cs.CV

Comments Accepted at DICTA 2025 (oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07133 2025-07-11 cs.GR cs.AI cs.LG 70%

Generative Panoramic Image Stitching

Mathieu Tuli, Kaveh Kamali, David B. Lindell

机构 * LG Electronics(LG电子公司) University of Toronto(多伦多大学)

专题命中 图像修复 :diffusion(abstract);inpainting(abstract);分类 cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01717 2025-07-09 cs.CV 70%

Driving View Synthesis on Free-form Trajectories with Generative Prior

Zeyu Yang, Zijie Pan, Yuankun Yang, Xiatian Zhu, Li Zhang

机构 * Fudan University(复旦大学) University of Surrey(Surrey大学)

专题命中 图像修复 :diffusion(abstract);inpainting(abstract);分类 cs.CV

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02633 2025-06-04 cs.CV 70%

ControlMambaIR: Conditional Controls with State-Space Model for Image Restoration

Cheng Yang, Lijing Liang, Zhixun Su

机构 * DLUT(大连理工大学)

专题命中 图像修复 :image generation(abstract);diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏