arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-08-10 至 2026-08-10 共收录 3 信号源:cs.CV, cs.GR, cs.MM

1. 图像修复 3 篇

2608.07176 2026-08-10 cs.CV cs.AI 新提交 77%

Representation-driven Endoscopic Visual Embedding Alignment for Latent Generation

面向隐空间生成的表征驱动型内窥镜视觉嵌入对齐

Francisco Caetano, Tim J. M. Jaspers, Haiko Middeljans, Martijn R. Jong, Rixta A. H. van Eijck van Heslinga, Floor Slooter, Albert J. de Groof, Jacques J. Bergman, Peter H. N. De With, Fons van der Sommen

机构 * Eindhoven University of Technology(埃因霍温理工大学) Amsterdam University Medical Centers(阿姆斯特丹大学医学中心) University of Amsterdam(阿姆斯特丹大学)

专题命中 图像修复 :image generation(abstract);diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 本研究针对内窥镜生成模型的领域差距与计算成本问题,提出REVEAL模型,基于500万帧内窥镜数据训练,在多任务中性能优于同类模型,为临床智能工具开发提供基础。

Comments Accepted at the DCA-MI Workshop (ECCV 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06981 2026-08-10 cs.CV 新提交 57%

Local Epistemic Uncertainty Guided Active Sampling for Plug-and-play Diffusive Image Restoration

面向即插即用扩散式图像复原的局部认知不确定性引导主动采样

Jiaqi Zhang, Zheng Pang, Rongrong Gao, Qiyuan Zhang, Yang Yang

机构 * Jiangsu University(江苏大学)

专题命中 图像修复 :diffusion(abstract);分类 cs.CV

AI总结 该研究针对现有DMIR方法忽略生成过程动态性的局限,提出LEADer框架,通过空间域逐像素不确定性调节与时间域自适应轨迹剪枝,提升图像复原性能并减少采样时间,且可即插即用集成至多种DMIR基线。

Comments 12 Pages, 7 Figures, 5 Tables. Accepted to ACM Multimedia 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30594 2026-08-10 eess.AS 版本更新 50%

FiPA-SR -- FiLM-Conditioned Perceptually Informed Audio Super-Resolution

FiPA-SR -- 基于FiLM条件感知的音频超分辨率

Wallace Abreu, Luiz W. P. Biscainho

专题命中 图像修复 :diffusion(abstract)

AI总结 提出FiPA-SR,一种基于GAN的感知架构,通过FiLM层适应不同输入带宽,在单一模型中处理多种采样率,性能优于AudioSR且效率更高。

Comments Submitted to the XLIV BRAZILIAN SYMPOSIUM ON TELECOMMUNICATIONS AND SIGNAL PROCESSING - SBrT 2026

详情

展开后加载摘要…

URL PDF HTML 收藏