arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-05-13 至 2026-05-13 共收录 5 信号源:cs.CV, cs.GR, cs.MM

1. 图像编辑 5 篇

2602.09587 2026-05-13 cs.CV cs.AI 79%

MieDB-100k: A Comprehensive Dataset for Medical Image Editing

MieDB-100k:用于医学图像编辑的综合数据集

Yongfan Lai, Wen Qian, Bo Liu, Hongyan Li, Hao Luo, Fan Wang, Bohan Zhuang, Shenda Hong

机构 * State Key Laboratory of General Artificial Intelligence, Beijing, China(1 国家一般人工智能重点实验室,北京,中国) School of Intelligence Science and Technology, Peking University, Beijing, China(2 智能科学与技术学院,北京大学,北京,中国) National Institute of Health Data Science, Peking University, Beijing, China(3 国家健康数据科学研究院,北京大学,北京,中国) DAMO Academy, Alibaba Group, Zhejiang, China(4 阿里巴巴集团 DAMO 院,浙江,中国) hupan lab, zhejiang province(5 鹏元实验室,浙江省) Zhejiang University, Zhejiang, China(6 浙江大学,浙江,中国)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 本文提出MieDB-100k数据集,通过数据筛选流程结合专家模型与规则生成方法,解决医学图像编辑中数据质量、多样性与可扩展性不足的问题,实验表明其在医学图像编辑任务中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12305 2026-05-13 cs.CV 70%

Images in Sentences: Scaling Interleaved Instructions for Unified Visual Generation

图像与句子:扩展交错指令以实现统一的视觉生成

Yabo Zhang, Kunchang Li, Dewei Zhou, Xinyu Huang, Xun Wang

机构 * ByteDance Seed(字节跳动种子)

专题命中 图像编辑 :image generation(abstract);image editing(abstract);分类 cs.CV

AI总结 本文提出INSET模型,通过将图像作为文本指令中的原生词汇,解决复杂交错指令下的视觉生成问题,提升多图像一致性和文本对齐性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.03717 2026-05-13 cs.CV cs.AI cs.GR 62%

Materialist: Physically Based Editing Using Single-Image Inverse Rendering

Materialist: 基于物理的单图像逆渲染中的材质编辑

Lezhong Wang, Duc Minh Tran, Ruiqi Cui, Thomson TG, Anders Bjorholm Dahl, Siavash Arjomand Bigdeli, Jeppe Revall Frisvad, Manmohan Chandraker

机构 * Technical University of Denmark(丹麦技术大学) University of California San Diego(加州大学圣地亚哥分校)

专题命中 图像编辑 :image editing(abstract);分类 cs.CV、cs.GR

AI总结 Materialist提出一种基于物理的单图像逆渲染方法,利用神经网络预测初始材质属性并优化,实现材质编辑、物体插入和光照调整,同时引入高效的光线追踪折射方法进行透明度编辑。

Comments More Comprehensive IJCV Camera-Ready Version. Project website: https://lez-s.github.io/materialist_project/

Journal ref International Journal of Computer Vision (IJCV), 134(6), 267 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11203 2026-05-13 cs.LG cs.CV 57%

FeatMap: Understanding image manipulation in the feature space and its implications for feature space geometry

FeatMap: 在特征空间中理解图像篡改及其对特征空间几何的影响

Elias B. Krey, Nils Neukirch, Nils Strodthoff

机构 * Division AI4Health(AI4Health部门) Carl von Ossietzky Universität Oldenburg(奥尔登堡卡尔·冯·奥西特齐克大学)

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

AI总结 本文通过在输入空间中应用多种篡改方法,探讨特征空间中的映射学习,发现线性模型在特征空间中能有效重建复杂语义篡改。

Comments 27 pages, 24 figures, 3 tables, Code is available at https://github.com/AI4HealthUOL/FeatMap

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11368 2026-05-13 cs.LG cs.AI q-bio.GN 50%

LPDP: Inference-Time Reward Control for Variable-Length DNA Generation with Edit Flows

LPDP:用于可变长度DNA生成的推理时间奖励控制

Jeongchan Kim, Yunkyung Ko, Jong Chul Ye

机构 * KAIST AI(韩国釜山科学技术院人工智能实验室)

专题命中 图像编辑 :inpainting(abstract)

AI总结 本文提出LPDP,一种无需训练的局部重解算子,用于可变长度DNA编辑动作生成。通过局部离散程序聚焦于连贯的替换、插入和删除子图,并利用硬Max或软LSE备份聚合局部延续,用于增强子优化和外显子内含子外显子修复。

Comments 22 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏