arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 86585 信号源:cs.CV, cs.GR, cs.MM

1. 图像编辑 1264 篇

2603.01586 2026-05-11 cs.CV 79%

InterCoG: Towards Spatially Precise Image Editing with Interleaved Chain-of-Grounding Reasoning

InterCoG:迈向空间精确图像编辑的交错链式 grounding 推理

Yecong Wan, Fan Li, Chunwei Wang, Hao Wu, Mingwen Shao, Wangmeng Zuo

机构 * Faculty of Computing, Harbin Institute of Technology(哈尔滨工业大学计算机学院) Zhengzhou Advanced Research Institute of Harbin Institute of Technology(哈尔滨工业大学郑州先进研究院) Huawei Noah’s Ark Lab(华为诺亚实验室) Artificial Intelligence Research Institute, Shenzhen University of Advanced Technology(深圳先进技术大学人工智能研究院)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 本文提出InterCoG框架,通过文本与视觉的交错链式推理实现复杂场景中精细图像编辑,结合文本空间关系和视觉定位提升编辑精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00707 2026-05-04 cs.CV 79%

PhysEdit: Physically-Consistent Region-Aware Image Editing via Adaptive Spatio-Temporal Reasoning

PhysEdit: 一种通过自适应时空推理实现物理一致的区域感知图像编辑

Guandong Li, Mengxia Ye

机构 * iFLYTEK Aegon THTF

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 PhysEdit通过自适应时空推理实现物理一致的区域感知图像编辑,提升编辑效率和准确性,适用于不同复杂度的图像编辑任务。

Comments 11 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23763 2026-05-01 cs.CV 79%

Edit Where You Mean: Region-Aware Adapter Injection for Mask-Free Local Image Editing

在需要的地方编辑:区域感知的适配器注入用于无掩码的局部图像编辑

Honghao Cai, Xiangyuan Wang, Yunhao Bai, Haohua Chen, Tianze Zhou, Runqi Wang, Wei Zhu, Yibo Chen, Xu Tang, Yao Hu, Zhen Li

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Beijing University of Aeronautics and Astronautics(北京航空航天大学) Tsinghua University(清华大学) Peking University(北京大学) Xiaohongshu Inc.(小红书公司)

专题命中 图像编辑 :image editing(title);diffusion(abstract);分类 cs.CV

AI总结 本文提出AdaptEdit框架,通过区域感知适配器实现无掩码的局部图像编辑,结合轻量级Block Adapter和SpatialGate提升编辑精度,同时通过Region-Aware Loss优化训练目标,实现无需用户掩码的高质量编辑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25477 2026-04-29 cs.CV cs.AI 79%

DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing

DDA-Thinker: 解耦双原子强化学习用于推理驱动的图像编辑

Hanqing Yang, Qiang Zhou, Yongchao Du, Sashuai Zhou, Zhibin Wang, Jun Song, Tiezheng Ge, Cheng Yu, Bo Zheng

机构 * Alibaba Group(阿里巴巴集团) Zhejiang University(浙江大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 本文提出DDA-Thinker框架,通过解耦的规划模块与固定生成模型,提升图像编辑中的推理能力,采用双原子强化学习分解反馈,结合可验证检查清单提升训练效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22868 2026-04-28 cs.CV cs.AI 79%

Probing Visual Planning in Image Editing Models

探测图像编辑模型中的视觉规划

Zhimu Zhou, Yanpeng Zhao, Qiuyu Liao, Bo Zhao, Xiaojian Ma

机构 * Shanghai Jiao Tong University(上海交通大学) Renmin University of China(中国人民大学) State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,BIGAI)

专题命中 图像编辑 :image editing(title);diffusion(abstract);分类 cs.CV

AI总结 本文提出EAR框架,通过抽象谜题和生成数据集AMAZE,评估图像编辑模型的视觉规划能力,发现模型在零样本设置下表现不佳,但微调后能有效泛化。

Comments Accepted to ES-Reasoning Workshop @ ICLR 2026. Our code is available at https://github.com/spatigen/amaze

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09386 2026-04-13 cs.CV 79%

Region-Constrained Group Relative Policy Optimization for Flow-Based Image Editing

区域约束的群相对策略优化用于基于流的图像编辑

Zhuohan Ouyang, Zhe Qian, Wenhuo Cui, Chaoqun Wang

机构 * South China Normal University(华南师范大学) South China Agricultural University(华南农业大学) Monash University(莫纳什大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 本文提出RC-GRPO-Editing框架,通过区域约束的GRPO后训练提升流基图像编辑中目标区域指令遵循和非目标区域保留。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05180 2026-04-08 cs.CV 79%

MIRAGE: Benchmarking and Aligning Multi-Instance Image Editing

MIRAGE:多实例图像编辑的基准测试与对齐

Ziqian Liu, Stephan Alaniz

机构 * LTCI, Télécom Paris, Institut Polytechnique de Paris, France(法国巴黎理工学院电信巴黎分校LTCI实验室)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 本文提出MIRAGE框架,通过多分支并行去噪策略实现精确多实例编辑,解决现有方法在多实例和复合指令下的过度编辑和空间错位问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02088 2026-04-03 cs.CV 79%

FlowSlider: Training-Free Continuous Image Editing via Fidelity-Steering Decomposition

FlowSlider: 无训练的连续图像编辑通过保真度引导分解

Taichi Endo, Guoqing Hao, Kazuhiko Sumi

机构 * Aoyama Gakuin University(青山学院大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 FlowSlider通过保真度引导分解实现无训练连续图像编辑,通过几何分析和实证测量证明其稳定性,提升编辑质量。

Comments HuggingFace Space: https://huggingface.co/spaces/dominoer/FlowSlider

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25502 2026-03-27 cs.CV 79%

RealRestorer: Towards Generalizable Real-World Image Restoration with Large-Scale Image Editing Models

RealRestorer:迈向通用的现实世界图像修复的大型图像编辑模型

Yufeng Yang, Xianfang Zeng, Zhangqi Jiang, Fukun Yin, Jianzhuang Liu, Wei Cheng, jinghong lan, Shiyu Liu, Yuqi Peng, Gang YU, Shifeng Chen

机构 * Southern University of Science and Technology(南方科技大学) StepFun Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院) Shenzhen University of Advanced Technology(深圳理工大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 本文提出RealRestorer,通过构建大规模数据集和训练先进开源模型,提升现实世界图像修复的泛化能力,并引入RealIR-Bench评估基准,实验表明其在开源方法中表现最佳。

Comments 27 pages, 15 figures, Project homepage: https://yfyang007.github.io/RealRestorer/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12200 2026-03-27 cs.CV 79%

CompBench: Benchmarking Complex Instruction-guided Image Editing

CompBench:复杂指令引导图像编辑的基准测试

Bohan Jia, Wenxuan Huang, Yuntian Tang, Junbo Qiao, Jincheng Liao, Shaosheng Cao, Fei Zhao, Zhaopeng Feng, Zhouhong Gu, Zhenfei Yin, Lei Bai, Wanli Ouyang, Lin Chen, Fei Zhao, Yao Hu, Zihan Wang, Yuan Xie, Shaohui Lin

机构 * East China Normal University(华东师范大学) Xiaohongshu Inc.(小红书) KLATASDS, MOE, China(中国教育部统计与数据科学重点实验室) The Chinese University of Hong Kong(香港中文大学) Zhejiang University(浙江大学) Fudan University(复旦大学) University of Oxford(牛津大学) Shanghai Jiao Tong University(上海交通大学) University of Science and Technology of China(中国科学技术大学) Nanjing University(南京大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 CompBench旨在解决现有图像编辑基准测试对任务复杂度简化的问题,通过引入复杂指令引导的图像编辑基准,评估模型在精细操控能力上的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21615 2026-03-24 cs.CV 79%

AdaEdit: Adaptive Temporal and Channel Modulation for Flow-Based Image Editing

AdaEdit: 一种基于流的图像编辑中的自适应时间与通道调节

Guandong Li, Zhaobin Chu

机构 * iFLYTEK

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 本文提出AdaEdit框架,通过自适应的渐进注入策略和通道选择性潜在扰动,解决流匹配模型中源特征注入与目标特征生成的矛盾,提升图像编辑效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01755 2026-03-24 cs.CV 79%

FreqEdit: Preserving High-Frequency Features for Robust Multi-Turn Image Editing

FreqEdit: 为鲁棒多轮图像编辑保留高频特征

Yucheng Liao, Jiajun Liang, Kaiqian Cui, Baoquan Zhao, Haoran Xie, Wei Liu, Qing Li, Xudong Mao

机构 * School of Artificial Intelligence, Sun Yat-sen University(中山大学人工智能学院) Lingnan University(岭大大学) Video Rebirth The Hong Kong Polytechnic University(香港理工大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 本文提出FreqEdit框架,通过高频特征注入、自适应注入策略和路径补偿机制,解决多轮图像编辑中高频信息丢失问题,提升编辑稳定性和指令遵循能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10685 2026-03-23 cs.CV 79%

A$^2$-Edit: Precise Reference-Guided Image Editing of Arbitrary Objects and Ambiguous Masks

A²-Edit:基于精确参考的任意物体和模糊掩码图像编辑

Huayu Zheng, Guangzhao Li, Baixuan Zhao, Siqi Luo, Hantao Jiang, Guangtao Zhai, Xiaohong Liu

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 图像编辑 :image editing(title);inpainting(abstract);分类 cs.CV

AI总结 本文提出A²-Edit框架,通过大规模多类别数据集UniEdit-500K解决现有数据集的同质化和类别覆盖不足问题,引入Transformer混合模块和Mask Annealing训练策略,实现高效任意物体编辑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16967 2026-03-19 cs.CV cs.AI 79%

MSRAMIE: Multimodal Structured Reasoning Agent for Multi-instruction Image Editing

MSRAMIE:多模态结构推理代理用于多指令图像编辑

Zhaoyuan Qiu, Ken Chen, Xiangwei Wang, Yu Xia, Sachith Seneviratne, Saman Halgamuge

机构 * University Of Melbourne(墨尔本大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 MSRAMIE基于多模态大语言模型构建无需训练的代理框架,通过结构化多模态推理处理多指令图像编辑任务,提升复杂指令遵循度和完成概率,同时保持图像质量和一致性。

Comments 14 pages, 6 figures, 3 tables, appendix and references provided

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16944 2026-03-19 cs.CV cs.AI 79%

Omni IIE Bench: Benchmarking the Practical Capabilities of Image Editing Models

Omni IIE Bench:图像编辑模型实际能力的基准测试

Yujia Yang, Yuanxiang Wang, Zhenyu Guan, Tiankun Yang, Chenxi Bao, Haopeng Jin, Jinwen Luo, Xinyu Zuo, Lisheng Duan, Haijin Liang, Jin Ma, Xinming Wang, Ruiwen Tao, Hongzhu Yi

机构 * University of Chinese Academy of Sciences(中国科学院大学) Tencent(腾讯)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 本文提出Omni IIE Bench,通过双轨诊断设计评估图像编辑模型在不同语义尺度任务中的一致性,揭示模型在低到高语义任务间性能显著下降的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01893 2026-03-17 cs.CV 79%

Generative Visual Chain-of-Thought for Image Editing

生成式视觉链式思维用于图像编辑

Zijin Yin, Tiankai Hang, Yiji Cheng, Shiyi Zhang, Runze He, Yu Xu, Chunyu Wang, Bing Li, Zheng Chang, Kongming Liang, Qinglin Lu, Zhanyu Ma

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 本文提出GVCoT框架,通过生成空间线索实现视觉推理与编辑,解决复杂场景下的编辑定位问题,提出GVCoT-Edit-Instruct数据集和SREdit-Bench基准,实验表明其在图像编辑任务中表现优异。

Comments Project page: https://pris-cv.github.io/GVCoT/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13388 2026-03-17 cs.CV 79%

VeloEdit: Training-Free Consistent and Continuous Instruction-Based Image Editing via Velocity Field Decomposition

VeloEdit: 无需训练的一致且连续的基于指令的图像编辑 via 速度场分解

Zongqing Li, Zhihui Liu, Yujie Xie, Shansiyuan Wu, Hongshen Lv, Songzhi Su

机构 * Xiamen University(厦门大学) Truesight

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 VeloEdit通过速度场分解实现无需训练的一致且连续的基于指令的图像编辑,通过动态识别编辑区域并采用速度插值控制编辑强度,提升视觉一致性和编辑连续性。

Comments 26 pages, 21 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12264 2026-03-13 cs.CV 79%

GRADE: Benchmarking Discipline-Informed Reasoning in Image Editing

GRADE: 图像编辑中学科引导推理的基准测试

Mingxin Liu, Ziqian Fan, Zhaokai Wang, Leyao Gu, Zirun Zhu, Yiguo He, Yuchen Yang, Changyao Tian, Xiangyu Zhao, Ning Liao, Shaofeng Zhang, Qibing Ren, Zhihang Zhong, Xuanhe Zhou, Junchi Yan, Xue Yang

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 GRADE是首个评估图像编辑中学科引导推理能力的基准测试,通过多领域样本和多维评估协议揭示当前模型在知识密集型编辑任务中的局限性。

Comments 49 pages, 23 figures, 10 tables; Project Page: https://grade-bench.github.io/, Code: https://github.com/VisionXLab/GRADE, Dataset: https://huggingface.co/datasets/VisionXLab/GRADE

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08589 2026-03-10 cs.CV 79%

CARE-Edit: Condition-Aware Routing of Experts for Contextual Image Editing

CARE-Edit:基于条件的专家路由用于上下文图像编辑

Yucheng Wang, Zedong Wang, Yuetong Wu, Yue Ma, Dan Xu

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学)

专题命中 图像编辑 :image editing(title);diffusion(abstract);分类 cs.CV

AI总结 CARE-Edit通过条件感知的专家路由提升上下文图像编辑的性能和稳定性

Comments Accepted by CVPR 2026. Project page: https://care-edit.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03657 2026-03-05 cs.CV cs.AI 79%

InEdit-Bench: Benchmarking Intermediate Logical Pathways for Intelligent Image Editing Models

InEdit-Bench:智能图像编辑模型中间逻辑路径的基准测试

Zhiqiang Sheng, Xumeng Han, Zhiwei Zhang, Zenghui Xiong, Yifan Ding, Aoxiang Ping, Xiang Li, Tong Guo, Yao Mao

机构 * State Key Laboratory of Optical Field Manipulation Science and Technology, Institute of Optics and Electronics, Chinese Academy of Sciences(光学场操控科学与技术国家重点实验室,光学电子研究所,中国科学院) National Laboratory on Adaptive Optics(自适应光学国家实验室) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 InEdit-Bench通过评估图像编辑模型在中间逻辑路径推理中的表现,揭示了现有模型在动态推理和多步骤演变建模方面的不足,推动更智能的多模态生成模型发展。

Comments CVPR findings. Project page: https://github.com/SZStrong1/InEdit-Bench

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00423 2026-03-03 cs.CV cs.AI 79%

An Interpretable Local Editing Model for Counterfactual Medical Image Generation

可解释的局部编辑模型用于反事实医学图像生成

Hyungi Min, Taeseung You, Hangyeul Lee, Yeongjae Cho, Sungzoon Cho

机构 * Seoul National University(首尔国立大学)

专题命中 图像编辑 :image generation(title,abstract);分类 cs.CV

AI总结 本文提出InstructX2X模型,通过区域特定编辑实现反事实医学图像生成,提供可解释的编辑过程和高质量图像生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26346 2026-03-03 cs.CV cs.AI cs.CL 79%

EditReward: A Human-Aligned Reward Model for Instruction-Guided Image Editing

EditReward:一种用于指令引导图像编辑的人类对齐奖励模型

Keming Wu, Sicong Jiang, Max Ku, Ping Nie, Minghao Liu, Wenhu Chen

机构 * University of Waterloo(滑铁卢大学) McGill University(麦吉尔大学) Independent(独立研究者)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 EditReward是一种基于人类偏好的奖励模型,通过大规模标注数据提升图像编辑任务的质量与性能,展示了在指令引导图像编辑中的卓越对齐能力。

Comments Accepted by ICLR 2026. Project Page: https://tiger-ai-lab.github.io/EditReward

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09084 2026-02-24 cs.CV 79%

Agent Banana: High-Fidelity Image Editing with Agentic Thinking and Tooling

Agent Banana: 基于代理思维与工具的高质量图像编辑

Ruijie Ye, Jiayi Zhang, Zhuoxin Liu, Zihao Zhu, Siyuan Yang, Li Li, Tianfu Fu, Franck Dernoncourt, Yue Zhao, Jiacheng Zhu, Ryan Rossi, Wenhao Chai, Zhengzhong Tu

机构 * TAMU(德克萨斯大学) Brown University(布朗大学) UW-Madison(威斯康星大学麦迪逊分校) UCSD(加州大学圣地亚哥分校) USC(南加州大学) xAI(xAI公司) Adobe Research(Adobe研究院) Meta AI Princeton University(普林斯顿大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 Agent Banana通过分层代理规划-执行框架实现高质量图像编辑,解决多轮次编辑一致性与背景忠实度问题,同时保持指令遵循能力。

Comments Project Website: agent-banana.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08134 2026-02-24 cs.CV 79%

Follow-Your-Shape: Shape-Aware Image Editing via Trajectory-Guided Region Control

跟随你的形状:通过轨迹引导的区域控制实现形状感知图像编辑

Zeqian Long, Mingzhe Zheng, Kunyu Feng, Xinhua Zhang, Hongyu Liu, Harry Yang, Linfeng Zhang, Qifeng Chen, Yue Ma

机构 * HKUST(香港科技大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Shanghai Jiao Tong University(上海交通大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 Follow-Your-Shape通过轨迹引导的区域控制实现精准形状编辑,无需训练和掩码,提升大规模形状变换任务的编辑性和视觉保真度。

Comments Accepted to ICLR 2026. Project webpage is available at https://follow-your-shape.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25740 2026-02-23 cs.CV 79%

Dragging with Geometry: From Pixels to Geometry-Guided Image Editing

拖拽与几何:从像素到几何引导的图像编辑

Xinyu Pu, Hongsong Wang, Jie Gui, Pan Zhou

机构 * Southeast University(东南大学) Purple Mountain Laboratories(紫金山实验室) Singapore Management University(新加坡国立大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 GeoDrag通过整合3D几何线索和统一位移场,实现了高精度、结构一致的拖拽图像编辑,解决了多点拖拽冲突和几何引导不连续性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07993 2026-02-10 cs.CV cs.AI 79%

MCIE: Multimodal LLM-Driven Complex Instruction Image Editing with Spatial Guidance

MCIE: 多模态大语言模型驱动的复杂指令图像编辑与空间引导

Xuehai Bai, Xiaoling Gu, Akide Liu, Hangjie Yuan, YiFan Zhang, Jack Ma

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 MCIE通过空间引导和背景一致性模块,提升复杂指令图像编辑的指令合规性,实现23.96%的性能提升。

Comments Accepted by AAAI2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07095 2026-02-10 cs.CV cs.AI 79%

WorldEdit: Towards Open-World Image Editing with a Knowledge-Informed Benchmark

WorldEdit: 向开放世界图像编辑迈进的基于知识的基准

Wang Lin, Feng Wang, Majun Zhang, Wentao Hu, Tao Jin, Zhou Zhao, Fei Wu, Jingyuan Chen, Alan Yuille, Sucheng Ren

机构 * Zhejiang University(浙江大学) Johns Hopkins University(约翰霍普金斯大学) Nanyang Technological University(南洋理工大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 WorldEdit通过引入基于知识的基准,提升模型在开放世界图像编辑中对隐式指令的理解和处理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01805 2026-02-03 cs.CV 79%

FlowBypass: Rectified Flow Trajectory Bypass for Training-Free Image Editing

FlowBypass: 基于修正流的无训练图像编辑轨迹绕过

Menglin Han, Zhangkai Ni

机构 * School of Computer Science and Technology, Tongji University, Shanghai, China(计算机科学与技术学院,同济大学,上海,中国)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 FlowBypass通过基于修正流的轨迹绕过方法,在无需特征操作的情况下提升无训练图像编辑的保真度与提示对齐能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23909 2026-02-03 cs.CV 79%

EditScore: Unlocking Online RL for Image Editing via High-Fidelity Reward Modeling

EditScore: 通过高保真奖励建模解锁图像编辑的在线强化学习

Xin Luo, Jiahao Wang, Chenyuan Wu, Shitao Xiao, Xiyan Jiang, Defu Lian, Jiajun Zhang, Dong Liu, Zheng liu

机构 * University of Science and Technology of China(中国科学技术大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Beijing Academy of Artificial Intelligence(北京人工智能研究院) Zhejiang University(浙江大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 EditScore通过高保真奖励建模解锁图像编辑的在线强化学习,提供从基准到奖励建模到RL训练的系统路径。

Comments Accepted to ICLR 2026. Code, models, and benchmark: https://github.com/VectorSpaceLab/EditScore

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00105 2026-02-03 cs.CV cs.AI 79%

HYPE-EDIT-1: Benchmark for Measuring Reliability in Frontier Image Editing Models

HYPE-EDIT-1:衡量前沿图像编辑模型可靠性的基准

Wing Chan, Richard Allen

机构 * Sourceful Ltd(源丰有限公司)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 HYPE-EDIT-1是一个评估前沿图像编辑模型可靠性的基准,通过100个任务测试模型通过率和有效成本,揭示了低单价模型在考虑重试和人工审查后的高总成本。

Comments 14 pages, 5 figures, for code and data, see https://github.com/sourceful-official/hype-edit-1-benchmark

详情

展开后加载摘要…

URL PDF HTML 收藏