arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 1258 信号源:cs.CV, cs.GR, cs.MM

1. 图像编辑 1258 篇

2604.05180 2026-04-08 cs.CV 79%

MIRAGE: Benchmarking and Aligning Multi-Instance Image Editing

MIRAGE:多实例图像编辑的基准测试与对齐

Ziqian Liu, Stephan Alaniz

机构 * LTCI, Télécom Paris, Institut Polytechnique de Paris, France(法国巴黎理工学院电信巴黎分校LTCI实验室)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 本文提出MIRAGE框架,通过多分支并行去噪策略实现精确多实例编辑,解决现有方法在多实例和复合指令下的过度编辑和空间错位问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02088 2026-04-03 cs.CV 79%

FlowSlider: Training-Free Continuous Image Editing via Fidelity-Steering Decomposition

FlowSlider: 无训练的连续图像编辑通过保真度引导分解

Taichi Endo, Guoqing Hao, Kazuhiko Sumi

机构 * Aoyama Gakuin University(青山学院大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 FlowSlider通过保真度引导分解实现无训练连续图像编辑,通过几何分析和实证测量证明其稳定性,提升编辑质量。

Comments HuggingFace Space: https://huggingface.co/spaces/dominoer/FlowSlider

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25502 2026-03-27 cs.CV 79%

RealRestorer: Towards Generalizable Real-World Image Restoration with Large-Scale Image Editing Models

RealRestorer:迈向通用的现实世界图像修复的大型图像编辑模型

Yufeng Yang, Xianfang Zeng, Zhangqi Jiang, Fukun Yin, Jianzhuang Liu, Wei Cheng, jinghong lan, Shiyu Liu, Yuqi Peng, Gang YU, Shifeng Chen

机构 * Southern University of Science and Technology(南方科技大学) StepFun Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院) Shenzhen University of Advanced Technology(深圳理工大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 本文提出RealRestorer,通过构建大规模数据集和训练先进开源模型,提升现实世界图像修复的泛化能力,并引入RealIR-Bench评估基准,实验表明其在开源方法中表现最佳。

Comments 27 pages, 15 figures, Project homepage: https://yfyang007.github.io/RealRestorer/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12200 2026-03-27 cs.CV 79%

CompBench: Benchmarking Complex Instruction-guided Image Editing

CompBench:复杂指令引导图像编辑的基准测试

Bohan Jia, Wenxuan Huang, Yuntian Tang, Junbo Qiao, Jincheng Liao, Shaosheng Cao, Fei Zhao, Zhaopeng Feng, Zhouhong Gu, Zhenfei Yin, Lei Bai, Wanli Ouyang, Lin Chen, Fei Zhao, Yao Hu, Zihan Wang, Yuan Xie, Shaohui Lin

机构 * East China Normal University(华东师范大学) Xiaohongshu Inc.(小红书) KLATASDS, MOE, China(中国教育部统计与数据科学重点实验室) The Chinese University of Hong Kong(香港中文大学) Zhejiang University(浙江大学) Fudan University(复旦大学) University of Oxford(牛津大学) Shanghai Jiao Tong University(上海交通大学) University of Science and Technology of China(中国科学技术大学) Nanjing University(南京大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 CompBench旨在解决现有图像编辑基准测试对任务复杂度简化的问题,通过引入复杂指令引导的图像编辑基准,评估模型在精细操控能力上的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21615 2026-03-24 cs.CV 79%

AdaEdit: Adaptive Temporal and Channel Modulation for Flow-Based Image Editing

AdaEdit: 一种基于流的图像编辑中的自适应时间与通道调节

Guandong Li, Zhaobin Chu

机构 * iFLYTEK

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 本文提出AdaEdit框架,通过自适应的渐进注入策略和通道选择性潜在扰动,解决流匹配模型中源特征注入与目标特征生成的矛盾,提升图像编辑效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01755 2026-03-24 cs.CV 79%

FreqEdit: Preserving High-Frequency Features for Robust Multi-Turn Image Editing

FreqEdit: 为鲁棒多轮图像编辑保留高频特征

Yucheng Liao, Jiajun Liang, Kaiqian Cui, Baoquan Zhao, Haoran Xie, Wei Liu, Qing Li, Xudong Mao

机构 * School of Artificial Intelligence, Sun Yat-sen University(中山大学人工智能学院) Lingnan University(岭大大学) Video Rebirth The Hong Kong Polytechnic University(香港理工大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 本文提出FreqEdit框架,通过高频特征注入、自适应注入策略和路径补偿机制,解决多轮图像编辑中高频信息丢失问题,提升编辑稳定性和指令遵循能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10685 2026-03-23 cs.CV 79%

A$^2$-Edit: Precise Reference-Guided Image Editing of Arbitrary Objects and Ambiguous Masks

A²-Edit:基于精确参考的任意物体和模糊掩码图像编辑

Huayu Zheng, Guangzhao Li, Baixuan Zhao, Siqi Luo, Hantao Jiang, Guangtao Zhai, Xiaohong Liu

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 图像编辑 :image editing(title);inpainting(abstract);分类 cs.CV

AI总结 本文提出A²-Edit框架,通过大规模多类别数据集UniEdit-500K解决现有数据集的同质化和类别覆盖不足问题,引入Transformer混合模块和Mask Annealing训练策略,实现高效任意物体编辑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16967 2026-03-19 cs.CV cs.AI 79%

MSRAMIE: Multimodal Structured Reasoning Agent for Multi-instruction Image Editing

MSRAMIE:多模态结构推理代理用于多指令图像编辑

Zhaoyuan Qiu, Ken Chen, Xiangwei Wang, Yu Xia, Sachith Seneviratne, Saman Halgamuge

机构 * University Of Melbourne(墨尔本大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 MSRAMIE基于多模态大语言模型构建无需训练的代理框架,通过结构化多模态推理处理多指令图像编辑任务,提升复杂指令遵循度和完成概率,同时保持图像质量和一致性。

Comments 14 pages, 6 figures, 3 tables, appendix and references provided

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16944 2026-03-19 cs.CV cs.AI 79%

Omni IIE Bench: Benchmarking the Practical Capabilities of Image Editing Models

Omni IIE Bench:图像编辑模型实际能力的基准测试

Yujia Yang, Yuanxiang Wang, Zhenyu Guan, Tiankun Yang, Chenxi Bao, Haopeng Jin, Jinwen Luo, Xinyu Zuo, Lisheng Duan, Haijin Liang, Jin Ma, Xinming Wang, Ruiwen Tao, Hongzhu Yi

机构 * University of Chinese Academy of Sciences(中国科学院大学) Tencent(腾讯)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 本文提出Omni IIE Bench,通过双轨诊断设计评估图像编辑模型在不同语义尺度任务中的一致性,揭示模型在低到高语义任务间性能显著下降的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01893 2026-03-17 cs.CV 79%

Generative Visual Chain-of-Thought for Image Editing

生成式视觉链式思维用于图像编辑

Zijin Yin, Tiankai Hang, Yiji Cheng, Shiyi Zhang, Runze He, Yu Xu, Chunyu Wang, Bing Li, Zheng Chang, Kongming Liang, Qinglin Lu, Zhanyu Ma

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 本文提出GVCoT框架,通过生成空间线索实现视觉推理与编辑,解决复杂场景下的编辑定位问题,提出GVCoT-Edit-Instruct数据集和SREdit-Bench基准,实验表明其在图像编辑任务中表现优异。

Comments Project page: https://pris-cv.github.io/GVCoT/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13388 2026-03-17 cs.CV 79%

VeloEdit: Training-Free Consistent and Continuous Instruction-Based Image Editing via Velocity Field Decomposition

VeloEdit: 无需训练的一致且连续的基于指令的图像编辑 via 速度场分解

Zongqing Li, Zhihui Liu, Yujie Xie, Shansiyuan Wu, Hongshen Lv, Songzhi Su

机构 * Xiamen University(厦门大学) Truesight

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 VeloEdit通过速度场分解实现无需训练的一致且连续的基于指令的图像编辑,通过动态识别编辑区域并采用速度插值控制编辑强度,提升视觉一致性和编辑连续性。

Comments 26 pages, 21 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12264 2026-03-13 cs.CV 79%

GRADE: Benchmarking Discipline-Informed Reasoning in Image Editing

GRADE: 图像编辑中学科引导推理的基准测试

Mingxin Liu, Ziqian Fan, Zhaokai Wang, Leyao Gu, Zirun Zhu, Yiguo He, Yuchen Yang, Changyao Tian, Xiangyu Zhao, Ning Liao, Shaofeng Zhang, Qibing Ren, Zhihang Zhong, Xuanhe Zhou, Junchi Yan, Xue Yang

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 GRADE是首个评估图像编辑中学科引导推理能力的基准测试,通过多领域样本和多维评估协议揭示当前模型在知识密集型编辑任务中的局限性。

Comments 49 pages, 23 figures, 10 tables; Project Page: https://grade-bench.github.io/, Code: https://github.com/VisionXLab/GRADE, Dataset: https://huggingface.co/datasets/VisionXLab/GRADE

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08589 2026-03-10 cs.CV 79%

CARE-Edit: Condition-Aware Routing of Experts for Contextual Image Editing

CARE-Edit:基于条件的专家路由用于上下文图像编辑

Yucheng Wang, Zedong Wang, Yuetong Wu, Yue Ma, Dan Xu

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学)

专题命中 图像编辑 :image editing(title);diffusion(abstract);分类 cs.CV

AI总结 CARE-Edit通过条件感知的专家路由提升上下文图像编辑的性能和稳定性

Comments Accepted by CVPR 2026. Project page: https://care-edit.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03657 2026-03-05 cs.CV cs.AI 79%

InEdit-Bench: Benchmarking Intermediate Logical Pathways for Intelligent Image Editing Models

InEdit-Bench:智能图像编辑模型中间逻辑路径的基准测试

Zhiqiang Sheng, Xumeng Han, Zhiwei Zhang, Zenghui Xiong, Yifan Ding, Aoxiang Ping, Xiang Li, Tong Guo, Yao Mao

机构 * State Key Laboratory of Optical Field Manipulation Science and Technology, Institute of Optics and Electronics, Chinese Academy of Sciences(光学场操控科学与技术国家重点实验室,光学电子研究所,中国科学院) National Laboratory on Adaptive Optics(自适应光学国家实验室) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 InEdit-Bench通过评估图像编辑模型在中间逻辑路径推理中的表现,揭示了现有模型在动态推理和多步骤演变建模方面的不足,推动更智能的多模态生成模型发展。

Comments CVPR findings. Project page: https://github.com/SZStrong1/InEdit-Bench

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00423 2026-03-03 cs.CV cs.AI 79%

An Interpretable Local Editing Model for Counterfactual Medical Image Generation

可解释的局部编辑模型用于反事实医学图像生成

Hyungi Min, Taeseung You, Hangyeul Lee, Yeongjae Cho, Sungzoon Cho

机构 * Seoul National University(首尔国立大学)

专题命中 图像编辑 :image generation(title,abstract);分类 cs.CV

AI总结 本文提出InstructX2X模型,通过区域特定编辑实现反事实医学图像生成,提供可解释的编辑过程和高质量图像生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26346 2026-03-03 cs.CV cs.AI cs.CL 79%

EditReward: A Human-Aligned Reward Model for Instruction-Guided Image Editing

EditReward:一种用于指令引导图像编辑的人类对齐奖励模型

Keming Wu, Sicong Jiang, Max Ku, Ping Nie, Minghao Liu, Wenhu Chen

机构 * University of Waterloo(滑铁卢大学) McGill University(麦吉尔大学) Independent(独立研究者)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 EditReward是一种基于人类偏好的奖励模型,通过大规模标注数据提升图像编辑任务的质量与性能,展示了在指令引导图像编辑中的卓越对齐能力。

Comments Accepted by ICLR 2026. Project Page: https://tiger-ai-lab.github.io/EditReward

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09084 2026-02-24 cs.CV 79%

Agent Banana: High-Fidelity Image Editing with Agentic Thinking and Tooling

Agent Banana: 基于代理思维与工具的高质量图像编辑

Ruijie Ye, Jiayi Zhang, Zhuoxin Liu, Zihao Zhu, Siyuan Yang, Li Li, Tianfu Fu, Franck Dernoncourt, Yue Zhao, Jiacheng Zhu, Ryan Rossi, Wenhao Chai, Zhengzhong Tu

机构 * TAMU(德克萨斯大学) Brown University(布朗大学) UW-Madison(威斯康星大学麦迪逊分校) UCSD(加州大学圣地亚哥分校) USC(南加州大学) xAI(xAI公司) Adobe Research(Adobe研究院) Meta AI Princeton University(普林斯顿大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 Agent Banana通过分层代理规划-执行框架实现高质量图像编辑,解决多轮次编辑一致性与背景忠实度问题,同时保持指令遵循能力。

Comments Project Website: agent-banana.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08134 2026-02-24 cs.CV 79%

Follow-Your-Shape: Shape-Aware Image Editing via Trajectory-Guided Region Control

跟随你的形状:通过轨迹引导的区域控制实现形状感知图像编辑

Zeqian Long, Mingzhe Zheng, Kunyu Feng, Xinhua Zhang, Hongyu Liu, Harry Yang, Linfeng Zhang, Qifeng Chen, Yue Ma

机构 * HKUST(香港科技大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Shanghai Jiao Tong University(上海交通大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 Follow-Your-Shape通过轨迹引导的区域控制实现精准形状编辑,无需训练和掩码,提升大规模形状变换任务的编辑性和视觉保真度。

Comments Accepted to ICLR 2026. Project webpage is available at https://follow-your-shape.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25740 2026-02-23 cs.CV 79%

Dragging with Geometry: From Pixels to Geometry-Guided Image Editing

拖拽与几何:从像素到几何引导的图像编辑

Xinyu Pu, Hongsong Wang, Jie Gui, Pan Zhou

机构 * Southeast University(东南大学) Purple Mountain Laboratories(紫金山实验室) Singapore Management University(新加坡国立大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 GeoDrag通过整合3D几何线索和统一位移场,实现了高精度、结构一致的拖拽图像编辑,解决了多点拖拽冲突和几何引导不连续性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07993 2026-02-10 cs.CV cs.AI 79%

MCIE: Multimodal LLM-Driven Complex Instruction Image Editing with Spatial Guidance

MCIE: 多模态大语言模型驱动的复杂指令图像编辑与空间引导

Xuehai Bai, Xiaoling Gu, Akide Liu, Hangjie Yuan, YiFan Zhang, Jack Ma

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 MCIE通过空间引导和背景一致性模块,提升复杂指令图像编辑的指令合规性,实现23.96%的性能提升。

Comments Accepted by AAAI2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07095 2026-02-10 cs.CV cs.AI 79%

WorldEdit: Towards Open-World Image Editing with a Knowledge-Informed Benchmark

WorldEdit: 向开放世界图像编辑迈进的基于知识的基准

Wang Lin, Feng Wang, Majun Zhang, Wentao Hu, Tao Jin, Zhou Zhao, Fei Wu, Jingyuan Chen, Alan Yuille, Sucheng Ren

机构 * Zhejiang University(浙江大学) Johns Hopkins University(约翰霍普金斯大学) Nanyang Technological University(南洋理工大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 WorldEdit通过引入基于知识的基准,提升模型在开放世界图像编辑中对隐式指令的理解和处理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01805 2026-02-03 cs.CV 79%

FlowBypass: Rectified Flow Trajectory Bypass for Training-Free Image Editing

FlowBypass: 基于修正流的无训练图像编辑轨迹绕过

Menglin Han, Zhangkai Ni

机构 * School of Computer Science and Technology, Tongji University, Shanghai, China(计算机科学与技术学院,同济大学,上海,中国)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 FlowBypass通过基于修正流的轨迹绕过方法,在无需特征操作的情况下提升无训练图像编辑的保真度与提示对齐能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23909 2026-02-03 cs.CV 79%

EditScore: Unlocking Online RL for Image Editing via High-Fidelity Reward Modeling

EditScore: 通过高保真奖励建模解锁图像编辑的在线强化学习

Xin Luo, Jiahao Wang, Chenyuan Wu, Shitao Xiao, Xiyan Jiang, Defu Lian, Jiajun Zhang, Dong Liu, Zheng liu

机构 * University of Science and Technology of China(中国科学技术大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Beijing Academy of Artificial Intelligence(北京人工智能研究院) Zhejiang University(浙江大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 EditScore通过高保真奖励建模解锁图像编辑的在线强化学习,提供从基准到奖励建模到RL训练的系统路径。

Comments Accepted to ICLR 2026. Code, models, and benchmark: https://github.com/VectorSpaceLab/EditScore

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00105 2026-02-03 cs.CV cs.AI 79%

HYPE-EDIT-1: Benchmark for Measuring Reliability in Frontier Image Editing Models

HYPE-EDIT-1:衡量前沿图像编辑模型可靠性的基准

Wing Chan, Richard Allen

机构 * Sourceful Ltd(源丰有限公司)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 HYPE-EDIT-1是一个评估前沿图像编辑模型可靠性的基准,通过100个任务测试模型通过率和有效成本,揭示了低单价模型在考虑重试和人工审查后的高总成本。

Comments 14 pages, 5 figures, for code and data, see https://github.com/sourceful-official/hype-edit-1-benchmark

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07611 2026-01-27 cs.CV 79%

DragNeXt: Rethinking Drag-Based Image Editing

DragNeXt: 重新思考基于拖动的图像编辑

Yuan Zhou, Junbao Zhou, Qingshan Xu, Kesen Zhao, Yuxuan Wang, Hao Fei, Richang Hong, Hanwang Zhang

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 DragNeXt通过重新定义拖动为变形、旋转和翻译,提出简单有效的编辑框架,提升图像编辑质量。

Comments https://github.com/zhouyuan888888/DragNeXt

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05572 2026-01-12 cs.CV 79%

Towards Generalized Multi-Image Editing for Unified Multimodal Models

面向统一多模态模型的通用多图像编辑

Pengcheng Xu, Peng Tang, Donghao Luo, Xiaobin Hu, Weichu Cui, Qingdong He, Zhennan Chen, Jiangning Zhang, Charles Ling, Boyu Wang

机构 * Western University(西方大学) Tencent YouTu Lab(腾讯优图实验室) Nanjing University(南京大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 本文提出了一种面向统一多模态模型的通用多图像编辑框架,通过可学习的潜在分离器和正弦索引编码提升多图像编辑任务中的视觉一致性和泛化能力。

Comments Project page: https://github.com/Pengchengpcx/MIE-UMM

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17681 2026-01-06 cs.CV cs.AI 79%

PICABench: How Far Are We from Physically Realistic Image Editing?

PICABench: 我们距离物理真实图像编辑还有多远?

Yuandong Pu, Le Zhuo, Songhao Han, Jinbo Xing, Kaiwen Zhu, Shuo Cao, Bin Fu, Si Liu, Hongsheng Li, Yu Qiao, Wenlong Zhang, Xi Chen, Yihao Liu

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 PICABench通过系统评估物理真实感,探索图像编辑中物理效应的挑战与解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00542 2026-01-05 cs.CV 79%

DynaDrag: Dynamic Drag-Style Image Editing by Motion Prediction

DynaDrag: 通过运动预测实现动态拖拽式图像编辑

Jiacheng Sui, Yujie Zhou, Li Niu

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 DynaDrag通过运动预测和动态调整手柄点,实现了更高效的拖拽式图像编辑方法,优于现有技术。

Comments 9 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21637 2025-12-29 cs.CV 79%

Training-Free Disentangled Text-Guided Image Editing via Sparse Latent Constraints

无需训练的解耦文本引导图像编辑:通过稀疏潜在约束

Mutiara Shabrina, Nova Kurnia Putri, Jefri Satria Ferdiansyah, Sabita Khansa Dewi, Novanto Yudistira

机构 * Department of Informatics Engineering Universitas Brawijaya Malang, Indonesia(信息工程系 乌姆拉大学 马拉邦,印度尼西亚)

专题命中 图像编辑 :image editing(title);image generation(abstract);分类 cs.CV

AI总结 本文提出一种无需训练的解耦文本引导图像编辑方法,通过引入稀疏潜在约束减少属性纠缠问题,提升编辑的可控性与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18699 2025-12-29 cs.CV 79%

Affective Image Editing: Shaping Emotional Factors via Text Descriptions

情感图像编辑:通过文本描述塑造情感因素

Peixuan Zhang, Shuchen Weng, Chengxuan Zhu, Binghao Tang, Zijian Jia, Si Li, Boxin Shi

机构 * School of Artificial Intelligence, Beijing University of Posts and Telecommunications, China(北京邮电大学人工智能学院) Beijing Academy of Artificial Intelligence(北京人工智能研究院) State Key Laboratory for Multimedia Information Processing and National Engineering Research Center of Visual Technology, School of Computer Science, Peking University, China(多媒体信息处理国家重点实验室和视觉技术国家工程研究中心,北京大学计算机学院)

专题命中 图像编辑 :image editing(title,abstract);分类 cs.CV

AI总结 AIEdiT通过文本描述实现情感图像编辑,利用情感映射器和MLLM生成符合用户情感需求的图像。

详情

展开后加载摘要…

URL PDF HTML 收藏