arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 1260 信号源:cs.CV, cs.GR, cs.MM

1. 图像编辑 1260 篇

1805.03857 2018-05-23 cs.CV 57%

Avatar-Net: Multi-scale Zero-shot Style Transfer by Feature Decoration

Lu Sheng, Ziyi Lin, Jing Shao, Xiaogang Wang

专题命中 图像编辑 :image synthesis(abstract);分类 cs.CV

Comments Accepted at CVPR 2018

详情

展开后加载摘要…

URL PDF HTML 收藏
1802.08645 2018-02-26 cs.CV 57%

Interactive Image Manipulation with Natural Language Instruction Commands

Seitaro Shinagawa, Koichiro Yoshino, Sakriani Sakti, Yu Suzuki, Satoshi Nakamura

专题命中 图像编辑 :image generation(abstract);分类 cs.CV

Comments accepted at NIPS 2017 ViGIL workshop (https://nips2017vigil.github.io/)

详情

展开后加载摘要…

URL PDF HTML 收藏
1801.02768 2018-02-20 cs.MM 57%

Fake Colorized Image Detection

Yuanfang Guo, Xiaochun Cao, Wei Zhang, Rui Wang

专题命中 图像编辑 :image editing(abstract);分类 cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
1711.06448 2017-11-20 cs.CV 57%

Chinese Typeface Transformation with Hierarchical Adversarial Network

Jie Chang, Yujun Gu, Ya Zhang

专题命中 图像编辑 :image generation(abstract);分类 cs.CV

Comments 8 pages(exclude reference), 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1707.01253 2017-08-01 cs.CV 57%

Laplacian-Steered Neural Style Transfer

Shaohua Li, Xinxing Xu, Liqiang Nie, Tat-Seng Chua

专题命中 图像编辑 :image synthesis(abstract);分类 cs.CV

Comments Accepted by the ACM Multimedia Conference (MM) 2017. 9 pages, 65 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1612.03989 2017-02-16 cs.CV 57%

A Fast Keypoint Based Hybrid Method for Copy Move Forgery Detection

Sunil Kumar, J. V. Desai, Shaktidev Mukherjee

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
1612.04227 2016-12-14 cs.IT cs.GR math.IT 57%

CFD results calibration from sparse sensor observations with a case study for indoor thermal map

Chaoyang Jiang, Yeng Chai Soh, Hua Li, Mustafa K. Masood, Zhe Wei, Xiaoli Zhou, Deqing Zhai

专题命中 图像编辑 :image editing(abstract);分类 cs.GR

Comments 17 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
1608.05180 2016-09-19 cs.CV 57%

A Holistic Approach for Data-Driven Object Cutout

Huayong Xu, Yangyan Li, Wenzheng Chen, Dani Lischinski, Daniel Cohen-Or, Baoquan Chen

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
1305.0871 2016-09-14 cs.CV 57%

Dictionary learning based image enhancement for rarity detection

Hui Li, Xiaomeng Wang, Weifeng Liu, Yanjiang Wang

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments 4 pages, International Conferences on Signal Processing 2014

详情

展开后加载摘要…

URL PDF HTML 收藏
1608.01505 2016-08-05 cs.CV 57%

Recoding Color Transfer as a Color Homography

Han Gong, Graham D. Finlayson, Robert B. Fisher

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments Accepted by BMVC 2016

详情

展开后加载摘要…

URL PDF HTML 收藏
1606.07396 2016-06-24 cs.CV 57%

Fast Multi-Layer Laplacian Enhancement

Hossein Talebi, Peyman Milanfar

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
1602.07335 2016-02-25 cs.CV 57%

Robust Detection of Intensity Variant Clones in Forged and JPEG Compressed Images

Minati Mishra, M. C. Adhikary

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments page 48-60

Journal ref ANSVESA, 9(1), 48-60, 2014, ISSN-0974-715X

详情

展开后加载摘要…

URL PDF HTML 收藏
1505.00996 2015-05-06 cs.CV 57%

Fast Guided Filter

Kaiming He, Jian Sun

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments Technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
1407.6877 2014-07-28 cs.MM 57%

An Easy yet Effective Method for Detecting Spatial Domain LSB Steganography

Minati Mishra, M. C. Adhikary

专题命中 图像编辑 :image editing(abstract);分类 cs.MM

Comments 12 pages; International Journal of Computer Science and Business Informatics, Dec 2012

详情

展开后加载摘要…

URL PDF HTML 收藏
1406.0074 2014-06-03 cs.CV 57%

Combined Approach for Image Segmentation

Shradha Dakhare, Harshal Chowhan, Manoj B. Chandak

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments 4 pages, 5 figures, Published with International Journal of Computer Trends and Technology (IJCTT)

Journal ref IJCTT, Volume 11 Number 3 May 2014

详情

展开后加载摘要…

URL PDF HTML 收藏
1311.6932 2013-11-28 cs.CV 57%

A novel framework for image forgery localization

Davide Cozzolino, Diego Gragnaniello, Luisa Verdoliva

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments 4 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
1306.6737 2013-07-01 cs.CR cs.CV 57%

Digital Image Tamper Detection Techniques - A Comprehensive Study

Minati Mishra, Flt. Lt. Dr. M. C. Adhikary

专题命中 图像编辑 :image editing(abstract);分类 cs.CV

Comments 12 pages available online via http://ijcsbi.org/index.php/ijcsbi/article/view/50

Journal ref IJCSBI Vol. 2, No. 1. June 2013

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11124 2026-08-03 cs.SD cs.AI 版本更新 50%

BeatEdit: Symbolic Music Generation as Explicit Editing

BeatEdit:作为显式编辑的符号音乐生成

Haoyu Gu, Lekai Qian, Haowu Zhou, Qi Liu, Shuai Wang

机构 * School of Future Technology South China University of Technology Guangzhou China(未来技术学院 华南理工大学 广州 中国) South China University of Technology(华南理工大学) Nanjing University(南京大学)

专题命中 图像编辑 :diffusion(abstract)

AI总结 研究针对符号音乐生成中缺乏选择性修改支持的问题,提出BeatEdit框架,基于BEAT编码,含三种互补机制,共享单一编码和预训练主干,在多项任务中精度和质量更高且高效,揭示编码设计对编辑有效性有重要影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24538 2026-07-28 cs.RO 新提交 50%

NEO: NeRF It Once, Edit It Many Times for Continuous Object Manipulation

NEO:一次性NeRF,多次编辑以进行连续物体操纵

Mikołaj Zieliński, David Hall, Dominik Belter, Peyman Moghadam

机构 * Institute of Robotics and Machine Intelligence, Poznan University of Technology(波兹南理工大学机器人与机器智能研究所) CSIRO Robotics, CSIRO(联邦科学与工业研究组织机器人部)

专题命中 图像编辑 :inpainting(abstract)

AI总结 本文提出NEO框架,用于机器人操纵的语言引导NeRF编辑。结合神经场重采样与多视图修复实现物体移除,利用知识蒸馏进行NeRF权重编辑,还创建了评估基准NEO-Dataset。该方法在场景编辑任务中表现出色,优于现有基线。

Comments Accepted to IEEE ROBOTICS AND AUTOMATION LETTERS (RA-L) JULY, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28732 2026-06-30 eess.AS 50%

CTC-Seeded Token Edit Refinement for Non-Autoregressive Speech Recognition

基于CTC初始化的标记编辑精炼用于非自回归语音识别

Wanting Huang, Weiran Wang

专题命中 图像编辑 :diffusion(abstract)

AI总结 提出一种非自回归语音识别方法,利用CTC假设作为初始序列,通过编辑流解码器并行预测插入、删除和替换操作,仅需两步编辑即可显著降低词错误率。

Comments Submitted to IEEE SLT 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03573 2026-06-17 cs.CE 版本更新 50%

STRIDE: Post-Training LLMs to Reason and Refine Bio-Sequences via Edit Trajectories

STRIDE: 通过编辑轨迹对生物序列进行后训练推理与优化

Daiheng Zhang, Shiyang Zhang, Sizhuang He, Yangtian Zhang, Syed Asad Rizvi, David van Dijk

专题命中 图像编辑 :diffusion(abstract)

AI总结 提出STRIDE框架,通过后训练使LLM生成可执行的插入/删除/替换轨迹,结合监督微调和策略优化实现离散生物序列的迭代优化,在蛋白质和分子编辑任务上显著提升成功率和新颖性。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14531 2026-06-15 cs.RO 新提交 50%

AERMANI-PLACE: Language Guided Object Placement with Aerial Manipulators

AERMANI-PLACE: 基于语言引导的空中机械臂物体放置

Sarthak Mishra, Ritama Sanyal, Rishabh Dev Yadav, Wei Pan, Spandan Roy

机构 * Robotics Research Center, IIIT Hyderabad(海得拉巴国际信息技术学院机器人研究中心) Department of Computer Science, University of Manchester(曼彻斯特大学计算机科学系) Newcastle University(纽卡斯尔大学)

专题命中 图像编辑 :image editing(abstract)

AI总结 提出AERMANI-PLACE框架,通过自然语言指令和图像编辑模型生成视觉标记,引导空中机械臂完成物体放置,在测试集和真实平台上分别达到87%和72%的平均成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06140 2026-06-05 cs.CR 50%

RedEdit: Agentic Red-Teaming of Image Safety Classifiers via MCTS-Guided Photo-Editing

RedEdit: 基于MCTS引导的照片编辑的图像安全分类器智能红队测试

Weilin Lin, Ziqi Lin, Zhenxing Zhou, Jianze Li, Tong Zhang, Hui Xiong, Li Liu

专题命中 图像编辑 :image editing(abstract)

AI总结 提出RedEdit,一种基于视觉语言模型提议和蒙特卡洛树搜索规划的黑盒红队代理,通过组合编辑工具序列使不安全图像逃避检测,平均不到两次编辑即可使76.2%的不安全图像绕过分类器,同时保留93.0%的恶意语义。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24735 2026-05-26 cs.CY 50%

Dual-Use AI Face Swap Apps Are Mostly Unsafe: A Systematic Safety Audit

双用途AI换脸应用大多不安全:系统性安全审计

Alaa Daffalla, Sarah Chao, Eric Zeng

专题命中 图像编辑 :image editing(abstract)

AI总结 本研究系统审计了iOS和Android平台上的420款AI换脸应用,发现70%缺乏防止生成裸体图像的技术保障,且多数应用的服务条款未禁止此类滥用,建议平台和立法者强制要求安全过滤措施。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11368 2026-05-13 cs.LG cs.AI q-bio.GN 50%

LPDP: Inference-Time Reward Control for Variable-Length DNA Generation with Edit Flows

LPDP:用于可变长度DNA生成的推理时间奖励控制

Jeongchan Kim, Yunkyung Ko, Jong Chul Ye

机构 * KAIST AI(韩国釜山科学技术院人工智能实验室)

专题命中 图像编辑 :inpainting(abstract)

AI总结 本文提出LPDP,一种无需训练的局部重解算子,用于可变长度DNA编辑动作生成。通过局部离散程序聚焦于连贯的替换、插入和删除子图,并利用硬Max或软LSE备份聚合局部延续,用于增强子优化和外显子内含子外显子修复。

Comments 22 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24104 2026-04-28 cs.CL 50%

Factual and Edit-Sensitive Graph-to-Sequence Generation via Graph-Aware Adaptive Noising

通过图感知自适应噪声生成事实和编辑敏感的图到序列生成

Aditya Hemant Shahane, Anuj Kumar Sirohi, Tanmoy Chakraborty, Prathosh A P, Sandeep Kumar

机构 * Department of Electrical Engineering, Indian Institute of Technology Delhi, New Delhi, India(印度理工学院德里分校电子工程系) Indian Institute of Science, Bengaluru, India(印度科学研究所,班加罗尔,印度)

专题命中 图像编辑 :diffusion(abstract)

AI总结 本文提出DLM4G框架,通过自适应噪声策略提升图到序列生成的事实性和编辑敏感性,在多个数据集上优于现有基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11703 2026-04-09 cs.LG 50%

EvoFlows: Evolutionary Edit-Based Flow-Matching for Protein Engineering

EvoFlows:基于进化编辑的蛋白质工程流匹配

Nicolas Deutschmann, Constance Ferragu, Jonathan D. Ziegler, Shayan Aziznejad, Eli Bixby

机构 * Cradle Zürich, CH(Cradle 苏黎世,瑞士)

专题命中 图像编辑 :diffusion(abstract)

AI总结 EvoFlows通过编辑流学习蛋白质序列间的突变轨迹,实现可控的插入、删除和替换操作,生成与自然蛋白家族一致的变异体,优于现有方法。

Comments Accepted at Workshop on Foundation Models for Science: Real-World Impact and Science-First Design, ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07990 2026-03-25 cs.LG 50%

MJ1: Multimodal Judgment via Grounded Verification

MJ1: 通过 grounded 验证实现多模态判断

Bhavesh Kumar, Dylan Feng, Leonard Tang

机构 * Haize Labs(哈泽实验室)

专题命中 图像编辑 :image editing(abstract)

AI总结 MJ1 通过结构化 grounded 验证链和反事实一致性奖励提升多模态判断准确性,训练后在 MMRB2 数据集上达到 77.0% 准确率,超越更大模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07148 2026-03-10 cs.LG 50%

Agentic Planning with Reasoning for Image Styling via Offline RL

基于推理的图像风格化代理规划 via 离线强化学习

Subhojyoti Mukherjee, Stefano Petrangeli, Branislav Kveton, Trung Bui, Franck Dernoncourt, Arko Mukherjee

机构 * Adobe Research(Adobe研究)

专题命中 图像编辑 :image editing(abstract)

AI总结 本文提出基于推理的代理规划框架,通过结构化规划和工具链提升图像风格化效果,采用合成数据生成和离线强化学习方法,验证在视觉质量和指令遵循上的优越性。

Comments 85 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08570 2026-02-23 cs.LG 50%

Who Said Neural Networks Aren't Linear?

谁说神经网络不是线性的?

Nimrod Berman, Assaf Hallak, Assaf Shocher

专题命中 图像编辑 :diffusion(abstract)

AI总结 本文提出线性化器架构,通过结构运输概念使神经网络在特定向量空间中表现为线性算子,从而应用线性代数工具处理非线性映射,并展示其在扩散模型和风格迁移中的应用。

详情

展开后加载摘要…

URL PDF HTML 收藏