Avatar-Net: Multi-scale Zero-shot Style Transfer by Feature Decoration
专题命中 图像编辑 :image synthesis(abstract);分类 cs.CV
Comments Accepted at CVPR 2018
视觉与机器人
图像生成、文生图、图像编辑、扩散模型和可控生成。
专题命中 图像编辑 :image synthesis(abstract);分类 cs.CV
Comments Accepted at CVPR 2018
专题命中 图像编辑 :image generation(abstract);分类 cs.CV
Comments accepted at NIPS 2017 ViGIL workshop (https://nips2017vigil.github.io/)
专题命中 图像编辑 :image editing(abstract);分类 cs.MM
专题命中 图像编辑 :image generation(abstract);分类 cs.CV
Comments 8 pages(exclude reference), 6 figures
专题命中 图像编辑 :image synthesis(abstract);分类 cs.CV
Comments Accepted by the ACM Multimedia Conference (MM) 2017. 9 pages, 65 figures
专题命中 图像编辑 :image editing(abstract);分类 cs.CV
专题命中 图像编辑 :image editing(abstract);分类 cs.GR
Comments 17 pages
专题命中 图像编辑 :image editing(abstract);分类 cs.CV
专题命中 图像编辑 :image editing(abstract);分类 cs.CV
Comments 4 pages, International Conferences on Signal Processing 2014
专题命中 图像编辑 :image editing(abstract);分类 cs.CV
Comments Accepted by BMVC 2016
专题命中 图像编辑 :image editing(abstract);分类 cs.CV
专题命中 图像编辑 :image editing(abstract);分类 cs.CV
Comments page 48-60
Journal ref ANSVESA, 9(1), 48-60, 2014, ISSN-0974-715X
专题命中 图像编辑 :image editing(abstract);分类 cs.CV
Comments Technical report
专题命中 图像编辑 :image editing(abstract);分类 cs.MM
Comments 12 pages; International Journal of Computer Science and Business Informatics, Dec 2012
专题命中 图像编辑 :image editing(abstract);分类 cs.CV
Comments 4 pages, 5 figures, Published with International Journal of Computer Trends and Technology (IJCTT)
Journal ref IJCTT, Volume 11 Number 3 May 2014
专题命中 图像编辑 :image editing(abstract);分类 cs.CV
Comments 4 pages
专题命中 图像编辑 :image editing(abstract);分类 cs.CV
Comments 12 pages available online via http://ijcsbi.org/index.php/ijcsbi/article/view/50
Journal ref IJCSBI Vol. 2, No. 1. June 2013
BeatEdit:作为显式编辑的符号音乐生成
机构 * School of Future Technology South China University of Technology Guangzhou China(未来技术学院 华南理工大学 广州 中国) ; South China University of Technology(华南理工大学) ; Nanjing University(南京大学)
专题命中 图像编辑 :diffusion(abstract)
AI总结 研究针对符号音乐生成中缺乏选择性修改支持的问题,提出BeatEdit框架,基于BEAT编码,含三种互补机制,共享单一编码和预训练主干,在多项任务中精度和质量更高且高效,揭示编码设计对编辑有效性有重要影响。
NEO:一次性NeRF,多次编辑以进行连续物体操纵
机构 * Institute of Robotics and Machine Intelligence, Poznan University of Technology(波兹南理工大学机器人与机器智能研究所) ; CSIRO Robotics, CSIRO(联邦科学与工业研究组织机器人部)
专题命中 图像编辑 :inpainting(abstract)
AI总结 本文提出NEO框架,用于机器人操纵的语言引导NeRF编辑。结合神经场重采样与多视图修复实现物体移除,利用知识蒸馏进行NeRF权重编辑,还创建了评估基准NEO-Dataset。该方法在场景编辑任务中表现出色,优于现有基线。
Comments Accepted to IEEE ROBOTICS AND AUTOMATION LETTERS (RA-L) JULY, 2026
基于CTC初始化的标记编辑精炼用于非自回归语音识别
专题命中 图像编辑 :diffusion(abstract)
AI总结 提出一种非自回归语音识别方法,利用CTC假设作为初始序列,通过编辑流解码器并行预测插入、删除和替换操作,仅需两步编辑即可显著降低词错误率。
Comments Submitted to IEEE SLT 2026
STRIDE: 通过编辑轨迹对生物序列进行后训练推理与优化
专题命中 图像编辑 :diffusion(abstract)
AI总结 提出STRIDE框架,通过后训练使LLM生成可执行的插入/删除/替换轨迹,结合监督微调和策略优化实现离散生物序列的迭代优化,在蛋白质和分子编辑任务上显著提升成功率和新颖性。
Comments Accepted to ICML 2026
AERMANI-PLACE: 基于语言引导的空中机械臂物体放置
机构 * Robotics Research Center, IIIT Hyderabad(海得拉巴国际信息技术学院机器人研究中心) ; Department of Computer Science, University of Manchester(曼彻斯特大学计算机科学系) ; Newcastle University(纽卡斯尔大学)
专题命中 图像编辑 :image editing(abstract)
AI总结 提出AERMANI-PLACE框架,通过自然语言指令和图像编辑模型生成视觉标记,引导空中机械臂完成物体放置,在测试集和真实平台上分别达到87%和72%的平均成功率。
RedEdit: 基于MCTS引导的照片编辑的图像安全分类器智能红队测试
专题命中 图像编辑 :image editing(abstract)
AI总结 提出RedEdit,一种基于视觉语言模型提议和蒙特卡洛树搜索规划的黑盒红队代理,通过组合编辑工具序列使不安全图像逃避检测,平均不到两次编辑即可使76.2%的不安全图像绕过分类器,同时保留93.0%的恶意语义。
双用途AI换脸应用大多不安全:系统性安全审计
专题命中 图像编辑 :image editing(abstract)
AI总结 本研究系统审计了iOS和Android平台上的420款AI换脸应用,发现70%缺乏防止生成裸体图像的技术保障,且多数应用的服务条款未禁止此类滥用,建议平台和立法者强制要求安全过滤措施。
LPDP:用于可变长度DNA生成的推理时间奖励控制
机构 * KAIST AI(韩国釜山科学技术院人工智能实验室)
专题命中 图像编辑 :inpainting(abstract)
AI总结 本文提出LPDP,一种无需训练的局部重解算子,用于可变长度DNA编辑动作生成。通过局部离散程序聚焦于连贯的替换、插入和删除子图,并利用硬Max或软LSE备份聚合局部延续,用于增强子优化和外显子内含子外显子修复。
Comments 22 pages, 5 figures
通过图感知自适应噪声生成事实和编辑敏感的图到序列生成
机构 * Department of Electrical Engineering, Indian Institute of Technology Delhi, New Delhi, India(印度理工学院德里分校电子工程系) ; Indian Institute of Science, Bengaluru, India(印度科学研究所,班加罗尔,印度)
专题命中 图像编辑 :diffusion(abstract)
AI总结 本文提出DLM4G框架,通过自适应噪声策略提升图到序列生成的事实性和编辑敏感性,在多个数据集上优于现有基线方法。
EvoFlows:基于进化编辑的蛋白质工程流匹配
机构 * Cradle Zürich, CH(Cradle 苏黎世,瑞士)
专题命中 图像编辑 :diffusion(abstract)
AI总结 EvoFlows通过编辑流学习蛋白质序列间的突变轨迹,实现可控的插入、删除和替换操作,生成与自然蛋白家族一致的变异体,优于现有方法。
Comments Accepted at Workshop on Foundation Models for Science: Real-World Impact and Science-First Design, ICLR 2026
MJ1: 通过 grounded 验证实现多模态判断
机构 * Haize Labs(哈泽实验室)
专题命中 图像编辑 :image editing(abstract)
AI总结 MJ1 通过结构化 grounded 验证链和反事实一致性奖励提升多模态判断准确性,训练后在 MMRB2 数据集上达到 77.0% 准确率,超越更大模型。
基于推理的图像风格化代理规划 via 离线强化学习
机构 * Adobe Research(Adobe研究)
专题命中 图像编辑 :image editing(abstract)
AI总结 本文提出基于推理的代理规划框架,通过结构化规划和工具链提升图像风格化效果,采用合成数据生成和离线强化学习方法,验证在视觉质量和指令遵循上的优越性。
Comments 85 pages
谁说神经网络不是线性的?
专题命中 图像编辑 :diffusion(abstract)
AI总结 本文提出线性化器架构,通过结构运输概念使神经网络在特定向量空间中表现为线性算子,从而应用线性代数工具处理非线性映射,并展示其在扩散模型和风格迁移中的应用。