arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-07-15 至 2026-07-15 共收录 3 信号源:cs.CV, cs.GR, cs.MM

1. 图像修复 3 篇

2602.00995 2026-07-15 cs.CV 79%

VAMOS-OCTA: Vessel-Aware Multi-Axis Orthogonal Supervision for Inpainting Motion-Corrupted OCT Angiography Volumes

VAMOS-OCTA:面向血管的多轴正交监督用于修复运动受损的OCT血管成像体积

Nick DiSanto, Ehsan Khodapanah Aghdam, Han Liu, Jacob Watson, Yuankai K. Tao, Hao Li, Ipek Oguz

机构 * Department of Computer Science, Vanderbilt University(计算机科学系,范德比尔特大学) Digital Technology and Innovation, Siemens Healthineers(数字技术与创新,西门子医疗) Department of Biomedical Engineering, Vanderbilt University(生物医学工程系,范德比尔特大学)

专题命中 图像修复 :inpainting(title,abstract);分类 cs.CV

AI总结 VAMOS-OCTA通过多轴正交监督方法提升运动受损OCT血管成像体积的修复效果,增强B扫描锐度和投影准确性。

Comments Accepted to SPIE Medical Imaging 2026

Journal ref Proc. SPIE 13925, Medical Imaging 2026: Image Processing, 139250T (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16157 2026-07-15 cs.CV 版本更新 57%

Fast and Accurate Image Restoration and Generation with Rank Enhanced Linear Attention

基于秩增强线性注意力的快速准确图像恢复与生成

Yuang Ai

机构 * University of Chinese Academy of Sciences(中国科学院大学)

专题命中 图像修复 :diffusion(abstract);分类 cs.CV

AI总结 研究旨在解决Transformer自注意力二次复杂度问题,提出秩增强线性注意力(RELA)及高效视觉Transformer(LAformer),通过集成深度卷积丰富特征表示,经实验验证LAformer在图像恢复和生成任务中性能优且计算高效。

Comments Code: https://github.com/shallowdream204/LAformer

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12571 2026-07-15 cs.RO 新提交 50%

TrustVLA: Mechanism-Guided Inference-Time Defense Against Vision-Language-Action Backdoors

TrustVLA:针对视觉-语言-动作后门的机制引导推理时防御

Pinhan Fu, Xianda Guo, Xuetao Li, Wenke Huang, Ruilin Wang, Weiheng Zhao, Wei Sui, Mang Ye

机构 * School of Computer Science, Wuhan University(武汉大学计算机科学学院) D-Robotics(D-机器人公司) HUST(华中科技大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

专题命中 图像修复 :inpainting(abstract)

AI总结 研究视觉-语言-动作模型中毒后门问题,通过两种攻击识别出紧凑因果足迹机制,基于此提出TrustVLA防御,能检测异常证据演变、定位支持并恢复观测,在多评估中降低攻击成功率且保持干净任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏