arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 2542 信号源:cs.CV, cs.GR, cs.MM

1. 效率与蒸馏 2542 篇

2511.13587 2025-11-18 cs.CV cs.AI 57%

VVS: Accelerating Speculative Decoding for Visual Autoregressive Generation via Partial Verification Skipping

Haotian Dong, Ye Li, Rongwei Lu, Chen Tang, Shu-Tao Xia, Zhi Wang

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) The Chinese University of Hong Kong(香港中文大学)

专题命中 效率与蒸馏 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13106 2025-11-18 cs.CV 57%

Low-Level Dataset Distillation for Medical Image Enhancement

Fengzhi Xu, Ziyuan Yang, Mengyu Sun, Joey Tianyi Zhou, Yi Zhang

机构 * School of Cyber Science and Engineering, Sichuan University(四川大学计算机科学与工程学院) The Chinese University of Hong Kong(香港中文大学) Agency for Science, Technology and Research (A*STAR)(科技研究局)

专题命中 效率与蒸馏 :personalized generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13019 2025-11-18 cs.CV cs.AI cs.LG 57%

MeanFlow Transformers with Representation Autoencoders

Zheyuan Hu, Chieh-Hsin Lai, Ge Wu, Yuki Mitsufuji, Stefano Ermon

机构 * Sony AI(索尼人工智能) Sony Group Corporation(索尼集团) Nankai University(南开大学) Stanford University(斯坦福大学)

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

Comments Code is available at https://github.com/sony/mf-rae

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12893 2025-11-18 cs.CV 57%

ActVAR: Activating Mixtures of Weights and Tokens for Efficient Visual Autoregressive Generation

Kaixin Zhang, Ruiqing Yang, Yuan Zhang, Shan You, Tao Huang

机构 * School of Computer Science and Engineering, Central South University(中南大学计算机科学与工程学院) University of Electronic Science and Technology of China(电子科技大学) School of Computer Science, Peking University(北京大学计算机科学学院) SenseTime Research(商汤科技研究院) Shanghai Jiao Tong University(上海交通大学)

专题命中 效率与蒸馏 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00266 2025-11-14 cs.CV cs.LG 57%

MCM: Multi-layer Concept Map for Efficient Concept Learning from Masked Images

Yuwei Sun, Lu Mi, Ippei Fujisawa, Ruiqiao Mei, Jimin Chen, Siyu Zhu, Ryota Kanai

机构 * Shanghai Academy of AI for Science(上海人工智能科学研究院) Tsinghua University(清华大学) Araya Research(阿瑞亚研究)

专题命中 效率与蒸馏 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12114 2025-11-12 cs.CV 57%

LidarPainter: One-Step Away From Any Lidar View To Novel Guidance

Yuzhou Ji, Ke Ma, Hong Cai, Anchun Zhang, Lizhuang Ma, Xin Tan

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06953 2025-11-11 cs.CV 57%

GFix: Perceptually Enhanced Gaussian Splatting Video Compression

Siyue Teng, Ge Gao, Duolikun Danier, Yuxuan Jiang, Fan Zhang, Thomas Davis, Zoe Liu, David Bull

机构 * Visual Information Laboratory, University of Bristol(布里斯托大学视觉信息实验室) University of Bristol(布里斯托大学) School of Informatics, University of Edinburgh(爱丁堡大学信息学院) Visionular Inc.(Visionular公司)

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20349 2025-11-10 cs.CV 57%

Consistency Trajectory Matching for One-Step Generative Super-Resolution

Weiyi You, Mingyang Zhang, Leheng Zhang, Xingyu Zhou, Kexuan Shi, Shuhang Gu

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12532 2025-10-30 cs.CV cs.AI 57%

Addressing Small and Imbalanced Medical Image Datasets Using Generative Models: A Comparative Study of DDPM and PGGANs with Random and Greedy K Sampling

Iman Khazrak, Shakhnoza Takhirova, Mostafa M. Rezaee, Mehrdad Yadollahi, Robert C. Green, Shuteng Niu

机构 * Department of Computer Science, Bowling Green State University(计算机科学系,布卢明顿州立大学)

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

Journal ref Artificial Intelligence and Applications, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24474 2025-10-29 cs.CV 57%

Decoupled MeanFlow: Turning Flow Models into Flow Maps for Accelerated Sampling

Kyungmin Lee, Sihyun Yu, Jinwoo Shin

机构 * KAIST(韩国科学技术院)

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24211 2025-10-29 cs.CV 57%

MC-SJD : Maximal Coupling Speculative Jacobi Decoding for Autoregressive Visual Generation Acceleration

Junhyuk So, Hyunho Kook, Chaeyeon Jang, Eunhyeok Park

机构 * Department of Computer Science(计算机科学系) Graduate School of Artificial Intelligence, POSTECH, South Korea(人工智能研究生院,POSTECH,韩国)

专题命中 效率与蒸馏 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23977 2025-10-29 cs.LG cs.CV 57%

Synergistic Neural Forecasting of Air Pollution with Stochastic Sampling

Yohan Abeysinghe, Muhammad Akhtar Munir, Sanoojan Baliah, Ron Sarafian, Fahad Shahbaz Khan, Yinon Rudich, Salman Khan

机构 * Mohamed bin Zayed University of Artificial Intelligence(莫德尔·本·扎耶德人工智能大学) Weizmann Institute of Science(魏兹曼科学研究所) Linköping University(林雪平大学) Australian National University(澳大利亚国立大学)

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01320 2025-10-28 cs.LG cs.AI cs.CV 57%

Psi-Sampler: Initial Particle Sampling for SMC-Based Inference-Time Reward Alignment in Score Models

Taehoon Yoon, Yunhong Min, Kyeongmin Yeo, Minhyuk Sung

机构 * KAIST(韩国科学技术院)

专题命中 效率与蒸馏 :image generation(abstract);分类 cs.CV

Comments NeurIPS 2025, Spotlight Presentation

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19472 2025-10-23 cs.CV 57%

Predicting before Reconstruction: A generative prior framework for MRI acceleration

Juhyung Park, Rokgi Hong, Roh-Eul Yoo, Jaehyeon Koo, Se Young Chun, Seung Hong Choi, Jongho Lee

专题命中 效率与蒸馏 :image synthesis(abstract);分类 cs.CV

Comments 33 pages, 8figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.00537 2025-10-21 eess.IV cs.CV cs.LG 57%

Accelerating MRI with Longitudinally-informed Latent Posterior Sampling

Yonatan Urman, Zachary Shah, Ashwin Kumar, Bruno P. Soares, Kawin Setsompop

机构 * Electrical Engineering , Stanford University , California , USA(电气工程,斯坦福大学,加利福尼亚,美国) Radiology , Stanford University , California , USA(放射学,斯坦福大学,加利福尼亚,美国)

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12067 2025-10-14 cs.CV 57%

A Comprehensive Survey on Knowledge Distillation

Amir M. Mansourian, Rozhan Ahmadi, Masoud Ghafouri, Amir Mohammad Babaei, Elaheh Badali Golezani, Zeynab Yasamani Ghamchi, Vida Ramezanian, Alireza Taherian, Kimia Dinashi, Amirali Miri, Shohreh Kasaei

机构 * Sharif University of Technology(谢里夫科技大学)

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

Comments Published at TMLR (102 pages, 10 figures, 17 tables)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09586 2025-10-13 cs.CV 57%

Vision Language Models: A Survey of 26K Papers

Fengming Lin

机构 * School of Computer Science, The University of Manchester, Manchester, UK(曼彻斯特大学计算机科学学院)

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

Comments VLM/LLM Learning Notes

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07953 2025-10-10 cs.CV cs.LG 57%

SimCast: Enhancing Precipitation Nowcasting with Short-to-Long Term Knowledge Distillation

Yifang Yin, Shengkai Chen, Yiyao Li, Lu Wang, Ruibing Jin, Wei Cui, Shili Xiang

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

Comments accepted by ICME 2025

Journal ref IEEE International Conference on Multimedia and Expo (ICME) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07729 2025-10-10 cs.CV 57%

ComGS: Efficient 3D Object-Scene Composition via Surface Octahedral Probes

Jian Gao, Mengqi Yuan, Yifei Zeng, Chang Zeng, Zhihao Li, Zhenyu Chen, Weichao Qiu, Xiao-Xiao Long, Hao Zhu, Xun Cao, Yao Yao

机构 * Nanjing University(南京大学) Huawei Noah’s Ark Lab(华为诺亚实验室)

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05367 2025-10-08 cs.CV cs.LG 57%

LightCache: Memory-Efficient, Training-Free Acceleration for Video Generation

Yang Xiao, Gen Li, Kaiyuan Deng, Yushu Wu, Zheng Zhan, Yanzhi Wang, Xiaolong Ma, Bo Hui

机构 * University of Tulsa(塔尔萨大学) Clemson University(克莱姆斯大学) The University of Arizona(亚利桑那大学) Northeastern University(东北大学) Microsoft Research(微软研究院)

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09350 2025-10-03 cs.CV cs.AI cs.LG 57%

Autoregressive Adversarial Post-Training for Real-Time Interactive Video Generation

Shanchuan Lin, Ceyuan Yang, Hao He, Jianwen Jiang, Yuxi Ren, Xin Xia, Yang Zhao, Xuefeng Xiao, Lu Jiang

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00624 2025-10-02 cs.CV 57%

UCD: Unconditional Discriminator Promotes Nash Equilibrium in GANs

Mengfei Xia, Nan Xue, Jiapeng Zhu, Yujun Shen

机构 * Ant Group(蚂蚁集团)

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00260 2025-10-02 cs.LG cs.AI cs.CV 57%

Learning Energy-based Variational Latent Prior for VAEs

Debottam Dutta, Chaitanya Amballa, Zhongweiyang Xu, Yu-Lin Wei, Romit Roy Choudhury

专题命中 效率与蒸馏 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25182 2025-09-30 cs.CV cs.AI 57%

DC-VideoGen: Efficient Video Generation with Deep Compression Video Autoencoder

Junyu Chen, Wenkun He, Yuchao Gu, Yuyang Zhao, Jincheng Yu, Junsong Chen, Dongyun Zou, Yujun Lin, Zhekai Zhang, Muyang Li, Haocheng Xi, Ligeng Zhu, Enze Xie, Song Han, Han Cai

机构 * NVIDIA(英伟达)

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

Comments Tech Report. The first three authors contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24142 2025-09-30 cs.CV 57%

Asymmetric VAE for One-Step Video Super-Resolution Acceleration

Jianze Li, Yong Guo, Yulun Zhang, Xiaokang Yang

机构 * Shanghai Jiao Tong University(上海交通大学) South China University of Technology(华南理工大学)

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10774 2025-09-30 cs.CV cs.AI cs.LG 57%

BLADE: Block-Sparse Attention Meets Step Distillation for Efficient Video Generation

Youping Gu, Xiaolong Li, Yuhao Hu, Minqi Chen, Bohan Zhuang

机构 * Zhejiang University(浙江大学) Central Media Technology Institute, Huawei Technologies(华为技术有限公司中央媒体技术研究所)

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

Comments Tech report

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15472 2025-09-29 cs.CV 57%

Efficient Multimodal Dataset Distillation via Generative Models

Zhenghao Zhao, Haoxuan Wang, Junyi Wu, Yuzhang Shang, Gaowen Liu, Yan Yan

机构 * University of Illinois Chicago(伊利诺伊大学芝加哥分校) University of Central Florida(中央佛罗里达大学) Cisco Research(思科研究)

专题命中 效率与蒸馏 :text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09931 2025-09-29 cs.CV cs.AI 57%

Zero-shot detection of buildings in mobile LiDAR using Language Vision Model

June Moh Goo, Zichao Zeng, Jan Boehm

机构 * Department of Civil, Environmental and Geomatic Engineering, University College London(伦敦大学学院建筑、环境与地理工程系)

专题命中 效率与蒸馏 :image generation(abstract);分类 cs.CV

Comments 7 pages, 6 figures, conference

Journal ref The International Archives of the Photogrammetry, Remote Sensing and Spatial Information Sciences (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21318 2025-09-26 cs.CV cs.AI 57%

SD3.5-Flash: Distribution-Guided Distillation of Generative Flows

Hmrishav Bandyopadhyay, Rahim Entezari, Jim Scott, Reshinth Adithyan, Yi-Zhe Song, Varun Jampani

机构 * Stability AI SketchX, University of Surrey(SketchX,大学)

专题命中 效率与蒸馏 :image generation(abstract);分类 cs.CV

Comments Project Page: https://hmrishavbandy.github.io/sd35flash/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21027 2025-09-26 cs.RO cs.CV 57%

KeyWorld: Key Frame Reasoning Enables Effective and Efficient World Models

Sibo Li, Qianyue Hao, Yu Shang, Yong Li

机构 * Department of Electronic Engineering, BNRist, Tsinghua University(电子工程系、北京理工大学、清华大学)

专题命中 效率与蒸馏 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏