arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 2542 信号源:cs.CV, cs.GR, cs.MM

1. 效率与蒸馏 2542 篇

2503.24374 2025-04-01 cs.CV 57%

ERUPT: Efficient Rendering with Unposed Patch Transformer

Maxim V. Shugaev, Vincent Chen, Maxim Karrenbach, Kyle Ashley, Bridget Kennedy, Naresh P. Cuntoor

专题命中 效率与蒸馏 :image synthesis(abstract);分类 cs.CV

Comments Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13319 2025-04-01 cs.CV 57%

MagicDistillation: Weak-to-Strong Video Distillation for Large-Scale Few-Step Synthesis

Shitong Shao, Hongwei Yi, Hanzhong Guo, Tian Ye, Daquan Zhou, Michael Lingelbach, Zhiqiang Xu, Zeke Xie

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.17387 2025-04-01 cs.CV cs.AI 57%

Singular Value Scaling: Efficient Generative Model Compression via Pruned Weights Refinement

Hyeonjin Kim, Jaejun Yoo

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

Comments Accepted to AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10122 2025-03-27 cs.CV 57%

MuseTalk: Real-Time High-Fidelity Video Dubbing via Spatio-Temporal Sampling

Yue Zhang, Zhizhou Zhong, Minhao Liu, Zhaokang Chen, Bin Wu, Yubin Zeng, Chao Zhan, Yingjie He, Junxin Huang, Wenjiang Zhou

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

Comments 15 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19930 2025-03-26 cs.CV 57%

Identity-preserving Distillation Sampling by Fixed-Point Iterator

SeonHwa Kim, Jiwon Kim, Soobin Park, Donghoon Ahn, Jiwon Kang, Seungryong Kim, Kyong Hwan Jin, Eunju Cha

专题命中 效率与蒸馏 :image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.17808 2025-03-25 cs.CV 57%

Dora: Sampling and Benchmarking for 3D Shape Variational Auto-Encoders

Rui Chen, Jianfeng Zhang, Yixun Liang, Guan Luo, Weiyu Li, Jiarui Liu, Xiu Li, Xiaoxiao Long, Jiashi Feng, Ping Tan

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

Comments Accepted by CVPR 2025. Project page: https://aruichen.github.io/Dora/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18159 2025-03-25 cs.CV cs.AI cs.SD 57%

DiffusionTalker: Efficient and Compact Speech-Driven 3D Talking Head via Personalizer-Guided Distillation

Peng Chen, Xiaobao Wei, Ming Lu, Hui Chen, Feng Tian

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

Comments Accepted by ICME2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.03146 2025-03-21 cs.CV cs.LG 57%

Tiny models from tiny data: Textual and null-text inversion for few-shot distillation

Erik Landolsi, Fredrik Kahl

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

Comments 24 pages (13 main pages + references and appendix)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15056 2025-03-20 cs.CV 57%

Single-Step Bidirectional Unpaired Image Translation Using Implicit Bridge Consistency Distillation

Suhyeon Lee, Kwanyoung Kim, Jong Chul Ye

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

Comments 25 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05704 2025-03-20 cs.CV 57%

Hierarchical Features Matter: A Deep Exploration of Progressive Parameterization Method for Dataset Distillation

Xinhao Zhong, Hao Fang, Bin Chen, Xulin Gu, Meikang Qiu, Shuhan Qi, Shu-Tao Xia

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

Comments Accepted to CVPR2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13814 2025-03-19 cs.CV 57%

FusDreamer: Label-efficient Remote Sensing World Model for Multimodal Data Classification

Jinping Wang, Weiwei Song, Hao Chen, Jinchang Ren, Huimin Zhao

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10958 2025-03-18 cs.CV cs.AI cs.LG 57%

SoftVQ-VAE: Efficient 1-Dimensional Continuous Tokenizer

Hao Chen, Ze Wang, Xiang Li, Ximeng Sun, Fangyi Chen, Jiang Liu, Jindong Wang, Bhiksha Raj, Zicheng Liu, Emad Barsoum

专题命中 效率与蒸馏 :image generation(abstract);分类 cs.CV

Comments Code and model: https://github.com/Hhhhhhao/continuous_tokenizer

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.14468 2025-03-18 cs.AI cs.CV cs.HC 57%

K-Sort Arena: Efficient and Reliable Benchmarking for Generative Models via K-wise Human Preferences

Zhikai Li, Xuewen Liu, Dongrong Joe Fu, Jianquan Li, Qingyi Gu, Kurt Keutzer, Zhen Dong

专题命中 效率与蒸馏 :text-to-image(abstract);分类 cs.CV

Comments CVPR 2025. Project page: https://huggingface.co/spaces/ksort/K-Sort-Arena

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00521 2025-03-18 cs.LG cs.CV 57%

CHAIN: Enhancing Generalization in Data-Efficient GANs via lipsCHitz continuity constrAIned Normalization

Yao Ni, Piotr Koniusz

专题命中 效率与蒸馏 :image generation(abstract);分类 cs.CV

Comments Accepted by CVPR 2024. 26 pages. Code: https://github.com/MaxwellYaoNi/CHAIN

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10403 2025-03-14 cs.CV 57%

Hyper3D: Efficient 3D Representation via Hybrid Triplane and Octree Feature for Enhanced 3D Shape Variational Auto-Encoders

Jingyu Guo, Sensen Gao, Jia-Wang Bian, Wanhu Sun, Heliang Zheng, Rongfei Jia, Mingming Gong

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08605 2025-03-12 cs.CV cs.AI cs.LG 57%

Tuning-Free Multi-Event Long Video Generation via Synchronized Coupled Sampling

Subin Kim, Seoung Wug Oh, Jui-Hsien Wang, Joon-Young Lee, Jinwoo Shin

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

Comments Project page with visuals: https://syncos2025.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08136 2025-03-12 cs.CV cs.AI cs.LG 57%

FlowDPS: Flow-Driven Posterior Sampling for Inverse Problems

Jeongsol Kim, Bryan Sangwoo Kim, Jong Chul Ye

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01261 2025-03-12 cs.CV 57%

Towards Improved Text-Aligned Codebook Learning: Multi-Hierarchical Codebook-Text Alignment with Long Text

Guotao Liang, Baoquan Zhang, Zhiyuan Wen, Junteng Zhao, Yunming Ye, Kola Ye, Yao He

专题命中 效率与蒸馏 :image generation(abstract);分类 cs.CV

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07274 2025-03-11 cs.LG cs.CV 57%

Efficient Distillation of Classifier-Free Guidance using Adapters

Cristian Perez Jensen, Seyedmorteza Sadat

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07104 2025-03-11 eess.IV cs.CV cs.LG q-bio.QM 57%

Global Context Is All You Need for Parallel Efficient Tractography Parcellation

Valentin von Bornhaupt, Johannes Grün, and Justus Bisten, Tobias Bauer, Theodor Rüber, Thomas Schultz

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

Comments 8 pages, 2 pages references, 3 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06984 2025-03-11 cs.SD cs.CV eess.AS 57%

Synchronized Video-to-Audio Generation via Mel Quantization-Continuum Decomposition

Juncheng Wang, Chao Xu, Cheng Yu, Lei Shang, Zhe Hu, Shujun Wang, Liefeng Bo

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

Comments Accepted to CVPR-25

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06976 2025-03-11 cs.CV 57%

Task-Specific Knowledge Distillation from the Vision Foundation Model for Enhanced Medical Image Segmentation

Pengchen Liang, Haishan Huang, Bin Pu, Jianguo Chen, Xiang Hua, Jing Zhang, Weibo Ma, Zhuangzhuang Chen, Yiwei Li, Qing Chang

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

Comments 29 pages, 10 figures, 16 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06545 2025-03-11 cs.CV 57%

QuantCache: Adaptive Importance-Guided Quantization with Hierarchical Latent and Layer Caching for Video Generation

Junyi Wu, Zhiteng Li, Zheng Hui, Yulun Zhang, Linghe Kong, Xiaokang Yang

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

Comments The code and models will be available at https://github.com/JunyiWuCode/QuantCache

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00802 2025-03-04 cs.CV 57%

MFM-DA: Instance-Aware Adaptor and Hierarchical Alignment for Efficient Domain Adaptation in Medical Foundation Models

Jia-Xuan Jiang, Wenhui Lei, Yifeng Wu, Hongtao Wu, Furong Li, Yining Xie, Xiaofan Zhang, Zhong Wang

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.21079 2025-03-03 cs.CV 57%

Training-free and Adaptive Sparse Attention for Efficient Long Video Generation

Yifei Xia, Suhan Ling, Fangcheng Fu, Yujie Wang, Huixia Li, Xuefeng Xiao, Bin Cui

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16160 2025-02-25 cs.CV 57%

USegMix: Unsupervised Segment Mix for Efficient Data Augmentation in Pathology Images

Jiamu Wang, Jin Tae Kwak

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.22099 2025-02-17 cs.CV cs.AI 57%

TractShapeNet: Efficient Multi-Shape Learning with 3D Tractography Point Clouds

Yui Lo, Yuqian Chen, Dongnan Liu, Jon Haitz Legarreta, Leo Zekelman, Fan Zhang, Jarrett Rushmore, Yogesh Rathi, Nikos Makris, Alexandra J. Golby, Weidong Cai, Lauren J. O'Donnell

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

Comments 10 pages, 2 figures, 4 tables. This work has been accepted to 2025 IEEE 22nd International Symposium on Biomedical Imaging (ISBI)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.08781 2025-02-13 cs.CV cs.LG 57%

GMem: A Modular Approach for Ultra-Efficient Generative Models

Yi Tang, Peng Sun, Zhenglin Cheng, Tao Lin

专题命中 效率与蒸馏 :diffusion(abstract);分类 cs.CV

Comments 9 pages, 5 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07436 2025-02-12 cs.CV 57%

Optimizing Knowledge Distillation in Transformers: Enabling Multi-Head Attention without Alignment Barriers

Zhaodong Bing, Linze Li, Jiajun Liang

专题命中 效率与蒸馏 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05178 2025-02-10 cs.CV 57%

QLIP: Text-Aligned Visual Tokenization Unifies Auto-Regressive Multimodal Understanding and Generation

Yue Zhao, Fuzhao Xue, Scott Reed, Linxi Fan, Yuke Zhu, Jan Kautz, Zhiding Yu, Philipp Krähenbühl, De-An Huang

专题命中 效率与蒸馏 :image generation(abstract);分类 cs.CV

Comments Tech report. Project page: https://nvlabs.github.io/QLIP/

详情

展开后加载摘要…

URL PDF HTML 收藏