arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-07-29 至 2026-07-29 共收录 2 信号源:cs.CV, cs.GR, cs.MM

1. 效率与蒸馏 2 篇

2602.15355 2026-07-29 cs.CV 版本更新 79%

DAV-GSWT: Diffusion-Active-View Sampling for Data-Efficient Gaussian Splatting Wang Tiles

DAV-GSWT:基于扩散优先的主动视角采样用于数据高效的高斯溅射瓦片

Rong Fu, Jiekai Wu, Yee Tan Jia, Yang Li, Xiaowen Ma, Wangyu Wu, Simon Fong

机构 * University of Macau(澳门大学) Juntendo University(立命馆大学) Tongji University(同济大学) Renmin University of China(中国人民大学) University of Chinese Academy of Sciences(中国科学院大学) Zhejiang University(浙江大学) University of Liverpool(利物浦大学)

专题命中 效率与蒸馏 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出DAV-GSWT框架,利用扩散先验和主动视角采样,从少量输入观测合成高保真高斯溅射瓦片,减少数据需求并保持视觉质量和交互性能。

Comments 16 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26004 2026-07-29 cs.CV cs.LG 新提交 70%

Parallel Decoding Distillation for Fast Image and Video Generation

用于快速图像和视频生成的并行解码蒸馏

Neta Shaul, Chao Liu, Arash Vahdat, Julius Berner

机构 * NVIDIA(英伟达) Weizmann Institute of Science(魏茨曼科学研究所)

专题命中 效率与蒸馏 :text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 针对视频扩散或流模型生成计算昂贵问题,提出并行解码蒸馏方法PDD,兼容预训练模型,通过预测多去噪步骤加速生成,在多个数据集上达SOTA性能,提升视频多样性。

详情

展开后加载摘要…

URL PDF HTML 收藏