Foveated Diffusion: Efficient Spatially Adaptive Image and Video Generation
视网膜扩散:高效的视空适应图像和视频生成
机构 * Stanford University, USA(斯坦福大学,美国)
专题命中 视频扩散模型 :video generation(title,abstract);分类 cs.CV
AI总结 本文提出视网膜扩散模型,通过非均匀分配token提高生成效率,利用人类视觉的视网膜区域高分辨率特性,在保持视觉质量的同时显著减少token数量和生成时间。
Comments Project website at https://bchao1.github.io/foveated-diffusion