arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-03-30 至 2026-03-30 共收录 3 信号源:cs.CV, cs.GR, cs.MM

1. 个性化与一致性 3 篇

2603.26128 2026-03-30 cs.CV 85%

TaxaAdapter: Vision Taxonomy Models are Key to Fine-grained Image Generation over the Tree of Life

TaxaAdapter:视觉分类模型是生命树上细粒度图像生成的关键

Mridul Khurana, Amin Karimi Monsefi, Justin Lee, Medha Sawhney, David Carlyn, Julia Chae, Jianyang Gu, Rajiv Ramnath, Sara Beery, Wei-Lun Chao, Anuj Karpatne, Cheng Zhang

机构 * Virginia Tech(弗吉尼亚理工大学) The Ohio State University(俄亥俄州立大学) MIT(麻省理工学院) Boston University(波士顿大学)

专题命中 个性化与一致性 :image generation(title);text-to-image(abstract);diffusion(abstract);image synthesis(abstract)

AI总结 本文提出TaxaAdapter,通过整合视觉分类模型提升细粒度物种生成的精度与一致性,实验表明其在形态学和物种识别准确性上优于现有方法,且具备良好的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03220 2026-03-30 cs.CV 83%

PokeFusion Attention: A Lightweight Cross-Attention Mechanism for Style-Conditioned Image Generation

PokeFusion Attention:一种轻量级的跨注意力机制用于风格条件图像生成

Jingbang Tang

机构 * Independent Researcher, Vancouver, Canada(独立研究员,加拿大温哥华) School of Computing, Universiti Kebangsaan Malaysia (UKM), Malaysia(马来西亚国立大学计算机学院)

专题命中 个性化与一致性 :image generation(title);text-to-image(abstract);diffusion(abstract);分类 cs.CV

AI总结 本文提出PokeFusion Attention,一种轻量级跨注意力机制,用于风格条件图像生成,通过学习风格分布先验而非实例级条件,提升生成效果与一致性。

Comments 12 pages, 5 figures. Revised version with improved method description and corrected references

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09472 2026-03-30 cs.CV 57%

Zero-Shot Personalized Camera Motion Control for Image-to-Video Synthesis

零样本个性化摄像机运动控制用于图像到视频合成

Pooja Guhan, Divya Kothandaraman, Geonsun Lee, Tsung-Wei Huang, Guan-Ming Su, Dinesh Manocha

机构 * University of Maryland College Park(马里兰大学帕克分校) Dolby Laboratories(杜比实验室)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 本文提出零样本扩散框架,实现从单参考视频向静态图像转移电影级运动,提升非专家创作者的创意表达与视频制作可及性。

详情

展开后加载摘要…

URL PDF HTML 收藏