arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-04-21 至 2026-04-21 共收录 1 信号源:cs.CV, cs.GR, cs.MM

1. 其他图像生成 1 篇

2604.17856 2026-04-21 cs.CV 74%

PlankFormer: Robust Plankton Instance Segmentation via MAE-Pretrained Vision Transformers and Pseudo Community Image Generation

PlankFormer:通过MAE预训练视觉变换器和伪社区图像生成实现鲁棒的浮游生物实例分割

Masaharu Miyazaki, Yurie Otake, Koichi Ito, Wataru Makino, Jotaro Urabe, Takafumi Aoki

机构 * Graduate School of Information Sciences, Tohoku University(东京大学信息科学研究生院) The Center for Ecological Research, Kyoto University(京都大学生态研究中心) Graduate School of Life Sciences, Tohoku University(东京大学生命科学研究生院)

专题命中 其他图像生成 :image generation(title);分类 cs.CV

AI总结 本文提出PlankFormer框架,通过生成伪社区图像和MAE预训练视觉变换器解决浮游生物实例分割中的数据不足和区分困难问题,实验表明其在高杂质密度环境下表现优异。

Comments Accepted to ICPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏