arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-03-16 至 2026-03-16 共收录 2 信号源:cs.CV, cs.GR, cs.MM

1. 个性化与一致性 2 篇

2603.12873 2026-03-16 cs.CV 57%

TRACE: Structure-Aware Character Encoding for Robust and Generalizable Document Watermarking

TRACE:面向结构的字符编码用于鲁棒且可泛化的文档水印

Jiale Meng, Jie Zhang, Runyi Hu, Zhe-Ming Lu, Tianwei Zhang, Yiming Li

机构 * Zhejiang University(浙江大学) Nanyang Technological University(南洋理工大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 TRACE通过扩散模型实现结构感知的局部字符编码,提升文档水印的鲁棒性和泛化能力,实验显示其在PSNR和提取精度上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12513 2026-03-16 cs.CV 57%

MemRoPE: Training-Free Infinite Video Generation via Evolving Memory Tokens

MemRoPE:通过演化记忆标记实现无训练的无限视频生成

Youngrae Kim, Qixin Hu, C. -C. Jay Kuo, Peter A. Beerel

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 MemRoPE通过演化记忆标记和在线RoPE索引机制,解决长视频生成中的时间一致性、视觉保真度和主体一致性问题,实现无训练的无限视频生成。

Comments 9 pages main, 3 pages references, 6 pages appendix. Project page: https://memrope.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏