arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-03-10 至 2026-03-10 共收录 6 信号源:cs.CV, cs.GR, cs.MM

1. 个性化与一致性 6 篇

2603.08228 2026-03-10 cs.CV 79%

GarmentPainter: Efficient 3D Garment Texture Synthesis with Character-Guided Diffusion Model

GarmentPainter: 基于字符引导扩散模型的高效3D服装纹理合成

Jinbo Wu, Xiaobo Gao, Xing Liu, Chen Zhao, Jialun Liu

机构 * Baidu Inc.(百度公司) TeleAI

专题命中 个性化与一致性 :diffusion(title,abstract);分类 cs.CV

AI总结 GarmentPainter通过基于字符引导的扩散模型,实现了高效且高质量的3D服装纹理合成,提升了纹理生成的灵活性和一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07540 2026-03-10 cs.CV cs.AI 74%

How Long Can Unified Multimodal Models Generate Images Reliably? Taming Long-Horizon Interleaved Image Generation via Context Curation

统一多模态模型能可靠生成图像多长?通过上下文筛选驯服长周期交错图像生成

Haoyu Chen, Qing Liu, Yuqian Zhou, He Zhang, Zhaowen Wang, Mengwei Ren, Jingjing Ren, Xiang Wang, Zhe Lin, Lei Zhu

机构 * The Hong Kong University of Science(香港科学与技术大学) Adobe Research(Adobe研究) Huazhong University of Science(华中科技大学)

专题命中 个性化与一致性 :image generation(title);分类 cs.CV

AI总结 本研究提出UniLongGen,通过动态筛选模型记忆以提升长周期图像生成的稳定性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07543 2026-03-10 cs.CV cs.MM 73%

CONSTANT: Towards High-Quality One-Shot Handwriting Generation with Patch Contrastive Enhancement and Style-Aware Quantization

CONSTANT:通过补丁对比增强和风格感知量化实现高质量单次手写生成

Anh-Duy Le, Van-Linh Pham, Thanh-Nam Vo, Xuan Toan Mai, Tuan-Anh Tran

机构 * Viettel Artificial Intelligence and Data Services Center(越南 Viettel 人工智能与数据服务中心) Ho Chi Minh City University of Technology(胡志明市技术大学)

专题命中 个性化与一致性 :image generation(abstract);diffusion(abstract);分类 cs.CV、cs.MM

AI总结 CONSTANT通过补丁对比增强和风格感知量化,实现高质量单次手写生成,有效提升图像细节与风格适应性。

Comments Accepted as oral presentation at WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18734 2026-03-10 cs.CV cs.AI 70%

Yo'City: Personalized and Boundless 3D Realistic City Scene Generation via Self-Critic Expansion

Yo'City:通过自批评扩展实现个性化和无边界的3D逼真城市场景生成

Keyang Lu, Sifan Zhou, Hongbin Xu, Gang Xu, Zhifei Yang, Yikai Wang, Zhen Xiao, Jieyi Long, Ming Li

机构 * School of Computer Science, Peking University(北京大学计算机科学学院) Beihang University(北航) Southeast University(东南大学) ByteDance Seed(字节跳动种子) Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东省人工智能与数字经济实验室) Beijing Normal University(北京师范大学) Theta Labs(Theta实验室)

专题命中 个性化与一致性 :diffusion(abstract);image synthesis(abstract);分类 cs.CV

AI总结 Yo'City通过自批评扩展实现个性化和无边界的3D城市生成,利用大模型的推理能力提升生成质量。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08445 2026-03-10 cs.CV 57%

Alfa: Attentive Low-Rank Filter Adaptation for Structure-Aware Cross-Domain Personalized Gaze Estimation

Alfa: 用于结构感知跨域个性化眼动估计的注意力低秩滤波适应

He-Yen Hsieh, Wei-Te Mark Ting, H. T. Kung

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 Alfa通过重新加权预训练滤波器中的语义模式,实现结构感知的跨域个性化眼动估计,有效提升模型性能。

Comments 21 pages, 16 figures, AAAI2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20989 2026-03-10 cs.CV 57%

Cycle-Consistent Tuning for Layered Image Decomposition

循环一致性调谐用于分层图像分解

Zheng Gu, Min Lu, Zhida Sun, Dani Lischinski, Daniel Cohen-Or, Hui Huang

机构 * Shenzhen University(深圳大学) Hebrew University of Jerusalem(耶路撒冷希伯来大学) Tel Aviv University(特拉维夫大学)

专题命中 个性化与一致性 :diffusion(abstract);分类 cs.CV

AI总结 本文提出一种基于循环一致性调谐的图像分解框架,通过轻量级LoRA适应和双向监督提升分层分离的鲁棒性和泛化能力。

Comments Accepted to CVPR 2026. Project page: https://vcc.tech/research/2026/ImgDecom

详情

展开后加载摘要…

URL PDF HTML 收藏