arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-02-27 至 2026-02-27 共收录 3 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 3 篇

2512.02686 2026-02-27 cs.CV 77%

ClimaOoD: Improving Anomaly Segmentation via Physically Realistic Synthetic Data

ClimaOoD: 通过物理真实合成数据提升异常分割

Yuxing Liu, Zheng Li, Huanhuan Liang, Ji Zhang, Zeyu Sun, Yong Liu

机构 * Beijing University of Chemical Technology(北京化工大学) Southwest Minzu University(西南民族大学) Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所)

专题命中 文生图 :text-to-image(abstract);diffusion(abstract);inpainting(abstract);分类 cs.CV

AI总结 ClimaOoD通过生成物理真实且语义连贯的合成数据,提升异常分割的鲁棒性和泛化能力。

Comments Accepted by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20903 2026-02-27 cs.CV 70%

TextPecker: Rewarding Structural Anomaly Quantification for Enhancing Visual Text Rendering

TextPecker: 通过奖励结构异常量化提升视觉文本渲染

Hanshen Zhu, Yuliang Liu, Xuecheng Wu, An-Lan Wang, Hao Feng, Dingkang Yang, Chao Feng, Can Huang, Jingqun Tang, Xiang Bai

机构 * Huazhong University of Science and Technology(华中科技大学) ByteDance(字节跳动)

专题命中 文生图 :image generation(abstract);text-to-image(abstract);分类 cs.CV

AI总结 TextPecker通过结构异常感知强化学习策略提升视觉文本渲染的结构忠实度和语义对齐度。

Comments Accepted by CVPR 2026; Code: https://github.com/CIawevy/TextPecker

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22734 2026-02-27 cs.CV 57%

Asymmetric Idiosyncrasies in Multimodal Models

多模态模型中的非对称个性化特征

Muzi Tao, Chufan Shi, Huijuan Wang, Shengbang Tong, Xuezhe Ma

机构 * University of Southern California(南加州大学) New York University(纽约大学)

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

AI总结 本文研究了多模态模型中描述模型的个性化特征及其对文本到图像模型的影响,发现生成图像丢失了描述中的关键变化,提出了一种新的量化方法。

Comments Project page: https://muzi-tao.github.io/asymmetric-idiosyncrasies/

详情

展开后加载摘要…

URL PDF HTML 收藏