arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-07-22 至 2026-07-22 共收录 2 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 2 篇

2511.20651 2026-07-22 cs.CV 版本更新 86%

RubricRL: Simple Generalizable Rewards for Text-to-Image Generation

RubricRL:文本到图像生成的简单通用奖励

Xuelu Feng, Yunsheng Li, Ziyu Wan, Zixuan Gao, Junsong Yuan, Dongdong Chen, Chunming Qiao

机构 * University at Buffalo(布法罗大学) Microsoft CoreAI(微软核心人工智能)

专题命中 文生图 :text-to-image(title,abstract);image generation(title);分类 cs.CV

AI总结 提出RubricRL框架,通过为每个提示动态构建可分解的检查表(如对象正确性、属性准确性等),并由多模态评判器独立评估,实现可解释、可组合的奖励设计,提升文本到图像生成的对齐效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18724 2026-07-22 cs.AI 新提交 78%

One Rewrite to Fix Them All? Type-Aware Repair Allocation for Text-to-Image Prompt Optimization

一劳永逸?用于文本到图像提示优化的类型感知修复分配

Haoyue Liu, Xiaoyu Ma, Ye Chen, Shuguang Cui, Xiaoying Tang

机构 * School of Science and Engineering, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)理工学院) XJTU-POLIMI Joint School, Xi’an Jiaotong University(西安交通大学-米兰理工大学联合学院) Shenzhen Future Network of Intelligence Institute (FNii-Shenzhen)(深圳未来智能网络研究院)

专题命中 文生图 :text-to-image(title,abstract)

AI总结 研究文本到图像提示优化问题,提出将语义提示优化制定为原子修复分配的方法,在无需训练的TARA框架中实例化,实验表明该方法在多个基准生成器单元中语义准确性最佳,且运行快、图像质量好。

详情

展开后加载摘要…

URL PDF HTML 收藏