arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 1204 信号源:cs.CV, cs.GR, cs.MM

1. 图像生成评测 1204 篇

2506.20879 2026-01-23 cs.CV 79%

MultiHuman-Testbench: Benchmarking Image Generation for Multiple Humans

MultiHuman-Testbench: 多人图像生成的基准测试

Shubhankar Borse, Seokeon Choi, Sunghyun Park, Jeongho Kim, Shreya Kadambi, Risheek Garrepalli, Sungrack Yun, Munawar Hayat, Fatih Porikli

机构 * Qualcomm AI Research(高通AI研究)

专题命中 图像生成评测 :image generation(title,abstract);分类 cs.CV

AI总结 MultiHuman-Testbench提出了一种多人类图像生成的基准测试,通过多指标评估提升ID相似性,为研究提供标准化工具。

Comments Accepted at the NeurIPS 2025 D&B Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04300 2026-01-09 cs.CV 79%

Beyond Binary Preference: Aligning Diffusion Models to Fine-grained Criteria by Decoupling Attributes

超越二元偏好:通过解耦属性对齐扩散模型以实现细粒度标准

Chenye Meng, Zejian Li, Zhongni Liu, Yize Li, Changle Xie, Kaixin Jia, Ling Yang, Huanghuang Deng, Shiying Ding, Shengyuan Zhang, Jiayi Li, Lingyun Sun

机构 * Zhejiang University(浙江大学) University of Electronic Science and Technology of China(电子科技大学) Peking University(北京大学) University of Nottingham Ningbo China(诺丁汉大学宁波分校)

专题命中 图像生成评测 :diffusion(title,abstract);分类 cs.CV

AI总结 本文提出CPO方法,通过解耦属性实现扩散模型对细粒度标准的对齐,提升生成质量与专业对齐能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16853 2025-12-19 cs.CV cs.AI 79%

GenEval 2: Addressing Benchmark Drift in Text-to-Image Evaluation

GenEval 2:解决文本到图像评估中的基准漂移问题

Amita Kamath, Kai-Wei Chang, Ranjay Krishna, Luke Zettlemoyer, Yushi Hu, Marjan Ghazvininejad

机构 * FAIR at Meta(Meta 的 FAIR 部门) University of Washington(华盛顿大学) University of California, Los Angeles(洛杉矶大学) Allen Institute for AI(人工智能研究院)

专题命中 图像生成评测 :text-to-image(title,abstract);分类 cs.CV

AI总结 GenEval 2通过改进的视觉概念覆盖和组合性,解决文本到图像评估中的基准漂移问题,提供更符合人类判断的评估方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04660 2025-12-05 cs.CV 79%

I2I-Bench: A Comprehensive Benchmark Suite for Image-to-Image Editing Models

I2I-Bench: 一种全面的图像到图像编辑模型评估套件

Juntong Wang, Jiarui Wang, Huiyu Duan, Jiaxiang Kang, Guangtao Zhai, Xiongkuo Min

机构 * Institute of Image Communication and Network Engineering(图像通信与网络工程研究所) Shanghai Jiao Tong University(上海交通大学)

专题命中 图像生成评测 :image editing(title,abstract);分类 cs.CV

AI总结 I2I-Bench 提出了一种全面的图像到图像编辑模型评估套件,通过多样化的任务、全面的评估维度和严格的对齐验证,评估主流图像编辑模型的性能和权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00438 2025-12-02 cs.CV cs.AI 79%

FR-TTS: Test-Time Scaling for NTP-based Image Generation with Effective Filling-based Reward Signal

FR-TTS: 基于有效填充奖励信号的NTP图像生成测试时扩展

Hang Xu, Linjiang Huang, Feng Zhao

机构 * MoE Key Lab of BIPC, USTC(信息与通信技术联合实验室,中国科学技术大学) Beihang University(北京航空航天大学)

专题命中 图像生成评测 :image generation(title,abstract);分类 cs.CV

AI总结 FR-TTS通过有效填充奖励信号提升NTP图像生成的测试时扩展性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20256 2025-11-26 cs.CV 79%

The Image as Its Own Reward: Reinforcement Learning with Adversarial Reward for Image Generation

图像作为自身奖励:基于对抗性奖励的图像生成强化学习

Weijia Mao, Hao Chen, Zhenheng Yang, Mike Zheng Shou

机构 * Show Lab, National University of Singapore(新加坡国立大学Show实验室)

专题命中 图像生成评测 :image generation(title,abstract);分类 cs.CV

AI总结 本文提出Adv-GRPO框架,通过对抗性奖励提升图像生成质量,利用图像自身作为奖励,结合参考图像和基础模型,实现更高质量和审美效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10547 2025-11-14 cs.CV cs.LG 79%

Benchmarking Diversity in Image Generation via Attribute-Conditional Human Evaluation

Isabela Albuquerque, Ira Ktena, Olivia Wiles, Ivana Kajić, Amal Rannen-Triki, Cristina Vasconcelos, Aida Nematzadeh

机构 * Ellison Institute of Technology(埃利森技术研究所)

专题命中 图像生成评测 :image generation(title);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07870 2025-11-04 cs.CV 79%

TextAtlas5M: A Large-scale Dataset for Dense Text Image Generation

Alex Jinpeng Wang, Dongxing Mao, Jiawei Zhang, Weiming Han, Zhuobai Dong, Linjie Li, Yiqi Lin, Zhengyuan Yang, Libo Qin, Fuwei Zhang, Lijuan Wang, Min Li

机构 * CSU(中国科学技术大学) NUC(南京大学) NUS(国立新加坡大学) Microsoft(微软公司)

专题命中 图像生成评测 :image generation(title,abstract);分类 cs.CV

Comments 27 pages, 15 figures. Dataset Website: https://textatlas5m.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22521 2025-10-28 cs.CV cs.AI cs.IR cs.LG 79%

Open Multimodal Retrieval-Augmented Factual Image Generation

Yang Tian, Fan Liu, Jingyuan Zhang, Wei Bi, Yupeng Hu, Liqiang Nie

机构 * Shandong University(山东大学) National University of Singapore(新加坡国立大学) Kuaishou Technology(快手科技) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 图像生成评测 :image generation(title,abstract);分类 cs.CV

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21120 2025-10-27 cs.CV 79%

SafetyPairs: Isolating Safety Critical Image Features with Counterfactual Image Generation

Alec Helbling, Shruti Palaskar, Kundan Krishna, Polo Chau, Leon Gatys, Joseph Yitan Cheng

机构 * Georgia Tech(佐治亚理工学院) Apple(苹果公司)

专题命中 图像生成评测 :image generation(title);image editing(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20708 2025-10-24 cs.CV cs.RO 79%

ALICE-LRI: A General Method for Lossless Range Image Generation for Spinning LiDAR Sensors without Calibration Metadata

Samuel Soutullo, Miguel Yermo, David L. Vilariño, Óscar G. Lorenzo, José C. Cabaleiro, Francisco F. Rivera

专题命中 图像生成评测 :image generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07076 2025-10-21 cs.CV cs.AI 79%

NFIG: Multi-Scale Autoregressive Image Generation via Frequency Ordering

Zhihao Huang, Xi Qiu, Yukuo Ma, Yifu Zhou, Junjie Chen, Hongyuan Zhang, Chi Zhang, Xuelong Li

机构 * TeleAI, China Telecom(TeleAI,中国电信) Northwest Polytechnical University(西北工业大学) University of Hong Kong(香港大学) Beihang University(北京航空航天大学)

专题命中 图像生成评测 :image generation(title,abstract);分类 cs.CV

Comments 10 pages, 7 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01051 2025-10-03 cs.CV 79%

Diffusion Model as a Noise-Aware Latent Reward Model for Step-Level Preference Optimization

Tao Zhang, Cheng Da, Kun Ding, Huan Yang, Kun Jin, Yan Li, Tingting Gao, Di Zhang, Shiming Xiang, Chunhong Pan

机构 * MAIS, CASIA(中国科学院自动化研究所MAIS实验室) Kuaishou Technology(快手科技) School of Artificial Intelligence, UCAS(中国科学院大学人工智能学院)

专题命中 图像生成评测 :diffusion(title,abstract);分类 cs.CV

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19282 2025-09-24 cs.CV 79%

OverLayBench: A Benchmark for Layout-to-Image Generation with Dense Overlaps

Bingnan Li, Chen-Yu Wang, Haiyang Xu, Xiang Zhang, Ethan Armand, Divyansh Srivastava, Xiaojun Shan, Zeyuan Chen, Jianwen Xie, Zhuowen Tu

机构 * UC San Diego(加州大学圣地亚哥分校) Lambda, Inc(Lambda公司)

专题命中 图像生成评测 :image generation(title,abstract);分类 cs.CV

Comments Accepted to NeurIPS 2025 Dataset&Benchmark Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21066 2025-08-29 cs.CV 79%

OneReward: Unified Mask-Guided Image Generation via Multi-Task Human Preference Learning

Yuan Gong, Xionghui Wang, Jie Wu, Shiyin Wang, Yitong Wang, Xinglong Wu

机构 * ByteDance Inc.(字节跳动公司)

专题命中 图像生成评测 :image generation(title,abstract);分类 cs.CV

Comments project url: https://one-reward.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21721 2025-08-28 cs.CV 79%

Evaluating Text-to-Image and Text-to-Video Synthesis with a Conditional Fréchet Distance

Jaywon Koo, Jefferson Hernandez, Moayed Haji-Ali, Ziyan Yang, Vicente Ordonez

机构 * Rice University(里士大学)

专题命中 图像生成评测 :text-to-image(title,abstract);分类 cs.CV

Comments Added new video experiments and more image experiments to validate the method

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06152 2025-08-11 cs.CV 79%

VISTAR:A User-Centric and Role-Driven Benchmark for Text-to-Image Evaluation

Kaiyuan Jiang, Ruoxi Sun, Ying Cao, Yuqi Xu, Xinran Zhang, Junyan Guo, ChengSheng Deng

机构 * Peking University(北京大学) LinkSure University of Glasgow(格拉斯哥大学) Boston University(波士顿大学)

专题命中 图像生成评测 :text-to-image(title,abstract);分类 cs.CV

Comments 17 pages,8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11493 2025-07-28 cs.CV 79%

GIE-Bench: Towards Grounded Evaluation for Text-Guided Image Editing

Yusu Qian, Jiasen Lu, Tsu-Jui Fu, Xinze Wang, Chen Chen, Yinfei Yang, Wenze Hu, Zhe Gan

机构 * Apple(苹果公司)

专题命中 图像生成评测 :image editing(title,abstract);分类 cs.CV

Comments Project page: https://sueqian6.github.io/GIE-Bench-web/

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05255 2025-07-02 cs.CV cs.LG 79%

Bridging SFT and DPO for Diffusion Model Alignment with Self-Sampling Preference Optimization

Daoan Zhang, Guangchen Lan, Dong-Jun Han, Wenlin Yao, Xiaoman Pan, Hongming Zhang, Mingxiao Li, Pengcheng Chen, Yu Dong, Christopher Brinton, Jiebo Luo

机构 * University of Rochester(罗切斯特大学) Purdue University(普渡大学) Yonsei University(延世大学) Tencent AI Lab(腾讯AI实验室) University of Washington(华盛顿大学)

专题命中 图像生成评测 :diffusion(title);text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13827 2025-06-18 cs.GR cs.AI 79%

Balancing Preservation and Modification: A Region and Semantic Aware Metric for Instruction-Based Image Editing

Zhuoying Li, Zhu Xu, Yuxin Peng, Yang Liu

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学计算机技术研究院)

专题命中 图像生成评测 :image editing(title,abstract);分类 cs.GR

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17017 2025-06-11 cs.CV cs.AI cs.CL cs.LG 79%

Delving into RL for Image Generation with CoT: A Study on DPO vs. GRPO

Chengzhuo Tong, Ziyu Guo, Renrui Zhang, Wenyu Shan, Xinyu Wei, Zhenghao Xing, Hongsheng Li, Pheng-Ann Heng

机构 * CUHK(香港中文大学) MiuLar Lab(MiuLar 实验室) MMLab Peking University(北京大学) Shanghai AI Lab(上海人工智能实验室)

专题命中 图像生成评测 :image generation(title,abstract);分类 cs.CV

Comments Code is released at https://github.com/ZiyuGuo99/Image-Generation-CoT

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02761 2025-06-09 cs.AI cs.CL cs.CR cs.CV 79%

Rethinking Machine Unlearning in Image Generation Models

Renyang Liu, Wenjie Feng, Tianwei Zhang, Wei Zhou, Xueqi Cheng, See-Kiong Ng

机构 * Institute of Data Science, National University of Singapore(新加坡国立大学数据科学研究所) School of Artificial Intelligence and Data Science, University of Science and Technology of China(中国科学技术大学人工智能与数据科学学院) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院) National Pilot School of Software, Yunnan University(云南大学软件试点学院) AI Safety of Chinese Academy of Sciences, Institute of Computing Technology, Chinese Academy of Sciences(中国科学院人工智能安全研究院、计算技术研究所)

专题命中 图像生成评测 :image generation(title,abstract);分类 cs.CV

Comments Accepted by ACM CCS 2025

Journal ref ACM Conference on Computer and Communications Security (CCS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24870 2025-06-09 cs.CV 79%

GenSpace: Benchmarking Spatially-Aware Image Generation

Zehan Wang, Jiayang Xu, Ziang Zhang, Tianyu Pang, Chao Du, Hengshuang Zhao, Zhou Zhao

机构 * Zhejiang University(浙江大学) Sea AI Lab(海思人工智能实验室) The University of Hong Kong(香港大学)

专题命中 图像生成评测 :image generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24875 2025-06-06 cs.CV cs.CL 79%

ReasonGen-R1: CoT for Autoregressive Image generation models through SFT and RL

Yu Zhang, Yunqi Li, Yifan Yang, Rui Wang, Yuqing Yang, Dai Qi, Jianmin Bao, Dongdong Chen, Chong Luo, Lili Qiu

机构 * ShanghaiTech University(上海科技大学) Microsoft Corporation(微软公司) Fudan University(复旦大学)

专题命中 图像生成评测 :image generation(title);generative vision(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13439 2025-05-20 cs.CV cs.AI cs.LG 79%

VTBench: Evaluating Visual Tokenizers for Autoregressive Image Generation

Huawei Lin, Tong Geng, Zhaozhuo Xu, Weijie Zhao

机构 * Rochester Institute of Technology(罗切斯特理工学院) University of Rochester(罗切斯特大学) Stevens Institute of Technology(史蒂文斯理工学院)

专题命中 图像生成评测 :image generation(title,abstract);分类 cs.CV

Comments 24 pages, 13 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00502 2025-05-02 cs.CV 79%

Towards Scalable Human-aligned Benchmark for Text-guided Image Editing

Suho Ryu, Kihyun Kim, Eugene Baek, Dongsoo Shin, Joonseok Lee

机构 * Graduate School of Data Science, Seoul National University(数据科学研究生院,首尔国立大学)

专题命中 图像生成评测 :image editing(title,abstract);分类 cs.CV

Comments Accepted to CVPR 2025 (highlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.06502 2025-05-01 cs.CV cs.LG 79%

Prompt Recovery for Image Generation Models: A Comparative Study of Discrete Optimizers

Joshua Nathaniel Williams, Avi Schwarzschild, Yutong He, J. Zico Kolter

机构 * Department of Computer Science(计算机科学系) Carnegie Mellon University(卡内基梅隆大学) Department of Machine Learning(机器学习系)

专题命中 图像生成评测 :image generation(title,abstract);分类 cs.CV

Comments 11 Pages, 3 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11129 2025-04-17 cs.CV cs.AI 79%

Direction-Aware Diagonal Autoregressive Image Generation

Yijia Xu, Jianzhong Ju, Jian Luan, Jinshi Cui

专题命中 图像生成评测 :image generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11374 2025-03-21 cs.CV cs.AI 79%

Preserve or Modify? Context-Aware Evaluation for Balancing Preservation and Modification in Text-Guided Image Editing

Yoonjeon Kim, Soohyun Ryu, Yeonsung Jung, Hyunkoo Lee, Joowon Kim, June Yong Yang, Jaeryong Hwang, Eunho Yang

专题命中 图像生成评测 :image editing(title,abstract);分类 cs.CV

Comments accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07004 2025-03-11 cs.CV cs.AI 79%

NukesFormers: Unpaired Hyperspectral Image Generation with Non-Uniform Domain Alignment

Jiaojiao Li, Shiyao Duan, Haitao XU, Rui Song

专题命中 图像生成评测 :image generation(title,abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏