arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 1204 信号源:cs.CV, cs.GR, cs.MM

1. 图像生成评测 1204 篇

2406.03070 2025-02-10 cs.CV cs.AI 57%

A-Bench: Are LMMs Masters at Evaluating AI-generated Images?

Zicheng Zhang, Haoning Wu, Chunyi Li, Yingjie Zhou, Wei Sun, Xiongkuo Min, Zijian Chen, Xiaohong Liu, Weisi Lin, Guangtao Zhai

专题命中 图像生成评测 :text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.07346 2025-02-04 cs.CV 57%

Quality Assessment for AI Generated Images with Instruction Tuning

Jiarui Wang, Huiyu Duan, Guangtao Zhai, Xiongkuo Min

专题命中 图像生成评测 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.11236 2025-01-22 cs.CV cs.LG 57%

A New Formulation of Lipschitz Constrained With Functional Gradient Learning for GANs

Chang Wan, Ke Fan, Xinwei Sun, Yanwei Fu, Minglu Li, Yunliang Jiang, Zhonglong Zheng

专题命中 图像生成评测 :image generation(abstract);分类 cs.CV

Journal ref Machine learning 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18224 2024-12-25 cs.CV cs.AI 57%

Expand VSR Benchmark for VLLM to Expertize in Spatial Rules

Peijin Xie, Lin Sun, Bingquan Liu, Dexin Wang, Xiangzheng Zhang, Chengjie Sun, Jiajia Zhang

专题命中 图像生成评测 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10594 2024-12-17 cs.CV cs.LG 57%

Towards Unified Benchmark and Models for Multi-Modal Perceptual Metrics

Sara Ghazanfari, Siddharth Garg, Nicolas Flammarion, Prashanth Krishnamurthy, Farshad Khorrami, Francesco Croce

专题命中 图像生成评测 :generative vision(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09715 2024-12-16 cs.CV cs.CL 57%

Human vs. AI: A Novel Benchmark and a Comparative Study on the Detection of Generated Images and the Impact of Prompts

Philipp Moeßner, Heike Adel

专题命中 图像生成评测 :text-to-image(abstract);分类 cs.CV

Comments Accepted at Workshop on Detecting AI Generated Content (at COLING 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.01314 2024-12-13 cs.CV cs.LG 57%

Disentangling Mean Embeddings for Better Diagnostics of Image Generators

Sebastian G. Gruber, Pascal Tobias Ziegler, Florian Buettner

专题命中 图像生成评测 :image generation(abstract);分类 cs.CV

Comments Published at Interpretable AI: Past, Present and Future Workshop at NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04835 2024-12-09 cs.RO cs.AI cs.CV cs.LG 57%

Maximizing Alignment with Minimal Feedback: Efficiently Learning Rewards for Visuomotor Robot Policy Alignment

Ran Tian, Yilin Wu, Chenfeng Xu, Masayoshi Tomizuka, Jitendra Malik, Andrea Bajcsy

专题命中 图像生成评测 :diffusion(abstract);分类 cs.CV

Comments Submitted to IJRR, this paper is an extended journal version of the conference paper arXiv:2310.07932 with new results and discussion. arXiv admin note: substantial text overlap with arXiv:2310.07932

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01197 2024-12-04 cs.CV cs.AI 57%

InstantSwap: Fast Customized Concept Swapping across Sharp Shape Differences

Chenyang Zhu, Kai Li, Yue Ma, Longxiang Tang, Chengyu Fang, Chubin Chen, Qifeng Chen, Xiu Li

专题命中 图像生成评测 :text-to-image(abstract);分类 cs.CV

Comments Project Page: https://instantswap.github.io/. Github Page: https://github.com/chenyangzhu1/InstantSwap

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19246 2024-12-02 cs.CV 57%

Face2QR: A Unified Framework for Aesthetic, Face-Preserving, and Scannable QR Code Generation

Xuehao Cui, Guangyang Wu, Zhenghao Gan, Guangtao Zhai, Xiaohong Liu

专题命中 图像生成评测 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.19474 2024-11-26 cs.CV cs.CL 57%

Visual Riddles: a Commonsense and World Knowledge Challenge for Large Vision and Language Models

Nitzan Bitton-Guetta, Aviv Slobodkin, Aviya Maimon, Eliya Habba, Royi Rassin, Yonatan Bitton, Idan Szpektor, Amir Globerson, Yuval Elovici

专题命中 图像生成评测 :text-to-image(abstract);分类 cs.CV

Comments https://visual-riddles.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15584 2024-11-26 cs.CV cs.LG eess.IV 57%

FLD+: Data-efficient Evaluation Metric for Generative Models

Pranav Jeevan, Neeraj Nixon, Amit Sethi

专题命中 图像生成评测 :diffusion(abstract);分类 cs.CV

Comments 13 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.01294 2024-11-25 cs.CV eess.IV 57%

CE-VAE: Capsule Enhanced Variational AutoEncoder for Underwater Image Enhancement

Rita Pucci, Niki Martinel

专题命中 图像生成评测 :image generation(abstract);分类 cs.CV

Comments Accepted for publication at IEEE/CVF Winter Conference on Applications of Computer Vision (WACV)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.13503 2024-11-21 cs.CV 57%

VBench++: Comprehensive and Versatile Benchmark Suite for Video Generative Models

Ziqi Huang, Fan Zhang, Xiaojie Xu, Yinan He, Jiashuo Yu, Ziyue Dong, Qianli Ma, Nattapol Chanpaisit, Chenyang Si, Yuming Jiang, Yaohui Wang, Xinyuan Chen, Ying-Cong Chen, Limin Wang, Dahua Lin, Yu Qiao, Ziwei Liu

专题命中 图像生成评测 :image generation(abstract);分类 cs.CV

Comments Leaderboard: https://huggingface.co/spaces/Vchitect/VBench_Leaderboard Code: https://github.com/Vchitect/VBench Project page: https://vchitect.github.io/VBench-project/ extension of arXiv:2311.17982. arXiv admin note: substantial text overlap with arXiv:2311.17982

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08982 2024-11-20 cs.CV 57%

Deep Generative Classification of Blood Cell Morphology

Simon Deltadahl, Julian Gilbey, Christine Van Laer, Nancy Boeckx, Mathie Leers, Tanya Freeman, Laura Aiken, Timothy Farren, Matthew Smith, Mohamad Zeina, BloodCounts consortium, James HF Rudd, Concetta Piazzese, Joseph Taylor, Nicholas Gleadall, Carola-Bibiane Schönlieb, Suthesh Sivapalaratnam, Michael Roberts, Parashkev Nachev

专题命中 图像生成评测 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07539 2024-11-13 cs.MM 57%

Harmonizing Pixels and Melodies: Maestro-Guided Film Score Generation and Composition Style Transfer

F. Qi, L. Ni, C. Xu

专题命中 图像生成评测 :diffusion(abstract);分类 cs.MM

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07229 2024-11-12 cs.CV 57%

Learning from Limited and Imperfect Data

Harsh Rangwani

专题命中 图像生成评测 :image generation(abstract);分类 cs.CV

Comments ICVGIP'24 Young Researcher Symposium Abstract

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.13495 2024-11-01 cs.CV 57%

DF40: Toward Next-Generation Deepfake Detection

Zhiyuan Yan, Taiping Yao, Shen Chen, Yandan Zhao, Xinghe Fu, Junwei Zhu, Donghao Luo, Chengjie Wang, Shouhong Ding, Yunsheng Wu, Li Yuan

专题命中 图像生成评测 :image synthesis(abstract);分类 cs.CV

Comments arXiv admin note: text overlap with arXiv:2108.05080 by other authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.19825 2024-10-29 cs.CV 57%

Automating Video Thumbnails Selection and Generation with Multimodal and Multistage Analysis

Elia Fantini

专题命中 图像生成评测 :diffusion(abstract);分类 cs.CV

Comments 150 pages, 60 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19830 2024-10-25 cs.CV 57%

GameLabel-10K: Collecting Image Preference Data Through Mobile Game Crowdsourcing

Jonathan Zhou

专题命中 图像生成评测 :diffusion(abstract);分类 cs.CV

Comments 7 pages, 7 images

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14965 2024-10-22 eess.IV cs.CV 57%

Non-Invasive to Invasive: Enhancing FFA Synthesis from CFP with a Benchmark Dataset and a Novel Network

Hongqiu Wang, Zhaohu Xing, Weitong Wu, Yijun Yang, Qingqing Tang, Meixia Zhang, Yanwu Xu, Lei Zhu

专题命中 图像生成评测 :diffusion(abstract);分类 cs.CV

Comments ACMMM 24 MCHM

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.04993 2024-10-02 cs.CV cs.AI cs.CL 57%

LAViTeR: Learning Aligned Visual and Textual Representations Assisted by Image and Caption Generation

Mohammad Abuzar Hashemi, Zhanghexuan Li, Mihir Chauhan, Yan Shen, Abhishek Satbhai, Mir Basheer Ali, Mingchen Gao, Sargur Srihari

专题命中 图像生成评测 :image synthesis(abstract);分类 cs.CV

Comments 15 pages, 10 Figures, 5 Tables. Accepted for Oral Presentation at Irish Machine Vision and Image Processing Conference Proceedings (IMVIP), 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19436 2024-10-01 cs.CV 57%

Introducing SDICE: An Index for Assessing Diversity of Synthetic Medical Datasets

Mohammed Talha Alam, Raza Imam, Mohammad Areeb Qazi, Asim Ukaye, Karthik Nandakumar

专题命中 图像生成评测 :image generation(abstract);分类 cs.CV

Comments Accepted at BMVC 2024 - PFATCV

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.18314 2024-09-30 cs.LG cs.CL cs.CV 57%

Realistic Evaluation of Model Merging for Compositional Generalization

Derek Tam, Yash Kant, Brian Lester, Igor Gilitschenski, Colin Raffel

专题命中 图像生成评测 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.02003 2024-09-30 cs.CV 57%

GenFace: A Large-Scale Fine-Grained Face Forgery Benchmark and Cross Appearance-Edge Learning

Yaning Zhang, Zitong Yu, Tianyi Wang, Xiaobin Huang, Linlin Shen, Zan Gao, Jianfeng Ren

专题命中 图像生成评测 :diffusion(abstract);分类 cs.CV

Comments Accepted by IEEE Transactions on Information Forensics and Security

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.12827 2024-09-25 cs.CV 57%

Video Instance Shadow Detection Under the Sun and Sky

Zhenghao Xing, Tianyu Wang, Xiaowei Hu, Haoran Wu, Chi-Wing Fu, Pheng-Ann Heng

专题命中 图像生成评测 :inpainting(abstract);分类 cs.CV

Comments Accepted by IEEE Transactions on Image Processing (IEEE TIP)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14888 2024-09-24 cs.CV 57%

Advancing Video Quality Assessment for AIGC

Xinli Yue, Jianhui Sun, Han Kong, Liangchao Yao, Tianyi Wang, Lei Li, Fengyun Rao, Jing Lv, Fan Xia, Yuetang Deng, Qian Wang, Lingchen Zhao

专题命中 图像生成评测 :image generation(abstract);分类 cs.CV

Comments 5 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.08453 2024-09-24 cs.CV 57%

Better Fit: Accommodate Variations in Clothing Types for Virtual Try-on

Dan Song, Xuanpu Zhang, Jianhao Zeng, Pengxin Zhan, Qingguo Chen, Weihua Luo, An-An Liu

专题命中 图像生成评测 :inpainting(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.04777 2024-09-19 eess.IV cs.CV 57%

Deep Learning-based Unsupervised Domain Adaptation via a Unified Model for Prostate Lesion Detection Using Multisite Bi-parametric MRI Datasets

Hao Li, Han Liu, Heinrich von Busch, Robert Grimm, Henkjan Huisman, Angela Tong, David Winkel, Tobias Penzkofer, Ivan Shabunin, Moon Hyung Choi, Qingsong Yang, Dieter Szolar, Steven Shea, Fergus Coakley, Mukesh Harisinghani, Ipek Oguz, Dorin Comaniciu, Ali Kamen, Bin Lou

专题命中 图像生成评测 :diffusion(abstract);分类 cs.CV

Comments Accept at Radiology: Artificial Intelligence. Journal reference and external DOI will be added once published

Journal ref Radiology: Artificial Intelligence 2024;6(5):e230521

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.12371 2024-09-12 cs.CV cs.AI 57%

HIMO: A New Benchmark for Full-Body Human Interacting with Multiple Objects

Xintao Lv, Liang Xu, Yichao Yan, Xin Jin, Congsheng Xu, Shuwen Wu, Yifan Liu, Lincheng Li, Mengxiao Bi, Wenjun Zeng, Xiaokang Yang

专题命中 图像生成评测 :diffusion(abstract);分类 cs.CV

Comments Project page: https://lvxintao.github.io/himo, accepted by ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏