arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 1204 信号源:cs.CV, cs.GR, cs.MM

1. 图像生成评测 1204 篇

2407.14944 2024-09-11 cs.CV 57%

Automatic Generation of Fashion Images using Prompting in Generative Machine Learning Models

Georgia Argyrou, Angeliki Dimitriou, Maria Lymperaiou, Giorgos Filandrianos, Giorgos Stamou

专题命中 图像生成评测 :diffusion(abstract);分类 cs.CV

Journal ref ECCVW 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.05965 2024-09-10 cs.CV cs.AI cs.CL cs.CR cs.LG 57%

T2VSafetyBench: Evaluating the Safety of Text-to-Video Generative Models

Yibo Miao, Yifan Zhu, Yinpeng Dong, Lijia Yu, Jun Zhu, Xiao-Shan Gao

专题命中 图像生成评测 :text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08459 2024-08-22 cs.CL cs.CV cs.LG 57%

JPEG-LM: LLMs as Image Generators with Canonical Codec Representations

Xiaochuang Han, Marjan Ghazvininejad, Pang Wei Koh, Yulia Tsvetkov

专题命中 图像生成评测 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08412 2024-08-19 cs.CV 57%

Penny-Wise and Pound-Foolish in Deepfake Detection

Yabin Wang, Zhiwu Huang, Su Zhou, Adam Prugel-Bennett, Xiaopeng Hong

专题命中 图像生成评测 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.03695 2024-08-08 cs.CV 57%

Openstory++: A Large-scale Dataset and Benchmark for Instance-aware Open-domain Visual Storytelling

Zilyu Ye, Jinxiu Liu, Ruotian Peng, Jinjin Cao, Zhiyang Chen, Yiyang Zhang, Ziwei Xuan, Mingyuan Zhou, Xiaoqian Shen, Mohamed Elhoseiny, Qi Liu, Guo-Jun Qi

专题命中 图像生成评测 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.04492 2024-08-07 cs.CV cs.CL 57%

ColorSwap: A Color and Word Order Dataset for Multimodal Evaluation

Jirayu Burapacheep, Ishan Gaur, Agam Bhatia, Tristan Thrush

专题命中 图像生成评测 :image generation(abstract);分类 cs.CV

Comments ACL Findings 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.01723 2024-08-06 cs.CV cs.IR 57%

A Novel Evaluation Framework for Image2Text Generation

Jia-Hong Huang, Hongyi Zhu, Yixian Shen, Stevan Rudinac, Alessio M. Pacces, Evangelos Kanoulas

专题命中 图像生成评测 :image generation(abstract);分类 cs.CV

Comments The paper has been accepted for presentation at the 47th International ACM SIGIR Conference on Research and Development in Information Retrieval, specifically in the Large Language Model for Evaluation in IR (LLM4Eval) Workshop in 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.00096 2024-08-02 cs.CV cs.AI 57%

From Attributes to Natural Language: A Survey and Foresight on Text-based Person Re-identification

Fanzhi Jiang, Su Yang, Mark W. Jones, Liumei Zhang

专题命中 图像生成评测 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.15587 2024-07-30 cs.CV 57%

Composed Image Retrieval for Remote Sensing

Bill Psomas, Ioannis Kakogeorgiou, Nikos Efthymiadis, Giorgos Tolias, Ondrej Chum, Yannis Avrithis, Konstantinos Karantzalos

专题命中 图像生成评测 :text-to-image(abstract);分类 cs.CV

Comments Accepted for ORAL presentation at the 2024 IEEE International Geoscience and Remote Sensing Symposium

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.14897 2024-07-29 cs.CV eess.IV math.DG 57%

Geometric Generative Models based on Morphological Equivariant PDEs and GANs

El Hadji S. Diop, Thierno Fall, Alioune Mbengue, Mohamed Daoudi

专题命中 图像生成评测 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.16124 2024-07-24 cs.CV 57%

Fréchet Video Motion Distance: A Metric for Evaluating Motion Consistency in Videos

Jiahe Liu, Youran Qu, Qi Yan, Xiaohui Zeng, Lele Wang, Renjie Liao

专题命中 图像生成评测 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.13442 2024-07-19 cs.CV cs.CL 57%

BEAF: Observing BEfore-AFter Changes to Evaluate Hallucination in Vision-language Models

Moon Ye-Bin, Nam Hyeon-Woo, Wonseok Choi, Tae-Hyun Oh

专题命中 图像生成评测 :image editing(abstract);分类 cs.CV

Comments Accepted at ECCV 2024. [Project Pages] https://beafbench.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.17261 2024-07-18 cs.CV cs.AI 57%

Attribute Based Interpretable Evaluation Metrics for Generative Models

Dongkyun Kim, Mingi Kwon, Youngjung Uh

专题命中 图像生成评测 :diffusion(abstract);分类 cs.CV

Comments Accepted to ICML2024, code: github.com/notou10/sadpad

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.09172 2024-07-15 cs.AI cs.CV 57%

Machine Apophenia: The Kaleidoscopic Generation of Architectural Images

Alexey Tikhonov, Dmitry Sinyavin

专题命中 图像生成评测 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.01942 2024-07-03 cs.AI cs.CL cs.CV 57%

Certainly Uncertain: A Benchmark and Metric for Multimodal Epistemic and Aleatoric Awareness

Khyathi Raghavi Chandu, Linjie Li, Anas Awadalla, Ximing Lu, Jae Sung Park, Jack Hessel, Lijuan Wang, Yejin Choi

专题命中 图像生成评测 :inpainting(abstract);分类 cs.CV

Comments 26 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.14566 2024-06-24 cs.CV cs.AI 57%

LM-IGTD: a 2D image generator for low-dimensional and mixed-type tabular data to leverage the potential of convolutional neural networks

Vanesa Gómez-Martínez, Francisco J. Lara-Abelenda, Pablo Peiro-Corbacho, David Chushig-Muzo, Conceicao Granja, Cristina Soguero-Ruiz

专题命中 图像生成评测 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.12671 2024-06-24 cs.CV 57%

GeoBench: Benchmarking and Analyzing Monocular Geometry Estimation Models

Yongtao Ge, Guangkai Xu, Zhiyue Zhao, Libo Sun, Zheng Huang, Yanlong Sun, Hao Chen, Chunhua Shen

专题命中 图像生成评测 :diffusion(abstract);分类 cs.CV

Comments Code and Benchmark are available at: https://github.com/aim-uofa/GeoBench

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.14477 2024-06-21 cs.CV cs.AI cs.DB 57%

SafeSora: Towards Safety Alignment of Text2Video Generation via a Human Preference Dataset

Josef Dai, Tianle Chen, Xuyao Wang, Ziran Yang, Taiye Chen, Jiaming Ji, Yaodong Yang

专题命中 图像生成评测 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.07315 2024-06-18 cs.IR cs.CV 57%

Fetch-A-Set: A Large-Scale OCR-Free Benchmark for Historical Document Retrieval

Adrià Molina, Oriol Ramos Terrades, Josep Lladós

专题命中 图像生成评测 :text-to-image(abstract);分类 cs.CV

Comments Preprint for the manuscript accepted for publication in the DAS2024 LNCS proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.13636 2024-06-18 cs.CV cs.CL cs.CY 57%

A Unified Framework and Dataset for Assessing Societal Bias in Vision-Language Models

Ashutosh Sathe, Prachi Jain, Sunayana Sitaram

专题命中 图像生成评测 :text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.06496 2024-06-18 cs.LG cs.CL cs.CV 57%

Direct Preference Optimization for Suppressing Hallucinated Prior Exams in Radiology Report Generation

Oishi Banerjee, Hong-Yu Zhou, Subathra Adithan, Stephen Kwak, Kay Wu, Pranav Rajpurkar

专题命中 图像生成评测 :generative vision(abstract);分类 cs.CV

Comments Added acknowledgemnts

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10227 2024-06-17 cs.CV cs.AI 57%

VideoGUI: A Benchmark for GUI Automation from Instructional Videos

Kevin Qinghong Lin, Linjie Li, Difei Gao, Qinchen WU, Mingyi Yan, Zhengyuan Yang, Lijuan Wang, Mike Zheng Shou

专题命中 图像生成评测 :diffusion(abstract);分类 cs.CV

Comments 24 pages, 16 tables, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.09601 2024-06-17 cs.CV 57%

Turns Out I'm Not Real: Towards Robust Detection of AI-Generated Videos

Qingyuan Liu, Pengyuan Shi, Yun-Yun Tsai, Chengzhi Mao, Junfeng Yang

专题命中 图像生成评测 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.08656 2024-06-14 cs.CV cs.AI cs.CL 57%

TC-Bench: Benchmarking Temporal Compositionality in Text-to-Video and Image-to-Video Generation

Weixi Feng, Jiachen Li, Michael Saxon, Tsu-jui Fu, Wenhu Chen, William Yang Wang

专题命中 图像生成评测 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.04923 2024-06-11 cs.CV cs.AI 57%

Learning to Evaluate the Artness of AI-generated Images

Junyu Chen, Jie An, Hanjia Lyu, Christopher Kanan, Jiebo Luo

专题命中 图像生成评测 :image generation(abstract);分类 cs.CV

Comments Published in IEEE Transactions on Multimedia

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.20112 2024-05-31 cs.CV 57%

RIGID: A Training-free and Model-Agnostic Framework for Robust AI-Generated Image Detection

Zhiyuan He, Pin-Yu Chen, Tsung-Yi Ho

专题命中 图像生成评测 :image generation(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.01485 2024-05-28 stat.ML cs.CV cs.LG 57%

Approximations to the Fisher Information Metric of Deep Generative Models for Out-Of-Distribution Detection

Sam Dauncey, Chris Holmes, Christopher Williams, Fabian Falck

专题命中 图像生成评测 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.09426 2024-05-17 cs.CV 57%

Global-Local Image Perceptual Score (GLIPS): Evaluating Photorealistic Quality of AI-Generated Images

Memoona Aziz, Umair Rehman, Muhammad Umair Danish, Katarina Grolinger

专题命中 图像生成评测 :image generation(abstract);分类 cs.CV

Comments 10 pages, 3 figures. Submitted to IEEE Transactions on Human-Machine Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.04133 2024-05-08 cs.CV 57%

Exposing AI-generated Videos: A Benchmark Dataset and a Local-and-Global Temporal Defect Based Detection Method

Peisong He, Leyao Zhu, Jiaxing Li, Shiqi Wang, Haoliang Li

专题命中 图像生成评测 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.03803 2024-05-08 cs.CV 57%

MoDiPO: text-to-motion alignment via AI-feedback-driven Direct Preference Optimization

Massimiliano Pappa, Luca Collorone, Giovanni Ficarra, Indro Spinelli, Fabio Galasso

专题命中 图像生成评测 :diffusion(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏