arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

共收录 86585 信号源:cs.CV, cs.GR, cs.MM

1. 文生图 3480 篇

2407.04542 2024-07-08 cs.NI cs.CV cs.LG eess.IV 57%

Rethinking Image Compression on the Web with Generative AI

Shayan Ali Hassan, Danish Humair, Ihsan Ayyub Qazi, Zafar Ayyub Qazi

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.04032 2024-07-04 cs.CV cs.LG 57%

A Systematic Performance Analysis of Deep Perceptual Loss Networks: Breaking Transfer Learning Conventions

Gustav Grund Pihlgren, Konstantina Nikolaidou, Prakash Chandra Chhipa, Nosheen Abid, Rajkumar Saini, Fredrik Sandin, Marcus Liwicki

专题命中 文生图 :image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.16884 2024-07-03 cs.CV 57%

Instant Photorealistic Neural Radiance Fields Stylization

Shaoxu Li, Ye Pan

专题命中 文生图 :image synthesis(abstract);分类 cs.CV

Comments Accepted by ICASSP2024. Code: https://github.com/lishaoxu1994/Instant-NeRF-Stylization

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.01886 2024-06-27 cs.CV 57%

InstructTA: Instruction-Tuned Targeted Attack for Large Vision-Language Models

Xunguang Wang, Zhenlan Ji, Pingchuan Ma, Zongjie Li, Shuai Wang

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.14683 2024-06-18 cs.CV cs.AI cs.LG 57%

Visual Hallucinations of Multi-modal Large Language Models

Wen Huang, Hongbin Liu, Minxin Guo, Neil Zhenqiang Gong

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

Comments To appear in ACL Findings, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.08141 2024-06-18 cs.AI cs.CV cs.HC cs.LG 57%

ArtWhisperer: A Dataset for Characterizing Human-AI Interactions in Artistic Creations

Kailas Vodrahalli, James Zou

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

Comments 31 pages, 27 figures, ICML 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.09356 2024-06-14 cs.CV eess.IV 57%

CMC-Bench: Towards a New Paradigm of Visual Signal Compression

Chunyi Li, Xiele Wu, Haoning Wu, Donghui Feng, Zicheng Zhang, Guo Lu, Xiongkuo Min, Xiaohong Liu, Guangtao Zhai, Weisi Lin

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.07450 2024-06-12 cs.CV cs.LG 57%

Benchmarking Vision-Language Contrastive Methods for Medical Representation Learning

Shuvendu Roy, Yasaman Parhizkar, Franklin Ogidi, Vahid Reza Khazaie, Michael Colacci, Ali Etemad, Elham Dolatabadi, Arash Afkanpour

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.15734 2024-06-12 cs.CV 57%

LM4LV: A Frozen Large Language Model for Low-level Vision Tasks

Boyang Zheng, Jinjin Gu, Shijun Li, Chao Dong

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.02889 2024-06-06 cs.CV 57%

Language-guided Detection and Mitigation of Unknown Dataset Bias

Zaiying Zhao, Soichiro Kumano, Toshihiko Yamasaki

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09092 2024-05-30 cs.GR 57%

InverseVis: Revealing the Hidden with Curved Sphere Tracing

Kai Lawonn, Monique Meuschke, Tobias Günther

专题命中 文生图 :image synthesis(abstract);分类 cs.GR

Comments Eurographics Conference on Visualization (EuroVis)

Journal ref Computer Graphics Forum, volume 43, number 3, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.12985 2024-05-24 cs.HC cs.AI cs.CV 57%

Sketch2Prototype: Rapid Conceptual Design Exploration and Prototyping with Generative AI

Kristen M. Edwards, Brandon Man, Faez Ahmed

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

Comments 10 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.05363 2024-05-10 cs.CV cs.RO 57%

LOC-ZSON: Language-driven Object-Centric Zero-Shot Object Retrieval and Navigation

Tianrui Guan, Yurou Yang, Harry Cheng, Muyuan Lin, Richard Kim, Rajasimman Madhivanan, Arnie Sen, Dinesh Manocha

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

Comments Accepted to ICRA 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.03190 2024-05-07 cs.CV 57%

Adapting Dual-encoder Vision-language Models for Paraphrased Retrieval

Jiacheng Cheng, Hijung Valentina Shin, Nuno Vasconcelos, Bryan Russell, Fabian Caba Heilbron

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.19752 2024-05-01 cs.CV 57%

Visual Fact Checker: Enabling High-Fidelity Detailed Caption Generation

Yunhao Ge, Xiaohui Zeng, Jacob Samuel Huffman, Tsung-Yi Lin, Ming-Yu Liu, Yin Cui

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

Comments CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.17255 2024-04-30 cs.CV 57%

SDFD: Building a Versatile Synthetic Face Image Dataset with Diverse Attributes

Georgia Baltsou, Ioannis Sarridis, Christos Koutlis, Symeon Papadopoulos

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.17498 2024-04-29 cs.CV 57%

Learning text-to-video retrieval from image captioning

Lucas Ventura, Cordelia Schmid, Gül Varol

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

Comments A short version of this work appeared at CVPR 2023 Workshops. Project page: https://imagine.enpc.fr/~ventural/multicaps/

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.15163 2024-04-24 cs.CV eess.IV 57%

Adaptive Mixed-Scale Feature Fusion Network for Blind AI-Generated Image Quality Assessment

Tianwei Zhou, Songbai Tan, Wei Zhou, Yu Luo, Yuan-Gen Wang, Guanghui Yue

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

Comments IEEE Transactions on Broadcasting (TBC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.14830 2024-04-24 cs.CV cs.AI 57%

CoProNN: Concept-based Prototypical Nearest Neighbors for Explaining Vision Models

Teodor Chiaburu, Frank Haußer, Felix Bießmann

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

Comments 24 pages, 9 figures, 2 tables, accepted at WCXAI 2024 Valletta

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.08703 2024-04-16 eess.IV cs.CV q-bio.NC 57%

Synthetic Brain Images: Bridging the Gap in Brain Mapping With Generative Adversarial Model

Drici Mourad, Kazeem Oluwakemi Oseni

专题命中 文生图 :image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.03407 2024-04-05 cs.CV 57%

AIGIQA-20K: A Large Database for AI-Generated Image Quality Assessment

Chunyi Li, Tengchuan Kou, Yixuan Gao, Yuqin Cao, Wei Sun, Zicheng Zhang, Yingjie Zhou, Zhichao Zhang, Weixia Zhang, Haoning Wu, Xiaohong Liu, Xiongkuo Min, Guangtao Zhai

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.03126 2024-04-05 eess.IV cs.CV 57%

GaSpCT: Gaussian Splatting for Novel CT Projection View Synthesis

Emmanouil Nikolakakis, Utkarsh Gupta, Jonathan Vengosh, Justin Bui, Razvan Marinescu

专题命中 文生图 :image synthesis(abstract);分类 cs.CV

Comments Under Review Process for MICCAI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.09228 2024-04-05 cs.CV 57%

3DGS-Avatar: Animatable Avatars via Deformable 3D Gaussian Splatting

Zhiyin Qian, Shaofei Wang, Marko Mihajlovic, Andreas Geiger, Siyu Tang

专题命中 文生图 :image synthesis(abstract);分类 cs.CV

Comments Project page: https://neuralbodies.github.io/3DGS-Avatar

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.19866 2024-04-04 cs.CV cs.AI 57%

Is Synthetic Image Useful for Transfer Learning? An Investigation into Data Generation, Volume, and Utilization

Yuhang Li, Xin Dong, Chen Chen, Jingtao Li, Yuxin Wen, Michael Spranger, Lingjuan Lyu

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

Comments ICLR24 Score 6865 https://openreview.net/forum?id=CjPt1AC6w0

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.15276 2024-04-04 cs.IR cs.AI cs.CV 57%

CFIR: Fast and Effective Long-Text To Image Retrieval for Large Corpora

Zijun Long, Xuri Ge, Richard Mccreadie, Joemon Jose

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.03587 2024-04-04 cs.CV 57%

Language-Informed Visual Concept Learning

Sharon Lee, Yunzhi Zhang, Shangzhe Wu, Jiajun Wu

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

Comments ICLR 2024. The first two authors contributed equally and are alphabetically ordered. Project page: https://ai.stanford.edu/~yzzhang/projects/concept-axes/

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00419 2024-04-02 cs.CV cs.CL 57%

Do Vision-Language Models Understand Compound Nouns?

Sonal Kumar, Sreyan Ghosh, S Sakshi, Utkarsh Tyagi, Dinesh Manocha

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

Comments Accepted to NAACL 2024 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.20231 2024-04-01 cs.CV 57%

U-VAP: User-specified Visual Appearance Personalization via Decoupled Self Augmentation

You Wu, Kean Liu, Xiaoyue Mi, Fan Tang, Juan Cao, Jintao Li

专题命中 文生图 :text-to-image(abstract);分类 cs.CV

Comments 14 pages, 13 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.20018 2024-04-01 eess.IV cs.CV 57%

SCINeRF: Neural Radiance Fields from a Snapshot Compressive Image

Yunhao Li, Xiaodong Wang, Ping Wang, Xin Yuan, Peidong Liu

专题命中 文生图 :image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.01705 2024-04-01 eess.IV cs.CV 57%

Cross-modal tumor segmentation using generative blending augmentation and self training

Guillaume Sallé, Pierre-Henri Conze, Julien Bert, Nicolas Boussion, Dimitris Visvikis, Vincent Jaouen

专题命中 文生图 :image synthesis(abstract);分类 cs.CV

详情

展开后加载摘要…

URL PDF HTML 收藏