POSTA: A Go-to Framework for Customized Artistic Poster Generation
专题命中 多模态生成 :multimodal(abstract);MLLM(abstract);分类 cs.CV、cs.AI
Comments Accepted to CVPR 2025
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 多模态生成 :multimodal(abstract);MLLM(abstract);分类 cs.CV、cs.AI
Comments Accepted to CVPR 2025
专题命中 多模态生成 :multi-modal(abstract);cross-modal(abstract);分类 cs.CV、cs.MM
Comments 20 pages, 16 figures
专题命中 多模态生成 :multi-modal(abstract);audio-visual(abstract);分类 cs.MM、eess.AS
专题命中 多模态生成 :multimodal(abstract);image-text(abstract);分类 cs.CV、cs.MM
Comments Accepted to APSIPA ASC 2024
专题命中 多模态生成 :multimodal(abstract);multi-modal(abstract);分类 cs.CV、cs.CL
专题命中 多模态生成 :multimodal(abstract);MLLM(abstract);分类 cs.CV、cs.AI
专题命中 多模态生成 :multimodal(abstract);multi-modal(abstract);分类 cs.CV、cs.AI
Comments 9 pages,7 figures
Journal ref NeurIPS 2024
专题命中 多模态生成 :multi-modal(abstract);cross-modal(abstract);分类 cs.MM、eess.AS
Comments NeurIPS 2024
专题命中 多模态生成 :multi-modal(abstract);MLLM(abstract);分类 cs.CV、cs.AI
专题命中 多模态生成 :multimodal(abstract);multi-modal(abstract);分类 cs.CV、cs.AI
专题命中 多模态生成 :multimodal(abstract);multi-modal(abstract);分类 cs.CV、cs.AI
Comments Accepted by European Conference on Computer Vision (ECCV) 2024 workshop on VCAD
专题命中 多模态生成 :multimodal(abstract);image-text(abstract);分类 cs.CV、cs.CL
Comments ECCV 2024
专题命中 多模态生成 :cross-modal(abstract);image-text(abstract);分类 cs.CV、cs.CL
Comments First five authors contributed equally
专题命中 多模态生成 :multi-modal(abstract);image-text(abstract);分类 cs.CV、cs.CL
专题命中 多模态生成 :multi-modal(abstract);image-text(abstract);分类 cs.CV、cs.AI
Comments 9 pages, 6 figures
专题命中 多模态生成 :multimodal(abstract);cross-modal(abstract);分类 cs.CV、cs.AI
专题命中 多模态生成 :multimodal(abstract);image-text(abstract);分类 cs.CV、cs.CL
Comments Project page: https://eclipse-t2i.github.io/Lambda-ECLIPSE/
专题命中 多模态生成 :multimodal(abstract);MLLM(abstract);分类 cs.CV、cs.AI
专题命中 多模态生成 :multimodal(abstract);multi-modal(abstract);分类 cs.CV、cs.CL
Comments Working in Process
专题命中 多模态生成 :cross-modal(abstract);image-text(abstract);分类 cs.CV、cs.MM
专题命中 多模态生成 :multimodal(abstract);multimodal foundation model(abstract);分类 cs.CV、cs.AI
Comments added the investigation of Gemini. 66 pages, 41 figures
专题命中 多模态生成 :multimodal(abstract);cross-modal(abstract);分类 cs.CV、cs.AI
专题命中 多模态生成 :multi-modal(abstract);MLLM(abstract);分类 cs.CV、cs.CL
Comments 51 pages, 36 figures, Repository: https://github.com/hkust-vgd/Marine_GPT-4V_Eval
专题命中 多模态生成 :multimodal(abstract);multimodal foundation model(abstract);分类 cs.CV、cs.CL
专题命中 多模态生成 :multi-modal(abstract);audio-visual(abstract);分类 cs.CV、eess.AS
Comments Tech Report
专题命中 多模态生成 :multimodal(abstract);multi-modal(abstract);分类 cs.CV、cs.CL
专题命中 多模态生成 :multimodal(abstract);image-text(abstract);分类 cs.CV、cs.CL
Comments CVPR 2023
专题命中 多模态生成 :multi-modal(abstract);image-text(abstract);分类 cs.CV、cs.AI
Comments 9 pages
专题命中 多模态生成 :multi-modal(abstract);image-text(abstract);分类 cs.CV、cs.AI
Comments CVPR 2022. 13 pages. Website: https://ajayj.com/dreamfields
专题命中 多模态生成 :multimodal(abstract);multi-modal(abstract);分类 cs.CV、cs.MM
Comments arXiv admin note: substantial text overlap with arXiv:2012.03308