AV-DiT: Efficient Audio-Visual Diffusion Transformer for Joint Audio and Video Generation
专题命中 多模态生成 :audio-visual(title,abstract);multimodal(abstract);分类 cs.CV
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 多模态生成 :audio-visual(title,abstract);multimodal(abstract);分类 cs.CV
专题命中 多模态生成 :multi-modal(title,abstract);cross-modal(abstract);分类 cs.CL
专题命中 多模态生成 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments ACL 2024 (Findings)
专题命中 多模态生成 :MLLM(title,abstract);multimodal(abstract);分类 cs.AI
Comments Accepted to workshop on ReGenAI@CVPR 2024
专题命中 多模态生成 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV
Comments Accepted by ICML 2024
专题命中 多模态生成 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV
专题命中 多模态生成 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV
Comments AAAI2024
专题命中 多模态生成 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV
Comments Project page: https://yuzhou914.github.io/SmartEdit/
专题命中 多模态生成 :multi-modal(title,abstract);multimodal(abstract);分类 cs.AI
专题命中 多模态生成 :multimodal(title,abstract);image-text(abstract);分类 cs.CV
Comments Project page: https://jerryxu.net/IMProv
专题命中 多模态生成 :cross-modal(title,abstract);image-text(abstract);分类 cs.CV
专题命中 多模态生成 :multi-modal(title,abstract);multimodal(abstract);分类 cs.CV
专题命中 多模态生成 :multi-modal(title,abstract);multimodal(abstract);分类 cs.CV
Comments 10 pages
专题命中 多模态生成 :cross-modal(title,abstract);multi-modal(abstract);分类 cs.CV
Comments Technical report. Project page: https://dediffusion.github.io
专题命中 多模态生成 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV
Comments Accepted by ACMMM'23
专题命中 多模态生成 :cross-modal(title,abstract);image-text(abstract);分类 cs.CV
Comments ICCV2023
专题命中 多模态生成 :image-text(title,abstract);multi-modal(abstract);分类 cs.CV
Comments Project Website: https://neuralcarver.github.io/michelangelo
专题命中 多模态生成 :multi-modal(title,abstract);audio-visual(abstract);分类 cs.CV
专题命中 多模态生成 :cross-modal(title,abstract);multi-modal(abstract);分类 cs.CV
专题命中 多模态生成 :multi-modal(title,abstract);image-text(abstract);分类 cs.CV
Comments Accepted to ICML2023
专题命中 多模态生成 :multi-modal(title,abstract);cross-modal(abstract);分类 cs.CV
Comments Accepted by CVPR 2023
专题命中 多模态生成 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
专题命中 多模态生成 :cross-modal(title,abstract);multimodal(abstract);分类 cs.CV
Comments ICLR 2023. Project at https://github.com/L-YeZhu/CDCD
专题命中 多模态生成 :multimodal(title,abstract);cross-modal(abstract);分类 cs.AI
Comments First Submission
专题命中 多模态生成 :cross-modal(title,abstract);multi-modal(abstract);分类 cs.CV
专题命中 多模态生成 :multi-modal(title,abstract);cross-modal(abstract);分类 cs.CV
专题命中 多模态生成 :cross-modal(title,abstract);image-text(abstract);分类 cs.CV
Comments CVPR 2021
专题命中 多模态生成 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments Accepted to ACL 2022 Main Conference
专题命中 多模态生成 :multimodal(title,abstract);cross-modal(abstract);分类 cs.MM
Comments To appear in MM 2021 industrial track (long paper)
专题命中 多模态生成 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CL
Comments 12 pages, technical report. Extension of paper "M6" accepted to KDD 2021