Qffusion: Controllable Portrait Video Editing via Quadrant-Grid Attention Learning
机构 * International Digital Economy Academy (IDEA)(国际数字经济学院)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
Comments 19 pages
Journal ref TVCG 2025
AI 大模型
视频理解、视频生成、视频语言模型和时序视觉推理。
机构 * International Digital Economy Academy (IDEA)(国际数字经济学院)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
Comments 19 pages
Journal ref TVCG 2025
机构 * School of Computer Science, Wuhan University(武汉大学计算机学院) ; Wuhan National Laboratory for Optoelectronics, Huazhong University of Science and Technology(华中科技大学光电研究院) ; Meta Reality Lab(Meta现实实验室) ; Xi’an Jiao Tong University(西安交通大学) ; National University of Singapore(新加坡国立大学) ; The Department of Systems Hub, Hong Kong University of Science and Technology (Guangzhou)(香港科技大学系统枢纽部门(广州))
专题命中 视频生成 :video generation(abstract);分类 cs.CV
Comments ICCV 2025
机构 * CUHK(香港中文大学) ; HKUST(香港理工大学) ; Huawei Noah’s Ark Lab(华为诺亚实验室)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
Comments Project Page: https://flymin.github.io/magicdrive3d
机构 * The Hong Kong University of Science and Technology(香港科技大学) ; Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院) ; Li Auto ; BAAI(北京人工智能研究院)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
Comments Accepted at IEEE/RSJ IROS 2025
机构 * University of California, Berkeley(加州大学伯克利分校)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
Comments 10 pages, 3 figures, 3 tables
专题命中 视频生成 :video generation(abstract);分类 cs.CV
机构 * NVIDIA ; KAIST(韩国科学技术院)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
Comments Project website: https://research.nvidia.com/labs/dir/mamba-tokenizer/
机构 * Gaoling School of AI, Renmin University of China(中国人民大学人工智能学院) ; Tsinghua University(清华大学) ; Zhipu AI(智谱AI)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
机构 * Tsinghua University(清华大学) ; Manifold AI
专题命中 视频生成 :video generation(abstract);分类 cs.CV
Comments 17 pages
机构 * Seoul National University(首尔国立大学)
专题命中 视频生成 :text-to-video(abstract);分类 cs.CV
Comments 15 pages, 9 figures, 3 tables
机构 * ByteDance(字节跳动)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
Comments ICCV 2025, Homepage: https://omnihuman-lab.github.io/
机构 * Xi’an Jiaotong University(西安交通大学) ; Tsinghua University(清华大学) ; DAMO Academy, Alibaba Group(阿里云实验室) ; Chinese Academy of Sciences(中国科学院) ; National University of Singapore(新加坡国立大学)
专题命中 视频生成 :text-to-video(abstract);分类 cs.CV
Comments Codes: https://github.com/Should-AI-Lab/GRID
专题命中 视频生成 :video generation(abstract);分类 cs.CV
机构 * HKUST(香港科技大学) ; Microsoft Research(微软研究院) ; University of Sydney(悉尼大学) ; Tsinghua University(清华大学) ; University of Waterloo(滑铁卢大学)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
Comments Project page: https://wenqsun.github.io/RealPlay/
机构 * The University of Hong Kong(香港大学) ; Kuaishou Technology(快手科技) ; Microsoft Research(微软研究院) ; Tsinghua University(清华大学)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
Comments Project Page: https://filmaster-ai.github.io/
机构 * Skywork AI
专题命中 视频生成 :video generation(abstract);分类 cs.CV
Comments Technical Report
机构 * Advanced Micro Devices Inc.(先进微器件公司) ; Dalian University of Technology(大连理工大学) ; Tsinghua University(清华大学)
专题命中 视频生成 :text-to-video(abstract);分类 cs.CV
Comments Code: https://github.com/AMD-AIG-AIMA/ReNeg
机构 * Tsinghua University(清华大学) ; ByteDance Seed(字节跳动种子)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
Comments project page: https://a-suozhang.xyz/paroattn.github.io
机构 * University of Science and Technology of China(中国科学技术大学)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
专题命中 视频生成 :video generation(abstract);分类 cs.CV
Comments Only the core contributors are listed. The full list of contributors can be found in Appendix A of this paper
机构 * University of Maryland, College Park(马里兰大学 College Park 分校)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
Comments ICLR 2025. Project page: https://hywang66.github.io/larp/
机构 * Tsinghua University(清华大学) ; ARC Lab, Tencent PCG(腾讯ARC实验室)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
Comments ICML 2025; GitHub: https://github.com/wangjiangshan0725/RF-Solver-Edit
机构 * Department of Automation, Tsinghua University, China(自动化系,清华大学) ; Department of Electronic Engineering, Tsinghua University, China(电子工程系,清华大学)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
专题命中 视频生成 :video generation(abstract);分类 cs.CV
Comments Technical report website: mirage.app/research/seeing-voices, product website: mirage.app
机构 * KAIST AI(韩国科学技术院人工智能研究所) ; University of Seoul(首尔大学)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
机构 * Department of Computer Science, Tsinghua University(清华大学计算机科学系)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
机构 * HKUST(香港科技大学) ; HKUST(GZ)(香港科技大学(广州)) ; NUS(国立新加坡大学) ; Tsinghua Univerisity(清华大学) ; CUHK(香港中文大学)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
Comments Project Page: https://follow-your-creation.github.io/
机构 * School of Software Engineering, South China University of Technology(华南理工大学软件工程学院) ; Department of Automation, Tsinghua University(清华大学自动化系) ; School of Artificial Intelligence, Beijing Normal University(北京师范大学人工智能学院)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
机构 * The organizers of the NTIRE 2025 XGC Quality Challenge(NTIRE 2025 XGC质量评估挑战的组织者)
专题命中 视频生成 :text-to-video(abstract);分类 cs.CV
Comments NTIRE 2025 XGC Quality Assessment Challenge Report. arXiv admin note: text overlap with arXiv:2404.16687
机构 * The University of Hong Kong(香港大学) ; Tsinghua University(清华大学) ; Duke University(杜克大学) ; University of Rochester(罗切斯特大学) ; The Ohio State University(俄亥俄州立大学) ; Bytedance(字节跳动) ; The University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) ; Apple(苹果公司) ; The Hong Kong Polytechnic University(香港理工大学) ; Princeton University(普林斯顿大学)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
Comments The paper is accepted by TMLR