Half-order Fine-Tuning for Diffusion Model: A Recursive Likelihood Ratio Optimizer
机构 * Peking University(北京大学)
专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV
AI 大模型
视频理解、视频生成、视频语言模型和时序视觉推理。
机构 * Peking University(北京大学)
专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV
机构 * Peking University(北京大学) ; OpenAI ; University of California, Los Angeles(加州大学洛杉矶分校) ; Carnegie Mellon University(卡内基梅隆大学) ; University of California at Merced(加州大学默塞德分校)
专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV
Comments 59 pages, 19 figures, citing 396 (up-to-date) papers, project: https://github.com/YangLing0818/Diffusion-Models-Papers-Survey-Taxonomy, accepted by ACM Computing Surveys
机构 * Zhejiang University(浙江大学) ; Damo Academy, Alibaba Group(阿里达摩院) ; Hupan Lab(虎斑实验室)
专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV
Comments 39th Conference on Neural Information Processing Systems (NeurIPS 2025)
机构 * Technical University of Munich(慕尼黑技术大学)
专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV
Comments Accepted to SIGGRAPH Asia 2025. Project page: see https://mschneider456.github.io/world-explorer, video: see https://youtu.be/N6NJsNyiv6I, code: https://github.com/mschneider456/WorldExplorer
机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) ; SpreeAI
专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV
Comments Project Page: https://immortalco.github.io/DressAndDance/
专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV
Comments Code: github.com/showlab/Ego-PM
机构 * Julian Ost(未知) ; Andrea Ramazzina(未知) ; Amogh Joshi(未知) ; Maximilian Bömer(未知) ; Mario Bijelic(未知) ; Felix Heide(未知)
专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV
Comments Project webpage: https://light.princeton.edu/LSD-3D
专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV
机构 * Zhipu AI(智谱AI)
专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV
Comments Accepted by ICCV 2025
机构 * Shanghai Jiao Tong University(上海交通大学) ; South China University of Technology(华南理工大学) ; Fudan University(复旦大学) ; Tsinghua University(清华大学) ; Hong Kong University of Science and Technology(香港科技大学)
专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV
专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV
机构 * Zhejiang University(浙江大学) ; Zhejiang University of Technology(浙江工业大学)
专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV
Comments Project webpage: https://aim-uofa.github.io/Tinker
机构 * CRCV, University of Central Florida(CRCV,中央佛罗里达大学)
专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV
机构 * S-Lab, Nanyang Technological University(南洋理工大学S实验室) ; Shanghai AI Laboratory(上海人工智能实验室)
专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV
Comments Project Page: https://4dnex.github.io/
机构 * Tsinghua University(清华大学) ; Zhejiang University(浙江大学) ; Shanghai Jiao Tong University(上海交通大学)
专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV
Comments Accept to ACMMM 2025
机构 * The University of Adelaide(阿德莱德大学) ; Zhejiang University(浙江大学) ; Alibaba Group(阿里巴巴集团) ; Zhejiang University of Technology(浙江工业大学)
专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV
Journal ref SIGGRAPH Conference Papers 2025
机构 * Shenzhen Campus of Sun Yat-sen University(中山大学深圳校区) ; Hong Kong University of Science and Technology(香港科学与技术大学) ; Mohamed bin Zayed University of Artificial Intelligence(马尔代夫 bin Zayed 人工智能大学) ; Lenovo Research(联想研究)
专题命中 视频扩散模型 :text-to-video(abstract);分类 cs.CV
Comments Accepted to ACM MM 2025
机构 * The University of Hong Kong(香港大学) ; Nanyang Technological University(南洋理工大学) ; Google DeepMind(谷歌DeepMind)
专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV
机构 * Department of Data Science & AI, Faculty of Information Technology, Monash University(数据科学与人工智能系,信息科技学院,墨尔本大学) ; Nanjing University of Posts and Telecommunications(南京邮电大学) ; Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
专题命中 视频扩散模型 :text-to-video(abstract);分类 cs.CV
Comments Project Page: https://maxin-cn.github.io/miramo_project
机构 * Shenzhen Graduate School, Peking University(北京大学深圳研究生院) ; GVC Lab, Great Bay University(大湾大学GVC实验室) ; ARC Lab, Tencent PCG(腾讯PCG ARC实验室) ; Rabbitpre Intelligence(Rabbitpre智能)
专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV
Comments 17 pages, 11 figures
机构 * Yonsei University(延世大学)
专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV
Comments 10 pages, 6 Figures, ICCV 2025
机构 * Tsinghua University(清华大学) ; ARC Lab, Tencent PCG(腾讯PCG实验室)
专题命中 视频扩散模型 :long video(abstract);分类 cs.CV
Comments Accepted by ICCV 2025; Project Homepage: https://yuejiangdong.github.io/depthsync
专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV
Comments ai security, 10pages, 5 figures
机构 * ByteDance Intelligent Creation(字节跳动智能创作)
专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV
Comments 18 pages, 12 figures
机构 * Spotify, UK(英国Spotify)
专题命中 视频扩散模型 :video generation(abstract);分类 cs.CV
机构 * State Key Laboratory of General Artificial Intelligence, Peking University(北京大学通用人工智能国家重点实验室) ; State Key Laboratory of General Artificial Intelligence, BIGAI(BIGAI 通用人工智能国家重点实验室) ; Tsinghua University(清华大学)
专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV
Comments Accepted by ICCV 2025.Project page: https://jason-aplp.github.io/TACO
机构 * Faculty of Science and Engineering(科学与工程学部) ; RPTU Kaiserslautern-Landau & DFKI GmbH(科隆-兰道大学与DFKI GmbH)
专题命中 视频扩散模型 :text-to-video(abstract);分类 cs.CV
Comments Accepted to CVPR2025(Highlight). Code at: https://github.com/ryugo417/TKG-DM
机构 * Shanghai Jiao Tong University(上海交通大学) ; Tianjin University(天津大学) ; Communication University of China(中国通信大学)
专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV
机构 * National Key Laboratory of Human-Machine Hybrid Augmented Intelligence, Xi'an Jiaotong University, Ant Group(人机混合增强智能国家级实验室,西安交通大学,蚂蚁集团) ; National Key Laboratory of Human-Machine Hybrid Augmented Intelligence, Xi'an Jiaotong University(人机混合增强智能国家级实验室,西安交通大学) ; University at Buffalo(布法罗大学)
专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV
Comments Accepted by ACM MM2025
专题命中 视频扩散模型 :video diffusion(abstract);分类 cs.CV
Comments Project page: https://hanyangyu1021.github.io/lm-gaussian.github.io/