Prompting-MammAlps: Fine-Grained Text-to-Video Retrieval for Camera-Trap Data
Prompting-MammAlps:用于相机陷阱数据的细粒度文本到视频检索
Valentin Gabeff, Baptiste Maquignaz, Jennifer Shan, Sepideh Mamooler, Gencer Sumbul, Blair Costelloe, Devis Tuia, Alexander Mathis
机构
*
Ecole Polytechnique Fédérale de Lausanne (EPFL)(洛桑联邦理工学院)
;
Max Planck Institute of Animal Behavior(马克斯·普朗克动物行为研究所)
;
University of Konstanz(康斯坦茨大学)
Video Generation Models are General-Purpose Vision Learners
视频生成模型是通用视觉学习者
Letian Wang, Chuhan Zhang, Rishabh Kabra, Jasper Uijlings, Steven Waslander, Andrew Zisserman, Joao Carreira, Kaiming He, Misha Andriluka, Eduard Gabriel Bazavan, Andrei Zanfir, Cristian Sminchisescu
Causal-rCM: A Unified Teacher-Forcing and Self-Forcing Open Recipe for Autoregressive Diffusion Distillation in Streaming Video Generation and Interactive World Models
CourseBlueprint: A Structured Pipeline for Adaptive Pedagogical Video Generation Grounded in Course Corpora
CourseBlueprint:基于课程语料库的自适应教学视频生成的结构化流程
Md Zabirul Islam, Md Motaleb Hossen Manik, Ge Wang
机构
*
Department of Computer Science, Rensselaer Polytechnic Institute(计算机科学系,拉特格斯理工学院)
;
Department of Biomedical Engineering, Rensselaer Polytechnic Institute(生物医学工程系,拉特格斯理工学院)
RGB-D Video Generation for Improving Human-to-Robot Object Handover Prediction
用于改进人机物体交接预测的RGB-D视频生成
Tianyu Sun, Zhoujie Fu, Zihui Gao, Bang Zhang, Guosheng Lin
机构
*
Nanyang Technological University(南洋理工大学)
;
College of Computing and Data Science(计算与数据科学学院)
;
Zhejiang University(浙江大学)
;
College of Computer Science and Technology(计算机科学与技术学院)
;
Alibaba Group(阿里巴巴集团)