Visual-OPSD: Cross-Modal On-Policy Self-Distillation for Efficient Unified Multimodal Reasoning
Visual-OPSD:用于高效统一多模态推理的跨模态在策略自蒸馏
Pengyu Li, Zhitao Gao, Lingling Zhang, Muye Huang, Yuanming Li, Fangzhi Xu, Jun Liu
机构
*
Xi’an Jiaotong University(西安交通大学)
;
MOE KLINNS Lab(MOE KLINNS实验室)
;
Shaanxi Province Key Laboratory of Big Data Knowledge Engineering(陕西省大数据知识工程重点实验室)
;
Sun Yat-sen University(中山大学)
机构
*
The University of British Columbia(不列颠哥伦比亚大学)
;
The Ohio State University(俄亥俄州立大学)
;
Czech Technical University in Prague(布拉格捷克理工大学)
;
TerraSense Analytics(TerraSense Analytics公司)
UniTemp: Unlocking Video Generation in Any Temporal Order via Bidirectional Distillation
UniTemp: 通过双向蒸馏实现任意时间顺序的视频生成
Lin Zhang, Sicheng Mo, Zefan Cai, Jinhong Lin, Zihao Lin, Jiuxiang Gu, Krishna Kumar Singh, Yuheng Li, Yin Li
机构
*
University of Wisconsin Madison(威斯康星大学麦迪逊分校)
;
Adobe Research(Adobe 研究院)
;
University of California Los Angeles(加利福尼亚大学洛杉矶分校)
;
University of California Davis(加利福尼亚大学戴维斯分校)