Reasoning with Memory: A Temporal Granularity-Adaptive Framework for Training-Free Long Video Understanding
利用记忆进行推理:一种用于免训练长视频理解的时间粒度自适应框架
Linghao Meng, Qiankun Li, Junyuan Mao, Pujin Liao, Zhicheng He, Enbo Zhang, Kun Wang, Yang Liu, Huazhu Fu, Yueming Jin
机构
*
National University of Singapore(新加坡国立大学)
;
Institute of High Performance Computing, Agency for Science, Technology and Research (A*STAR)(高性能计算研究所,科学、技术与研究机构(A*STAR))
;
Nanyang Technological University(南洋理工大学)
;
University of Science and Technology of China(中国科学技术大学)
;
Jilin University(吉林大学)
FlowInOne:Unifying Multimodal Generation as Image-in, Image-out Flow Matching
FlowInOne:将多模态生成统一为图像输入、图像输出的流匹配
Junchao Yi, Rui Zhao, Jiahao Tang, Weixian Lei, Linjie Li, Qisheng Su, Zhengyuan Yang, Lijuan Wang, Xiaofeng Zhu, Alex Jinpeng Wang
机构
*
University of Electronic Science and Technology of China(电子科技大学)
;
Central South University(中南大学)
;
National University of Singapore(新加坡国立大学)
;
University of Science and Technology of China(中国科学技术大学)
;
Microsoft(微软)