机构
*
AI Lab, Qifu Technology(启赋科技AI实验室)
;
College of Future Information Technology, Fudan University(复旦大学未来信息学院)
;
School of Future Technology, South China University of Technology(华南理工大学未来技术学院)
;
Pazhou Lab(琶洲实验室)
Co-Director: Agentic Generative Video Storytelling
Co-Director: 基于代理的生成视频叙事
Yale Song, Yiwen Song, Nick Losier, Nathan Hodson, Ye Jin, Rhyard Zhu, Yan Xu, Daniel Vlasic, Carina Claassen, Jasmine Leon, Khanh G. LeViet, Zack Chomyn, Joe Timmons, Brett Slatkin, Scott Penberthy, Tomas Pfister
UpstreamQA: A Modular Framework for Explicit Reasoning on Video Question Answering Tasks
UpstreamQA:一个用于视频问答任务显式推理的模块化框架
Jason Nguyen, Ameet Rao, Alexander Chang, Ishaan Kumar, Erin Tan
机构
*
Lincoln North Star High School(林肯北星高中)
;
The Charter School of Wilmington(威尔明顿 charter 学校)
;
Greenwich High School(格林威治高中)
;
Santa Susana High School(圣塔苏娜高中)
;
UC Berkeley(伯克利大学)
CamReasoner: Reinforcing Camera Movement Understanding via Structured Spatial Reasoning
CamReasoner:通过结构化空间推理强化相机运动理解
Hang Wu, Yujun Cai, Zehao Li, Haonan Ge, Bowen Sun, Junsong Yuan, Yiwei Wang
机构
*
University of California, Merced(加州大学梅尔德分校)
;
University of Queensland(昆士兰大学)
;
Ant Group(蚂蚁集团)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
University at Buffalo, State University of New York(纽约州立大学布法罗分校)
机构
*
MoE Key Lab of Artificial Intelligence, AI Institute, Shanghai Jiao Tong University(上海交通大学人工智能研究院教育部人工智能重点实验室)
;
Central Research Institute, Huawei(华为中央研究院)
机构
*
School of Artificial Intelligence, Wuhan University(武汉大学人工智能学院)
;
Center for Language and Information Research, Wuhan University(武汉大学语言与信息研究中心)
;
Southwest Jiaotong University(西南交通大学)
;
MBZUAI(穆罕默德·本·扎耶德人工智能大学)
;
The University of Manchester(曼彻斯特大学)
;
Zhongnan Hospital of Wuhan University(武汉大学中南医院)