机构
*
The University of Manchester(曼彻斯特大学)
;
Stanford University(斯坦福大学)
;
Imperial College London(伦敦帝国理工学院)
;
National Institute of Advanced Industrial Science(国家先进工业科学与技术研究院)
Video Detective: Seek Critical Clues Recurrently to Answer Question from Long Videos
视频侦探:通过反复寻找关键线索来回答长视频中的问题
Henghui Du, Chunjie Zhang, Xi Chen, Chang Zhou, Di Hu
机构
*
Gaoling School of Artificial Intelligence(北京中国人民大学人工智能学院)
;
Renmin University of China(中国人民大学)
;
AI Technology Center Online Video Business Unit(人工智能技术中心在线视频业务部)
;
Tencent PCG(腾讯PCG)
专题命中
长上下文与记忆
:large language model(abstract);language model(abstract)
TAMEing Long Contexts in Personalization: Towards Training-Free and State-Aware MLLM Personalized Assistant
在个性化中延长上下文:迈向无训练和状态感知的MLLM个性化助手
Rongpei Hong, Jian Lang, Ting Zhong, Yong Wang, Fan Zhou
机构
*
University of Electronic Science and Technology of China(电子科技大学)
;
Aiwen Technology Co., Ltd.(Aiwen科技有限公司)
;
Intelligent Digital Media Technology Key Laboratory of Sichuan Province(四川省智能数字媒体技术重点实验室)
专题命中
长上下文与记忆
:large language model(abstract);language model(abstract)
Exploring Automated Recognition of Instructional Activity and Discourse from Multimodal Classroom Data
探索多模态课堂数据中教学活动和话语的自动化识别
Ivo Bueno, Ruikun Hou, Babette Bühler, Tim Fütterer, James Drimalla, Jonathan Kyle Foster, Peter Youngs, Peter Gerjets, Ulrich Trautwein, Enkelejda Kasneci