Haochen Huang, Yue Su, Xin Sun, Moonisa Ahsan, Mohammad Aliannejadi, Irene Viola, Zhaochun Ren, Chuang Yu, Aneta Lisowska, Artem Belopolsky, Koen Hindriks, Pablo Cesar, Junxiao Wang, Jiahuan Pei
机构
*
Vrije University of Amsterdam University of Amsterdam Centrum Wiskunde \& Informatic
;
University of Amsterdam National Institute of Informatics Centrum Wiskunde \& Informatic
;
Centrum Wiskunde \& Informatic Leiden University University College London
;
Vrije University of Amsterdam
;
Centrum Wiskunde \& Informatica Technische Universiteit Delft Guangzhou University
;
Vrije University of Amsterdam Centrum Wiskunde \& Informatic
EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization
EmoAgent-R1:基于强化学习的动态智能体专业化实现多模态情感理解
Lihuang Fang, Yuchen Zou, kebing Jin, Jinghui Qin
机构
*
Guangdong University of Technology(广东工业大学)
;
Southern University of Science and Technology(南方科技大学)
;
Xi’an Jiaotong University(西安交通大学)
;
Guizhou Provincial Laboratory of Big Data, State Key Laboratory of Public Big Data, Guizhou University(贵州大学大数据省级重点实验室、公共大数据国家重点实验室)
专题命中
视觉推理
:multimodal large language model(abstract);MLLM(abstract);分类 cs.CV、cs.AI
MarineEVT: Advancing Event-Centric Marine Video Understanding via Visual Tool Reasoning
MarineEVT:通过视觉工具推理推进以事件为中心的海洋视频理解
Tuan-An To, Yuk-Kwan Wong, Tuan-Anh Vu, Ziqiang Zheng, Sai-Kit Yeung
机构
*
The Hong Kong University of Science and Technology(香港科技大学)
;
University of California, Los Angeles(加利福尼亚大学洛杉矶分校)
;
University of Electronic Science and Technology of China(电子科技大学)
机构
*
College of Computer Science and Software Engineering, Shenzhen University(深圳大学计算机科学与软件学院)
;
Harbin Institute of Technology Shenzhen(哈尔滨工业大学(深圳))
;
City University of Macau(澳门城市大学)
专题命中
视觉推理
:multimodal large language model(abstract);分类 cs.AI