Training-Free Composed Video Retrieval via Visual Representation-Guided Video-LLM Reasoning
基于视觉表示引导的视频-大语言模型推理的无训练组合视频检索
Yang Liu, Qianqian Xu, Peisong Wen, Siran Dai, Qingming Huang
机构
*
School of Computer Science and Technology, University of Chinese Academy of Sciences(中国科学院大学计算机科学与技术学院)
;
State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(中国科学院人工智能安全国家重点实验室)
;
Beijing Academy of Artificial Intelligence(北京人工智能研究院)
;
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
;
School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院)
Generative Multi-Robot Motion Planning via Diffusion Modeling with Multi-Agent Reinforcement Learning Guidance
基于扩散建模与多智能体强化学习引导的生成式多机器人运动规划
Suk Ki Lee, Venkata Sai Deepak Mutta, Hyunwoong Ko
机构
*
School of Manufacturing Systems and Networks, Arizona State University, Mesa, AZ(1制造系统与网络学院,亚利桑那州立大学,梅萨,AZ)
;
Michael W. Hall School of Mechanical Engineering, Mississippi State University, Starkville, MS(2迈克尔·W·霍尔机械工程学院,密西西比州立大学,斯塔克维尔,MS)
机构
*
Institute of Cyber-Systems and Control, College of Control Science and Engineering, Zhejiang University(浙江大学控制科学与工程学院智能系统与控制研究所)
;
Huzhou Institute, Zhejiang University(浙江大学湖州研究院)