SVAgent: Storyline-Guided Long Video Understanding via Cross-Modal Multi-Agent Collaboration
SVAgent:通过跨模态多智能体协作实现故事线引导的长视频理解
机构 * BCML, Heriot-Watt University(赫瑞瓦特大学BCML) ; Nanyang Technological University(南洋理工大学) ; Peking University(北京大学)
专题命中 视频理解 :video understanding(title,abstract);long video(title);分类 cs.CV
AI总结 SVAgent通过跨模态多智能体协作,利用故事线引导实现视频问答的高效理解,提升推理鲁棒性和答案一致性。
Comments Published in CVPR2026