Graph-to-Frame RAG: Visual-Space Knowledge Fusion for Training-Free and Auditable Video Reasoning
图到帧RAG:面向无训练和可审计的视频推理的视觉空间知识融合
机构 * National University of Defense Technology(国防科技大学) ; Sun Yat-sen University(中山大学)
专题命中 长视频与时序推理 :video reasoning(title,abstract);long video(abstract);分类 cs.CV
AI总结 本文提出G2F-RAG,通过视觉空间知识融合提升视频推理的可解释性和效率,减少认知负担并保留可追溯的证据轨迹。
Comments Accepted at CVPR 2026. Camera-ready version