Graph-to-Frame RAG: Visual-Space Knowledge Fusion for Training-Free and Auditable Video Reasoning
图到帧RAG:面向无训练和可审计的视频推理的视觉空间知识融合
机构 * National University of Defense Technology(国防科技大学) ; Sun Yat-sen University(中山大学)
专题命中 多模态RAG :RAG(title,abstract)
AI总结 本文提出G2F-RAG,通过视觉空间知识融合提升视频推理的可解释性和效率,减少认知负担并保留可追溯的证据轨迹。
Comments Accepted at CVPR 2026. Camera-ready version