VimRAG: Navigating Massive Visual Context in Retrieval-Augmented Generation via Multimodal Memory Graph
VimRAG:通过多模态记忆图导航大规模视觉上下文
机构 * Tongyi Lab, Alibaba Group(通义实验室,阿里巴巴集团)
专题命中 多模态RAG :retrieval-augmented generation(title,abstract);RAG(abstract,abstract_cn);分类 cs.CL
AI总结 VimRAG通过多模态记忆图提升检索增强生成在处理大规模视觉上下文中的能力,采用动态有向无环图结构和图调制视觉记忆编码机制,实现高效的信息检索与推理。