Beyond Pixels: Introspective and Interactive Grounding for Visualization Agents
超越像素:可视化代理的 introspective 和 interactive 地基
机构 * William & Mary(威廉玛丽学院) ; Oak Ridge National Laboratory(橡树岭国家实验室)
专题命中 视觉定位与Grounding :grounding(title,abstract);VLM(summary_cn,abstract);vision-language model(abstract,abstract_cn)
AI总结 本文提出IVG框架,结合规范引导的反思与视图引导的交互,解决VLM在可视化任务中的误读与歧义问题,通过iPlotBench验证,提升问答准确度至0.81,并展示在自主探索与实时协作中的能力。
Comments 18 pages, 8 figures