arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视觉大模型 / VLM

视觉语言模型、视觉推理、视觉问答、图文理解和视觉 grounding。

2026-05-25 至 2026-05-25 共收录 1 信号源:cs.CV, cs.AI, cs.LG

1. 文档图表理解 1 篇

2605.23527 2026-05-25 cs.CE 87%

LiveFigure: Generating Editable Scientific Illustration with VLM Agents

LiveFigure: 利用VLM智能体生成可编辑的科学插图

Chenyang Shao, Jiahe Liu, Fengli Xu, Yong Li

专题命中 文档图表理解 :VLM(title,title_cn)

AI总结 提出LiveFigure框架,通过VLM智能体模拟人类多步绘图流程,生成完全矢量化的可编辑科学插图,在17次手动编辑后达到80%的出版就绪率。

详情

展开后加载摘要…

URL PDF HTML 收藏