TRivia: Self-supervised Fine-tuning of Vision-Language Models for Table Recognition
TRivia: 基于视觉-语言模型的自监督微调用于表格识别
机构 * The University of Hong Kong(香港大学) ; Shanghai AI Laboratory(上海人工智能实验室) ; Peking University(北京大学) ; Shanghai Jiaotong University(上海交通大学) ; Sensetime
专题命中 文档图表理解 :vision-language model(title,abstract);分类 cs.CV
AI总结 TRivia通过自监督微调方法,使预训练视觉-语言模型直接从未标注的表格图像中学习表格识别,无需人工标注,提升了表格识别性能。
Comments Accepted by CVPR 2026