AdaptVision: Efficient Vision-Language Models via Adaptive Visual Acquisition
AdaptVision: 通过自适应视觉获取实现高效的视觉-语言模型
机构 * Tencent Hunyuan(腾讯文言)
专题命中 视觉问答 :vision-language model(title,abstract);VLM(abstract);visual question answering(abstract);分类 cs.CV、cs.AI、cs.LG
AI总结 AdaptVision通过自适应视觉获取机制,结合强化学习与工具学习,提升视觉-语言模型在视觉问答任务中的效率与准确性。
Comments Accepted by CVPR 2026. Code and models are available at https://github.com/AdaptVision/AdaptVision