LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models
LLMind: 基于生物启发的无训练自适应视觉表示用于视觉-语言模型
机构 * Nanyang Technological University(南洋理工大学)
专题命中 视觉问答 :vision-language model(title,abstract);VLM(abstract,abstract_cn);visual question answering(abstract);分类 cs.CV
AI总结 LLMind通过生物启发的自适应采样策略,实现视觉-语言模型在有限像素预算下的高效自适应表示,实验显示在多个基准测试中性能显著提升。
Comments CVPR 2026, Highlight, 10 pages, 7 figures, 3 tables