EduArt: An educational-level benchmark for evaluating art history knowledge in large language models
EduArt:评估大型语言模型艺术史知识的教育级基准
Gianmarco Spinaci, Lukas Klic, Giovanni Colavizza
机构
*
University of Bologna(博洛尼亚大学)
;
Villa i Tatti – The Harvard University Center for Italian Renaissance Studies(哈佛大学意大利文艺复兴研究中心(I Tatti))
;
University of Copenhagen(哥本哈根大学)
OmniView-Space: Reinforcing Spatial Reasoning via Multi-Perspective Spatial Mapping
OmniView-Space: 通过多视角空间映射增强空间推理
Xudong Li, Mengdan Zhang, Peixian Chen, Jiaxi Tan, Zihao Huang, Jingyuan Zheng, Yan Zhang, Xiawu Zheng, Xing Sun, Rongrong Ji
机构
*
Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University(厦门大学多媒体可信感知与高效计算教育部重点实验室)
;
Tencent Youtu Lab(腾讯优图实验室)
;
Beijing Institute of Technology(北京理工大学)
专题命中
视觉推理
:multimodal large language model(abstract);分类 cs.CV
Technical Report of RoboSpatial Challenge at CVPR 2026: Selective Reasoning Activation and Reference-Frame Disambiguation for Embodied Spatial Reasoning
RoboSpatial Challenge at CVPR 2026技术报告:选择性推理激活与参考框架消歧用于具身空间推理
机构
*
Central South University(中南大学)
;
Tsinghua University(清华大学)
;
South China Normal University(华南师范大学)
;
ByteDance Inc(字节跳动公司)
;
University of Zaragoza(阿拉维达大学)
;
CosmosMind
;
Wuhan University(武汉大学)
;
University of California, Los Angeles(加州大学洛杉矶分校)
;
Southeast University(东南大学)
;
Tencent(腾讯公司)
;
Nankai University(南开大学)
;
Supermicro Computer Inc(Supermicro计算机公司)
;
Huazhong University of Science and Technology(华中科技大学)
Position Rebinding Cache Reuse: Replay-Free Visual Revisiting for Interleaved Multimodal Reasoning
位置重绑定缓存复用:交错多模态推理中无重放的视觉重访
Mengzhao Wang, Yanli Ji, Wangmeng Zuo, Peng Ye, Chongjun Tu
机构
*
Sun Yat-sen University(中山大学)
;
Shenzhen Loop Area Institute(深圳河套学院)
;
Harbin Institute of Technology (HIT)(哈尔滨工业大学)
;
Fudan University(复旦大学)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
The Chinese University of Hong Kong(香港中文大学)
Visual-OPSD: Cross-Modal On-Policy Self-Distillation for Efficient Unified Multimodal Reasoning
Visual-OPSD:用于高效统一多模态推理的跨模态在策略自蒸馏
Pengyu Li, Zhitao Gao, Lingling Zhang, Muye Huang, Yuanming Li, Fangzhi Xu, Jun Liu
机构
*
Xi’an Jiaotong University(西安交通大学)
;
MOE KLINNS Lab(MOE KLINNS实验室)
;
Shaanxi Province Key Laboratory of Big Data Knowledge Engineering(陕西省大数据知识工程重点实验室)
;
Sun Yat-sen University(中山大学)
机构
*
The Chinese University of Hong Kong(香港中文大学)
;
Xiamen University(厦门大学)
;
Kling Team, Kuaishou Technology(快手科技Kling团队)
;
National University of Singapore(新加坡国立大学)
;
Southern University of Science and Technology(南方科技大学)
专题命中
视觉推理
:multimodal large language model(abstract);分类 cs.AI
Johan Bjorck, Zhiqi Li, Yunze Man, Jing Wang, An-Chieh Cheng, Sifei Liu, Shihao Wang, Zhiding Yu, Abhishek Badki, Stan Birchfield, Valts Blukis, Yevgen Chebotar, Siyi Chen, Sicong Leng, Yu-Cheng Chou, Tianli Ding, Boyi Li, Zhengyi Luo, Hang Su, Jonathan Tremblay, Tingwu Wang, Bowen Wen, Jimmy Wu, Xianghui Xie, Hanrong Ye, Hongxu Yin, K. R. Zentner, Liangyan Gui, Yu-Xiong Wang, Yuke Zhu, Linxi "Jim" Fan, Jan Kautz
机构
*
University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
;
University of California, San Diego(加州大学圣地亚哥分校)
;
The Hong Kong Polytechnic University(香港理工大学)
;
University of Michigan(密歇根大学)
;
Nanyang Technological University(南洋理工大学)
;
Johns Hopkins University(约翰霍普金斯大学)
;
University of Tübingen(图宾根大学)
3D Scene Graphs: Open Challenges and Future Directions
3D场景图:开放挑战与未来方向
Dennis Rotondi, Francesco Argenziano, Sebastian Koch, Nathan Hughes, Martin Buechner, Johanna Wald, Lukas Rosenberger Schmid, Daniele Nardi, Abhinav Valada, Liam Paull, Federico Tombari, Luca Carlone, Kai O. Arras
机构
*
University of Stuttgart(斯图加特大学)
;
IMPRS-IS(马克斯·普朗克研究所-智能系统)
;
Sapienza University of Rome(罗马萨皮恩扎大学)
;
Google(谷歌)
;
MIT(麻省理工学院)
;
University of Freiburg(弗赖堡大学)
;
UTN University of Montreal(蒙特利尔大学UTN分校)
;
Mila TU Munich(慕尼黑技术大学Mila)
MathVis-Fine: Aligning Visual Supervision with Necessity via Progressive Dependency-Guided Training for Multimodal Mathematical Reasoning
MathVis-Fine:通过渐进式依赖引导训练将视觉监督与必要性对齐的多模态数学推理
Wanshi Xu, Haokun Zhao, Haidong Yuan, Songjun Cao, Long Ma
机构
*
School of ECE, Peking University(北京大学电子与计算机工程学院)
;
College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与技术学院)
;
School of Software and Microelectronics, Peking University(北京大学软件与微电子学院)
;
Tencent Youtu Lab(腾讯优图实验室)
机构
*
Tsinghua University(清华大学)
;
Chongqing University(重庆大学)
;
Peking University(北京大学)
;
ZenoMind AI
;
Xi’an Jiaotong University(西安交通大学)
;
Beijing Institute of Technology(北京理工大学)
;
Southeast University(东南大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
Joy Future Academy(京东探索研究院)
;
The University of Hong Kong(香港大学)
专题命中
视觉推理
:multimodal large language model(abstract);分类 cs.AI
CommentsAccepted for publication in the Proceedings of the 30th International Conference on Knowledge-Based and Intelligent Information & Engineering Systems (KES 2026)
Han Huang, Hao Wang, Mengqi Zhang, Shu Wu, Qiang Liu, Liang Wang
机构
*
University of Chinese Academy of Sciences(中国科学院大学)
;
New Laboratory of Pattern Recognition (NLPR), CASIA(中国科学院自动化研究所模式识别国家重点实验室)
;
Harbin Institute of Technology(哈尔滨工业大学)
;
Shandong University(山东大学)
专题命中
视觉推理
:multimodal large language model(abstract);分类 cs.CV