机构
*
School of Computer Science and Technology, Beijing Jiaotong University(北京交通大学计算机科学与技术学院)
;
Key Laboratory of Big Data & Artificial Intelligence in Transportation, Ministry of Education(教育部交通运输大数据与人工智能重点实验室)
;
Beijing Key Laboratory of Traffic Data Mining and Embodied Intelligence (2018)(北京市交通数据挖掘与具身智能重点实验室)
机构
*
Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
CITIC Securities(中信证券)
;
School of Artificial Intelligence, Beijing Normal University(北京师范大学人工智能学院)
MaxSAT-Based Feedback for Guiding Vision-Language Models in Sudoku
基于最大可满足性的反馈在数独中引导视觉语言模型
Pedro Orvalho, Guillem Alenyà, Felip Manyà
机构
*
Artificial Intelligence Research Institute (IIIA), Consejo Superior de Investigaciones Científicas (CSIC)(人工智能研究所(IIIA),西班牙科学研究高级理事会(CSIC))
;
Institut de Robòtica i Informàtica Industrial (IRI-CSIC-UPC)(工业机器人与信息学研究所(IRI-CSIC-UPC))
机构
*
Research Center for Space Computing System, Zhejiang Lab, Hangzhou(杭州浙大实验室空间计算系统研究中心)
;
Hangzhou Institute for Advanced Study, University of Chinese Academy of Sciences, Hangzhou(中国科学院大学杭州高等研究院)
;
School of Cyber Science and Engineering, Zhengzhou University(郑州大学计算机科学与工程学院)
;
School of Computer Science and Technology, Xi’an Jiaotong University(西安交通大学计算机科学与技术学院)
专题命中
视觉推理
:visual reasoning(title,abstract);MLLM(abstract,abstract_cn);visual question answering(abstract);multimodal large language model(abstract)
SurgXBench: Explainable Vision-Language Model Benchmark for Surgery
SurgXBench: 可解释的视觉-语言模型手术基准
Jiajun Cheng, Xianwu Zhao, Sainan Liu, Xiaofan Yu, Ravi Prakash, Patrick J. Codd, Jonathan Elliott Katz, Shan Lin
机构
*
Arizona State University(亚利桑那州立大学)
;
Intel Labs(英特尔实验室)
;
Duke University(杜克大学)
;
University of Miami(迈阿密大学)
;
University of California, Merced(加州大学默塞德分校)
机构
*
Centennial High School, Frisco, Texas, USA(Centennial High School, Texas, USA)
;
Lebanon Trail High School, Frisco, Texas, USA(Lebanon Trail High School, Texas, USA)
;
West Windsor-Plainsboro High School, Princeton Junction, New Jersey, USA(West Windsor-Plainsboro High School, New Jersey, USA)
;
Algoverse AI Research, Palo Alto, California, USA(Algoververse AI Research, California, USA)
专题命中
视觉推理
:VLM(title_cn);vision-language model(abstract);vision language model(abstract);visual reasoning(abstract)
Comments14 pages, 4 figures, 8 tables. Presented at the 39th Conference on Neural Information Processing Systems Workshop: VLM4RWD. Presented at the 43th International Conference on Machine Learning Workshops: ICML 2026 CTB, ICML 2026 FAGEN, ICML 2026 EMM-QA. Authors Aahana Basappa and Pranay Goel contributed equally. Code: https://github.com/AahanaB24/AMVICC, Data: https://doi.org/10.5281/zenodo.17646068
机构
*
Fudan University(复旦大学)
;
Institute of Artificial Intelligence (TeleAI), China Telecom(人工智能研究所(TeleAI),中国电信)
;
Tianjin University(天津大学)
;
Northwestern Polytechnical University(西北工业大学)
;
Tsinghua University(清华大学)
;
City University of Hong Kong(香港城市大学)
专题命中
视觉推理
:multimodal large language model(title,abstract);vision-language model(abstract);VLM(abstract_cn);grounding(abstract)
EndoCoT: Scaling Endogenous Chain-of-Thought Reasoning in Diffusion Models
EndoCoT:扩散模型中的内生思维链推理扩展
Xuanlang Dai, Yujie Zhou, Long Xing, Jiazi Bu, Xilin Wei, Yuhong Liu, Beichen Zhang, Kai Chen, Yuhang Zang
机构
*
Shanghai AI Laboratory(上海人工智能实验室)
;
Xi’an Jiaotong University(西安交通大学)
;
University of Science and Technology of China(中国科学技术大学)
;
Shanghai Jiaotong University(上海交通大学)
;
Fudan University(复旦大学)
;
The Chinese University of Hong Kong(香港中文大学)
专题命中
视觉推理
:MLLM(summary_cn,abstract);grounding(abstract);multimodal large language model(abstract);分类 cs.CV
Reasoning in Computer Vision: Taxonomy, Models, Tasks, and Methodologies
计算机视觉中的推理:分类、模型、任务与方法论
Ayushman Sarkar, Zhenyu Yu, Mohd Yamani Idna Idris
机构
*
Department of Computer Science and Engineering, Birbhum Institute of Engineering and Technology(计算机科学与工程系,比罗尔理工学院)
;
College of Computer Science and Artificial Intelligence, Fudan University(计算机科学与人工智能学院,复旦大学)
;
Faculty of Computer Science and Information Technology, Universiti Malaya(计算机科学与信息技术学院,马来亚大学)
机构
*
Monash University(墨尔本大学)
;
Stanford University(斯坦福大学)
;
University of Washington(华盛顿大学)
;
Griffith University(格里菲斯大学)
;
Princeton University(普林斯顿大学)
;
Allen Institute for Artificial Intelligence(人工智能研究院)