RouterKGQA: Specialized--General Model Routing for Constraint-Aware Knowledge Graph Question Answering
RouterKGQA: 专用-通用模型路由用于约束感知的知识图谱问答
Bo Yuan, Hexuan Deng, Xuebo Liu, Min Zhang
机构
*
Institute of Computing and Intelligence, Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学深圳研究院)
;
Zhongguancun Academy, Beijing, China(中关村学院)
ReXInTheWild: A Unified Benchmark for Medical Photograph Understanding
ReXInTheWild:医疗照片理解的统一基准
Oishi Banerjee, Sung Eun Kim, Alexandra N. Willauer, Julius M. Kernbach, Abeer Rihan Alomaish, Reema Abdulwahab S. Alghamdi, Hassan Rayhan Alomaish, Mohammed Baharoon, Xiaoman Zhang, Julian Nicolas Acosta, Christine Zhou, Pranav Rajpurkar
机构
*
Department of Biomedical Informatics, Harvard Medical School(哈佛医学院生物医学信息学系)
;
National Strategic Technology Research Institute, Seoul National University Hospital(首尔国立大学医院国家战略技术研究所)
;
Department of Medicine, Division of Gastroenterology, Massachusetts General Hospital(麻省总医院内科与消化内科部门)
;
Department of Neuroradiology, Heidelberg University Hospital(海德堡大学医院神经放射科部门)
;
King Abdulaziz Medical City, National Guard Health Affairs(国王阿卜杜勒-阿齐兹医疗城,国民守卫健康事务局)
;
Division of Pulmonary, Critical Care, and Sleep Medicine, University of Cincinnati(辛辛那提大学肺科、重症医学及睡眠医学部门)
专题命中
视觉推理
:vision-language model(abstract);multimodal large language model(abstract);分类 cs.CV、cs.LG
One Model, Two Minds: Task-Conditioned Reasoning for Unified Image Quality and Aesthetic Assessment
一个模型,两种思维:任务条件推理用于统一的图像质量与审美评估
Wen Yin, Cencen Liu, Dingrui Liu, Bing Su, Yuan-Fang Li, Tao He
机构
*
University of Electronic Science and Technology of China(电子科技大学)
;
Faculty of Information Technology, Monash University(莫纳什大学信息科技学院)
;
The Laboratory of Intelligent Collaborative Computing of UESTC(UESTC智能协同计算实验室)
专题命中
视觉推理
:multimodal large language model(abstract);分类 cs.CV
EagleVision: A Dual-Stage Framework with BEV-grounding-based Chain-of-Thought for Spatial Intelligence
EagleVision:基于BEV的双阶段框架用于空间智能
Jiaxu Wan, Xu Wang, Mengwei Xie, Hang Zhang, Mu Xu, Yang Han, Hong Zhang, Ding Yuan, Yifan Yang
机构
*
Atlas Lab(Atlas实验室)
;
School of Aerospace, BUAA(北京航空航天大学航空学院)
;
School of Software, BUAA(北京航空航天大学软件学院)
;
State Key Laboratory of HERATT(HERATT国家重点实验室)
;
Key Laboratory of SDODS (MOE) Project(SDODS重点实验室(教育部))
专题命中
视觉定位与Grounding
:grounding(title,abstract);vision-language model(abstract);multimodal large language model(abstract);分类 cs.CV
MedSPOT: A Workflow-Aware Sequential Grounding Benchmark for Clinical GUI
MedSPOT: 一种面向临床GUI的流程感知序列接地基准
Rozain Shakeel, Abdul Rahman Mohammad Ali, Muneeb Mushtaq, Tausifa Jan Saleem, Tajamul Ashraf
机构
*
Gaash Research Lab, National Institute of Technology Srinagar, India(加什研究实验室,印度锡里纳杰尔国家理工学院)
;
e\& Group, UAE(e&集团,阿联酋)
;
Mohammad Bin Zayed University of Artificial Intelligence (MBZUAI), UAE(穆罕默德·本·扎耶德人工智能大学(MBZUAI),阿联酋)
;
King Abdullah University of Science and Technology (KAUST), Saudi Arabia(国王 Abdullah 科学技术大学(KAUST),沙特阿拉伯)
专题命中
视觉定位与Grounding
:grounding(title,abstract);multimodal large language model(abstract);分类 cs.CV
Think and Answer ME: Benchmarking and Exploring Multi-Entity Reasoning Grounding in Remote Sensing
思考并回答ME:基准测试和探索遥感中的多实体推理 grounding
Shuchang Lyu, Haiquan Wen, Guangliang Cheng, Meng Li, Zheng Zhou, You Zhou, Dingding Yao, Zhenwei Shi
机构
*
Beihang University, Beijing, China(北京航空航天大学)
;
University of Liverpool, Liverpool, UK(利物浦大学)
;
Institute of Acoustics, Chinese Academy of Sciences, Beijing, China(中国科学院声学研究所)
FB-CLIP: Fine-Grained Zero-Shot Anomaly Detection with Foreground-Background Disentanglement
FB-CLIP:基于前景-背景解耦的细粒度零样本异常检测
Ming Hu, Yongsheng Huo, Mingyu Dou, Jianfu Yin, Peng Zhao, Yao Wang, Cong Hu, Bingliang Hu, Quan Wang
机构
*
Xi’an Institute of Optics and Precision Mechanics, Chinese Academy of Sciences(西安光学精密机械研究所,中国科学院)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Xi’an Jiaotong University(西安交通大学)
;
Zhongnan Hospital of Wuhan University(武汉大学中南医院)
机构
*
Department of Management Science and Technology(管理科学与技术系)
;
Hellenic Mediterranean University(希伯伦地中海大学)
;
Institute of Computer Science, FORTH(信息科学研究所,FORTH)