See or Say Graphs: Agent-Driven Scalable Graph Structure Understanding with Vision-Language Models
见或说图:基于视觉语言模型的 agent 驱动可扩展图结构理解
Shuo Han, Yukun Cao, Zezhong Ding, Zengyi Gao, S Kevin Zhou, Xike Xie
机构
*
University of Science and Technology of China(中国科学技术大学)
;
Data Darkness Lab, MIRACLE Center, USTC(数据黑暗实验室,MIRACLE中心,USTC)
;
MIRACLE Center, Suzhou Institute for Advance Research, USTC(MIRACLE中心,苏州先进研究所,USTC)
机构
*
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
China Mobile (Jiangxi) Virtual Reality Technology Co., Ltd.(中国移动(江西)虚拟现实技术有限公司)
;
School of Computer and Information Technology, Beijing Jiaotong University(北京交通大学计算机与信息学院)
;
Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)
专题命中
视觉推理
:multimodal large language model(title,abstract);分类 cs.AI
Chain-of-Anomaly Thoughts with Large Vision-Language Models
基于大视觉-语言模型的异常思维链
Pedro Domingos, João Pereira, Vasco Lopes, João Neves, David Semedo
机构
*
NOVALINCS, NOVA School of Science and Technology(NOVALINCS、NOVA科学与技术学院)
;
NOVALINCS, Universidade da Beira Interior(NOVALINCS、贝拉内尔大学)
;
DeepNeuronic
ChemVTS-Bench: Evaluating Visual-Textual-Symbolic Reasoning of Multimodal Large Language Models in Chemistry
ChemVTS-Bench: 评估多模态大语言模型在化学中的视觉-文本-符号推理能力
Zhiyuan Huang, Baichuan Yang, Zikun He, Yanhong Wu, Fang Hongyu, Zhenhe Liu, Lin Dongsheng, Bing Su
机构
*
Renmin University of China(中国人民大学)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
;
South China University of Technology(华南理工大学)
;
Gaotu Techedu Inc(高图科技公司)
专题命中
视觉推理
:multimodal large language model(title,abstract);分类 cs.AI
机构
*
State Key Laboratory for Novel Software Technology, Nanjing University(南京大学新型软件技术国家重点实验室)
;
Sensetime Research(商汤科技研究院)
;
Beijing Institute of Technology(北京理工大学)
;
Shanghai AI Lab(上海人工智能实验室)
专题命中
视觉推理
:MLLM(title);multimodal large language model(abstract);分类 cs.CV