MLlm-DR: Towards Explainable Depression Recognition with MultiModal Large Language Models
MLlm-DR: 向多模态大语言模型的可解释性抑郁识别迈进
Wei Zhang, Juan Chen, En Zhu, Wenhong Cheng, YunPeng Li, Yanbo J. Wang
机构
*
National University of Defense Technology(国防科技大学)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Shanghai Mental Health Center, Shanghai Jiao Tong University School of Medicine(上海精神卫生中心,上海交通大学医学院)
;
Nanjing Industria Tenebris Information Technology Co., Ltd.(南京Industria Tenebris信息技术有限公司)
;
National University of Uzbekistan named after Mirzo Ulugbek(乌兹别克斯坦Mirzo Ulugbek命名的国立大学)
专题命中
视觉推理
:multimodal large language model(title,abstract);MLLM(title,abstract);分类 cs.AI
机构
*
Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学北京校区人工智能学院)
;
Beijing Key Laboratory of Research on Large Models and Intelligent Governance(北京大型模型与智能治理研究重点实验室)
;
Engineering Research Center of Next-Generation Intelligent Search and Recommendation, MOE(教育部下一代智能搜索与推荐工程研究中心)
;
Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系)
;
Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院)
OpenQlaw: An Agentic AI Assistant for Analysis of 2D Quantum Materials
OpenQlaw: 一种用于二维量子材料分析的代理AI助手
Sankalp Pandey, Xuan-Bac Nguyen, Hoang-Quan Nguyen, Tim Faltermeier, Nicholas Borys, Hugh Churchill, Khoa Luu
机构
*
Quantum AI Lab, University of Arkansas, USA(量子人工智能实验室,美国亚拉巴马大学)
;
University of Utah, USA(美国犹他大学)
;
Department of Physics, University of Arkansas, USA(美国亚拉巴马大学物理系)
;
MonARK NSF Quantum Foundry(MonARK NSF 量子熔炉)
专题命中
视觉推理
:multimodal large language model(abstract);MLLM(abstract);分类 cs.CV
Symphony: A Cognitively-Inspired Multi-Agent System for Long-Video Understanding
Symphony:一种受认知启发的多智能体系统用于长视频理解
Haiyang Yan, Hongyun Zhou, Peng Xu, Xiaoxue Feng, Mengyi Liu
机构
*
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Kuaishou Technology(快手科技)
;
School of Future Technology, University of Chinese Academy of Sciences(中国科学院大学未来技术学院)
机构
*
Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
Wuhan University(武汉大学)
;
University of North Texas(北卡罗来纳州立大学)
;
Fudan University(复旦大学)
Evidence Packing for Cross-Domain Image Deepfake Detection with LVLMs
跨领域图像深度伪造检测中的证据打包与大视觉语言模型
Yuxin Liu, Fei Wang, Kun Li, Yiqi Nie, Junjie Chen, Zhangling Duan, Zhaohong Jia
机构
*
Anhui University(安徽大学)
;
Hefei University of Technology(合肥工业大学)
;
IAI, Hefei Comprehensive National Science Center(合肥综合国家科学中心人工智能研究院)
;
United Arab Emirates University(阿拉伯联合酋长国大学)