Shape2Animal: Creative Animal Generation from Natural Silhouettes
Shape2Animal: 从自然剪影生成创意动物
Quoc-Duy Tran, Anh-Tuan Vo, Dinh-Khoi Vo, Tam V. Nguyen, Minh-Triet Tran, Trung-Nghia Le
机构
*
University of Science, Ho Chi Minh City, Vietnam(胡志明市科学技术大学)
;
Vietnam National University, Ho Chi Minh City, Vietnam(越南国家大学)
;
University of Dayton, Ohio, US(Dayton 大学)
PlotPick: AI-powered batch extraction of numerical data from scientific figures
PlotPick: 基于AI的科学图表中数值数据批量提取工具
Tommy Carstensen
机构
*
Copenhagen Research Centre for Biological and Precision Psychiatry(哥本哈根生物与精准精神病学研究中心)
;
Mental Health Centre Copenhagen(哥本哈根心理健康中心)
;
Copenhagen University Hospital(哥本哈根大学医院)
Uncovering Entity Identity Confusion in Multimodal Knowledge Editing
揭示多模态知识编辑中的实体身份混淆
Shu Wu, Xiaotian Ye, Xinyu Mou, Dongsheng Liu, Xiaohan Wang, Mengqi Zhang
机构
*
New Laboratory of Pattern Recognition (NLPR)(模式识别新实验室)
;
State Key Laboratory of Multimodal Artificial Intelligence Systems (MAIS)(多模态人工智能系统国家重点实验室)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences(中国科学院大学先进交叉学科学院)
;
Huazhong University of Science and Technology(华中科技大学)
;
Shandong University(山东大学)
Large Vision-Language Models Get Lost in Attention
大视觉-语言模型在注意力中迷失
Gongli Xi, Ye Tian, Mengyu Yang, Huahui Yi, Liang Lin, Xiaoshuai Hao, Kun Wang, Wendong Wang
机构
*
School of Cyberspace Security, Beijing University of Posts(信息安全学院,北京邮电大学)
;
State Key Laboratory of Networking and Switching Technology, Beijing University of Posts(网络与交换技术国家重点实验室,北京邮电大学)
;
School of Computer Science (National Pilot Software Engineering School), Beijing University of Posts(计算机科学学院(国家试点软件工程学院),北京邮电大学)
;
Nanyang Technological University, Singapore(新加坡南洋理工大学)
;
Institute of Information Engineering, Chinese Academy of Sciences, Beijing, China(信息工程研究所,中国科学院北京研究院)
机构
*
School of Computer Science and Technology, Dalian University of Technology(大连理工大学计算机科学与技术学院)
;
Key Laboratory of Social Computing and Cognitive Intelligence (Dalian University of Technology), Ministry of Education(社会计算与认知智能重点实验室(大连理工大学),教育部)
;
Institute of Image Processing and Understanding, North Minzu University(北华大学图像处理与理解研究所)
KORE: Enhancing Knowledge Injection for Large Multimodal Models via Knowledge-Oriented Controls
KORE:通过知识导向控制增强大型多模态模型的知识注入
Kailin Jiang, Hongbo Jiang, Ning Jiang, Zhi Gao, Jinhe Bi, Yuchen Ren, Bin Li, Yuntao Du, Lei Liu, Qing Li
机构
*
University of Science
;
State Key Laboratory of General Artificial Intelligence, BIGAI
;
Xiamen University
;
Northeast Forestry University
;
Beijing Institute of Technology
;
Ludwig Maximilian University of Munich
;
The University of Sydney
;
C-FAIR\&school of software, Shandong University
;
State Key Lab. for Novel Software Technology, Nanjing University, P.R. China
Plug-and-play Class-aware Knowledge Injection for Prompt Learning with Visual-Language Model
即插即用的类感知知识注入用于具有视觉-语言模型的提示学习
Junhui Yin, Nan Pu, Xinyu Zhang, Lingfeng Yang, Lin Wu, Xiaojie Wang, Zhun Zhong
机构
*
University of Science and Technology Beijing(北京科技大学)
;
Hefei University of Technology(合肥工业大学)
;
University of Auckland(奥克兰大学)
;
Nanjing University of Science and Technology(南京理工大学)
;
Swansea University(斯旺西大学)
;
Beijing University of Posts and Telecommunications(北京邮电大学)