Enhancing Multimodal Large Language Models for Ancient Chinese Character Evolution Analysis via Glyph-Driven Fine-Tuning
通过字形驱动微调增强多模态大语言模型用于古汉字演变分析
Rui Song, Lida Shi, Ruihua Qi, Yingji Li, Hao Xu
机构
*
College of Computer Science and Technology, Jilin University, China(吉林大学计算机科学与技术学院)
;
Key Laboratory of Ancient Chinese Script, Culture Relics and Artificial Intelligence, Jilin University, China(吉林大学古文字、文物与人工智能重点实验室)
;
School of Artificial Intelligence, Jilin University, China(吉林大学人工智能学院)
;
School of Archaeology, Jilin University, China(吉林大学考古学院)
专题命中
指令微调
:large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI
Risk Awareness Injection: Calibrating Vision-Language Models for Safety without Compromising Utility
风险感知注入:为安全校准视觉-语言模型而不牺牲实用性
Mengxuan Wang, Yuxin Chen, Gang Xu, Tao He, Hongjie Jiang, Ming Li
机构
*
Shien-Ming Wu School of Intelligent Engineering, South China University of Technology(华南理工大学吴贤铭智能工程学院)
;
Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东省人工智能与数字经济实验室(深圳))
;
Computer Science and Engineering, The Hong Kong University of Science and Technology(香港科技大学计算机科学与工程系)
;
University of Electronic Science and Technology of China(电子科技大学)
专题命中
指令微调
:language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.AI、cs.LG
Consolidation or Adaptation? PRISM: Disentangling SFT and RL Data via Gradient Concentration
巩固还是适应?PRISM:通过梯度集中解耦SFT和RL数据
Yang Zhao, Yangou Ouyang, Xiao Ding, Hepeng Wang, Bibo Cai, Kai Xiong, Jinglong Gao, Zhouhao Sun, Li Du, Bing Qin, Ting Liu
机构
*
Research Center for Social Computing and Interactive Robotics, Harbin Institute of Technology(哈尔滨工业大学社会计算与交互机器人研究中心)
;
Beijing Academy of Artificial Intelligence(北京人工智能研究院)
机构
*
Key Laboratory of Computing Power Network and Information Security, Ministry of Education, Shandong Computer Science Center (National Supercomputer Center in Jinan), Qilu University of Technology (Shandong Academy of Sciences)(计算能力网络与信息安全教育部重点实验室,山东省计算中心(国家超级计算济南中心),齐鲁工业大学(山东省科学院))
;
Shenyang Institute of Computing Technology, Chinese Academy of Sciences(中国科学院沈阳计算技术研究所)
;
MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所多模态人工智能系统实验室)
;
University of Chinese Academy of Sciences(中国科学院大学)
专题命中
指令微调
:LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)
Wenhong Zhu, Ruobing Xie, Rui Wang, Xingwu Sun, Di Wang, Pengfei Liu
机构
*
Shanghai Jiao Tong University(上海交通大学)
;
Shanghai Innovation Institute(上海创新研究院)
;
Large Language Model Department, Tencent(腾讯大语言模型部)
;
University of Macau(澳门大学)
Unified Graph Prompt Learning via Low-Rank Graph Message Prompting
通过低秩图消息提示实现统一图提示学习
Beibei Wang, Bo Jiang, Ziyan Zhang, Jin Tang
机构
*
School of Computer Science and Technology, Anhui University(安徽大学计算机科学与技术学院)
;
State Key Laboratory of Opto-Electronic Information Acquisition and Protection Technology, School of Computer Science and Technology, Anhui University(安徽大学计算机科学与技术学院光电信息获取与防护技术国家重点实验室)
CLSGen: A Dual-Head Fine-Tuning Framework for Joint Probabilistic Classification and Verbalized Explanation
CLSGen:一种用于联合概率分类和 verbalized 解释的双头微调框架
WonJin Yoon, Kangyu Zhu, Ian Bulovic, Autumn Sehy, Yanjun Gao, Dmitriy Dligach, Majid Afshar, Timothy A. Miller
机构
*
Boston Children’s Hospital(波士顿儿童医院)
;
Harvard Medical School(哈佛医学院)
;
University of Colorado Anschutz Medical Campus(科罗拉多大学安施图茨医学院)
;
Loyola University Chicago(芝加哥洛约拉大学)
;
University of Wisconsin Madison(威斯康星大学麦迪逊分校)
专题命中
指令微调
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL
BoxTuning: Directly Injecting the Object Box for Multimodal Model Fine-Tuning
BoxTuning:直接注入物体框进行多模态模型微调
Zekun Qian, Ruize Han, Wei Feng
机构
*
School of Computer Science and Technology, Tianjin University(天津大学计算机科学与技术学院)
;
Faculty of Computer Science and Artificial Intelligence, Shenzhen University of Advanced Technology(深圳理工大学计算机科学与人工智能学院)
专题命中
指令微调
:large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI
Ultra-Low-Dimensional Prompt Tuning via Random Projection
超低维提示调优
Zijun Wu, Yongchang Hao, Lili Mou
机构
*
Dept. Computing Science & Alberta Machine Intelligence Institute (Amii), University of Alberta(阿尔伯塔大学计算机科学系与阿尔伯塔机器智能研究所)
;
Canada CIFAR AI Chair(加拿大CIFAR人工智能讲席)
专题命中
指令微调
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL
Jailbreaking the Matrix: Nullspace Steering for Controlled Model Subversion
矩阵劫持:用于受控模型反制的空域操控
Vishal Pramanik, Maisha Maliha, Susmit Jha, Sumit Kumar Jha
机构
*
Department of Computer & Information Science & Engineering, University of Florida(佛罗里达大学计算机与信息科学与工程系)
;
School of Computer Science, University of Oklahoma(俄克拉荷马大学计算机科学学院)
;
Computer Science Laboratory, SRI International(SRI国际计算机科学实验室)
专题命中
指令微调
:large language model(abstract);language model(abstract);instruction tuning(abstract);分类 cs.AI