PrefixMemory-Tuning: Modernizing Prefix-Tuning by Decoupling the Prefix from Attention
PrefixMemory-Tuning: 通过解耦前缀与注意力来现代化前缀微调
Haonan Wang, Brian Chen, Siquan Li, Xinhe Liang, Hwee Kuan Lee, Kenji Kawaguchi, Tianyang Hu
机构
*
National University of Singapore(新加坡国立大学)
;
Bioinformatics Institute, A*STAR(A*STAR生物信息研究所)
;
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
专题命中
指令微调
:LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
Beyond Fine-Tuning: In-Context Learning and Chain-of-Thought for Reasoned Distractor Generation
超越微调:基于上下文学习和推理链的干扰项生成
Elaf Alhazmi, Quan Z. Sheng, Wei Emma Zhang
机构
*
School of Computing, Macquarie University, Australia(麦考瑞大学计算机学院,澳大利亚)
;
School of Computer and Mathematical Sciences, Adelaide University, Australia(阿德莱德大学计算机与数学科学学院,澳大利亚)
;
College of Engineering and Computing in Al-Lith, Umm Al-Qura University, Saudi Arabia(乌姆·阿尔·库拉大学阿尔·利思工程与计算学院,沙特阿拉伯)
专题命中
指令微调
:LLM(abstract_cn);large language model(abstract);language model(abstract);prompting(abstract)
Medical Image Understanding Improves Survival Prediction via Visual Instruction Tuning
医学图像理解通过视觉指令调优提升生存预测
Xixi Liu, Jorge Lazo, Andreas Hallqvist, Mikael Johansson, Åse Johnsson, Jonas S Andersson, Ella Äng Eklund, Patrik Sund, Nasser Hosseini, Jennifer Alvén, Ida Häggström
LIFT the Veil for the Truth: Principal Weights Emerge after Rank Reduction for Reasoning-Focused Supervised Fine-Tuning
揭开真相的面纱:秩减少后主权重的浮现使以推理为导向的监督微调得以提升
Zihang Liu, Tianyu Pang, Oleg Balabanov, Chaoqun Yang, Tianjin Huang, Lu Yin, Yaoqing Yang, Shiwei Liu
机构
*
University of California, Berkeley, CA, USA(加州大学伯克利分校)
;
International Computer Science Institute, CA, USA(国际计算机科学研究所)
;
Lawrence Berkeley National Laboratory, CA, USA(伯克利国家实验室)
;
Dartmouth College, NH, USA(达特茅斯学院)
;
University of Exeter, Exeter, UK(埃克塞特大学)
;
University of Oxford, Oxford, UK(牛津大学)
;
University of Surrey, Guildford, UK(萨里大学)
;
Tsinghua University, China(清华大学)
;
Eindhoven University of Technology, the Netherlands(埃因霍温理工大学)
ImpRIF: Stronger Implicit Reasoning Leads to Better Complex Instruction Following
ImpRIF:更强的隐式推理导致更好的复杂指令遵循
Yuancheng Yang, Lin Yang, Xu Wang, Chao Tong, Haihua Yang
机构
*
ByteDance China(字节跳动中国)
;
School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院)
;
State Key Laboratory of Virtual Reality Technology and Systems, Beihang University(北京航空航天大学虚拟现实技术与系统国家重点实验室)
专题命中
指令微调
:large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
Small Model as Master Orchestrator: Learning Unified Agent-Tool Orchestration with Parallel Subtask Decomposition
小模型作为主指挥者:通过并行子任务分解学习统一的智能体-工具协调
Wenzhen Yuan, Wutao Xiong, Fanchen Yu, Shengji Tang, Ting Liu, Tao Chen, Peng Ye, Yuzhuo Fu, Wanli Ouyang, Lei Bai
机构
*
Shanghai Jiao Tong University(上海交通大学)
;
Fudan University(复旦大学)
;
Shanghai AI Lab(上海人工智能实验室)
;
Sichuan University(四川大学)
;
The Chinese University of Hong Kong(香港中文大学)
机构
*
Yulin AI-Enhanced HealthCare Lab(云林人工智能增强医疗实验室)
;
School of Nursing, Fudan University(复旦大学护理学院)
;
School of Nursing, Medical College of Soochow University(苏州大学医学院护理学院)
;
School of Nursing, Dali University(大理大学护理学院)
;
Department of Advanced Interdisciplinary Studies, The University of Tokyo(东京大学先进跨学科研究部)
;
The First Affiliated Hospital of Soochow University(苏州大学第一附属医院)
;
Department of Nursing, The First Affiliated Hospital, Jiangxi Medical College, Nanchang University(江西医学院护理部,南昌大学第一附属医院)
;
School of Social Development, East China University of Political Science and Law(中国政法大学社会发展学院)
;
Rory Meyers College of Nursing, New York University(纽约大学 Rory Meyers 护理学院)
;
New York University Shanghai(纽约大学上海校区)