arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11567 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11567 篇

2409.06277 2025-06-10 cs.LG cs.AI 88%

Ferret: Federated Full-Parameter Tuning at Scale for Large Language Models

Yao Shu, Wenyang Hu, See-Kiong Ng, Bryan Kian Hsiang Low, Fei Richard Yu

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

Comments Published as a conference paper at ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13097 2025-06-03 cs.LG cs.CL 88%

Communication-Efficient and Tensorized Federated Fine-Tuning of Large Language Models

Sajjad Ghiasvand, Yifan Yang, Zhiyu Xue, Mahnoosh Alizadeh, Zheng Zhang, Ramtin Pedarsani

机构 * Electrical and Computer Engineering Department, UC Santa Barbara(加州大学圣芭芭拉分校电气与计算机工程系) Computer Science Department, UC Santa Barbara(加州大学圣芭芭拉分校计算机科学系)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.08491 2025-06-02 cs.CL cs.LG 88%

Contrastive Perplexity for Controlled Generation: An Application in Detoxifying Large Language Models

Tassilo Klein, Moin Nabi

机构 * SAP SE(SAP股份有限公司)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

Comments Accepted to ACL 2025 (Main Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20925 2025-05-28 cs.CL cs.AI 88%

Multi-objective Large Language Model Alignment with Hierarchical Experts

Zhuo Li, Guodong Du, Weiyang Guo, Yigeng Zhou, Xiucheng Li, Wenya Wang, Fangming Liu, Yequan Wang, Deheng Ye, Min Zhang, Jing Li

机构 * Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳)) Nanyang Technological University(南洋理工大学) Peng Cheng Laboratory(鹏城实验室) Beijing Academy of Artificial Intelligence(北京人工智能研究院) Tencent(腾讯)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19286 2025-05-28 cs.CL cs.LG cs.SI 88%

A Graph Perspective to Probe Structural Patterns of Knowledge in Large Language Models

Utkarsh Sahu, Zhisheng Qi, Yongjia Lei, Ryan A. Rossi, Franck Dernoncourt, Nesreen K. Ahmed, Mahantesh M Halappanavar, Yao Ma, Yu Wang

机构 * University of Oregon(俄勒冈大学) Adobe Research(Adobe研究) Cisco AI Research(思科人工智能研究) Pacific Northwest National Laboratory(太平洋西北国家实验室) Rensselaer Polytechnic Institute(拉特格斯理工学院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.08985 2025-05-28 cs.LG cs.AI 88%

T-REX: Mixture-of-Rank-One-Experts with Semantic-aware Intuition for Multi-task Large Language Model Finetuning

Rongyu Zhang, Yijiang Liu, Huanrui Yang, Shenli Zheng, Dan Wang, Yuan Du, Li Du, Shanghang Zhang

机构 * Nanjing University(南京大学) PolyU Peking University(北京大学) University of Arizona(亚利桑那大学) Ant Group(蚂蚁集团)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

Comments 18 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20109 2025-05-27 cs.CL cs.AI 88%

Language-Agnostic Suicidal Risk Detection Using Large Language Models

June-Woo Kim, Wonkyo Oh, Haram Yoon, Sung-Hoon Yoon, Dae-Jin Kim, Dong-Ho Lee, Sang-Yeol Lee, Chan-Mo Yang

机构 * Wonkwang University HospitalRepublic of Korea(Wonkwang大学医院) MODULABSRepublic of Korea(MODULABS) Wonkwang UniversityRepublic of Korea(Wonkwang大学) Department of Psychiatry RSC LAB(精神病学系RSC实验室) Department of Psychiatry, School of Medicine(精神病学系,医学院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted to InterSpeech 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19059 2025-05-27 cs.SE cs.AI cs.ET cs.LG 88%

An Initial Exploration of Fine-tuning Small Language Models for Smart Contract Reentrancy Vulnerability Detection

Ignacio Mariano Andreozzi Pofcher, Joshua Ellul

专题命中 指令微调 :language model(title,abstract);small language model(title);large language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18536 2025-05-27 cs.CL cs.AI cs.CV 88%

Reinforcement Fine-Tuning Powers Reasoning Capability of Multimodal Large Language Models

Haoyuan Sun, Jiaqi Wu, Bo Xia, Yifu Luo, Yifei Zhao, Kai Qin, Xufei Lv, Tiantian Zhang, Yongzhe Chang, Xueqian Wang

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院,清华大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07340 2025-05-27 cs.CL cs.AI 88%

Aligning Large Language Models to Follow Instructions and Hallucinate Less via Effective Data Filtering

Shuzheng Si, Haozhe Zhao, Gang Chen, Cheng Gao, Yuzhuo Bai, Zhitong Wang, Kaikai An, Kangyang Luo, Chen Qian, Fanchao Qi, Baobao Chang, Maosong Sun

机构 * Tsinghua University(清华大学) Peking University(北京大学) DeepLang AI

专题命中 指令微调 :large language model(title);language model(title);LLM(abstract);instruction tuning(abstract)

Comments ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14436 2025-05-21 cs.CL cs.AI 88%

Neural Incompatibility: The Unbridgeable Gap of Cross-Scale Parametric Knowledge Transfer in Large Language Models

Yuqiao Tan, Shizhu He, Kang Liu, Jun Zhao

机构 * The Key Laboratory of Cognition and Decision Intelligence for Complex Systems, Institute of Automation, Chinese Academy of Sciences(认知与决策智能复杂系统重点实验室,自动化研究所,中国科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(人工智能学院,中国科学院大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted by ACL'25 Main. Code link: https://github.com/Trae1ounG/Neural_Incompatibility

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.09597 2025-05-13 cs.CL cs.AI 88%

Clickbait Detection via Large Language Models

Han Wang, Yi Zhu, Ye Wang, Yun Li, Yunhao Yuan, Jipeng Qiang

机构 * School of Information Engineering, Yangzhou University(扬州大学信息工程学院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04666 2025-05-09 cs.CL cs.IR cs.LG 88%

Fine-Tuning Large Language Models and Evaluating Retrieval Methods for Improved Question Answering on Building Codes

Mohammad Aqib, Mohd Hamza, Qipei Mei, Ying Hei Chui

专题命中 指令微调 :language model(title,abstract);large language model(title);LLM(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00034 2025-05-06 cs.CL cs.AI 88%

Improving Phishing Email Detection Performance of Small Large Language Models

Zijie Lin, Zikang Liu, Hanbo Fan

机构 * National University of Singapore(新加坡国立大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.21053 2025-05-01 cs.LG cs.AI 88%

NeuRel-Attack: Neuron Relearning for Safety Disalignment in Large Language Models

Yi Zhou, Wenpeng Xing, Dezhang Kong, Changting Lin, Meng Han

机构 * Binjiang Institute of Zhejiang University(浙江大学滨江研究院) South China University of Technology(华南理工大学) Zhejiang University(浙江大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10617 2025-04-29 cs.CL cs.AI 88%

Compositional Subspace Representation Fine-tuning for Adaptive Large Language Models

Andy Zhou

机构 * Intology AI

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted to ICLR 2025 SCOPE

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18041 2025-04-28 cs.CL cs.AI 88%

RAG LLMs are Not Safer: A Safety Analysis of Retrieval-Augmented Generation for Large Language Models

Bang An, Shiyue Zhang, Mark Dredze

机构 * Bloomberg AI(布莱尔人工智能) University of Maryland(马里兰大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments NAACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.21060 2025-04-22 cs.CR cs.AI cs.LG 88%

CTINexus: Automatic Cyber Threat Intelligence Knowledge Graph Construction Using Large Language Models

Yutong Cheng, Osama Bajaber, Saimon Amanuel Tsegai, Dawn Song, Peng Gao

机构 * Virginia Tech(弗吉尼亚理工大学) UC Berkeley(加州大学伯克利分校)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

Comments Accepted at 2025 IEEE European Symposium on Security and Privacy (Euro S&P)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.02948 2025-04-10 cs.LG cs.AI 88%

PiSSA: Principal Singular Values and Singular Vectors Adaptation of Large Language Models

Fanxu Meng, Zhaohui Wang, Muhan Zhang

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

Comments NeurIPS 2024 spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04550 2025-04-08 cs.CV cs.AI cs.LG cs.RO 88%

Advancing Egocentric Video Question Answering with Multimodal Large Language Models

Alkesh Patel, Vibhav Chitalia, Yinfei Yang

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00031 2025-04-02 cs.CR cs.AI cs.CL 88%

Leaking LoRa: An Evaluation of Password Leaks and Knowledge Storage in Large Language Models

Ryan Marinelli, Magnus Eckhoff

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.06663 2025-03-19 cs.CL cs.AI 88%

Amuro and Char: Analyzing the Relationship between Pre-Training and Fine-Tuning of Large Language Models

Kaiser Sun, Mark Dredze

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Rep4NLP Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.01586 2025-03-18 cs.CL cs.AI 88%

Booster: Tackling Harmful Fine-tuning for Large Language Models via Attenuating Harmful Perturbation

Tiansheng Huang, Sihao Hu, Fatih Ilhan, Selim Furkan Tekin, Ling Liu

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04849 2025-03-10 cs.CL cs.AI cs.CY cs.HC cs.MA 88%

Enhancing Collective Intelligence in Large Language Models Through Emotional Integration

Likith Kadiyala, Ramteja Sajja, Yusuf Sermet, Ibrahim Demir

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments 23 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04064 2025-03-07 cs.CL cs.AI cs.CY 88%

Uncovering inequalities in new knowledge learning by large language models across different languages

Chenglong Wang, Haoyu Tang, Xiyuan Yang, Yueqi Xie, Jina Suh, Sunayana Sitaram, Junming Huang, Yu Xie, Zhaoya Gong, Xing Xie, Fangzhao Wu

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18168 2025-03-05 cs.CL cs.AI 88%

SECURA: Sigmoid-Enhanced CUR Decomposition with Uninterrupted Retention and Low-Rank Adaptation in Large Language Models

Yuxuan Zhang

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments New work on PEFT for LLMs, introducing S-MagNorm and CABR-LoRA to enhance fine-tuning performance and knowledge retention. In v4, we renamed Sigmoid-based Magnitude Normalization to S-MagNorm for clarity and added a gradient comparison between SECURA and CABR-LoRA to highlight their contributions

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.17812 2025-03-03 cs.LG cs.CL 88%

DropBP: Accelerating Fine-Tuning of Large Language Models by Dropping Backward Propagation

Sunghyeon Woo, Baeseong Park, Byeongwook Kim, Minjung Jo, Se Jung Kwon, Dongsuk Jeon, Dongsoo Lee

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16797 2025-02-25 cs.CL cs.AI 88%

Enhancing Answer Reliability Through Inter-Model Consensus of Large Language Models

Alireza Amiri-Margavi, Iman Jebellat, Ehsan Jebellat, Seyed Pouyan Mousavi Davoudi

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments 14 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14766 2025-02-20 cs.CL cs.LG 88%

Evaluating Large Language Models for Public Health Classification and Extraction Tasks

Joshua Harris, Timothy Laurence, Leo Loman, Fan Grayson, Toby Nonnenmacher, Harry Long, Loes WalsGriffith, Amy Douglas, Holly Fountain, Stelios Georgiou, Jo Hardstaff, Kathryn Hopkins, Y-Ling Chi, Galena Kuyumdzhieva, Lesley Larkin, Samuel Collins, Hamish Mohammed, Thomas Finnie, Luke Hounsome, Michael Borowitz, Steven Riley

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

Comments 36 pages. Feedback and comments are highly appreciated

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14735 2025-02-18 cs.CL cs.AI cs.NE 88%

Agent Skill Acquisition for Large Language Models via CycleQD

So Kuroki, Taishi Nakamura, Takuya Akiba, Yujin Tang

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments To appear at the 13th International Conference on Learning Representations (ICLR 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏