arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11585 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11585 篇

2506.11638 2025-06-16 cs.CL cs.AI 87%

LoRA-Gen: Specializing Large Language Model via Online LoRA Generation

Yicheng Xiao, Lin Song, Rui Yang, Cheng Cheng, Yixiao Ge, Xiu Li, Ying Shan

机构 * Tsinghua University(清华大学) ARC Lab, Tencent PCG(腾讯PCG实验室) The University of Hong Kong(香港大学) Xi’an JiaoTong University(西安交通大学)

专题命中 指令微调 :language model(title,abstract);large language model(title);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.12244 2025-05-28 cs.CL cs.AI 87%

WizardLM: Empowering large pre-trained language models to follow complex instructions

Can Xu, Qingfeng Sun, Kai Zheng, Xiubo Geng, Pu Zhao, Jiazhan Feng, Chongyang Tao, Qingwei Lin, Daxin Jiang

专题命中 指令微调 :language model(title,abstract);large language model(abstract,comments);LLM(abstract);分类 cs.CL、cs.AI

Comments large language model, instruction fine-tune

Journal ref The Twelfth International Conference on Learning Representations (ICLR 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.00137 2025-04-30 cs.CL cs.AI 87%

Correcting Negative Bias in Large Language Models through Negative Attention Score Alignment

Sangwon Yu, Jongyoon Song, Bongkyu Hwang, Hoyoung Kang, Sooah Cho, Junhwa Choi, Seongho Joe, Taehee Lee, Youngjune L. Gwon, Sungroh Yoon

机构 * Department of Electrical and Computer Engineering, Seoul National University(电子与计算机工程系,首尔国立大学) Samsung SDS, Korea(三星SDS,韩国) AIIS, ASRI, INMC, ISRC, and IPAI, Seoul National University(人工智能研究所、人工智能研究机构、智能网络中心、智能系统研究室和人工智能政策研究所,首尔国立大学)

专题命中 指令微调 :language model(title,abstract);large language model(title);分类 cs.CL、cs.AI

Comments NAACL 2025 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04336 2025-04-08 cs.CL cs.AI 87%

Generative Large Language Models Trained for Detecting Errors in Radiology Reports

Cong Sun, Kurt Teichman, Yiliang Zhou, Brian Critelli, David Nauheim, Graham Keir, Xindi Wang, Judy Zhong, Adam E Flanders, George Shih, Yifan Peng

专题命中 指令微调 :large language model(title);language model(title);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10217 2025-03-14 cs.LG cs.AI cs.DC 87%

Efficient Federated Fine-Tuning of Large Language Models with Layer Dropout

Shilong Wang, Jianchun Liu, Hongli Xu, Jiaming Yan, Xianjun Gao

专题命中 指令微调 :large language model(title);language model(title);LLM(abstract);分类 cs.AI、cs.LG

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05223 2025-03-11 cs.LG cs.AI 87%

CorDA: Context-Oriented Decomposition Adaptation of Large Language Models for Task-Aware Parameter-Efficient Fine-tuning

Yibo Yang, Xiaojie Li, Zhongzhu Zhou, Shuaiwen Leon Song, Jianlong Wu, Liqiang Nie, Bernard Ghanem

专题命中 指令微调 :large language model(title);language model(title);LLM(abstract);分类 cs.AI、cs.LG

Comments NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10288 2025-03-03 cs.CL cs.LG 87%

Do as I do (Safely): Mitigating Task-Specific Fine-tuning Risks in Large Language Models

Francisco Eiras, Aleksandar Petrov, Philip H. S. Torr, M. Pawan Kumar, Adel Bibi

专题命中 指令微调 :large language model(title);language model(title);prompting(abstract);分类 cs.CL、cs.LG

Comments Accepted to ICLR'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12346 2025-02-19 cs.LG cs.AI 87%

QuZO: Quantized Zeroth-Order Fine-Tuning for Large Language Models

Jiajun Zhou, Yifan Yang, Kai Zhen, Ziyue Liu, Yequan Zhao, Ershad Banijamali, Athanasios Mouchtaris, Ngai Wong, Zheng Zhang

专题命中 指令微调 :language model(title,abstract);large language model(title);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.17985 2025-01-22 cs.CL cs.AI cs.SI 87%

Detection of Conspiracy Theories Beyond Keyword Bias in German-Language Telegram Using Large Language Models

Milena Pustet, Elisabeth Steffen, Helena Mihaljević

专题命中 指令微调 :large language model(title);language model(title);prompting(abstract);分类 cs.CL、cs.AI

Comments Accepted to the 8th Workshop on Online Abuse and Harms (WOAH), ACL 2024

Journal ref in: 8th Workshop on Online Abuse and Harms (WOAH), ACL (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18242 2024-11-28 cs.CL cs.AI 87%

Thai Financial Domain Adaptation of THaLLE -- Technical Report

KBTG Labs, Atthakorn Petchsod, Pornchanan Balee, Danupat Khamnuansin, Anuruth Lertpiya, Chanatip Saetia, Tawunrat Chalothorn, Thadpong Pongthawornkamol, Monchai Lertsutthiwong

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.19025 2024-10-28 cs.LG cs.AI 87%

Large Language Models for Financial Aid in Financial Time-series Forecasting

Md Khairul Islam, Ayush Karmacharya, Timothy Sue, Judy Fox

专题命中 指令微调 :large language model(title);language model(title);foundation model(abstract);分类 cs.AI、cs.LG

Comments GitHub link MLSys/Financial-Time-Series" target="_blank" rel="noopener">https://github.com/UVA-MLSys/Financial-Time-Series

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16799 2024-09-26 cs.AI cs.LG stat.AP 87%

Large Language Model Predicts Above Normal All India Summer Monsoon Rainfall in 2024

Ujjawal Sharma, Madhav Biyani, Akhil Dev Suresh, Debi Prasad Bhuyan, Saroj Kanta Mishra, Tanmoy Chakraborty

专题命中 指令微调 :large language model(title);language model(title);LLM(abstract);分类 cs.AI、cs.LG

Comments 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.05385 2024-09-19 cs.CL cs.AI 87%

Towards Building a Robust Knowledge Intensive Question Answering Model with Large Language Models

Xingyun Hong, Yan Shao, Zhilin Wang, Manni Duan, Jin Xiongnan

专题命中 指令微调 :large language model(title);language model(title);LLM(abstract);分类 cs.CL、cs.AI

Comments This paper has been accepted by NLPCC-2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.00209 2024-09-04 cs.CL cs.LG 87%

Enhancing Event Reasoning in Large Language Models through Instruction Fine-Tuning with Semantic Causal Graphs

Mazal Bethany, Emet Bethany, Brandon Wherry, Cho-Yu Chiang, Nishant Vishwamitra, Anthony Rios, Peyman Najafirad

专题命中 指令微调 :large language model(title);language model(title);prompting(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.16753 2024-08-30 cs.CL cs.LG 87%

Reinforcement Learning without Human Feedback for Last Mile Fine-Tuning of Large Language Models

Alec Solway

专题命中 指令微调 :language model(title,abstract);large language model(title);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.12884 2024-05-22 cs.CL cs.AI 87%

Investigating Persuasion Techniques in Arabic: An Empirical Study Leveraging Large Language Models

Abdurahmman Alzahrani, Eyad Babkier, Faisal Yanbaawi, Firas Yanbaawi, Hassan Alhuzali

专题命中 指令微调 :language model(title,abstract);large language model(title);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.07301 2024-05-14 cs.CL cs.AI 87%

Small Language Model Can Self-correct

Haixia Han, Jiaqing Liang, Jie Shi, Qianyu He, Yanghua Xiao

专题命中 指令微调 :language model(title,abstract);small language model(title);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.01552 2023-12-05 cs.CL cs.AI 87%

The Unlocking Spell on Base LLMs: Rethinking Alignment via In-Context Learning

Bill Yuchen Lin, Abhilasha Ravichander, Ximing Lu, Nouha Dziri, Melanie Sclar, Khyathi Chandu, Chandra Bhagavatula, Yejin Choi

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)

Comments 26 pages, 8 figures. Project website: https://allenai.github.io/re-align/

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.18063 2023-12-01 cs.CL cs.LG cs.SI 87%

TurkishBERTweet: Fast and Reliable Large Language Model for Social Media Analysis

Ali Najafi, Onur Varol

专题命中 指令微调 :language model(title,abstract);large language model(title);分类 cs.CL、cs.LG

Comments 21 pages, 4 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.00035 2023-10-06 cs.LG cs.AI 87%

LoRA ensembles for large language model fine-tuning

Xi Wang, Laurence Aitchison, Maja Rudolph

专题命中 指令微调 :large language model(title);language model(title);LLM(abstract);分类 cs.AI、cs.LG

Comments Update the title in the PDF file

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.01240 2023-08-03 cs.CL cs.AI 87%

Evaluating Instruction-Tuned Large Language Models on Code Comprehension and Generation

Zhiqiang Yuan, Junwei Liu, Qiancheng Zi, Mingwei Liu, Xin Peng, Yiling Lou

专题命中 指令微调 :large language model(title);language model(title);instruction tuning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.10464 2023-08-01 cs.LG cs.CL 87%

SPDF: Sparse Pre-training and Dense Fine-tuning for Large Language Models

Vithursan Thangarasa, Abhay Gupta, William Marshall, Tianda Li, Kevin Leong, Dennis DeCoste, Sean Lie, Shreyas Saxena

专题命中 指令微调 :language model(title,abstract);large language model(title);分类 cs.CL、cs.LG

Comments Accepted to Uncertainty in Artificial Intelligence (UAI) 2023 Conference; 13 pages, 4 figures (Main Paper) + 5 pages (Supplementary Material)

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.12132 2023-03-23 cs.CL cs.CR cs.LG 87%

Fundamentals of Generative Large Language Models and Perspectives in Cyber-Defense

Andrei Kucharavy, Zachary Schillaci, Loïc Maréchal, Maxime Würsch, Ljiljana Dolamic, Remi Sabonnadiere, Dimitri Percia David, Alain Mermoud, Vincent Lenders

专题命中 指令微调 :language model(title,abstract);large language model(title);分类 cs.CL、cs.LG

Comments 41 pages (without references), 13 figures; public report of Cyber-Defence Campus

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.16637 2022-11-24 cs.CL cs.LG 87%

Beyond Prompting: Making Pre-trained Language Models Better Zero-shot Learners by Clustering Representations

Yu Fei, Ping Nie, Zhao Meng, Roger Wattenhofer, Mrinmaya Sachan

专题命中 指令微调 :language model(title,abstract);prompting(title);分类 cs.CL、cs.LG

Comments Accepted to EMNLP 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.05687 2021-09-14 cs.CL cs.AI 87%

Raise a Child in Large Language Model: Towards Effective and Generalizable Fine-tuning

Runxin Xu, Fuli Luo, Zhiyuan Zhang, Chuanqi Tan, Baobao Chang, Songfang Huang, Fei Huang

专题命中 指令微调 :language model(title,abstract);large language model(title);分类 cs.CL、cs.AI

Comments Accepted as a long paper to EMNLP 2021 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2102.00875 2021-02-02 cs.LG cs.CL cs.DC 87%

Scaling Federated Learning for Fine-tuning of Large Language Models

Agrin Hilmkil, Sebastian Callh, Matteo Barbieri, Leon René Sütfeld, Edvin Listo Zec, Olof Mogren

专题命中 指令微调 :language model(title,abstract);large language model(title);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16275 2025-09-23 cs.CR cs.AI cs.SE 87%

SecureFixAgent: A Hybrid LLM Agent for Automated Python Static Vulnerability Repair

Jugal Gajjar, Kamalasankari Subramaniakuppusamy, Relsy Puthal, Kaustik Ranaware

机构 * Computer Science Department(计算机科学系) Applied Economics Department(应用经济学系)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract,comments);language model(abstract,comments);分类 cs.AI

Comments 6 pages, 3 figures, 4 tables, 1 algorithm, accepted in the Robustness and Security of Large Language Models (ROSE-LLM) special session at ICMLA 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.09796 2024-01-22 cs.LG cs.CR 87%

A Fast, Performant, Secure Distributed Training Framework For Large Language Model

Wei Huang, Yinggui Wang, Anda Cheng, Aihui Zhou, Chaofan Yu, Lei Wang

专题命中 指令微调 :large language model(title);language model(title);LLM(abstract,comments);分类 cs.LG

Comments Accepted by ICASSP 2024 (Federated LLM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12147 2026-08-18 cs.CL cs.AI cs.LG 版本更新 87%

Improving Influence-based Instruction Tuning Data Selection for Balanced Learning of Diverse Capabilities

改进基于影响力的指令调优数据选择以实现多样化能力的均衡学习

Qirun Dai, Dylan Zhang, Jiaqi W. Ma, Hao Peng

专题命中 指令微调 :instruction tuning(title);LLM(abstract_cn);large language model(abstract);language model(abstract)

AI总结 该研究针对基于影响力的指令调优数据选择的任务偏向问题,提出BIDS算法,经实验验证其在小比例数据下可实现更均衡性能且优于现有方法。

Comments Accepted to EMNLP 2025 (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06027 2026-08-13 cs.AI cs.CL cs.LG cs.SI 版本更新 87%

RedditPersona: A Modular Framework for Community-Conditioned LLM Adaptation from Reddit

RedditPersona: 一个用于从Reddit进行社区条件化LLM适配的模块化框架

Amirhossein Ghaffari, Ali Goodarzi, Huong Nguyen, Simo Hosio, Lauri Lovén, Ekaterina Gilman

机构 * Future Computing Group University of Oulu(未来计算组奥卢大学) Centre for Applied Computing University of Oulu(应用计算中心奥卢大学)

专题命中 指令微调 :LLM(title,title_cn);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出RedditPersona模块化框架,通过五种分组策略和QLoRA训练参数高效适配器,在112个Reddit子版块上评估社区条件化语言模型,发现适配器的行为可识别性与策略内在一致性相关,且所有策略在可识别性和分布相似性之间存在一致权衡。

Comments Accepted manuscript (CC BY 4.0). To appear in ACM CIKM 2026, Rome, Italy, Nov 7-11, 2026. DOI: https://doi.org/10.1145/3799682.3840182

详情

展开后加载摘要…

URL PDF HTML 收藏