arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11511 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11511 篇

2412.00631 2025-09-01 cs.LG cs.AI cs.CL 90%

ROSE: A Reward-Oriented Data Selection Framework for LLM Task-Specific Instruction Tuning

Yang Wu, Huayi Zhang, Yizheng Jiao, Lin Ma, Xiaozhong Liu, Jinhong Yu, Dongyu Zhang, Dezhi Yu, Wei Xu

机构 * Worcester Polytechnic Institute(沃斯特理工学院) ByteDance Inc.(字节跳动公司)

专题命中 指令微调 :instruction tuning(title,abstract);LLM(title);large language model(abstract);language model(abstract)

Comments EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18793 2025-08-27 cs.SE 90%

SolEval: Benchmarking Large Language Models for Repository-level Solidity Code Generation

Zhiyuan Peng, Xin Yin, Rui Qian, Peiqin Lin, Yongkang Liu, Hao Zhang, Chenhao Ying, Yuan Luo

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);SFT(abstract)

Comments Accepted By EMNLP'25-Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.09805 2025-08-05 q-bio.QM cs.AI cs.CL cs.LG stat.AP 90%

Contextual Phenotyping of Pediatric Sepsis Cohort Using Large Language Models

Aditya Nagori, Ayush Gautam, Matthew O. Wiens, Vuong Nguyen, Nathan Kenya Mugisha, Jerome Kabakyenga, Niranjan Kissoon, John Mark Ansermino, Rishikesan Kamaleswaran

机构 * Department of Surgery, Duke university school of medicine(杜克大学医学学院外科部) Department of Anesthesiology, Duke university school of medicine(杜克大学医学学院麻醉科) Indian Institute of Technology, Goa(印度去邦理工学院) Institute for Global Health, BC Children’s Hospital and BC Women’s Hospital + Health Centre(全球健康研究所,BC儿童医院和BC妇女医院及健康中心) Department of Anesthesia, Pharmacology & Therapeutics, University of British Columbia(不列颠哥伦比亚大学麻醉学、药理学与治疗学系) BC Children’s Hospital Research Institute, BC Children’s Hospital(BC儿童医院研究学院,BC儿童医院) Department of Pediatrics, University of British Columbia(不列颠哥伦比亚大学儿科系) Walimu, Kampala, Uganda(乌干达坎帕拉沃尔imu) Department of Community Health, Mbarara University of Science and Technology(马巴拉拉大学科学与技术学院社区健康系)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 11 pages, 2 Figures, 1 Table

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02020 2025-08-05 cs.IR 90%

Evaluating Position Bias in Large Language Model Recommendations

Ethan Bito, Yongli Ren, Estrid He

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.05727 2025-08-05 cs.CL cs.AI cs.LG 90%

Self-Evolving Critique Abilities in Large Language Models

Zhengyang Tang, Ziniu Li, Zhenyang Xiao, Tian Ding, Ruoyu Sun, Benyou Wang, Dayiheng Liu, Fei Huang, Tianyu Liu, Bowen Yu, Junyang Lin

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Shenzhen Research Institute of Big Data(深圳大数据研究院) Shenzhen International Center for Industrial and Applied Mathematics(深圳国际工业与应用数学中心) Qwen Team, Alibaba Inc.(阿里云通义团队)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.13238 2025-06-17 cs.LG cs.AI cs.CL 90%

Personalized Wireless Federated Learning for Large Language Models

Feibo Jiang, Li Dong, Siwei Tu, Yubo Peng, Kezhi Wang, Kun Yang, Cunhua Pan, Dusit Niyato

机构 * IEEE

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);instruction tuning(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 7 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06854 2025-06-06 cs.LG cs.AI cs.CL 90%

Can Large Language Models Understand Intermediate Representations in Compilers?

Hailong Jiang, Jianfeng Zhu, Yao Wan, Bo Fang, Hongyu Zhang, Ruoming Jin, Qiang Guan

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20633 2025-05-28 cs.CL cs.AI cs.LG 90%

Test-Time Learning for Large Language Models

Jinwu Hu, Zhitian Zhang, Guohao Chen, Xutao Wen, Chao Shuai, Wei Luo, Bin Xiao, Yuanqing Li, Mingkui Tan

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by ICML2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.08185 2025-05-22 cs.CL cs.AI cs.LG 90%

Fine-tuning Large Language Models for Entity Matching

Aaron Steiner, Ralph Peeters, Christian Bizer

机构 * University of Mannheim(曼海姆大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 8 pages, 4 figures. For related code and data, see this https://github.com/wbsg-uni-mannheim/TailorMatch

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13515 2025-05-21 cs.LG cs.AI cs.CL 90%

LoRASuite: Efficient LoRA Adaptation Across Large Language Model Upgrades

Yanan Li, Fanxu Meng, Muhan Zhang, Shiai Zhu, Shangguang Wang, Mengwei Xu

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Peking University(北京大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11389 2025-05-07 cs.CR 90%

PEEK: Phishing Evolution Framework for Phishing Generation and Evolving Pattern Analysis using Large Language Models

Fengchao Chen, Tingmin Wu, Van Nguyen, Shuo Wang, Alsharif Abuadbba, Carsten Rudolph

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00662 2025-05-02 cs.CL cs.AI cs.LG 90%

DeepCritic: Deliberate Critique with Large Language Models

Wenkai Yang, Jingwen Chen, Yankai Lin, Ji-Rong Wen

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学首都人工智能学院) School of Computer Science and Technology, Beijing Jiaotong University(北京交通大学计算机科学与技术学院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Work in progress. Data and models are available at https://github.com/RUCBM/DeepCritic

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.17525 2025-05-02 cs.LG cs.AI cs.CL 90%

Large Language Model Agent as a Mechanical Designer

Yayati Jadhav, Amir Barati Farimani

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.16326 2025-04-29 cs.CL cs.AI cs.IR cs.LG 90%

Benchmarking large language models for biomedical natural language processing applications and recommendations

Qingyu Chen, Yan Hu, Xueqing Peng, Qianqian Xie, Qiao Jin, Aidan Gilson, Maxwell B. Singer, Xuguang Ai, Po-Ting Lai, Zhizheng Wang, Vipina Kuttichi Keloth, Kalpana Raja, Jiming Huang, Huan He, Fongci Lin, Jingcheng Du, Rui Zhang, W. Jim Zheng, Ron A. Adelman, Zhiyong Lu, Hua Xu

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Journal ref Nature Communications; 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04351 2025-04-08 cs.SE cs.AI cs.CL cs.LG 90%

DDPT: Diffusion-Driven Prompt Tuning for Large Language Model Code Generation

Jinyang Li, Sangwon Hyun, M. Ali Babar

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ICSE CAIN 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10870 2025-04-01 cs.CL cs.AI cs.LG 90%

PortLLM: Personalizing Evolving Large Language Models with Training-Free and Portable Model Patches

Rana Muhammad Shahroz Khan, Pingzhi Li, Sukwon Yun, Zhenyu Wang, Shahriar Nirjon, Chau-Wai Wong, Tianlong Chen

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20807 2025-03-28 stat.ML cs.AI cs.CL cs.LG 90%

Fundamental Safety-Capability Trade-offs in Fine-tuning Large Language Models

Pin-Yu Chen, Han Shen, Payel Das, Tianyi Chen

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments The first two authors contribute equally to this work and are listed in alphabetical order

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08144 2025-03-21 cs.CV 90%

Bring Remote Sensing Object Detect Into Nature Language Model: Using SFT Method

Fei Wang, Chengcheng Chen, Hongyu Chen, Yugang Chang, Weiming Zeng

专题命中 指令微调 :language model(title,abstract);SFT(title,abstract);large language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11739 2025-03-18 cs.LG cs.AI cs.CL 90%

CoLLMLight: Cooperative Large Language Model Agents for Network-Wide Traffic Signal Control

Zirui Yuan, Siqi Lai, Hao Liu

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Under review, 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10793 2025-03-17 cs.CR cs.SE 90%

HALURust: Exploiting Hallucinations of Large Language Models to Detect Vulnerabilities in Rust

Yu Luo, Han Zhou, Mengtao Zhang, Dylan De La Rosa, Hafsa Ahmed, Weifeng Xu, Dianxiang Xu

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.10510 2025-03-10 cs.NE cs.AI cs.CL cs.LG 90%

When Large Language Models Meet Evolutionary Algorithms: Potential Enhancements and Challenges

Chao Wang, Jiaxuan Zhao, Licheng Jiao, Lingling Li, Fang Liu, Shuyuan Yang

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments The article has been accepted for publication in Research

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01703 2025-02-05 cs.LG cs.AI cs.CL 90%

QLESS: A Quantized Approach for Data Valuation and Selection in Large Language Model Fine-Tuning

Moses Ananta, Muhammad Farid Adilazuarda, Zayd Muhammad Kawakibi Zuhri, Ayu Purwarianti, Alham Fikri Aji

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.13816 2025-01-24 cs.IR 90%

Large Language Model driven Policy Exploration for Recommender Systems

Jie Wang, Alexandros Karatzoglou, Ioannis Arapakis, Joemon M. Jose

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09237 2025-01-17 cs.DC 90%

Split Fine-Tuning for Large Language Models in Wireless Networks

Songge Zhang, Guoliang Cheng, Xinyu Huang, Zuguang Li, Wen Wu, Lingyang Song, Xuemin Shen

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);SFT(abstract)

Comments 14pages, 10figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.05706 2025-01-13 cs.SE cs.HC 90%

Debugging Without Error Messages: How LLM Prompting Strategy Affects Programming Error Explanation Effectiveness

Audrey Salmon, Katie Hammer, Eddie Antonio Santos, Brett A. Becker

专题命中 指令微调 :LLM(title,abstract);prompting(title,abstract);large language model(abstract);language model(abstract)

Comments 7 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16620 2024-12-24 cs.SE 90%

A Large-scale Empirical Study on Fine-tuning Large Language Models for Unit Testing

Ye Shang, Quanjun Zhang, Chunrong Fang, Siqi Gu, Jianyi Zhou, Zhenyu Chen

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments Accepted to the ACM SIGSOFT International Symposium on Software Testing and Analysis (ISSTA 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.02987 2024-12-19 cs.LG cs.AI cs.CL 90%

LoRA-Guard: Parameter-Efficient Guardrail Adaptation for Content Moderation of Large Language Models

Hayder Elesedy, Pedro M. Esperança, Silviu Vlad Oprea, Mete Ozay

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.11441 2024-12-17 cs.CL cs.AI cs.LG 90%

InfuserKI: Enhancing Large Language Models with Knowledge Graphs via Infuser-Guided Knowledge Integration

Fali Wang, Runxue Bao, Suhang Wang, Wenchao Yu, Yanchi Liu, Wei Cheng, Haifeng Chen

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 14 pages, 7 figures, EMNLP 2024 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16714 2024-12-11 cs.CL cs.AI cs.LG 90%

AutoDetect: Towards a Unified Framework for Automated Weakness Detection in Large Language Models

Jiale Cheng, Yida Lu, Xiaotao Gu, Pei Ke, Xiao Liu, Yuxiao Dong, Hongning Wang, Jie Tang, Minlie Huang

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments EMNLP 2024 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.02549 2024-11-14 cs.CL cs.AI cs.LG 90%

Are Large Language Models Table-based Fact-Checkers?

Hanwen Zhang, Qingyi Si, Peng Fu, Zheng Lin, Weiping Wang

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);instruction tuning(abstract);分类 cs.CL、cs.AI、cs.LG

Comments CSCWD 2024

详情

展开后加载摘要…

URL PDF HTML 收藏