arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11585 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11585 篇

2508.11889 2025-08-19 cs.CL 85%

In-Context Examples Matter: Improving Emotion Recognition in Conversation with Instruction Tuning

Hui Ma, Bo Zhang, Jinpeng Hu, Zenglin Shi

专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10467 2025-08-15 cs.AI cs.DL 85%

FIRESPARQL: A LLM-based Framework for SPARQL Query Generation over Scholarly Knowledge Graphs

Xueli Pan, Victor de Boer, Jacco van Ossenbruggen

机构 * Vrije Universiteit Amsterdam(阿姆斯特丹自由大学)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted at 17th International Joint Conference on Knowledge Discovery, Knowledge Engineering and Knowledge Management (IC3K)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07371 2025-08-12 cs.SE cs.AI 85%

AutoAssert 1: A LoRA Fine-Tuned LLM Model for Efficient Automated Assertion Generation

Yi Zhong, Hongchao Liu, Di ZHao

机构 * Institute of Computing Technology(计算技术研究所) Chinese Academy of Sciences(中国科学院) International College(国际学院) Beijing University of Posts and Telecommunications(北京邮电大学) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 16pages,6figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07172 2025-08-12 cs.CL 85%

Gradient Surgery for Safe LLM Fine-Tuning

Biao Yi, Jiahao Li, Baolei Zhang, Lihai Nie, Tong Li, Tiansheng Huang, Zheli Liu

机构 * Nankai University(南开大学)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06765 2025-08-12 cs.LG 85%

Fed MobiLLM: Efficient Federated LLM Fine-Tuning over Heterogeneous Mobile Devices via Server Assisted Side-Tuning

Xingke Yang, Liang Li, Sicong Li, Liwei Guan, Hao Wang, Xiaoqi Qi, Jiang Liu, Xin Fu, Miao Pan

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01216 2025-08-12 cs.LG cs.CR 85%

PAE MobiLLM: Privacy-Aware and Efficient LLM Fine-Tuning on the Mobile Device via Additive Side-Tuning

Xingke Yang, Liang Li, Zhiyi Wan, Sicong Li, Xiaoqi Qi, Jiang Liu, Tomoaki Ohtsuki, Xin Fu, Miao Pan

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04063 2025-08-07 cs.LG 85%

Fine-tuning for Better Few Shot Prompting: An Empirical Comparison for Short Answer Grading

Joel Walsh, Siddarth Mamidanna, Benjamin Nye, Mark Core, Daniel Auerbach

机构 * University of Southern California - Institute for Creative Technologies(南加州大学创意技术研究所) University of California, Santa Cruz(加州大学圣克鲁兹分校)

专题命中 指令微调 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments Proceedings of the Second Workshop on Automated Evaluation of Learning and Assessment Content co-located with 26th International Conference on Artificial Intelligence in Education (AIED 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.16491 2025-07-30 cs.CL 85%

BIG5-CHAT: Shaping LLM Personalities Through Training on Human-Grounded Data

Wenkai Li, Jiarui Liu, Andy Liu, Xuhui Zhou, Mona Diab, Maarten Sap

机构 * Language Technologies Institute, Carnegie Mellon University(卡内基梅隆大学语言技术研究所)

专题命中 指令微调 :LLM(title,abstract);preference optimization(abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18812 2025-07-28 cs.SE cs.AI 85%

MemoCoder: Automated Function Synthesis using LLM-Supported Agents

Yiping Jia, Zhen Ming Jiang, Shayan Noei, Ying Zou

机构 * Queen's University(女王大学) York University(约克大学)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05209 2025-07-28 cs.CR cs.AI 85%

Model Tampering Attacks Enable More Rigorous Evaluations of LLM Capabilities

Zora Che, Stephen Casper, Robert Kirk, Anirudh Satheesh, Stewart Slocum, Lev E McKinney, Rohit Gandikota, Aidan Ewart, Domenic Rosati, Zichu Wu, Zikui Cai, Bilal Chughtai, Yarin Gal, Furong Huang, Dylan Hadfield-Menell

机构 * University of Maryland(马里兰大学) MIT CSAIL(麻省理工学院计算机科学与人工智能实验室) UK AI Security Institute(英国人工智能安全研究所) University of Toronto(多伦多大学) Northeastern University(东北大学) Haize Labs(Haize实验室) Dalhousie University(达尔豪斯大学) University of Waterloo(滑铁卢大学) University of Oxford(牛津大学) MIT(麻省理工学院)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted to TMLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11704 2025-07-22 cs.AI 85%

A Library of LLM Intrinsics for Retrieval-Augmented Generation

Marina Danilevsky, Kristjan Greenewald, Chulaka Gunasekara, Maeda Hanafi, Lihong He, Yannis Katsis, Krishnateja Killamsetty, Yulong Li, Yatin Nandwani, Lucian Popa, Dinesh Raghu, Frederick Reiss, Vraj Shah, Khoi-Nguyen Tran, Huaiyu Zhu, Luis Lastras

机构 * IBM Research(IBM研究院)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments This (June 2025) is the second version of this paper (the first was published in April 2025). Intrinsics implemented as LoRAs are now trained on IBM Granite 3.3 8b instruct (previously 3.2)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11558 2025-07-17 cs.CV cs.AI 85%

Reprogramming Vision Foundation Models for Spatio-Temporal Forecasting

Changlu Chen, Yanbin Liu, Chaoxi Niu, Ling Chen, Tianqing Zhu

专题命中 指令微调 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12318 2025-07-15 cs.CR cs.AI 85%

UTF:Undertrained Tokens as Fingerprints A Novel Approach to LLM Identification

Jiacheng Cai, Jiahao Yu, Yangguang Shao, Yuhang Wu

机构 * Shanghai Jiao Tong University(上海交通大学) Northwestern University(西北大学) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.13949 2025-07-02 cs.CV cs.AI 85%

SMoLoRA: Exploring and Defying Dual Catastrophic Forgetting in Continual Visual Instruction Tuning

Ziqi Wang, Chang Che, Qi Wang, Yangyang Li, Zenglin Shi, Meng Wang

机构 * Hefei University of Technology(合肥工业大学) Tsinghua University(清华大学) Academy of Cyber(网络学院)

专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.22819 2025-07-01 cs.CV cs.LG 85%

Prompting without Panic: Attribute-aware, Zero-shot, Test-Time Calibration

Ramya Hebbalaguppe, Tamoghno Kandar, Abhinav Nagpal, Chetan Arora

机构 * IIT Delhi(德里印度理工学院) TCS Research Labs(塔塔咨询公司研究实验室)

专题命中 指令微调 :prompting(title);LLM(abstract);large language model(abstract);language model(abstract)

Comments 26 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16334 2025-07-01 cs.CL 85%

LLM Braces: Straightening Out LLM Predictions with Relevant Sub-Updates

Ying Shen, Lifu Huang

机构 * Computer Science Department University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校计算机科学系) Computer Science Department UC Davis(加州大学戴维斯分校计算机科学系)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments ACL 2025, 16 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17670 2025-06-24 cs.LG 85%

Online Multi-LLM Selection via Contextual Bandits under Unstructured Context Evolution

Manhin Poon, XiangXiang Dai, Xutong Liu, Fang Kong, John C. S. Lui, Jinhang Zuo

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17449 2025-06-24 cs.AI 85%

OmniReflect: Discovering Transferable Constitutions for LLM agents via Neuro-Symbolic Reflections

Manasa Bharadwaj, Nikhil Verma, Kevin Ferreira

机构 * LG Electronics, Toronto AI Lab(LG电子,多伦多人工智能实验室)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15683 2025-06-19 cs.CL cs.CY 85%

PhantomHunter: Detecting Unseen Privately-Tuned LLM-Generated Text via Family-Aware Learning

Yuhui Shi, Yehan Yang, Qiang Sheng, Hao Mi, Beizhe Hu, Chaoxi Xu, Juan Cao

机构 * University of Chinese Academy of Sciences(中国科学院大学)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments 17 pages, 3 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13116 2025-06-19 cs.CR cs.AR cs.LG 85%

VeriLeaky: Navigating IP Protection vs Utility in Fine-Tuning for LLM-Driven Verilog Coding

Zeng Wang, Minghao Shao, Mohammed Nabeel, Prithwish Basu Roy, Likhitha Mankali, Jitendra Bhandari, Ramesh Karri, Ozgur Sinanoglu, Muhammad Shafique, Johann Knechtel

机构 * NYU Tandon School of Engineering(纽约大学Tandon工程学院) NYU Abu Dhabi(纽约大学阿布扎克分校)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14336 2025-06-18 cs.AI 85%

AviationLLM: An LLM-based Knowledge System for Aviation Training

Jia'ang Wan, Feng Shen, Fujuan Li, Yanjin Sun, Yan Li, Shiwen Zhang

机构 * Wuhan University(武汉大学) China Eastern Technology Application Research And Development Center Co., Ltd(中国东方技术应用研发有限公司)

专题命中 指令微调 :LLM(title,abstract);SFT(abstract);preference optimization(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10424 2025-06-13 cs.CR cs.AI 85%

SOFT: Selective Data Obfuscation for Protecting LLM Fine-tuning against Membership Inference Attacks

Kaiyuan Zhang, Siyuan Cheng, Hanxi Guo, Yuetian Chen, Zian Su, Shengwei An, Yuntao Du, Charles Fleming, Ashish Kundu, Xiangyu Zhang, Ninghui Li

机构 * Purdue University(普渡大学) Cisco Research(思科研究)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted by the 34th USENIX Security Symposium 2025. Code is available at https://github.com/KaiyuanZh/SOFT

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21971 2025-06-12 cs.LG cs.SE 85%

RocketPPA: Code-Level Power, Performance, and Area Prediction via LLM and Mixture of Experts

Armin Abdollahi, Mehdi Kamal, Massoud Pedram

机构 * Department of Electrical and Computer Engineering(电气与计算机工程系)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.12803 2025-06-12 cs.CV cs.LG 85%

TextSquare: Scaling up Text-Centric Visual Instruction Tuning

Jingqun Tang, Chunhui Lin, Zhen Zhao, Shu Wei, Binghong Wu, Qi Liu, Yangfan He, Kuan Lu, Hao Feng, Yang Li, Siqi Wang, Lei Liao, Wei Shi, Yuliang Liu, Hao Liu, Yuan Xie, Xiang Bai, Can Huang

机构 * ByteDance Inc.(字节跳动公司) East China Normal University(东华大学) Huazhong University of Science and Technology(华中科技大学) University of Minnesota(明尼苏达大学) Cornell University(康奈尔大学)

专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.02953 2025-06-10 cs.CL 85%

JsonTuning: Towards Generalizable, Robust, and Controllable Instruction Tuning

Chang Gao, Wenxuan Zhang, Guizhen Chen, Wai Lam

机构 * The Chinese University of Hong Kong(香港中文大学) Singapore University of Technology and Design(新加坡科技设计大学) DAMO Academy, Alibaba Group(阿里云达摩院) Nanyang Technological University(南洋理工大学)

专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments ACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01744 2025-06-09 cs.CV cs.CL 85%

Leopard: A Vision Language Model For Text-Rich Multi-Image Tasks

Mengzhao Jia, Wenhao Yu, Kaixin Ma, Tianqing Fang, Zhihan Zhang, Siru Ouyang, Hongming Zhang, Dong Yu, Meng Jiang

机构 * University of Notre Dame(诺丁汉大学) Tencent AI Seattle Lab(腾讯AI西雅图实验室) UIUC(伊利诺伊大学香槟分校)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);instruction tuning(abstract);分类 cs.CL

Comments Our code is available at https://github.com/tencent-ailab/Leopard

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05629 2025-06-09 cs.CL 85%

Leveraging Self-Attention for Input-Dependent Soft Prompting in LLMs

Ananth Muppidi, Abhilash Nandy, Sambaran Bandyopadhyay

机构 * IIIT Hyderabad(海得拉尔印度理工学院) IIT Kharagpur(克拉格浦尔印度理工学院) Adobe Research India(印度Adobe研究)

专题命中 指令微调 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted in ACL 2025 (Main) Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04711 2025-06-06 cs.SD cs.CL eess.AS 85%

LLM-based phoneme-to-grapheme for phoneme-based speech recognition

Te Ma, Min Bi, Saierdaer Yusuyin, Hao Huang, Zhijian Ou

机构 * Xinjiang University(新疆大学) Tsinghua University(清华大学) School of Computer Science and Technology(计算机科学与技术学院) Guangxi Radio and Television Monitoring Center(广西广播电视监测中心)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Interspeech 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.13326 2025-06-06 cs.CL 85%

Mosaic-IT: Cost-Free Compositional Data Synthesis for Instruction Tuning

Ming Li, Pei Chen, Chenguang Wang, Hongyu Zhao, Yijun Liang, Yupeng Hou, Fuxiao Liu, Tianyi Zhou

机构 * University of Maryland(马里兰大学) Texas A&M University(德克萨斯A&M大学) Stony Brook University(石溪大学)

专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments ACL2025, Camera-ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02522 2025-06-04 cs.AI 85%

Think Twice, Act Once: A Co-Evolution Framework of LLM and RL for Large-Scale Decision Making

Xu Wan, Wenyue Xu, Chao Yang, Mingyang Sun

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏