arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11567 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11567 篇

2410.15483 2025-11-11 cs.LG cs.AI cs.CL math.OC stat.ML 88%

Understanding Forgetting in LLM Supervised Fine-Tuning and Preference Learning -- A Convex Optimization Perspective

Heshan Fernando, Han Shen, Parikshit Ram, Yi Zhou, Horst Samulowitz, Nathalie Baracaldo, Tianyi Chen

机构 * Rensselaer Polytechnic Institute(罗切斯特理工学院) IBM Research(IBM研究院) Cornell University(康奈尔大学)

专题命中 指令微调 :LLM(title,abstract);post-training(abstract);SFT(abstract);RLHF(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06944 2025-10-13 cs.LG cs.AI cs.CL cs.CV 88%

AMFT: Aligning LLM Reasoners by Meta-Learning the Optimal Imitation-Exploration Balance

Lixuan He, Jie Feng, Yong Li

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);SFT(abstract)

Comments The paper is currently under investigation regarding concerns of potential academic misconduct. While the investigation is ongoing, the authors have voluntarily requested to withdraw the manuscript

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22853 2025-09-30 q-bio.QM cs.AI cs.CL cs.LG 88%

Patient-specific Biomolecular Instruction Tuning

Irsyad Adam, Zekai Chen, David Laub, Shaun Porwal, Arda Pekis, Kevin Brown

机构 * Standard Model Biomedicine(标准模型生物医学) University of California, San Diego(加州大学圣地亚哥分校)

专题命中 指令微调 :instruction tuning(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17711 2025-09-17 cs.SI 88%

Enhancing LLM-Based Social Bot via an Adversarial Learning Framework

Fanqi Kong, Xiaoyuan Zhang, Xinyu Chen, Yaodong Yang, Song-Chun Zhu, Xue Feng

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12953 2025-06-17 cs.LG cs.AI cs.CL 88%

Forecasting Time Series with LLMs via Patch-Based Prompting and Decomposition

Mayank Bumb, Anshul Vemulapalli, Sri Harsha Vardhan Prasad Jella, Anish Gupta, An La, Ryan A. Rossi, Hongjie Chen, Franck Dernoncourt, Nesreen K. Ahmed, Yu Wang

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) Adobe(Adobe公司) Dolby Labs(Dolby实验室) Intel(英特尔公司) University of Oregon(俄勒冈大学)

专题命中 指令微调 :prompting(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17316 2025-05-26 cs.CV cs.AI cs.CL cs.LG 88%

Analyzing Fine-Grained Alignment and Enhancing Vision Understanding in Multimodal Language Models

Jiachen Jiang, Jinxin Zhou, Bo Peng, Xia Ning, Zhihui Zhu

机构 * Department of Computer Science and Engineering, The Ohio State University(计算机科学与工程系,俄亥俄州立大学) Translational Data Analytics Institute, The Ohio State University(转化数据分析研究所,俄亥俄州立大学) Department of Biomedical Informatics, The Ohio State University(生物医学信息学系,俄亥俄州立大学)

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14905 2025-02-24 cs.CL cs.AI cs.LG 88%

Think Inside the JSON: Reinforcement Strategy for Strict LLM Schema Adherence

Bhavik Agarwal, Ishan Joshi, Viktoria Rojkova

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12217 2025-02-19 cs.LG cs.AI cs.CL 88%

Optimal Brain Iterative Merging: Mitigating Interference in LLM Merging

Zhixiang Wang, Zhenyu Mao, Yixuan Qiao, Yunfang Wu, Biye Li

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.15938 2025-02-18 cs.CL cs.AI cs.LG 88%

RuleR: Improving LLM Controllability by Rule-based Data Recycling

Ming Li, Han Chen, Chenguang Wang, Dang Nguyen, Dianqi Li, Tianyi Zhou

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);SFT(abstract)

Comments NAACL2025 main, Camera-ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.08739 2024-11-05 cs.CV 88%

MAVIS: Mathematical Visual Instruction Tuning with an Automatic Data Engine

Renrui Zhang, Xinyu Wei, Dongzhi Jiang, Ziyu Guo, Shicheng Li, Yichi Zhang, Chengzhuo Tong, Jiaming Liu, Aojun Zhou, Bin Wei, Shanghang Zhang, Peng Gao, Chunyuan Li, Hongsheng Li

专题命中 指令微调 :instruction tuning(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

Comments WData and Models will be released at https://github.com/ZrrSkywalker/MAVIS

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.01678 2024-10-30 cs.AI cs.CL cs.DB cs.LG 88%

Jellyfish: A Large Language Model for Data Preprocessing

Haochen Zhang, Yuyang Dong, Chuan Xiao, Masafumi Oyamada

专题命中 指令微调 :large language model(title,comments);language model(title,comments);instruction tuning(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by EMNLP 2024, a.k.a. "Jellyfish: Instruction-Tuning Local Large Language Models for Data Preprocessing''

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01610 2024-10-04 cs.CL cs.AI cs.LG 88%

Upcycling Instruction Tuning from Dense to Mixture-of-Experts via Parameter Merging

Tingfeng Hui, Zhenyu Zhang, Shuohuan Wang, Yu Sun, Hua Wu, Sen Su

专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)

Comments work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19817 2024-10-01 cs.LG cs.AI cs.CL 88%

Calibrating Language Models with Adaptive Temperature Scaling

Johnathan Xie, Annie S. Chen, Yoonho Lee, Eric Mitchell, Chelsea Finn

专题命中 指令微调 :language model(title,abstract);large language model(abstract);SFT(abstract);RLHF(abstract)

Comments EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13884 2024-09-24 cs.CL cs.AI cs.CY cs.LG 88%

A Multi-LLM Debiasing Framework

Deonna M. Owens, Ryan A. Rossi, Sungchul Kim, Tong Yu, Franck Dernoncourt, Xiang Chen, Ruiyi Zhang, Jiuxiang Gu, Hanieh Deilamsalehy, Nedim Lipka

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.18676 2024-07-19 cs.CL cs.AI cs.LG 88%

Understand What LLM Needs: Dual Preference Alignment for Retrieval-Augmented Generation

Guanting Dong, Yutao Zhu, Chenghao Zhang, Zechen Wang, Zhicheng Dou, Ji-Rong Wen

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);SFT(abstract)

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.05519 2024-06-26 cs.AI cs.CL cs.LG 88%

NExT-GPT: Any-to-Any Multimodal LLM

Shengqiong Wu, Hao Fei, Leigang Qu, Wei Ji, Tat-Seng Chua

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

Comments ICML 2024 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.10110 2024-06-11 cs.CL cs.AI cs.LG 88%

Selective Reflection-Tuning: Student-Selected Data Recycling for LLM Instruction-Tuning

Ming Li, Lichang Chen, Jiuhai Chen, Shwai He, Jiuxiang Gu, Tianyi Zhou

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

Comments ACL2024 (findings), Camera-ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.01633 2024-06-05 cs.IR cs.AI cs.CL cs.LG 88%

On Overcoming Miscalibrated Conversational Priors in LLM-based Chatbots

Christine Herlihy, Jennifer Neville, Tobias Schnabel, Adith Swaminathan

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Preprint of UAI'24 conference publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.05612 2024-05-30 cs.LG cs.AI cs.CL 88%

Unfamiliar Finetuning Examples Control How Language Models Hallucinate

Katie Kang, Eric Wallace, Claire Tomlin, Aviral Kumar, Sergey Levine

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.01854 2024-05-22 cs.CL cs.AI cs.LG 88%

Multilingual Instruction Tuning With Just a Pinch of Multilinguality

Uri Shaham, Jonathan Herzig, Roee Aharoni, Idan Szpektor, Reut Tsarfaty, Matan Eyal

专题命中 指令微调 :instruction tuning(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

Comments Findings of ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.00907 2024-01-03 cs.LG cs.AI cs.CL 88%

LaFFi: Leveraging Hybrid Natural Language Feedback for Fine-tuning Language Models

Qianxi Li, Yingyue Cao, Jikun Kang, Tianpei Yang, Xi Chen, Jun Jin, Matthew E. Taylor

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);SFT(abstract)

Comments Paper accepted in Human-Centric Representation Learning workshop at AAAI 2024 (https://hcrl-workshop.github.io/2024/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.04087 2023-12-29 cs.CV 88%

SVIT: Scaling up Visual Instruction Tuning

Bo Zhao, Boya Wu, Muyang He, Tiejun Huang

专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.08485 2023-12-14 cs.CV cs.AI cs.CL cs.LG 88%

Visual Instruction Tuning

Haotian Liu, Chunyuan Li, Qingyang Wu, Yong Jae Lee

专题命中 指令微调 :instruction tuning(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

Comments NeurIPS 2023 Oral; project page: https://llava-vl.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.18232 2023-12-01 cs.CL cs.AI cs.LG 88%

LMRL Gym: Benchmarks for Multi-Turn Reinforcement Learning with Language Models

Marwa Abdulhai, Isadora White, Charlie Snell, Charles Sun, Joey Hong, Yuexiang Zhai, Kelvin Xu, Sergey Levine

专题命中 指令微调 :language model(title,abstract);large language model(abstract);prompting(abstract);language agent(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.05833 2023-10-02 cs.CL cs.AI cs.LG cs.SE 88%

PACE-LM: Prompting and Augmentation for Calibrated Confidence Estimation with GPT-4 in Cloud Incident Root Cause Analysis

Dylan Zhang, Xuchao Zhang, Chetan Bansal, Pedro Las-Casas, Rodrigo Fonseca, Saravan Rajmohan

专题命中 指令微调 :prompting(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01206 2026-07-13 cs.CL cs.LG 版本更新 88%

RELISH: LLM REgression with a Latent Iterative State Head

基于潜在迭代状态头的大型语言模型回归

Yiheng Su, Matthew Lease

专题命中 指令微调 :LLM(title,abstract);language model(abstract,comments);large language model(abstract);分类 cs.CL、cs.LG

AI总结 RElish通过迭代优化潜在状态实现文本回归,优于三种主流回归方法,参数效率高。

Comments Accepted to the Third Conference on Language Modeling (COLM 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15315 2026-08-19 cs.AI 版本更新 88%

ChatPlanner: A Large Language Model Framework for Personalized Public Transit Routing

ChatPlanner: 一个用于个性化公共交通路线规划的大型语言模型框架

Tingting Yang, Chenhao Xue, Jun Chen

机构 * School of Engineering and Materials Science, Queen Mary University of London(伦敦玛丽女王大学工程与材料科学学院) Department of Engineering Science, University of Oxford(牛津大学工程科学系)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 提出ChatPlanner框架,利用大型语言模型和检索增强生成技术从自然语言查询中提取用户偏好并融入路线规划算法,实验证明其能生成更符合个性化需求的可行路线方案。

Comments Under Review at Transportation Research Part C

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14631 2026-08-18 cs.AI 新提交 88%

Accuracy and Reliability of Large Language Models in Cosmetic Chemistry and Skin Health: A Benchmarking Study

大型语言模型在化妆品化学与皮肤健康领域的准确性与可靠性:一项基准测试研究

Amelia Liu

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本研究测试14个LLMs在化妆品化学与皮肤健康领域的表现,发现其总体准确性差、技术深度不足,无法可靠提供相关信息,需微调验证数据集并改进算法推理。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19612 2026-08-18 cs.CL 88%

Anatomy of Unlearning: The Dual Impact of Fact Salience and Model Fine-Tuning

遗忘的解剖:事实显著性与模型微调的双重影响

Anna Borisiuk, Andrey Savchenko, Alexander Panchenko, Elena Tutubalina

机构 * AIRI Sber AI Lab HSE University(HSE大学) Skoltech ISP RAS Research Center for Trusted Artificial Intelligence(ISP RAS可信人工智能研究中心)

专题命中 指令微调 :LLM(abstract,abstract_cn);SFT(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本研究通过构建DUET基准,分析了预训练与监督微调阶段的事实显著性对机器遗忘效果的影响,发现微调后的模型遗忘更平滑且保留率更高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06854 2026-08-14 cs.CL 版本更新 88%

SEMA: Simple yet Effective Learning for Multi-Turn Jailbreak Attacks

SEMA: 简单却有效的多轮对抗攻击学习

Mingqian Feng, Xiaodong Liu, Weiwei Yang, Jialin Song, Xuekai Zhu, Chenliang Xu, Jianfeng Gao

专题命中 指令微调 :LLM(abstract,abstract_cn);SFT(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 SEMA通过多阶段学习实现高效多轮对抗攻击,无需依赖现有策略,提升攻击成功率并增强安全测试能力。

Comments ICLR 2026, 37 pages, 13 tables, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏