arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11585 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11585 篇

2309.15785 2024-06-28 cs.CV 87%

BT-Adapter: Video Conversation is Feasible Without Video Instruction Tuning

Ruyang Liu, Chen Li, Yixiao Ge, Ying Shan, Thomas H. Li, Ge Li

专题命中 指令微调 :instruction tuning(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.18187 2024-06-27 cs.CL cs.AI cs.LG 87%

Selective Prompting Tuning for Personalized Conversations with LLMs

Qiushi Huang, Xubo Liu, Tom Ko, Bo Wu, Wenwu Wang, Yu Zhang, Lilian Tang

专题命中 指令微调 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to ACL 2024 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.01886 2024-06-27 cs.CV 87%

InstructTA: Instruction-Tuned Targeted Attack for Large Vision-Language Models

Xunguang Wang, Zhenlan Ji, Pingchuan Ma, Zongjie Li, Shuai Wang

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.04333 2024-06-14 cs.CL cs.AI cs.LG 87%

LESS: Selecting Influential Data for Targeted Instruction Tuning

Mengzhou Xia, Sadhika Malladi, Suchin Gururangan, Sanjeev Arora, Danqi Chen

专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ICML 2024; Code and data are available at https://github.com/princeton-nlp/LESS

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.14348 2024-06-13 cs.CL cs.AI cs.CR cs.LG 87%

Defending Against Alignment-Breaking Attacks via Robustly Aligned LLM

Bochuan Cao, Yuanpu Cao, Lu Lin, Jinghui Chen

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 19 Pages, 5 Figures, 8 Tables. Accepted by ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.11138 2024-06-07 cs.CL cs.AI cs.LG 87%

Contrastive Instruction Tuning

Tianyi Lorena Yan, Fei Wang, James Y. Huang, Wenxuan Zhou, Fan Yin, Aram Galstyan, Wenpeng Yin, Muhao Chen

专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ACL 2024 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.03007 2024-06-06 cs.CL cs.AI cs.CR cs.LG 87%

BadAgent: Inserting and Activating Backdoor Attacks in LLM Agents

Yifei Wang, Dizhan Xue, Shengjie Zhang, Shengsheng Qian

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.07533 2024-05-20 cs.CV 87%

VILA: On Pre-training for Visual Language Models

Ji Lin, Hongxu Yin, Wei Ping, Yao Lu, Pavlo Molchanov, Andrew Tao, Huizi Mao, Jan Kautz, Mohammad Shoeybi, Song Han

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);instruction tuning(abstract)

Comments CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.13068 2024-03-15 cs.CL cs.AI cs.HC cs.IR cs.LG 87%

Making Language Models Better Tool Learners with Execution Feedback

Shuofei Qiao, Honghao Gui, Chengfei Lv, Qianghuai Jia, Huajun Chen, Ningyu Zhang

专题命中 指令微调 :language model(title,abstract);large language model(abstract);foundation model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments NAACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.00827 2024-03-05 cs.CL cs.AI cs.LG 87%

Self-Refinement of Language Models from External Proxy Metrics Feedback

Keshav Ramji, Young-Suk Lee, Ramón Fernandez Astudillo, Md Arafat Sultan, Tahira Naseem, Asim Munawar, Radu Florian, Salim Roukos

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.07543 2024-02-13 cs.CL cs.AI cs.LG 87%

Show Me How It's Done: The Role of Explanations in Fine-Tuning Language Models

Mohamad Ballout, Ulf Krumnack, Gunther Heidemann, Kai-Uwe Kuehnberger

专题命中 指令微调 :language model(title,abstract);large language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.02643 2024-02-06 cs.DB cs.AI cs.CL cs.LG 87%

LLM-Enhanced Data Management

Xuanhe Zhou, Xinyang Zhao, Guoliang Li

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.15670 2024-01-30 cs.CL cs.AI cs.LG 87%

YODA: Teacher-Student Progressive Learning for Language Models

Jianqiao Lu, Wanjun Zhong, Yufei Wang, Zhijiang Guo, Qi Zhu, Wenyong Huang, Yanlin Wang, Fei Mi, Baojun Wang, Yasheng Wang, Lifeng Shang, Xin Jiang, Qun Liu

专题命中 指令微调 :language model(title,abstract);large language model(abstract);SFT(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 14 pages, 4 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.00579 2024-01-02 cs.CL cs.AI cs.LG 87%

Exploring the Effectiveness of Instruction Tuning in Biomedical Language Processing

Omid Rohanian, Mohammadmahdi Nouriborji, David A. Clifton

专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.18445 2023-12-01 cs.CV 87%

VTimeLLM: Empower LLM to Grasp Video Moments

Bin Huang, Xin Wang, Hong Chen, Zihan Song, Wenwu Zhu

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.08172 2023-11-28 cs.MM cs.CV 87%

Vision-Language Instruction Tuning: A Review and Analysis

Chen Li, Yixiao Ge, Dian Li, Ying Shan

专题命中 指令微调 :instruction tuning(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

Comments 34 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.08401 2023-11-15 cs.CL cs.AI cs.LG 87%

Fine-tuning Language Models for Factuality

Katherine Tian, Eric Mitchell, Huaxiu Yao, Christopher D. Manning, Chelsea Finn

专题命中 指令微调 :language model(title,abstract);RLHF(abstract);preference optimization(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.07687 2023-11-15 cs.CL cs.AI cs.LG 87%

Language Model-In-The-Loop: Data Optimal Approach to Learn-To-Recommend Actions in Text Games

Arjun Vaithilingam Sudhakar, Prasanna Parthasarathi, Janarthanan Rajendran, Sarath Chandar

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.11816 2023-11-14 cs.LG cs.AI cs.CL 87%

Learning to Generate Better Than Your LLM

Jonathan D. Chang, Kiante Brantley, Rajkumar Ramamurthy, Dipendra Misra, Wen Sun

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 23 pages, 5 figures, 7 tables, 4 algorithms

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.11366 2023-10-11 cs.AI cs.CL cs.LG 87%

Reflexion: Language Agents with Verbal Reinforcement Learning

Noah Shinn, Federico Cassano, Edward Berman, Ashwin Gopinath, Karthik Narasimhan, Shunyu Yao

专题命中 指令微调 :language agent(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments v4 contains a few additional experiments

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.05915 2023-10-10 cs.CL cs.AI cs.LG 87%

FireAct: Toward Language Agent Fine-tuning

Baian Chen, Chang Shu, Ehsan Shareghi, Nigel Collier, Karthik Narasimhan, Shunyu Yao

专题命中 指令微调 :language agent(title,abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Code, data, and models are available at https://fireact-agent.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.03629 2023-08-09 cs.CL cs.AI cs.LG 87%

MedMine: Examining Pre-trained Language Models on Medication Mining

Haifa Alrdahi, Lifeng Han, Hendrik Šuvalov, Goran Nenadic

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Open Research Project. 7 pages, 1 figure, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.10719 2023-07-25 cs.AI cs.CL cs.CR cs.LG 87%

LLM Censorship: A Machine Learning Challenge or a Computer Security Problem?

David Glukhov, Ilia Shumailov, Yarin Gal, Nicolas Papernot, Vardan Papyan

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.15444 2023-06-21 cs.CL cs.AI cs.LG 87%

PromptNER: Prompting For Named Entity Recognition

Dhananjay Ashok, Zachary C. Lipton

专题命中 指令微调 :prompting(title);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.11025 2023-06-21 cs.LG cs.AI cs.CL q-fin.ST 87%

Temporal Data Meets LLM -- Explainable Financial Time Series Forecasting

Xinli Yu, Zheng Chen, Yuan Ling, Shujing Dong, Zongyi Liu, Yanbin Lu

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.02412 2023-05-09 cs.CL cs.AI cs.LG 87%

Plan, Eliminate, and Track -- Language Models are Good Teachers for Embodied Agents

Yue Wu, So Yeon Min, Yonatan Bisk, Ruslan Salakhutdinov, Amos Azaria, Yuanzhi Li, Tom Mitchell, Shrimai Prabhumoye

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.09689 2022-12-20 cs.CL cs.AI cs.LG 87%

Unnatural Instructions: Tuning Language Models with (Almost) No Human Labor

Or Honovich, Thomas Scialom, Omer Levy, Timo Schick

专题命中 指令微调 :language model(title,abstract);instruction tuning(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 18 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.12607 2022-10-25 cs.CL cs.AI cs.LG 87%

Learning to Perform Complex Tasks through Compositional Fine-Tuning of Language Models

Victor S. Bursztyn, David Demeter, Doug Downey, Larry Birnbaum

专题命中 指令微调 :language model(title,abstract);pretraining(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to findings of EMNLP 2022. Data and code available at https://github.com/vbursztyn/compositional-fine-tuning

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05134 2026-05-05 cs.LG cs.AI 87%

How Reasoning Evolves from Post-Training Data: An Empirical Study Using Chess

推理如何从训练数据中演变:使用国际象棋的实证研究

Lucas Dionisopoulos, Nicklas Majamaki, Prithviraj Ammanabrolu

机构 * Department of Computer Science and Engineering, University of California San Diego, San Diego, United States(计算机科学与工程系,加州大学圣地亚哥分校,圣地亚哥,美国)

专题命中 指令微调 :post-training(title);SFT(abstract,abstract_cn);language model(abstract,comments);分类 cs.AI、cs.LG

AI总结 研究语言模型推理从监督微调到强化学习的演变,发现直接预测最佳走法的微调能提升性能,但强化学习阶段导致不一致推理,而多步轨迹训练则能获得更稳定的推理。

Comments Accepted at ICML 2026. An earlier version appeared at the NeurIPS 2025 Foundations of Reasoning in Language Models (FoRLM) Workshop (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15621 2025-08-01 cs.CV cs.AI cs.CL cs.MM 87%

LLaVA-MORE: A Comparative Study of LLMs and Visual Backbones for Enhanced Visual Instruction Tuning

Federico Cocchi, Nicholas Moratelli, Davide Caffagni, Sara Sarto, Lorenzo Baraldi, Marcella Cornia, Rita Cucchiara

机构 * University of Modena and Reggio Emilia(摩德纳和雷吉奥艾米利亚大学) University of Pisa(比萨大学) IIT-CNR(意大利国家研究 council(IIT))

专题命中 指令微调 :instruction tuning(title);LLM(abstract);large language model(abstract);language model(abstract)

Comments ICCV 2025 Workshop on What is Next in Multimodal Foundation Models

详情

展开后加载摘要…

URL PDF HTML 收藏