arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11601 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11601 篇

2502.16343 2025-02-25 cs.LG cs.AI cs.CE cs.MA 84%

Exploring Sentiment Manipulation by LLM-Enabled Intelligent Trading Agents

David Byrd

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15828 2025-02-25 cs.LG cs.AI 84%

A Stronger Mixture of Low-Rank Experts for Fine-Tuning Foundation Models

Mengyang Sun, Yihao Wang, Tao Feng, Dan Zhang, Yifan Zhu, Jie Tang

专题命中 指令微调 :foundation model(title,abstract);instruction tuning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02028 2025-02-18 cs.CL cs.AI 84%

Fine-tuning Language Models for Recipe Generation: A Comparative Analysis and Benchmark Study

Anneketh Vij, Changhao Liu, Rahul Anil Nair, Theodore Eugene Ho, Edward Shi, Ayan Bhowmick

专题命中 指令微调 :language model(title,abstract);small language model(abstract);分类 cs.CL、cs.AI

Comments 18 pages, 10 figures,14 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03884 2025-02-07 cs.LG cs.AI 84%

Rank Also Matters: Hierarchical Configuration for Mixture of Adapter Experts in LLM Fine-Tuning

Peizhuang Cong, Wenpu Liu, Wenhan Yu, Haochen Zhao, Tong Yang

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13116 2025-01-28 cs.CL cs.AI 84%

Learning to Summarize from LLM-generated Feedback

Hwanjun Song, Taewon Yun, Yuho Lee, Jihwan Oh, Gihun Lee, Jason Cai, Hang Su

专题命中 指令微调 :LLM(title,abstract);preference optimization(abstract);分类 cs.CL、cs.AI

Comments Accepted at NAACL 2025 (main, long)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.13985 2025-01-27 cs.LG cs.AI cs.CV 84%

Pilot: Building the Federated Multimodal Instruction Tuning Framework

Baochen Xiong, Xiaoshan Yang, Yaguang Song, Yaowei Wang, Changsheng Xu

专题命中 指令微调 :instruction tuning(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.05200 2025-01-24 cs.CL cs.AI 84%

KIF: Knowledge Identification and Fusion for Language Model Continual Learning

Yujie Feng, Xu Chu, Yongxin Xu, Zexin Lu, Bo Liu, Philip S. Yu, Xiao-Ming Wu

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments This version updates the model name from Task Skill Localization and Consolidation (TaSL) to Knowledge Identification and Fusion (KIF). It is an extension of the ACL 2024 paper titled Continual Dialog State Tracking via Task Skill Localization and Consolidation

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11531 2025-01-15 cs.CL cs.AI 84%

Addressing Hallucinations in Language Models with Knowledge Graph Embeddings as an Additional Modality

Viktoriia Chekalina, Anton Razzhigaev, Elizaveta Goncharova, Andrey Kuznetsov

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.06434 2025-01-14 cs.CL cs.AI 84%

Synthetic Feature Augmentation Improves Generalization Performance of Language Models

Ashok Choudhary, Cornelius Thiels, Hojjat Salehinejad

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments Accepted for presentation at IEEE SSCI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.02683 2025-01-09 cs.CL cs.AI 84%

From Superficial Patterns to Semantic Understanding: Fine-Tuning Language Models on Contrast Sets

Daniel Petrov

专题命中 指令微调 :language model(title,abstract);small language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.00418 2025-01-03 cs.LG cs.AI 84%

Generalizing Trust: Weak-to-Strong Trustworthiness in Language Models

Martin Pawelczyk, Lillian Sun, Zhenting Qi, Aounon Kumar, Himabindu Lakkaraju

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.AI、cs.LG

Comments The first two authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.17365 2024-12-24 cs.CL cs.AI 84%

Boosting LLM via Learning from Data Iteratively and Selectively

Qi Jia, Siyu Ren, Ziheng Qin, Fuzhao Xue, Jinjie Ni, Yang You

专题命中 指令微调 :LLM(title);instruction tuning(abstract);post-training(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.08392 2024-12-12 cs.CL cs.AI 84%

The Roles of English in Evaluating Multilingual Language Models

Wessel Poelman, Miryam de Lhoneux

专题命中 指令微调 :language model(title,abstract);instruction tuning(abstract);分类 cs.CL、cs.AI

Comments NoDaLiDa 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.03817 2024-12-10 cs.AI cs.CL cs.HC cs.RO 84%

From Novice to Expert: LLM Agent Policy Optimization via Step-wise Reinforcement Learning

Zhirui Deng, Zhicheng Dou, Yutao Zhu, Ji-Rong Wen, Ruibin Xiong, Mang Wang, Weipeng Chen

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02785 2024-12-06 cs.LG cs.AI 84%

Stochastic Monkeys at Play: Random Augmentations Cheaply Break LLM Safety Alignment

Jason Vega, Junsheng Huang, Gaokai Zhang, Hangoo Kang, Minjia Zhang, Gagandeep Singh

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments v2: Updated with changes from peer review rebuttal. v1: Version under peer review

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01078 2024-12-04 cs.CL cs.AI cs.HC 84%

Advancing Speech Language Models by Scaling Supervised Fine-Tuning with Over 60,000 Hours of Synthetic Speech Dialogue Data

Shuaijiang Zhao, Tingwei Guo, Bajian Xiang, Tongtang Wan, Qiang Niu, Wei Zou, Xiangang Li

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments KE-Omni, Ke-SpeechChat

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15831 2024-11-26 cs.LG cs.AI 84%

Efficient and Private: Memorisation under differentially private parameter-efficient fine-tuning in language models

Olivia Ma, Jonathan Passerat-Palmbach, Dmitrii Usynin

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.19581 2024-11-22 cs.SE cs.AI cs.CL 84%

Source Code Foundation Models are Transferable Binary Analysis Knowledge Bases

Zian Su, Xiangzhe Xu, Ziyang Huang, Kaiyuan Zhang, Xiangyu Zhang

专题命中 指令微调 :foundation model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.14736 2024-11-12 cs.CL cs.LG 84%

Data Diversity Matters for Robust Instruction Tuning

Alexander Bukharin, Shiyang Li, Zhengyang Wang, Jingfeng Yang, Bing Yin, Xian Li, Chao Zhang, Tuo Zhao, Haoming Jiang

专题命中 指令微调 :instruction tuning(title,abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 22 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09699 2024-10-15 cs.CL cs.AI 84%

Honest AI: Fine-Tuning "Small" Language Models to Say "I Don't Know", and Reducing Hallucination in RAG

Xinxi Chen, Li Wang, Wei Wu, Qi Tang, Yiyao Liu

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Journal ref 2024 KDD Cup Workshop for Retrieval Augmented Generation at the 30th ACM SIGKDD Conference on Knowledge Discovery and Data Mining

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.07706 2024-10-11 cs.CL cs.AI 84%

AgentBank: Towards Generalized LLM Agents via Fine-Tuning on 50000+ Interaction Trajectories

Yifan Song, Weimin Xiong, Xiutian Zhao, Dawei Zhu, Wenhao Wu, Ke Wang, Cheng Li, Wei Peng, Sujian Li

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Findings of EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.10353 2024-10-08 cs.CL cs.LG 84%

Prompt-Based Bias Calibration for Better Zero/Few-Shot Learning of Language Models

Kang He, Yinghan Long, Kaushik Roy

专题命中 指令微调 :language model(title,abstract);prompting(abstract);分类 cs.CL、cs.LG

Comments EMNLP 2024 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.17745 2024-10-08 cs.IR cs.CL cs.LG 84%

Few-shot Prompting for Pairwise Ranking: An Effective Non-Parametric Retrieval Model

Nilanjan Sinhababu, Andrew Parry, Debasis Ganguly, Debasis Samanta, Pabitra Mitra

专题命中 指令微调 :prompting(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Accepted to EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14394 2024-10-04 cs.CL cs.AI 84%

Instruction Tuning With Loss Over Instructions

Zhengyan Shi, Adam X. Yang, Bin Wu, Laurence Aitchison, Emine Yilmaz, Aldo Lipani

专题命中 指令微调 :instruction tuning(title,abstract);language model(abstract);分类 cs.CL、cs.AI

Comments NeurIPS 2024. Code is available at https://github.com/ZhengxiangShi/InstructionModelling

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.20566 2024-10-01 cs.CV cs.CL cs.LG 84%

MM1.5: Methods, Analysis & Insights from Multimodal LLM Fine-tuning

Haotian Zhang, Mingfei Gao, Zhe Gan, Philipp Dufter, Nina Wenzel, Forrest Huang, Dhruti Shah, Xianzhi Du, Bowen Zhang, Yanghao Li, Sam Dodge, Keen You, Zhen Yang, Aleksei Timofeev, Mingze Xu, Hong-You Chen, Jean-Philippe Fauconnier, Zhengfeng Lai, Haoxuan You, Zirui Wang, Afshin Dehghan, Peter Grasch, Yinfei Yang

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.17354 2024-09-02 cs.LG cs.AI cs.CR 84%

Forget to Flourish: Leveraging Machine-Unlearning on Pretrained Language Models for Privacy Leakage

Md Rafi Ur Rashid, Jing Liu, Toshiaki Koike-Akino, Shagufta Mehnaz, Ye Wang

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.04816 2024-08-12 cs.CL cs.LG 84%

FUSE-ing Language Models: Zero-Shot Adapter Discovery for Prompt Optimization Across Tokenizers

Joshua Nathaniel Williams, J. Zico Kolter

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.LG

Comments Published as a Conference Paper at COLM 2024; 10 Pages; https://github.com/jnwilliams/FUSE_prompt_inversion.git

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.10859 2024-08-09 cs.CL cs.LG 84%

Forcing Diffuse Distributions out of Language Models

Yiming Zhang, Avi Schwarzschild, Nicholas Carlini, Zico Kolter, Daphne Ippolito

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.09497 2024-07-15 cs.CR cs.AI cs.LG cs.SE 84%

Instruction Tuning for Secure Code Generation

Jingxuan He, Mark Vero, Gabriela Krasnopolska, Martin Vechev

专题命中 指令微调 :instruction tuning(title,abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.01691 2024-07-15 cs.CL cs.AI 84%

Zero-Shot Continuous Prompt Transfer: Generalizing Task Semantics Across Language Models

Zijun Wu, Yongkang Wu, Lili Mou

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by ICLR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏