arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11601 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11601 篇

2412.01072 2024-12-03 cs.SE 85%

When Fine-Tuning LLMs Meets Data Privacy: An Empirical Study of Federated Learning in LLM-Based Program Repair

Wenqiang Luo, Jacky Wai Keung, Boyang Yang, He Ye, Claire Le Goues, Tegawende F. Bissyande, Haoye Tian, Bach Le

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16775 2024-11-27 cs.CL cs.AI cs.LG 85%

Parameter Efficient Instruction Tuning: An Empirical Study

Pengfei He

专题命中 指令微调 :instruction tuning(title,abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 7 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.02884 2024-11-27 cs.CV 85%

PosterLLaVa: Constructing a Unified Multi-modal Layout Generator with LLM

Tao Yang, Yingmin Luo, Zhongang Qi, Yang Wu, Ying Shan, Chang Wen Chen

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);instruction tuning(abstract)

Comments 13 pages; with PosterGen as extension; IEEE template

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.15269 2024-11-26 cs.CL cs.AI cs.IR cs.LG 85%

Aligning LLM Agents by Learning Latent Preference from User Edits

Ge Gao, Alexey Taymanov, Eduardo Salinas, Paul Mineiro, Dipendra Misra

专题命中 指令微调 :LLM(title,abstract);language agent(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.12214 2024-11-20 cs.HC 85%

DexAssist: A Voice-Enabled Dual-LLM Framework for Accessible Web Navigation

Shridhar Mehendale, Ankit Walishetti

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Both authors contributed equally to this work. This paper will appear at the 16th International Conference on Intelligent Human Computer Interaction (IHCI 2024) and will be published under conference proceedings in Springer Lecture Notes in Computer Science (LNCS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07021 2024-11-19 cs.IR 85%

Invar-RAG: Invariant LLM-aligned Retrieval for Better Generation

Ziwei Liu, Liang Zhang, Qian Li, Jianghua Wu, Guangxu Zhu

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.06634 2024-11-13 q-fin.CP cs.AI cs.CL cs.LG q-fin.ST 85%

Harnessing Earnings Reports for Stock Predictions: A QLoRA-Enhanced LLM Approach

Haowei Ni, Shuchen Meng, Xupeng Chen, Ziqing Zhao, Andi Chen, Panfeng Li, Shiyao Zhang, Qifu Yin, Yuanqing Wang, Yuxi Chan

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by 2024 6th International Conference on Data-driven Optimization of Complex Systems

Journal ref Proceedings of the 2024 6th International Conference on Data-driven Optimization of Complex Systems (DOCS), 2024, pp. 909-915

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02718 2024-11-06 eess.SP 85%

LLM-based Framework for Bearing Fault Diagnosis

Laifa Tao, Haifei Liu, Guoao Ning, Wenyan Cao, Bohao Huang, Chen Lu

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 25 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11717 2024-11-01 cs.LG cs.AI cs.CL 85%

Refusal in Language Models Is Mediated by a Single Direction

Andy Arditi, Oscar Obeso, Aaquib Syed, Daniel Paleka, Nina Panickssery, Wes Gurnee, Neel Nanda

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.15741 2024-10-30 cs.CL cs.AI cs.LG 85%

Ladder: A Model-Agnostic Framework Boosting LLM-based Machine Translation to the Next Level

Zhaopeng Feng, Ruizhe Chen, Yan Zhang, Zijie Meng, Zuozhu Liu

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments EMNLP 2024 Main. Data and code are available at https://github.com/fzp0424/MT-Ladder

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.02888 2024-10-29 cs.CL cs.AI cs.LG 85%

HYDRA: Model Factorization Framework for Black-Box LLM Personalization

Yuchen Zhuang, Haotian Sun, Yue Yu, Rushi Qiang, Qifan Wang, Chao Zhang, Bo Dai

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted in NeurIPS'24

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.07113 2024-10-10 cs.CV 85%

Personalized Visual Instruction Tuning

Renjie Pi, Jianshu Zhang, Tianyang Han, Jipeng Zhang, Rui Pan, Tong Zhang

专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03750 2024-10-08 cs.LG cs.AI cs.CL 85%

SQFT: Low-cost Model Adaptation in Low-precision Sparse Foundation Models

Juan Pablo Muñoz, Jinjie Yuan, Nilesh Jain

专题命中 指令微调 :foundation model(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments To be published in EMNLP-24 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.08460 2024-10-04 cs.CL cs.AI cs.LG 85%

LongForm: Effective Instruction Tuning with Reverse Instructions

Abdullatif Köksal, Timo Schick, Anna Korhonen, Hinrich Schütze

专题命中 指令微调 :instruction tuning(title,abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments EMNLP 2024 Findings. This version extends the training with recent LLMs, evaluation with new metrics, and NLU tasks

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12842 2024-09-30 cs.CL cs.AI cs.LG 85%

PromptKD: Distilling Student-Friendly Knowledge for Generative Language Models via Prompt Tuning

Gyeongman Kim, Doohyuk Jang, Eunho Yang

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments EMNLP 2024 Findings. Our project page: https://promptkd.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16973 2024-09-26 cs.CL cs.AI cs.LG 85%

Adaptive Self-Supervised Learning Strategies for Dynamic On-Device LLM Personalization

Rafael Mendoza, Isabella Cruz, Richard Liu, Aarav Deshmukh, David Williams, Jesscia Peng, Rohan Iyer

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments First ASLS

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.16073 2024-09-17 cs.SE 85%

Combining Fine-Tuning and LLM-based Agents for Intuitive Smart Contract Auditing with Justifications

Wei Ma, Daoyuan Wu, Yuqiang Sun, Tianwen Wang, Shangqing Liu, Jian Zhang, Yue Xue, Yang Liu

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted for the 47th International Conference on Software Engineering (ICSE 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.00096 2024-09-04 cs.CL cs.AI cs.LG 85%

Non-instructional Fine-tuning: Enabling Instruction-Following Capabilities in Pre-trained Language Models without Instruction-Following Data

Juncheng Xie, Shensian Syu, Hung-yi Lee

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 16 pages, 2 figures, 15 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.05019 2024-08-12 cs.CV 85%

Instruction Tuning-free Visual Token Complement for Multimodal LLMs

Dongsheng Wang, Jiequan Cui, Miaoge Li, Wang Lin, Bo Chen, Hanwang Zhang

专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted by ECCV2024 (20pages)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.03940 2024-08-08 cs.CV 85%

How Well Can Vision Language Models See Image Details?

Chenhui Gou, Abdulwahab Felemban, Faizan Farooq Khan, Deyao Zhu, Jianfei Cai, Hamid Rezatofighi, Mohamed Elhoseiny

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.18990 2024-08-08 cs.LG cs.AI cs.CL 85%

Stay Tuned: An Empirical Study of the Impact of Hyperparameters on LLM Tuning in Real-World Applications

Alon Halfon, Shai Gretz, Ofir Arviv, Artem Spector, Orith Toledo-Ronen, Yoav Katz, Liat Ein-Dor, Michal Shmueli-Scheuer, Noam Slonim

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.01195 2024-08-06 cs.CV 85%

Consistency-guided Prompt Learning for Vision-Language Models

Shuvendu Roy, Ali Etemad

专题命中 指令微调 :language model(title,abstract);foundation model(abstract);prompting(abstract)

Comments Published as a conference paper at ICLR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.13173 2024-07-17 cs.CV cs.AI cs.CL cs.LG 85%

Biomedical Visual Instruction Tuning with Clinician Preference Alignment

Hejie Cui, Lingjun Mao, Xin Liang, Jieyu Zhang, Hui Ren, Quanzheng Li, Xiang Li, Carl Yang

专题命中 指令微调 :instruction tuning(title,abstract);foundation model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.08370 2024-07-16 cs.CL cs.AI cs.LG 85%

SMART: Submodular Data Mixture Strategy for Instruction Tuning

H S V N S Kowndinya Renduchintala, Sumit Bhatia, Ganesh Ramakrishnan

专题命中 指令微调 :instruction tuning(title,abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.17770 2024-06-28 cs.CV 85%

MG-LLaVA: Towards Multi-Granularity Visual Instruction Tuning

Xiangyu Zhao, Xiangtai Li, Haodong Duan, Haian Huang, Yining Li, Kai Chen, Hua Yang

专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16316 2024-06-25 cs.CL cs.AI cs.CY cs.LG 85%

Does Cross-Cultural Alignment Change the Commonsense Morality of Language Models?

Yuu Jinnai

专题命中 指令微调 :language model(title,abstract);SFT(abstract);分类 cs.CL、cs.AI、cs.LG

Comments The 2nd Workshop on Cross-Cultural Considerations in NLP (C3NLP) at ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.14005 2024-06-24 cs.CL cs.AI cs.LG 85%

Information Guided Regularization for Fine-tuning Language Models

Mandar Sharma, Nikhil Muralidhar, Shengzhe Xu, Raquib Bin Yousuf, Naren Ramakrishnan

专题命中 指令微调 :language model(title,abstract);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.07540 2024-06-12 cs.AI cs.CL cs.LG 85%

diff History for Neural Language Agents

Ulyana Piterbarg, Lerrel Pinto, Rob Fergus

专题命中 指令微调 :language agent(title);language model(abstract);instruction tuning(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ICML 2024 version

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.04076 2024-06-07 cs.CR 85%

Federated TrustChain: Blockchain-Enhanced LLM Training and Unlearning

Xuhan Zuo, Minghao Wang, Tianqing Zhu, Lefeng Zhang, Dayong Ye, Shui Yu, Wanlei Zhou

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 16 pages, 7 figures,

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.11450 2024-06-03 cs.RO 85%

Learning to Learn Faster from Human Feedback with Language Model Predictive Control

Jacky Liang, Fei Xia, Wenhao Yu, Andy Zeng, Montserrat Gonzalez Arenas, Maria Attarian, Maria Bauza, Matthew Bennice, Alex Bewley, Adil Dostmohamed, Chuyuan Kelly Fu, Nimrod Gileadi, Marissa Giustina, Keerthana Gopalakrishnan, Leonard Hasenclever, Jan Humplik, Jasmine Hsu, Nikhil Joshi, Ben Jyenis, Chase Kew, Sean Kirmani, Tsang-Wei Edward Lee, Kuang-Huei Lee, Assaf Hurwitz Michaely, Joss Moore, Ken Oslund, Dushyant Rao, Allen Ren, Baruch Tabanpour, Quan Vuong, Ayzaan Wahid, Ted Xiao, Ying Xu, Vincent Zhuang, Peng Xu, Erik Frey, Ken Caluwaerts, Tingnan Zhang, Brian Ichter, Jonathan Tompson, Leila Takayama, Vincent Vanhoucke, Izhak Shafran, Maja Mataric, Dorsa Sadigh, Nicolas Heess, Kanishka Rao, Nik Stewart, Jie Tan, Carolina Parada

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏