arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11601 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11601 篇

2507.21899 2025-07-30 cs.AI cs.LG cs.SE 84%

LLM-based Content Classification Approach for GitHub Repositories by the README Files

Malik Uzair Mehmood, Shahid Hussain, Wen Li Wang, Muhammad Usama Malik

机构 * Department of Computing and Built Environment(计算与环境系) Birmingham City University(伯明翰城市大学) Department of Computer Science and Software Engineering(计算机科学与软件工程系) School of Engineering(工程学院) Penn State University, Behrend, Erie PA(宾夕法尼亚州立大学贝伦分校,埃里普斯帕州) Department of Electrical Engineering(电气工程系) UET Taxila(塔希尔工程大学)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 8 pages, 4 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.10341 2025-07-29 cs.RO cs.AI cs.LG 84%

Affordance-Guided Reinforcement Learning via Visual Prompting

Olivia Y. Lee, Annie Xie, Kuan Fang, Karl Pertsch, Chelsea Finn

机构 * Stanford University(斯坦福大学) Cornell University(康奈尔大学) University of California, Berkeley(加州大学伯克利分校)

专题命中 指令微调 :prompting(title);language model(abstract);foundation model(abstract);分类 cs.AI、cs.LG

Comments 8 pages, 6 figures. IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11851 2025-07-17 cs.CL cs.LG 84%

Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential

Mohammad Samragh, Arnav Kundu, David Harrison, Kumari Nishu, Devang Naik, Minsik Cho, Mehrdad Farajtabar

机构 * Apple(苹果公司)

专题命中 指令微调 :LLM(title,abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06396 2025-07-10 cs.AI cs.LG cs.PL cs.SE 84%

Representing Prompting Patterns with PDL: Compliance Agent Case Study

Mandana Vaziri, Louis Mandel, Yuji Watanabe, Hirokuni Kitahara, Martin Hirzel, Anca Sailer

机构 * IBM Research, Yorktown Heights, USA(IBM研究院,Yorktown Heights,美国) IBM Research, Tokyo, Japan(IBM研究院,Tokyo,日本)

专题命中 指令微调 :prompting(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

Comments ICML 2025 Workshop on Programmatic Representations for Agent Learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05598 2025-07-09 cs.CL cs.AI 84%

Self-Review Framework for Enhancing Instruction Following Capability of LLM

Sihyun Park

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04250 2025-07-08 cs.LG cs.AI 84%

Just Enough Shifts: Mitigating Over-Refusal in Aligned Language Models with Targeted Representation Fine-Tuning

Mahavir Dabas, Si Chen, Charles Fleming, Ming Jin, Ruoxi Jia

机构 * Department of Electrical and Computer Engineering, Virginia Tech, Blacksburg, VA, USA(弗吉尼亚理工学院与州立大学电气与计算机工程系) Cisco Research, San Jose, CA, USA(思科研究)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20989 2025-06-27 cs.CL cs.LG 84%

Can Gradient Descent Simulate Prompting?

Eric Zhang, Leshem Choshen, Jacob Andreas

机构 * MIT CSAIL(麻省理工学院计算机科学与人工智能实验室)

专题命中 指令微调 :prompting(title,abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 14 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20856 2025-06-27 cs.LG cs.CL cs.CR 84%

Leaner Training, Lower Leakage: Revisiting Memorization in LLM Fine-Tuning with LoRA

Fei Wang, Baochun Li

机构 * Department of Electrical and Computer Engineering University of Toronto(电气与计算机工程系 东京大学)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16212 2025-06-17 cs.CL cs.AI 84%

MathFusion: Enhancing Mathematical Problem-solving of LLM through Instruction Fusion

Qizhi Pei, Lijun Wu, Zhuoshi Pan, Yu Li, Honglin Lin, Chenlin Ming, Xin Gao, Conghui He, Rui Yan

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学北京校区人工智能学院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Tsinghua University(清华大学) Shanghai Jiao Tong University(上海交通大学) Engineering Research Center of Next-Generation Intelligent Search and Recommendation, MOE(教育部下一代智能搜索与推荐工程技术研究中心) School of Artificial Intelligence, Wuhan University(武汉大学人工智能学院)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by ACL 2025 (main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02308 2025-06-10 cs.LG cs.AI 84%

MINT: Multimodal Instruction Tuning with Multimodal Interaction Grouping

Xiaojun Shan, Qi Cao, Xing Han, Haofei Yu, Paul Pu Liang

机构 * University of California, San Diego(加州大学圣地亚哥分校) Johns Hopkins University(约翰霍普金斯大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Massachusetts Institute of Technology(麻省理工学院)

专题命中 指令微调 :instruction tuning(title,abstract);foundation model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.19583 2025-06-03 cs.LG cs.CL 84%

Graph-Based Spectral Decomposition for Parameter Coordination in Language Model Fine-Tuning

Hanlu Zhang, Yumeng Ma, Shuo Wang, Guiran Liu, Binrong Zhu

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22704 2025-05-30 cs.CL cs.AI 84%

Training Language Models to Generate Quality Code with Program Analysis Feedback

Feng Yao, Zilong Wang, Liyuan Liu, Junxia Cui, Li Zhong, Xiaohan Fu, Haohui Mai, Vish Krishnan, Jianfeng Gao, Jingbo Shang

机构 * University of California, San Diego(加州大学圣迭戈分校) Microsoft Research(微软研究院) CausalFlow Inc.(CausalFlow公司)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments 10 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.14807 2025-05-29 cs.MA cs.AI cs.LG 84%

A Decision-Language Model (DLM) for Dynamic Restless Multi-Armed Bandit Tasks in Public Health

Nikhil Behari, Edwin Zhang, Yunfan Zhao, Aparna Taneja, Dheeraj Nagaraj, Milind Tambe

机构 * MIT(麻省理工学院) Harvard University(哈佛大学) GE Healthcare(通用电气医疗) Google(谷歌)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.AI、cs.LG

Journal ref Advances in Neural Information Processing Systems 37 (NeurIPS 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11492 2025-05-27 cs.AI cs.CL cs.CV 84%

Why Vision Language Models Struggle with Visual Arithmetic? Towards Enhanced Chart and Geometry Understanding

Kung-Hsiang Huang, Can Qin, Haoyi Qiu, Philippe Laban, Shafiq Joty, Caiming Xiong, Chien-Sheng Wu

机构 * Salesforce AI Research(Salesforce AI研究院) UCLA(加州大学洛杉矶分校)

专题命中 指令微调 :language model(title,abstract);post-training(abstract);分类 cs.CL、cs.AI

Comments Code and data are available at https://github.com/SalesforceAIResearch/CogAlign

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06814 2025-05-27 cs.LG cs.AI cs.GR 84%

Diffusion Instruction Tuning

Chen Jin, Ryutaro Tanno, Amrutha Saseendran, Tom Diethe, Philip Teare

专题命中 指令微调 :instruction tuning(title);language model(abstract);SFT(abstract);分类 cs.AI、cs.LG

Comments Project page at https://astrazeneca.github.io/vlm/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17151 2025-05-26 cs.CL cs.AI 84%

Bayesian Optimization for Enhanced Language Models: Optimizing Acquisition Functions

Zishuo Bao, Yibo Liu, Changyutao Qiu

机构 * Fuzhou University(福州大学) Xi’an Jiaotong-Liverpool University(西安交通大学利物浦大学) Dalian University of Technology(大连理工大学)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments 12 pages, 3 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03439 2025-05-07 cs.AI cs.CR cs.LG 84%

The Steganographic Potentials of Language Models

Artem Karpov, Tinuade Adeleke, Seong Hah Cho, Natalia Perez-Campanero

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.AI、cs.LG

Comments Published at Building Trust Workshop at ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02625 2025-05-06 cs.CL cs.AI cs.SD eess.AS 84%

LLaMA-Omni2: LLM-based Real-time Spoken Chatbot with Autoregressive Streaming Speech Synthesis

Qingkai Fang, Yan Zhou, Shoutao Guo, Shaolei Zhang, Yang Feng

机构 * Key Laboratory of Intelligent Information Processing Institute of Computing Technology, Chinese Academy of Sciences (ICT/CAS)(智能信息处理重点实验室,计算技术研究所,中国科学院) Key Laboratory of AI Safety, Chinese Academy of Sciences(人工智能安全重点实验室,中国科学院) University of Chinese Academy of Sciences, Beijing, China(中国科学院大学,北京,中国)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Preprint. Project: https://github.com/ictnlp/LLaMA-Omni2

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02467 2025-04-30 cs.LG cs.CL cs.CR 84%

DP-2Stage: Adapting Language Models as Differentially Private Tabular Data Generators

Tejumade Afonja, Hui-Po Wang, Raouf Kerkouche, Mario Fritz

机构 * CISPA Helmholtz Center for Information Security(CISPA 欧洲信息安全研究中心)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.LG

Journal ref Transactions on Machine Learning Research (03/2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14100 2025-04-22 eess.SP cs.AI cs.LG 84%

6G WavesFM: A Foundation Model for Sensing, Communication, and Localization

Ahmed Aboulfotouh, Elsayed Mohammed, Hatem Abou-Zeid

机构 * Department of Electrical and Software Engineering, University of Calgary(电气与软件工程系,卡尔加里大学)

专题命中 指令微调 :foundation model(title,abstract);pretraining(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12170 2025-04-21 cs.CL cs.AI 84%

Where is the answer? Investigating Positional Bias in Language Model Knowledge Extraction

Kuniaki Saito, Kihyuk Sohn, Chen-Yu Lee, Yoshitaka Ushiku

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments Code is published at https://github.com/omron-sinicx/WhereIsTheAnswer

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11019 2025-04-17 cs.LG cs.AI 84%

Unlocking the Power of Function Vectors for Characterizing and Mitigating Catastrophic Forgetting in Continual Instruction Tuning

Gangwei Jiang, Caigao Jiang, Zhaoyi Li, Siqiao Xue, Jun Zhou, Linqi Song, Defu Lian, Ying Wei

专题命中 指令微调 :instruction tuning(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 10pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10660 2025-04-16 cs.CL cs.AI 84%

LITERA: An LLM Based Approach to Latin-to-English Translation

Paul Rosu

专题命中 指令微调 :LLM(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments NAACL Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05855 2025-04-09 cs.CL cs.AI 84%

Enhancing Coreference Resolution with Pretrained Language Models: Bridging the Gap Between Syntax and Semantics

Xingzu Liu, Songhang deng, Mingbang Wang, Zhang Dong, Le Dai, Jiyuan Li, Ruilin Nong

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments acl submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07591 2025-04-08 cs.CV cs.AI cs.LG 84%

Filter Images First, Generate Instructions Later: Pre-Instruction Data Selection for Visual Instruction Tuning

Bardia Safaei, Faizan Siddiqui, Jiacong Xu, Vishal M. Patel, Shao-Yuan Lo

专题命中 指令微调 :instruction tuning(title,abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted at CVPR 2025 (Highlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17823 2025-03-25 cs.LG cs.CL 84%

A General Framework to Enhance Fine-tuning-based LLM Unlearning

Jie Ren, Zhenwei Dai, Xianfeng Tang, Hui Liu, Jingying Zeng, Zhen Li, Rahul Goutam, Suhang Wang, Yue Xing, Qi He, Hui Liu

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14900 2025-03-20 cs.CL cs.AI 84%

Deep Contrastive Unlearning for Language Models

Estrid He, Tabinda Sarwar, Ibrahim Khalil, Xun Yi, Ke Wang

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12667 2025-03-18 cs.CL cs.AI 84%

Plausibility Vaccine: Injecting LLM Knowledge for Event Plausibility

Jacob Chmura, Jonah Dauvet, Sebastian Sabry

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00691 2025-03-10 cs.SE cs.AI cs.CL 84%

How Diversely Can Language Models Solve Problems? Exploring the Algorithmic Diversity of Model-Generated Code

Seonghyeon Lee, Heejae Chon, Joonwon Jang, Dongha Lee, Hwanjo Yu

专题命中 指令微调 :language model(title,abstract);instruction tuning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02989 2025-03-06 cs.CL cs.AI 84%

Effectively Steer LLM To Follow Preference via Building Confident Directions

Bingqing Song, Boran Han, Shuai Zhang, Hao Wang, Haoyang Fang, Bonan Min, Yuyang Wang, Mingyi Hong

专题命中 指令微调 :LLM(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏