arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11585 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11585 篇

2412.06967 2024-12-11 cs.CL cs.SD eess.AS 87%

Effective Text Adaptation for LLM-based ASR through Soft Prompt Fine-Tuning

Yingyi Ma, Zhe Liu, Ozlem Kalinli

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments accepted as SLT 2024 proceeding

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03467 2024-12-05 cs.CV cs.AI 87%

Training-Free Mitigation of Language Reasoning Degradation After Multimodal Instruction Tuning

Neale Ratzlaff, Man Luo, Xin Su, Vasudev Lal, Phillip Howard

专题命中 指令微调 :instruction tuning(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15442 2024-11-26 cs.AR cs.AI 87%

Automatic High-quality Verilog Assertion Generation through Subtask-Focused Fine-Tuned LLMs and Iterative Prompting

Mohammad Shahidzadeh, Behnam Ghavami, Steve Wilton, Lesley Shannon

专题命中 指令微调 :prompting(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.06142 2024-11-12 cs.CV cs.AI 87%

Aquila-plus: Prompt-Driven Visual-Language Models for Pixel-Level Remote Sensing Image Understanding

Kaixuan Lu

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11801 2024-10-29 cs.CL 87%

Safety Arithmetic: A Framework for Test-time Safety Alignment of Language Models by Steering Parameters and Activations

Rima Hazra, Sayan Layek, Somnath Banerjee, Soujanya Poria

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);SFT(abstract)

Comments EMNLP 2024 Main. Codes are available at: https://github.com/declare-lab/safety-arithmetic

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.12917 2024-10-07 cs.LG 87%

Training Language Models to Self-Correct via Reinforcement Learning

Aviral Kumar, Vincent Zhuang, Rishabh Agarwal, Yi Su, John D Co-Reyes, Avi Singh, Kate Baumli, Shariq Iqbal, Colton Bishop, Rebecca Roelofs, Lei M Zhang, Kay McKinney, Disha Shrivastava, Cosmin Paduraru, George Tucker, Doina Precup, Feryal Behbahani, Aleksandra Faust

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14800 2024-09-24 cs.AI 87%

Choose the Final Translation from NMT and LLM hypotheses Using MBR Decoding: HW-TSC's Submission to the WMT24 General MT Shared Task

Zhanglin Wu, Daimeng Wei, Zongyao Li, Hengchao Shang, Jiaxin Guo, Shaojun Li, Zhiqiang Rao, Yuanchang Luo, Ning Xie, Hao Yang

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);preference optimization(abstract)

Comments 10 pages, 4 figures, 2 Tables, EMNLP2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09345 2024-09-17 cs.AI 87%

Enhancing Decision-Making for LLM Agents via Step-Level Q-Value Models

Yuanzhao Zhai, Tingkai Yang, Kele Xu, Feng Dawei, Cheng Yang, Bo Ding, Huaimin Wang

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.06189 2024-07-09 cs.CV cs.AI 87%

Video-STaR: Self-Training Enables Video Instruction Tuning with Any Supervision

Orr Zohar, Xiaohan Wang, Yonatan Bitton, Idan Szpektor, Serena Yeung-Levy

专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Project page: https://orrzohar.github.io/projects/video-star/

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.00367 2024-07-02 cs.CL 87%

Don't Hallucinate, Abstain: Identifying LLM Knowledge Gaps via Multi-LLM Collaboration

Shangbin Feng, Weijia Shi, Yike Wang, Wenxuan Ding, Vidhisha Balachandran, Yulia Tsvetkov

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.17923 2024-06-27 cs.CL 87%

PAFT: A Parallel Training Paradigm for Effective LLM Fine-Tuning

Shiva Kumar Pentyala, Zhichao Wang, Bin Bi, Kiran Ramnath, Xiang-Bo Mao, Regunathan Radhakrishnan, Sitaram Asur, Na, Cheng

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.04403 2024-05-08 cs.CV cs.CL 87%

Learning To See But Forgetting To Follow: Visual Instruction Tuning Makes LLMs More Prone To Jailbreak Attacks

Georgios Pantazopoulos, Amit Parekh, Malvina Nikandrou, Alessandro Suglia

专题命中 指令微调 :instruction tuning(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.11978 2024-04-19 cs.CL 87%

EVIT: Event-Oriented Instruction Tuning for Event Reasoning

Zhengwei Tao, Xiancai Chen, Zhi Jin, Xiaoying Bai, Haiyan Zhao, Yiwei Lou

专题命中 指令微调 :instruction tuning(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.10222 2024-04-12 cs.CV cs.AI 87%

Supervised Fine-tuning in turn Improves Visual Foundation Models

Xiaohu Jiang, Yixiao Ge, Yuying Ge, Dachuan Shi, Chun Yuan, Ying Shan

专题命中 指令微调 :foundation model(title,abstract);instruction tuning(abstract);pretraining(abstract);SFT(abstract)

Comments 23 pages, 3 figures, Project page: https://github.com/TencentARC/ViSFT/tree/main

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.12776 2024-03-20 cs.CL 87%

Automated Data Curation for Robust Language Model Fine-Tuning

Jiuhai Chen, Jonas Mueller

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.11251 2024-02-20 cs.CL 87%

LLM can Achieve Self-Regulation via Hyperparameter Aware Generation

Siyin Wang, Shimin Li, Tianxiang Sun, Jinlan Fu, Qinyuan Cheng, Jiasheng Ye, Junjie Ye, Xipeng Qiu, Xuanjing Huang

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.17107 2024-02-06 cs.CV cs.CL 87%

LLaVAR: Enhanced Visual Instruction Tuning for Text-Rich Image Understanding

Yanzhe Zhang, Ruiyi Zhang, Jiuxiang Gu, Yufan Zhou, Nedim Lipka, Diyi Yang, Tong Sun

专题命中 指令微调 :instruction tuning(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.00616 2023-12-04 cs.CL 87%

Extensible Prompts for Language Models on Zero-shot Language Style Customization

Tao Ge, Jing Hu, Li Dong, Shaoguang Mao, Yan Xia, Xun Wang, Si-Qing Chen, Furu Wei

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);prompting(abstract)

Comments Accepted by NeurIPS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.15653 2023-11-28 cs.CL 87%

MoDS: Model-oriented Data Selection for Instruction Tuning

Qianlong Du, Chengqing Zong, Jiajun Zhang

专题命中 指令微调 :instruction tuning(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.10367 2023-11-20 cs.CL 87%

Exploring the Relationship between In-Context Learning and Instruction Tuning

Hanyu Duan, Yixuan Tang, Yi Yang, Ahmed Abbasi, Kar Yan Tam

专题命中 指令微调 :instruction tuning(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.13225 2023-10-10 cs.CL 87%

Multi-Task Instruction Tuning of LLaMa for Specific Scenarios: A Preliminary Study on Writing Assistance

Yue Zhang, Leyang Cui, Deng Cai, Xinting Huang, Tao Fang, Wei Bi

专题命中 指令微调 :instruction tuning(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14898 2023-05-25 cs.CL 87%

PIVOINE: Instruction Tuning for Open-world Information Extraction

Keming Lu, Xiaoman Pan, Kaiqiang Song, Hongming Zhang, Dong Yu, Jianshu Chen

专题命中 指令微调 :instruction tuning(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27566 2026-07-31 cs.CV 新提交 87%

Objective-Aligned Direct Answer SFT for Robust Multi-Frame Medical VQA

面向稳健多帧医学视觉问答的目标对齐直接答案监督微调

Site Li, Jianyi Hao, Xiaofeng Liu

机构 * Yale University(耶鲁大学)

专题命中 指令微调 :SFT(title,summary_cn);foundation model(comments)

AI总结 该研究针对MedFrameQA数据集,提出目标对齐的直接答案SFT是最强稳健适配系列,其在保留报告准确率上优于冻结基线且稳定性好,还可迁移至其他骨干网络,旨在引导研究聚焦稳健优化而非架构复杂度。

Comments Presented at the CVPR 2026 Workshop on Multimodal Foundation Models for Biomedicine: Challenges and Opportunities

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19399 2025-12-24 cs.LG cs.AI cs.CL 87%

Brain-Grounded Axes for Reading and Steering LLM States

基于大脑活动的阅读与操控LLM状态的轴

Sandro Andric

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出利用人类大脑活动作为坐标系,通过ICA提取潜在轴,操控LLM状态,实现可解释和可控的LLM行为。

Comments 10 pages, 4 figures. Code: https://github.com/sandroandric/Brain-Grounded-Axes-for-Reading-and-Steering-LLM-States

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09499 2025-07-15 eess.AS cs.SD 87%

The DKU System for Multi-Speaker Automatic Speech Recognition in MLC-SLM Challenge

Yuke Lin, Ming Cheng, Ze Li, Ming Li

机构 * School of Computer Science, Wuhan University, China(武汉大学计算机学院) Suzhou Municipal Key Laboratory of Multimodal Intelligent Systems, Digital Innovation Research Center, Duke Kunshan University, China(多克大学数字创新研究中心)

专题命中 指令微调 :SLM(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

Comments Technical Report for MLC-SLM Challenge in Interspeech2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.13133 2023-12-29 cs.LG cs.AI cs.CL 87%

LIMIT: Less Is More for Instruction Tuning Across Evaluation Paradigms

Aditi Jha, Sam Havens, Jeremy Dohmann, Alex Trott, Jacob Portes

专题命中 指令微调 :instruction tuning(title,comments);LLM(abstract);large language model(abstract);language model(abstract)

Comments 36 pages, 12 figures, NeurIPS 2023 Workshop on Instruction Tuning and Instruction Following

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.00615 2023-09-04 cs.CV cs.AI cs.CL cs.LG cs.MM 87%

Point-Bind & Point-LLM: Aligning Point Cloud with Multi-modality for 3D Understanding, Generation, and Instruction Following

Ziyu Guo, Renrui Zhang, Xiangyang Zhu, Yiwen Tang, Xianzheng Ma, Jiaming Han, Kexin Chen, Peng Gao, Xianzhi Li, Hongsheng Li, Pheng-Ann Heng

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Work in progress. Code is available at https://github.com/ZiyuGuo99/Point-Bind_Point-LLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18767 2026-08-20 cs.CL cs.LG 新提交 87%

Gradient Mirage: Trainable yet Label-Unidentifiable Gradients in Large Language Model Split Learning

梯度幻影:大语言模型拆分学习中可训练且标签不可识别的梯度

Shiyu Miao, Yunlong Mao, Zirui Huang, Liang Yao, Tianshuo Zheng, Yanhui Gu, Fan Liu, Sheng Zhong

专题命中 指令微调 :large language model(title);language model(title);LLM(abstract);分类 cs.CL、cs.LG

AI总结 针对大语言模型拆分学习中梯度匹配攻击的标签泄露问题,提出Gradient Mirage防御方法,通过三个维度的不一致性打破梯度-目标一致性,在保留优化效用的同时提升隐私保护,实现更优的隐私-效用权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14563 2026-08-18 cs.LG cs.AI 新提交 87%

Forward Pass Domain Adaptation (Without Cross-Layer Backpropagation)

仅前向传播的领域适配(无需跨层反向传播)

Rivaan Patil, Simon Dennis, Hao Guo, Kevin Shabahang

机构 * University of California, Santa Cruz(加州大学圣克鲁兹分校) University of Melbourne(墨尔本大学)

专题命中 指令微调 :SFT(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 该研究提出仅前向传播的MLP训练(FPO)方法,无需跨层反向传播即可适配大语言模型,提升吞吐量、降低内存开销,在保持域外基准性能的同时优化域内困惑度,且耗时低于限定SFT的方案。

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10414 2026-08-12 cs.CL cs.LG 新提交 87%

How Robust Are LLMs to Vietnamese Dialects?

大型语言模型对越南方言的鲁棒性如何?

Minh Tran, Trinh Chau, Thanh-Nhan Le, Nam Tran, Luan Thanh Nguyen, Cuong Dang, Duc Hoang

专题命中 指令微调 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 本研究通过构建VialectBench基准,评估指令微调LLM对越南方言的鲁棒性,发现方言输入会导致模型性能下降,且不同方言组的影响存在显著差异,标准越南语上的性能不代表方言场景下的可靠性。

Comments 8 pages, 3 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏