arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11601 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11601 篇

2506.10635 2025-06-13 cs.IR cs.CL 83%

Conversational Search: From Fundamentals to Frontiers in the LLM Era

Fengran Mo, Chuan Meng, Mohammad Aliannejadi, Jian-Yun Nie

机构 * University of Amsterdam(阿姆斯特丹大学)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted by Tutorial Track in SIGIR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10334 2025-06-13 cs.CV cs.AI 83%

Using Vision Language Models to Detect Students' Academic Emotion through Facial Expressions

Deliang Wang, Chao Yang, Gaowei Chen

机构 * Faculty of Education(教育学院) The University of Hong Kong(香港大学)

专题命中 指令微调 :language model(title,abstract);prompting(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.00775 2025-06-10 cs.CL 83%

Decoding Hate: Exploring Language Models' Reactions to Hate Speech

Paloma Piot, Javier Parapar

机构 * IRLab(IR实验室) CITIC Research Centre(CITIC研究中心) University of A Coruña(阿维拉大学)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL

Journal ref Proceedings of the 2025 Conference of the Nations of the Americas Chapter of the Association for Computational Linguistics: Human Language Technologies

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03483 2025-06-05 cs.CL 83%

APT: Improving Specialist LLM Performance with Weakness Case Acquisition and Iterative Preference Training

Jun Rao, Zepeng Lin, Xuebo Liu, Xiaopeng Ke, Lian Lian, Dong Jin, Shengjun Cheng, Jun Yu, Min Zhang

机构 * Institute of Computing and Intelligence, Harbin Institute of Technology, Shenzhen, China(计算与智能学院,哈尔滨工业大学,深圳,中国) Huawei Cloud Computing Technologies Co., Ltd.(华为云计算技术有限公司) School of Intelligence Science and Engineering, Harbin Institute of Technology, Shenzhen, China(智能科学与工程学院,哈尔滨工业大学,深圳,中国)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

Comments ACL2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01277 2025-06-03 cs.AI 83%

GeoLocSFT: Efficient Visual Geolocation via Supervised Fine-Tuning of Multimodal Foundation Models

Qiang Yi, Lianlei Shan

机构 * University of California, Berkeley(加州大学伯克利分校) Tsinghua University(清华大学)

专题命中 指令微调 :foundation model(title,abstract);SFT(abstract);分类 cs.AI

Comments 29 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12212 2025-06-03 cs.CL 83%

Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning

Shaobo Wang, Xiangqi Jin, Ziming Wang, Jize Wang, Jiajun Zhang, Kaixin Li, Zichen Wen, Zhong Li, Conghui He, Xuming Hu, Linfeng Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) EPIC Lab, SJTU(SJTu EPIC 实验室) Nanyang Technological University(南洋理工大学) National University of Singapore(新加坡国立大学) Microsoft Research Asia(微软亚洲研究院) Shanghai AI Laboratory(上海人工智能实验室) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted by ACL 2025 main, 18 pages, 8 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24493 2025-06-02 cs.AI cs.SD eess.AS 83%

MELT: Towards Automated Multimodal Emotion Data Annotation by Leveraging LLM Embedded Knowledge

Xin Jing, Jiadong Wang, Iosif Tsangko, Andreas Triantafyllopoulos, Björn W. Schuller

机构 * Technical University of Munich(慕尼黑技术大学) Imperial College London(伦敦帝国理工学院) CHI – Chair of Health Informatics(健康信息学系) Munich Centre for Machine Learning(慕尼黑机器学习中心) GLAM – Group on Language, Audio, & Music(语言、音频与音乐小组)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19294 2025-05-27 cs.SD cs.CL cs.HC cs.MM eess.AS 83%

Towards Reliable Large Audio Language Model

Ziyang Ma, Xiquan Li, Yakun Song, Wenxi Chen, Chenpeng Du, Jian Wu, Yuanzhe Chen, Zhuo Chen, Yuping Wang, Yuxuan Wang, Xie Chen

机构 * X-LANCE Lab, School of Computer Science, MoE Key Lab of Artificial Intelligence, Shanghai Jiao Tong University(X-LANCE实验室,计算机科学学院,人工智能国家重点实验室,上海交通大学) ByteDance(字节跳动)

专题命中 指令微调 :language model(title,abstract);SFT(abstract);分类 cs.CL

Comments ACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18549 2025-05-27 cs.CL 83%

MSA at BEA 2025 Shared Task: Disagreement-Aware Instruction Tuning for Multi-Dimensional Evaluation of LLMs as Math Tutors

Baraa Hikal, Mohamed Basem, Islam Oshallah, Ali Hamdi

机构 * Faculty of Computer Science, MSA University(计算机科学学院,MSA大学)

专题命中 指令微调 :instruction tuning(title,abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11041 2025-05-27 cs.CL 83%

Separate the Wheat from the Chaff: A Post-Hoc Approach to Safety Re-Alignment for Fine-Tuned Language Models

Di Wu, Xin Lu, Yanyan Zhao, Bing Qin

机构 * Research Center for Social Computing and Information Retrieval(社会计算与信息检索研究中心) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL

Comments 16 pages, 14 figures. Camera-ready for ACL2025 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12835 2025-05-20 cs.CL cs.CV 83%

FlightGPT: Towards Generalizable and Interpretable UAV Vision-and-Language Navigation with Vision-Language Models

Hengxing Cai, Jinhan Dong, Jingjun Tan, Jingcheng Deng, Sihang Li, Zhifeng Gao, Haidong Wang, Zicheng Su, Agachai Sumalee, Renxin Zhong

机构 * School of Intelligent Systems Engineering, Sun Yat-Sen University(中山大学智能系统工程学院) DP Technology(DP技术公司) Beijing University Of Posts and Telecommunications(北京邮电大学) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) Tongji University(同济大学) School of Integrated Innovation, Chulalongkorn University(朱拉隆功大学创新学院)

专题命中 指令微调 :language model(title,abstract);SFT(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18804 2025-04-29 cs.SE cs.AI 83%

Can We Enhance Bug Report Quality Using LLMs?: An Empirical Study of LLM-Based Bug Report Generation

Jagrit Acharya, Gouri Ginde

机构 * University of Calgary(卡尔加里大学)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14848 2025-04-22 cs.CV cs.AI 83%

Object-Level Verbalized Confidence Calibration in Vision-Language Models via Semantic Perturbation

Yunpu Zhao, Rui Zhang, Junbin Xiao, Ruibo Hou, Jiaming Guo, Zihao Zhang, Yifan Hao, Yunji Chen

机构 * University of Science and Technology of China(中国科学技术大学) SKL of Processors, Institute of Computing Technology, CAS(中国科学院计算技术研究所处理器专项实验室) National University of Singapore(新加坡国立大学) University of Chinese Academy of Sciences(中国科学院大学) University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 指令微调 :language model(title,abstract);preference optimization(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23869 2025-04-22 cs.LG 83%

Communication-Efficient and Personalized Federated Foundation Model Fine-Tuning via Tri-Matrix Adaptation

Yongle Li, Bo Liu, Sheng Huang, ZHeng ZHang, Xiaotong Yuan, Richang Hong

机构 * Hefei University of Technology(合肥工业大学) Chongqing University(重庆大学) Tsinghua University(清华大学) Nanjing University(南京大学)

专题命中 指令微调 :foundation model(title,abstract);LLM(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12687 2025-04-18 cs.CL 83%

Data-efficient LLM Fine-tuning for Code Generation

Weijie Lv, Xuan Xia, Sheng-Jun Huang

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

Comments arXiv admin note: text overlap with arXiv:2408.02193

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23542 2025-04-14 cs.CL 83%

Whisper-LM: Improving ASR Models with Language Models for Low-Resource Languages

Xabier de Zuazo, Eva Navas, Ibon Saratxaga, Inma Hernáez Rioja

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL

Comments 26 pages, 6 figures, includes supplementary materials. Will be submitted to IEEE/ACM Transactions on Audio, Speech, and Language Processing

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18603 2025-03-27 cs.CL 83%

LANGALIGN: Enhancing Non-English Language Models via Cross-Lingual Embedding Alignment

Jong Myoung Kim, Young-Jun Lee, Ho-Jin Choi, Sangkeun Jung

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL

Comments now preparing

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11227 2025-03-18 cs.AI 83%

GKG-LLM: A Unified Framework for Generalized Knowledge Graph Construction

Jian Zhang, Bifan Wei, Shihao Qi, haiping Zhu, Jun Liu, Qika Lin

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.02032 2025-03-18 cs.CV cs.AI 83%

Self-Introspective Decoding: Alleviating Hallucinations for Large Vision-Language Models

Fushuo Huo, Wenchao Xu, Zhong Zhang, Haozhao Wang, Zhicheng Chen, Peilin Zhao

专题命中 指令微调 :language model(title,abstract);instruction tuning(abstract);分类 cs.AI

Comments ICLR2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.19597 2025-03-18 cs.CL cs.CR 83%

TuBA: Cross-Lingual Transferability of Backdoor Attacks in LLMs with Instruction Tuning

Xuanli He, Jun Wang, Qiongkai Xu, Pasquale Minervini, Pontus Stenetorp, Benjamin I. P. Rubinstein, Trevor Cohn

专题命中 指令微调 :instruction tuning(title);large language model(abstract);language model(abstract);分类 cs.CL

Comments work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15398 2025-03-17 cs.CL 83%

How Green are Neural Language Models? Analyzing Energy Consumption in Text Summarization Fine-tuning

Tohida Rehman, Debarshi Kumar Sanyal, Samiran Chattopadhyay

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04724 2025-03-07 cs.CL 83%

LLMVoX: Autoregressive Streaming Text-to-Speech Model for Any LLM

Sambal Shikhar, Mohammed Irfan Kurpath, Sahal Shaji Mullappilly, Jean Lahoud, Fahad Khan, Rao Muhammad Anwer, Salman Khan, Hisham Cholakkal

专题命中 指令微调 :LLM(title,abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01048 2025-03-06 cs.LG 83%

Personalize Your LLM: Fake it then Align it

Yijing Zhang, Dyah Adila, Changho Shin, Frederic Sala

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.LG

Comments NAACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11427 2025-02-18 cs.CL cs.CV 83%

Do we Really Need Visual Instructions? Towards Visual Instruction-Free Fine-tuning for Large Vision-Language Models

Zikang Liu, Kun Zhou, Wayne Xin Zhao, Dawei Gao, Yaliang Li, Ji-Rong Wen

专题命中 指令微调 :language model(title,abstract);instruction tuning(abstract);分类 cs.CL

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01237 2025-02-17 cs.CL 83%

Self-Refinement Strategies for LLM-based Product Attribute Value Extraction

Alexander Brinkmann, Christian Bizer

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01378 2025-02-04 cs.LG 83%

CE-LoRA: Computation-Efficient LoRA Fine-Tuning for Language Models

Guanduo Chen, Yutong He, Yipeng Hu, Kun Yuan, Binhang Yuan

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01056 2025-02-04 cs.CV cs.CL 83%

Mitigating Hallucinations in Large Vision-Language Models with Internal Fact-based Contrastive Decoding

Chao Wang, Xuancheng Zhou, Weiwei Fu, Yang Zhou

专题命中 指令微调 :language model(title,abstract);SFT(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09720 2025-02-04 cs.CV cs.AI 83%

A Simple Aerial Detection Baseline of Multimodal Language Models

Qingyun Li, Yushi Chen, Xinya Shu, Dong Chen, Xin He, Yi Yu, Xue Yang

专题命中 指令微调 :language model(title,abstract);foundation model(abstract);分类 cs.AI

Comments 4 pages, 1 table, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.19086 2025-02-03 cs.CV cs.AI 83%

Fairness Analysis of CLIP-Based Foundation Models for X-Ray Image Classification

Xiangyu Sun, Xiaoguang Zou, Yuanquan Wu, Guotai Wang, Shaoting Zhang

专题命中 指令微调 :foundation model(title);language model(abstract);pretraining(abstract);分类 cs.AI

Comments This paper has been accepted for presentation at the 2025 IEEE International Symposium on Biomedical Imaging (ISBI 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04472 2025-01-30 cs.CL cs.CY 83%

Collapsed Language Models Promote Fairness

Jingxuan Xu, Wuyang Chen, Linyi Li, Yao Zhao, Yunchao Wei

专题命中 指令微调 :language model(title,abstract);prompting(abstract);分类 cs.CL

Comments ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏