arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11547 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11547 篇

2602.12561 2026-02-16 cs.CV 89%

PLLM: Pseudo-Labeling Large Language Models for CAD Program Synthesis

PLLM:基于伪标签的大型语言模型用于CAD程序合成

Yuanbo Li, Dule Shu, Yanying Chen, Matt Klenk, Daniel Ritchie

机构 * Brown University(布朗大学) Toyota Research Institute(丰田研究机构)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 PLLM通过伪标签技术,利用预训练的大语言模型和未标记的3D形状数据,提升CAD程序合成的几何保真度和程序多样性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11411 2026-02-13 cs.SE 89%

Improving the Robustness of Large Language Models for Code Tasks via Fine-tuning with Perturbed Data

通过扰动数据微调提升大语言模型在代码任务中的鲁棒性

Yang Liu, Armstrong Foundjem, Xingfang Wu, Heng Li, Foutse Khomh

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 通过扰动数据微调提升大语言模型在代码任务中的鲁棒性,以增强其对对抗性输入的防御能力,同时注意性能的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20126 2026-01-29 cs.CL cs.AI cs.LG 89%

Rewarding Intellectual Humility Learning When Not To Answer In Large Language Models

在大型语言模型中不回答时如何奖励智力谦逊学习

Abha Jha, Akanksha Mahajan, Ashwath Vaithinathan Aravindan, Praveen Saravanan, Sai Sailaja Policharla, Sonal Chaturbhuj Gehlot

机构 * University of Southern California(南加州大学) Los Angeles, United States of America(美国洛杉矶)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出通过可验证奖励强化学习促进大型语言模型的智力谦逊,通过调整回避奖励机制减少错误响应,提升模型可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17441 2026-01-27 cs.LG cs.AI cs.CL 89%

Data-driven Clustering and Merging of Adapters for On-device Large Language Models

面向设备的大型语言模型适配器驱动聚类与合并

Ondrej Bohdal, Taha Ceritli, Mete Ozay, Jijoong Moon, Kyeng-Hun Lee, Hyeonmok Ko, Umberto Michieli

机构 * 1Samsung R\&D Institute UK, United Kingdom \ 2Samsung Research, South Korea

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出D2C方法,通过驱动聚类和合并适配器,提升设备上大型语言模型在多任务中的性能。

Comments Accepted at ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13409 2026-01-21 eess.AS 89%

RLBR: Reinforcement Learning with Biasing Rewards for Contextual Speech Large Language Models

RLBR: 基于偏置奖励的强化学习用于上下文语音大语言模型

Bo Ren, Ruchao Fan, Yelong Shen, Weizhu Chen, Jinyu Li

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);SFT(abstract)

AI总结 RLBR通过偏置奖励和参考感知机制提升语音大语言模型在罕见词识别中的性能。

Comments Accepted to the 2026 IEEE International Conference on Acoustics, Speech, and Signal Processing (ICASSP 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.04994 2025-12-23 cs.SE 89%

SPVR: syntax-to-prompt vulnerability repair based on large language models

SPVR: 基于大语言模型的语法到提示漏洞修复

Ruoke Wang, Zongjie Li, Cuiyun Gao, Chaozheng Wang, Yang Xiao, Xuan Wang

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 SPVR通过语法分析生成针对性提示,提升大语言模型修复漏洞的准确性。

Journal ref Automated Software Engineering 33 (2026) 38

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12978 2025-12-16 cs.IR 89%

Do Reviews Matter for Recommendations in the Era of Large Language Models?

在大语言模型时代,评论对推荐有何影响?

Chee Heng Tan, Huiying Zheng, Jing Wang, Zhuoyi Lin, Shaodi Feng, Huijing Zhan, Xiaoli Li, J. Senthilnath

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文研究了在大语言模型时代,文本评论对推荐系统的影响,通过比较深度学习和LLM方法,发现LLMs在数据稀疏和冷启动条件下表现更优,且移除评论不影响推荐准确性。

Comments 11 pages, 9 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19417 2025-11-25 cs.CL cs.AI cs.LG 89%

Be My Eyes: Extending Large Language Models to New Modalities Through Multi-Agent Collaboration

Be My Eyes: 通过多智能体协作扩展大型语言模型到新模态

James Y. Huang, Sheng Zhang, Qianchu Liu, Guanghui Qin, Tinghui Zhu, Tristan Naumann, Muhao Chen, Hoifung Poon

机构 * University of Southern California(南加州大学) Microsoft Research(微软研究院) University of California, Davis(加州大学戴维斯分校)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 BeMyEyes通过多智能体协作扩展LLMs到多模态推理,利用高效VLMs与强大LLMs的互补优势,实现轻量级开源解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18823 2025-11-25 cs.CV 89%

VideoPerceiver: Enhancing Fine-Grained Temporal Perception in Video Multimodal Large Language Models

VideoPerceiver: 提升视频多模态大语言模型的细粒度时序感知能力

Fufangchen Zhao, Liao Zhang, Daiqi Shi, Yuanjun Gao, Chen Ye, Yang Cai, Jian Gao, Danfeng Yan

机构 * State Key Laboratory of Networking and Switching Technology, BUPT(网络与交换技术国家重点实验室)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);SFT(abstract)

AI总结 VideoPerceiver通过两阶段训练框架提升视频多模态大语言模型对细粒度动作和短暂事件的感知能力,显著优于现有模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05981 2025-11-20 cs.SE 89%

Multi-Agent Debate Strategies to Enhance Requirements Engineering with Large Language Models

Marc Oriol, Quim Motger, Jordi Marco, Xavier Franch

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.09415 2025-11-18 cs.CV 89%

FaceShield: Explainable Face Anti-Spoofing with Multimodal Large Language Models

Hongyang Wang, Yichen Shi, Zhuofu Tao, Yuhao Gao, Liepiao Zhang, Xun Lin, Jun Feng, Xiaochen Yuan, Zitong Yu, Xiaochun Cao

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);SFT(abstract)

Comments Accepted by AAAI 2025. Hongyang Wang and Yichen Shi contribute equally. Corresponding author: Zitong Yu

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07777 2025-11-12 eess.SP 89%

A Causal-Guided Multimodal Large Language Model for Generalized Power System Time-Series Data Analytics

Zhenghao Zhou, Yiyan Li, Xinjie Yu, Runlong Liu, Zelin Guo, Zheng Yan, Mo-Yuen Chow, Yuqi Yang, Yang Xu

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07329 2025-11-06 cs.CL cs.AI cs.LG 89%

Assessing the Macro and Micro Effects of Random Seeds on Fine-Tuning Large Language Models

Nghia Bui, Guergana Savova, Lijing Wang

机构 * New Jersey Institute of Technology(新泽西理工学院) Boston Children’s Hospital and Harvard Medical School(波士顿儿童医院和哈佛医学院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 7 pages, 5 tables, 3 figures. Accepted at IJCNLP 2025. This is the final, peer-reviewed version of the work, which supersedes and extends the unauthorized draft previously posted as arXiv:2503.07329

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02423 2025-11-05 eess.SP 89%

LLM4PG: Adapting Large Language Model for Pathloss Map Generation via Synesthesia of Machines

Mingran Sun, Lu Bai, Xiang Cheng, Jianjun Wu

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.09539 2025-10-29 cs.CL cs.AI cs.LG 89%

Fine-tuning Large Language Models with Limited Data: A Survey and Practical Guide

Marton Szep, Daniel Rueckert, Rüdiger von Eisenhart-Rothe, Florian Hinterwimmer

机构 * Chair for AI in Healthcare and Medicine, Technical University of Munich (TUM) and TUM University Hospital(人工智能在医疗与医学中的chair,技术大学慕尼黑(TUM)和慕尼黑技术大学医院) Department of Orthopaedics and Sports Orthopaedics, TUM University Hospital(骨科与运动骨科,慕尼黑技术大学医院) Munich Center for Machine Learning (MCML), Munich, Germany(慕尼黑机器学习中心(MCML)) Department of Computing, Imperial College London, UK(计算系,帝国理工学院伦敦)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to TACL. Pre-MIT Press version. Major restructuring; added preference alignment section and additional tables. 36 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21657 2025-10-22 cs.CL cs.AI cs.LG 89%

Explaining Large Language Models with gSMILE

Zeinab Dehghani, Mohammed Naveed Akram, Koorosh Aslansefat, Adil Khan, Yiannis Papadopoulos

机构 * University of Hull(赫尔大学) Fraunhofer IESE(弗劳恩霍夫研究所)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13848 2025-10-17 cs.CL cs.AI cs.LG 89%

On-device System of Compositional Multi-tasking in Large Language Models

Ondrej Bohdal, Konstantinos Theodosiadis, Asterios Mpatziakas, Dimitris Filippidis, Iro Spyrou, Christos Zonios, Anastasios Drosou, Dimosthenis Ioannidis, Kyeng-Hun Lee, Jijoong Moon, Hyeonmok Ko, Mete Ozay, Umberto Michieli

机构 * Samsung R&D Institute UK(三星英国研发中心) CERTH(希腊CERTH) Samsung Research(三星研究)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at EMNLP 2025 (industry track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13131 2025-10-16 cs.CV cs.MM 89%

OS-HGAdapter: Open Semantic Hypergraph Adapter for Large Language Models Assisted Entropy-Enhanced Image-Text Alignment

Rongjun Chen, Chengsi Yao, Jinchang Ren, Xianxian Zeng, Peixian Wang, Jun Yuan, Jiawen Li, Huimin Zhao, Xu Lu

机构 * School of Computer Science, Guangdong Polytechnic Normal University(广东 polytechnic 正规大学计算机学院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18798 2025-09-24 eess.AS 89%

Group Relative Policy Optimization for Text-to-Speech with Large Language Models

Chang Liu, Ya-Jun Hu, Ying-Ying Gao, Shi-Lei Zhang, Zhen-Hua Ling

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 5 pages,submitted to ICASSP2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15178 2025-09-22 eess.AS cs.SD 89%

Enhancing Speech Large Language Models with Prompt-Aware Mixture of Audio Encoders

Weiqiao Shan, Yuang Li, Yuhao Zhang, Yingfeng Luo, Chen Xu, Xiaofeng Zhao, Long Meng, Yunfei Lu, Min Zhang, Hao Yang, Tong Xiao, Jingbo Zhu

机构 * School of Computer Science and Engineering, Northeastern University(东北大学计算机科学与工程学院) Huawei Translation Services Center(华为翻译服务中心) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) College of Computer Science and Technology, Harbin Engineering University(哈尔滨工程大学计算机科学与技术学院) NiuTrans Research(NiuTrans研究院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 16 pages,5 figures, 13 tables, to be published in EMNLP 2025 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14711 2025-09-19 eess.SP 89%

LLM4MG: Adapting Large Language Model for Multipath Generation via Synesthesia of Machines

Ziwei Huang, Shiliang Lu, Lu Bai, Xuesong Cai, Xiang Cheng

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17879 2025-09-04 eess.SP 89%

LLM4SG: Adapting Large Language Model for Scatterer Generation via Synesthesia of Machines

Zengrui Han, Lu Bai, Ziwei Huang, Xiang Cheng

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.09701 2025-09-04 cs.SE 89%

Towards Explainable Vulnerability Detection with Large Language Models

Qiheng Mao, Zhenhao Li, Xing Hu, Kui Liu, Xin Xia, Jianling Sun

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03238 2025-09-03 cs.RO 89%

RobotxR1: Enabling Embodied Robotic Intelligence on Large Language Models through Closed-Loop Reinforcement Learning

Liam Boyle, Nicolas Baumann, Paviththiren Sivasothilingam, Michele Magno, Luca Benini

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21156 2025-09-01 cs.SE 89%

Automated Bug Triaging using Instruction-Tuned Large Language Models

Kiana Kiashemshaki, Arsham Khosravani, Alireza Hosseinpour, Arshia Akhavan

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 11 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08066 2025-08-21 cs.CV cs.AI cs.CL cs.LG 89%

ExpVG: Investigating the Design Space of Visual Grounding in Multimodal Large Language Model

Weitai Kang, Weiming Zhuang, Zhizhong Li, Yan Yan, Lingjuan Lyu

机构 * University of Illinois Chicago(伊利诺伊大学香槟分校) Sony AI(索尼人工智能)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 8 pages for the main paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12622 2025-08-19 cs.CR 89%

Consiglieres in the Shadow: Understanding the Use of Uncensored Large Language Models in Cybercrimes

Zilong Lin, Zichuan Li, Xiaojing Liao, XiaoFeng Wang

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.19860 2025-08-14 cs.CV 89%

CoherenDream: Boosting Holistic Text Coherence in 3D Generation via Multimodal Large Language Models Feedback

Chenhan Jiang, Yihan Zeng, Dit-Yan Yeung

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08589 2025-08-13 cs.CV 89%

DocThinker: Explainable Multimodal Large Language Models with Rule-based Reinforcement Learning for Document Understanding

Wenwen Yu, Zhibo Yang, Yuliang Liu, Xiang Bai

机构 * Huazhong University of Science and Technology(华中科技大学) Alibaba Group(阿里巴巴集团)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);SFT(abstract)

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07485 2025-08-12 cs.AI cs.CL cs.CY cs.LG 89%

Democratizing Diplomacy: A Harness for Evaluating Any Large Language Model on Full-Press Diplomacy

Alexander Duffy, Samuel J Paech, Ishana Shastri, Elizabeth Karpinski, Baptiste Alloui-Cros, Tyler Marques, Matthew Lyle Olson

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏