arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11547 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11547 篇

2508.14916 2025-08-22 eess.AS cs.AI cs.CL 89%

Transsion Multilingual Speech Recognition System for MLC-SLM 2025 Challenge

Xiaoxiao Li, An Zhu, Youhai Jiang, Fengjie Zhu

机构 * Shenzhen Transsion Holdings Co., Ltd(深圳Transsion控股有限公司)

专题命中 指令微调 :SLM(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03930 2025-08-08 cs.CL cs.AI 89%

GuARD: Effective Anomaly Detection through a Text-Rich and Graph-Informed Language Model

Yunhe Pang, Bo Chen, Fanjin Zhang, Yanghui Rao, Evgeny Kharlamov, Jie Tang

机构 * School of Computer Science and Engineering(计算机科学与工程学院) Sun Yat-Sen University(中山大学) Department of Computer Science and Technology(计算机科学与技术系) Tsinghua University(清华大学) Robert Bosch GmbH(博世集团)

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);small language model(abstract)

Comments Accepted at KDD 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02081 2025-06-04 cs.LG cs.AI 89%

RATFM: Retrieval-augmented Time Series Foundation Model for Anomaly Detection

Chihiro Maru, Shoetsu Sato

机构 * Chuo University(中川大学)

专题命中 指令微调 :foundation model(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.08568 2025-05-28 cs.CL cs.AI 89%

WizardCoder: Empowering Code Large Language Models with Evol-Instruct

Ziyang Luo, Can Xu, Pu Zhao, Qingfeng Sun, Xiubo Geng, Wenxiang Hu, Chongyang Tao, Jing Ma, Qingwei Lin, Daxin Jiang

机构 * Microsoft(微软公司) Hong Kong Baptist University(香港 Baptist 大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Large Language model, Code Generation, Code LLMs.This paper has been accepted to ICLR 2024. Please cite the ICLR version

Journal ref The Twelfth International Conference on Learning Representations (ICLR 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02810 2025-05-27 cs.LG cs.AI physics.chem-ph q-bio.BM 89%

Mol-LLM: Multimodal Generalist Molecular LLM with Improved Graph Utilization

Chanhui Lee, Hanbum Ko, Yuheon Song, YongJun Jeong, Rodrigo Hormazabal, Sehui Han, Kyunghoon Bae, Sungbin Lim, Sungwoong Kim

机构 * Department of Artificial Intelligence, Korea University(韩国大学人工智能系) Department of Artificial Intelligence, UNIST(UNIST人工智能系) Kim Jaechul Graduate School of AI, KAIST(韩国科学技术院人工智能研究生院) LG AI Research(LG人工智能研究) Department of Statistics, Korea University(韩国大学统计系)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.15551 2025-05-01 eess.AS cs.AI cs.CL cs.MM cs.SD 89%

Revise, Reason, and Recognize: LLM-Based Emotion Recognition via Emotion-Specific Prompts and ASR Error Correction

Yuanchao Li, Yuan Gong, Chao-Han Huck Yang, Peter Bell, Catherine Lai

机构 * MIT(麻省理工学院) MIT CSAIL(麻省理工学院计算机科学与人工智能实验室) NVIDIA Research(英伟达研究)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

Comments Accepted to ICASSP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.06318 2024-08-13 cs.AI cs.LG 89%

Can We Rely on LLM Agents to Draft Long-Horizon Plans? Let's Take TravelPlanner as an Example

Yanan Chen, Ali Pesaranghader, Tanmana Sadhu, Dong Hoon Yi

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);SFT(abstract)

Comments 13 pages, 2 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.11651 2024-04-17 cs.CL 89%

Learning From Failure: Integrating Negative Examples when Fine-tuning Large Language Models as Agents

Renxi Wang, Haonan Li, Xudong Han, Yixuan Zhang, Timothy Baldwin

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL;LLM(comments)

Comments Agent, LLM, Large Language Model

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11912 2026-08-13 cs.CE 新提交 89%

Comparative Analysis of Low-Rank Adaptation in Large Language Models versus Dense Embedding Regression for Headline Click-Through Rate Prediction

用于标题点击率预测的大语言模型低秩适配(LoRA)与密集嵌入回归的对比分析

Samarth Sirsat, Anirudha Shinde, Amit Sethi, Aman Verma

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract_cn)

AI总结 本研究将标题选择建模为赢家通吃分类任务,对比发现用于标题点击率预测的密集嵌入回归模型,性能优于经LoRA微调的0.6B规模生成式语言模型,凸显了嵌入回归模型在高吞吐量内容排序中的应用潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15821 2026-08-12 cs.CL cs.AI cs.LG 版本更新 89%

The Truth Stays in the Family: Enhancing Contextual Grounding via Inherited Truthful Heads in Model Lineages

真相留在家族中:通过模型谱系中继承的真相头增强上下文基础

Miso Choi, Seonga Choi, Mincheol Kwon, Woosung Joung, Jinkyu Kim, Jungbeom Lee

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 指令微调 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

AI总结 研究发现基础LLM与下游变体间存在上下文真相分数的强继承性,提出TruthProbe软门控策略放大真相头以提升上下文真实性并减少多模态幻觉。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16580 2026-07-21 stat.AP cs.CE cs.SE 新提交 89%

Automating structural reliability analysis with a multi-agent large language model framework

使用多智能体大语言模型框架实现结构可靠性分析自动化

Jaehwan Jeon, Chang Hee Lee, Taeyong Kim

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 研究提出多智能体大语言模型框架,通过专门智能体处理结构可靠性分析流程,用QLoRA微调方法规划器,由确定性求解器计算结果,降低专业知识壁垒,保持计算可信度,实现结构可靠性分析自动化。

Comments 41 pages, 10 figures. Submitted to Automation in Construction

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13350 2026-07-16 physics.chem-ph 新提交 89%

How Well Can Frontier Large Language Models Generate Structures? High Quality Prediction of Molecular Geometries with Help from Fine-Tuning

前沿大语言模型在生成结构方面表现如何?通过微调实现分子几何结构的高质量预测

Joseph M. Cavanagh, Jonathan B. Arnold, Giovanni Battista Alteri, Andrew Gritsevskiy, Teresa Head-Gordon

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 研究探索大语言模型用于学习分子几何结构语言的微调方法,利用笛卡尔坐标或Z矩阵微调,能准确预测小分子平衡结构等,Z矩阵效果更好,且混入自然语言对微调可增强预测能力并保留预训练语言能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13537 2026-07-02 cs.LG cs.AI cs.CL 版本更新 89%

K-Merge: Online Continual Merging of Adapters for On-device Large Language Models

K-Merge: 面向设备端大语言模型的在线持续适配器合并

Donald Shenaj, Ondrej Bohdal, Taha Ceritli, Mete Ozay, Pietro Zanuttigh, Umberto Michieli

机构 * Samsung R&D Institute UK(三星英国研发中心) University of Pisa(比萨大学) University of Padova(帕多瓦大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 针对设备端大语言模型在线持续合并LoRA适配器的问题,提出一种无数据、计算高效的策略,在存储和计算受限下选择并合并新适配器,同时保持已有任务性能。

Comments ACL 2026 Main Conference, Long Paper (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16413 2026-06-30 cs.CV 89%

BrepLLM: Enabling Large Language Models to Understand Boundary Representations

BrepLLM: 使大语言模型能够理解边界表示

Liyuan Deng, Hao Guo, Yongkang Dai, Yunpeng Bai, Yifan Zhu, Yuanyuan Gao, Huaxi Huang, Yilei Shi

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 BrepLLM通过双阶段训练管道,将B-rep数据转化为图表示并进行语义对齐,实现3D语言生成,展示了在3D物体分类和描述任务中的最佳性能。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28266 2026-06-29 cs.CV 新提交 89%

RSICCLLM: A Multimodal Large Language Model for Remote Sensing Image Change Captioning

RSICCLLM:用于遥感图像变化描述的多模态大语言模型

Yelin Wang, Zijia Song, Shuo Ye, Chuanguang Yang, Miaoyu Wang, Yong Xu, Zhulin An, Yongjun Xu, Zitong Yu

机构 * State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences, Beijing, China(人工智能安全国家重点实验室,计算技术研究所,中国科学院,北京,中国) Great Bay University, Dongguan, China(东莞Great Bay大学,中国) Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学深圳学院,中国) Dongguan Key Laboratory for Intelligence and Information Technology, Dongguan, China(东莞智能与信息科技重点实验室,中国)

专题命中 指令微调 :language model(title,abstract);large language model(title);post-training(abstract);preference optimization(abstract)

AI总结 提出首个针对遥感图像变化描述任务的大视觉语言模型后训练框架RSICCLLM,通过数据生成范式、差异感知微调和双负偏好优化,仅7B参数即超越更大规模模型。

Comments Accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18879 2026-06-04 cs.LG cs.AI cs.CL 89%

ZeroUnlearn: Few-Shot Knowledge Unlearning in Large Language Models

ZeroUnlearn:大语言模型中的少样本知识遗忘

Yujie Lin, Chengyi Yang, Zhishang Xiang, Yiping Song, Jinsong Su

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出ZeroUnlearn框架,通过模型编辑将机器遗忘重新定义为精确的知识重映射问题,利用封闭解乘法参数更新实现高效、定向的少样本遗忘。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31445 2026-06-01 cs.GT cs.AI cs.CL cs.LG 89%

Used Car Salesbots? Honesty and Credulity of LLMs as Bargaining Agents under Partial Information

二手车销售机器人?作为讨价还价代理的LLM在部分信息下的诚实与轻信

Antonio Valerio Miceli-Barone, Vaishak Belle, Shay B. Cohen

机构 * University of Edinburgh(爱丁堡大学)

专题命中 指令微调 :LLM(title_cn,summary_cn);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究LLM代理在模拟讨价还价场景中的表现,发现它们偏离博弈论均衡,尝试撒谎但无法有效利用信息不对称,且优化财务效用会增强谈判能力但增加不诚实行为。

Comments 18 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14399 2026-05-29 cs.CV 89%

Multi-Turn Adaptive Prompting Attack on Large Vision-Language Models

多轮自适应提示攻击对大型视觉-语言模型

In Chong Choi, Jiacheng Zhang, Feng Liu, Yiliao Song

机构 * The University of Melbourne(墨尔本大学) The University of Adelaide(阿德莱德大学)

专题命中 指令微调 :language model(title,abstract);prompting(title,abstract);large language model(abstract)

AI总结 提出多轮自适应提示攻击(MAPA),通过交替文本-视觉攻击动作和跨轮迭代调整攻击轨迹,显著提升对大型视觉-语言模型的多轮越狱攻击成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.06304 2026-05-28 cs.CR 89%

SRAF: Stealthy and Robust Adversarial Fingerprint for Copyright Verification of Large Language Models

SRAF:用于大语言模型版权验证的隐蔽且鲁棒的对抗指纹

Zhebo Wang, Zhenhua Xu, Maike Li, Wenpeng Xing, Chunqiang Hu, Chen Zhi, Meng Han

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 提出SRAF框架,通过协同联合优化和困惑度隐藏技术,在多种模型修改下实现鲁棒且隐蔽的对抗指纹,用于大语言模型所有权验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24550 2026-05-26 cs.AI cs.CL cs.LG 89%

Jailbreak to Protect: Buffering and Reinforcing via Temporary Jailbreaking for Safe Fine-Tuning in Large Language Models

越狱以保护:通过临时越狱进行缓冲和强化以实现大型语言模型的安全微调

Seokil Ham, Jaehyuk Jang, Wonjun Lee, Changick Kim

机构 * School of Electrical Engineering, Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院电子工程学院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 针对微调即服务中安全对齐被有害微调攻击削弱的问题,提出一种基于梯度分析的缓冲与强化框架,通过临时越狱适配器减少有害更新并利用QR分解合并强化安全,实现无需额外安全数据的高效防御。

Comments ICML 2026 Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16171 2026-04-29 cs.LG cs.AI cs.CL 89%

JumpLoRA: Sparse Adapters for Continual Learning in Large Language Models

JumpLoRA: 大型语言模型中持续学习的稀疏适配器

Alexandra Dragomir, Ioana Pintilie, Antonio Barbalau, Marius Dragoi, Florin Brad, Cristian Daniel Paduraru, Alexandru Tifrea, Elena Burceanu, Radu Tudor Ionescu

机构 * Bitdefender(Bitdefender公司) ETH Zurich(苏黎世联邦理工学院) University of Bucharest(布加勒斯特大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 JumpLoRA通过JumpReLU门控在LoRA块中诱导稀疏性,实现动态参数隔离,提升IncLoRA性能并超越ELLA方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05062 2026-04-21 cs.CL cs.AI cs.LG 89%

Compositional Steering of Large Language Models with Steering Tokens

通过引导标记对大型语言模型进行组合引导

Gorjan Radevski, Kiril Gashteovski, Giwon Hong, Carolin Lawrence, Goran Glavaš

机构 * NEC Laboratories Europe(NEC欧洲实验室) University of Edinburgh(爱丁堡大学) Center for Artificial Intelligence and Data Science(人工智能与数据科学中心) University of Würzburg(乌尔姆大学) CAIR, Ss. Cyril and Methodius University of Skopje(CAIR,斯·西里尔和方法ius大学)

专题命中 指令微调 :large language model(title);language model(title);LLM(abstract,abstract_cn);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出组合引导标记,用于多行为引导,通过自蒸馏将自然语言指令嵌入专用标记,实现更有效的零样本组合,实验表明其在可验证约束上的表现优于其他方法。

Comments Accepted at ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10676 2026-04-15 cs.CL cs.AI cs.LG 89%

Fine-Tuning LLMs for Report Summarization: Analysis on Supervised and Unsupervised Data

针对报告摘要的LLM微调:对监督和非监督数据的分析

Swati Rallapalli, Shannon Gallagher, Andrew O. Mellinger, Jasmine Ratchford, Anusha Sinha, Tyler Brooks, William R. Nichols, Nick Winski, Bryan Brown

机构 * Software Engineering Institute, Carnegie Mellon University(软件工程研究院,卡内基梅隆大学)

专题命中 指令微调 :LLM(title_cn,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究LLM微调在报告摘要任务中的有效性,探讨在资源有限和本地计算环境下微调的可行性及摘要质量评估指标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20868 2026-04-14 cs.LG cs.AI cs.CL 89%

StyleBench: Evaluating thinking styles in Large Language Models

StyleBench: 评估大型语言模型中的思维风格

Junyu Guo, Shangding Gu, Ming Jin, Costas Spanos, Javad Lavaei

机构 * University of California, Berkeley(加州大学伯克利分校) Virginia Tech(弗吉尼亚理工大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文通过StyleBench评估不同推理风格在大型语言模型中的表现,发现结构复杂度在特定任务和模型容量下提升准确性,同时探讨了推理策略选择的挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08083 2026-04-10 cs.SE 89%

Can LLMs Deobfuscate Binary Code? A Systematic Analysis of Large Language Models into Pseudocode Deobfuscation

大语言模型能否解码二进制代码?对大型语言模型在伪代码解码中的系统分析

Li Hu, Xiuwei Shang, Jieke Shi, Shaoyin Cheng, Junqi Zhang, Gangyang Li, Zhou Yang, Weiming Zhang, David Lo

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文系统评估了大语言模型在二进制解码中的有效性,提出BinDeObfBench基准测试,发现解码性能更依赖推理能力和领域知识,任务特定的监督微调优于广泛领域预训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00818 2026-04-02 cs.CY 89%

Misconception Acquisition Dynamics in Large Language Models

大语言模型中的误解获取动态

Naiming Liu, Xinghe Chen, Richard Baraniuk, Mrinmaya Sachan, Shashank Sonkar

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);instruction tuning(abstract)

AI总结 研究大语言模型在模拟学生和导师时的误解获取动态,发现学生模型易泛化误解导致解题准确性下降,而导师模型能联合学习多个误解且保持正确性,关键在于推理步骤的监督。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17541 2026-03-19 cs.CV 89%

Temporal Gains, Spatial Costs: Revisiting Video Fine-Tuning in Multimodal Large Language Models

时间收益,空间代价:重新审视多模态大语言模型中的视频微调

Linghao Zhang, Jungang Li, Yonghua Hei, Sicheng Tao, Song Dai, Yibo Yan, Zihao Dongfang, Weiting Liu, Chenxi Qin, Hanqian Li, Xin Zou, Jiahao Zhang, Shuhang Xun, Haiyun Jiang, Xuming Hu

机构 * SJTU(上海交通大学) HKUST(GZ)(香港科技大学(珠海)) HKUST(香港科技大学) CityU(城市大学) FDU(复旦大学) HIT(哈尔滨工业大学) TJU(天津大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);SFT(abstract)

AI总结 本文研究了视频微调对多模态大语言模型视觉能力的影响,发现视频性能提升的同时,静态图像表现可能受限,提出混合帧策略以缓解空间与时间理解的平衡问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04453 2026-03-06 cs.CL cs.AI cs.LG 89%

Induced Numerical Instability: Hidden Costs in Multimodal Large Language Models

诱导的数值不稳定性:多模态大语言模型中的隐藏成本

Wai Tuck Wong, Jun Sun, Arunesh Sinha

机构 * School of Computing(计算学院) Information Systems, Singapore Management University, Singapore(信息系统,新加坡管理大学,新加坡) Information Systems Department, Rutgers Business School, New Jersey, USA(信息系统系,罗格斯商学院,新泽西,美国)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究揭示多模态大语言模型在推理阶段因优化数值不稳定性导致性能退化的新故障模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02555 2026-03-04 cs.IR 89%

Relevance Matters: A Multi-Task and Multi-Stage Large Language Model Approach for E-commerce Query Rewriting

相关性至关重要:一种多任务和多阶段大型语言模型方法用于电子商务查询重写

Aijun Dai, Jixiang Zhang, Haiqing Hu, Guoyu Tang, Lin Liu, Ziguang Cheng

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);SFT(abstract)

AI总结 本文提出一种基于多任务和多阶段的大型语言模型方法,用于提升电子商务查询重写的相关性和用户转化效果。

Comments Accepted for publication at ICDE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00004 2026-02-16 cs.AI cs.CL cs.LG 89%

Finetuning Large Language Models for Automated Depression Screening in Nigerian Pidgin English: GENSCORE Pilot Study

基于大型语言模型的尼日利亚皮钦英语自动化抑郁症筛查:GENSCORE试点研究

Isaac Iyinoluwa Olufadewa, Miracle Ayomikun Adesina, Ezekiel Ayodeji Oladejo, Uthman Babatunde Usman, Owen Kolade Adeniyi, Matthew Tolulope Olawoyin

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本研究利用微调的大型语言模型,针对尼日利亚皮钦英语开发自动化抑郁症筛查工具,GPT-4.1在准确率和文化适应性上表现最佳,为资源受限地区心理健康应用提供基础。

Comments 10 pages, 1 figure, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏