arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11511 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11511 篇

2506.20415 2025-06-26 cs.CR cs.AI cs.MA 92%

SV-LLM: An Agentic Approach for SoC Security Verification using Large Language Models

Dipayan Saha, Shams Tarek, Hasan Al Shaikh, Khan Thamid Hasan, Pavan Sai Nalluri, Md. Ajoad Hasan, Nashmin Alam, Jingbo Zhou, Sujan Kumar Saha, Mark Tehranipoor, Farimah Farahmandi

机构 * Department of Electrical and Computer Engineering, University of Florida(电子与计算机工程系,佛罗里达大学)

专题命中 指令微调 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18656 2025-05-27 cs.LG 92%

LLM-QFL: Distilling Large Language Model for Quantum Federated Learning

Dev Gurung, Shiva Raj Pokhrel

机构 * School of IT, Deakin University(德肯大学信息科技学院)

专题命中 指令微调 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17116 2025-05-26 cs.CL cs.ET 92%

Comparative Evaluation of Prompting and Fine-Tuning for Applying Large Language Models to Grid-Structured Geospatial Data

Akash Dhruv, Yangxinyu Xie, Jordan Branham, Tanwi Mallick

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);prompting(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16761 2025-04-01 cs.CV cs.AI 92%

Is 'Right' Right? Enhancing Object Orientation Understanding in Multimodal Large Language Models through Egocentric Instruction Tuning

Ji Hyeok Jung, Eun Tae Kim, Seoyeon Kim, Joo Ho Lee, Bumsoo Kim, Buru Chang

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);instruction tuning(title,abstract);分类 cs.AI

Comments CVPR2025 Camera-ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14735 2025-02-21 cs.IR cs.AI 92%

EAGER-LLM: Enhancing Large Language Models as Recommenders through Exogenous Behavior-Semantic Integration

Minjie Hong, Yan Xia, Zehan Wang, Jieming Zhu, Ye Wang, Sihang Cai, Xiaoda Yang, Quanyu Dai, Zhenhua Dong, Zhimeng Zhang, Zhou Zhao

专题命中 指令微调 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments 9 pages, 6 figures, accpeted by WWW 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.14500 2024-06-21 cs.CL 92%

Improving Expert Radiology Report Summarization by Prompting Large Language Models with a Layperson Summary

Xingmeng Zhao, Tongnian Wang, Anthony Rios

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);prompting(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.06532 2024-05-29 cs.CL cs.IR 92%

INTERS: Unlocking the Power of Large Language Models in Search with Instruction Tuning

Yutao Zhu, Peitian Zhang, Chenghao Zhang, Yifei Chen, Binyu Xie, Zheng Liu, Ji-Rong Wen, Zhicheng Dou

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);instruction tuning(title,abstract);分类 cs.CL

Comments Accepted by ACL 2024 main conference. Repo: https://github.com/DaoD/INTERS

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.08785 2024-02-15 cs.CL 92%

InstructGraph: Boosting Large Language Models via Graph-centric Instruction Tuning and Preference Alignment

Jianing Wang, Junda Wu, Yupeng Hou, Yao Liu, Ming Gao, Julian McAuley

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);instruction tuning(title,abstract);分类 cs.CL

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.14385 2024-01-30 cs.CL 92%

Mental-LLM: Leveraging Large Language Models for Mental Health Prediction via Online Text Data

Xuhai Xu, Bingsheng Yao, Yuanzhe Dong, Saadia Gabriel, Hong Yu, James Hendler, Marzyeh Ghassemi, Anind K. Dey, Dakuo Wang

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(title);prompting(abstract)

Comments Published at Proceedings of the ACM on Interactive, Mobile, Wearable and Ubiquitous Technologies (IMWUT) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14705 2023-07-06 cs.CL 92%

Mixture-of-Experts Meets Instruction Tuning:A Winning Combination for Large Language Models

Sheng Shen, Le Hou, Yanqi Zhou, Nan Du, Shayne Longpre, Jason Wei, Hyung Won Chung, Barret Zoph, William Fedus, Xinyun Chen, Tu Vu, Yuexin Wu, Wuyang Chen, Albert Webson, Yunxuan Li, Vincent Zhao, Hongkun Yu, Kurt Keutzer, Trevor Darrell, Denny Zhou

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);instruction tuning(title,abstract);分类 cs.CL

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27506 2026-07-31 cs.CL cs.AI 新提交 91%

Models for minimalist RAG: B1ade 335M Embedding and 1B Parameter Small Language Models

极简RAG的模型:B1ade 335M嵌入模型与1B参数小型语言模型

Shreyas Subramanian, Mecit Gungor, Vikram Elango

机构 * Amazon(亚马逊公司)

专题命中 指令微调 :language model(title);small language model(title);SLM(abstract,abstract_cn);SFT(abstract,abstract_cn)

AI总结 该研究提出含B1ade-embed嵌入模型与B1ade-1B小型语言模型的高效极简RAG架构,其在多QA基准及RAG评估中表现优异,还涌现出无明确监督的来源引用能力,验证了资源高效RAG的可行路径。

Comments 28 pages, 3 figures. Submitted to COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07457 2026-07-21 cs.CL cs.AI 版本更新 91%

GRIP: In-Parameter Graph Reasoning through Fine-Tuning Large Language Models

GRIP:通过微调大语言模型进行参数内图推理

Jiarui Feng, Donghong Cai, Yixin Chen, Muhan Zhang

机构 * Washington University in Saint Louis(华盛顿大学圣路易斯分校) Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院) State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,BIGAI)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);post-training(abstract)

AI总结 研究如何让大语言模型适应结构数据,提出GRIP方法,通过微调任务将图关系知识内化到模型参数,存储于轻量级LoRA模块,实验表明该方法在处理大图时优于基线,处理小图时以低推理成本达可比性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.13929 2026-06-24 cs.CL cs.AI 91%

Vikhr: The Family of Open-Source Instruction-Tuned Large Language Models for Russian

Vikhr:俄语专用的开源指令调优大型语言模型系列

Aleksandr Nikolich, Konstantin Korolev, Sergei Bratchikov, Igor Kiselev, Artem Shelmanov

机构 * ITMO University(ITMO大学) HSE University(莫斯科国立高等经济大学) Accenture(Accenture公司) MBZUAI(穆罕默德·本·拉希德智能科学研究院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);instruction tuning(abstract)

AI总结 本文提出Vikhr,一种专为俄语设计的开源指令调优大型语言模型,通过改进的双语模型和持续预训练提升性能与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20205 2026-06-19 cs.AI cs.CL cs.HC 新提交 91%

Apparent Psychological Profiles of Large Language Models are Largely a Measurement Artifact

大语言模型的心理特征很大程度上是测量假象

Jelena Meyer, David Garcia, Dirk U. Wulff

机构 * Max Planck Institute for Human Development(马克斯·普朗克人类发展研究所) University of Konstanz(康斯坦茨大学) Barcelona Supercomputing Center(巴塞罗那超级计算中心) University of Basel(巴塞尔大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(summary_cn,abstract_cn);分类 cs.CL、cs.AI

AI总结 通过心理测量框架分析56个指令微调LLM,发现模型间差异主要源于方向性响应偏差而非特质,该偏差解释了81-90%的变异,且可通过题目选择操控,表明LLM心理特征是测量假象。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20333 2026-06-02 cs.AI cs.LG cs.NE 91%

NNGPT: Rethinking AutoML with Large Language Models

NNGPT: 用大型语言模型重新思考AutoML

Roman Kochnev, Waleed Khalid, Tolgay Atinc Uzun, Xi Zhang, Yashkumar Sanjaybhai Dhameliya, Furui Qin, Chandini Vysyaraju, Raghuvir Duvvuri, Avi Goyal, Dmitry Ignatov, Radu Timofte

机构 * Computer Vision Lab, CAIDAS & IFI, University of Würzburg, Germany(计算机视觉实验室,CAIDAS与IFI,乌尔姆大学,德国)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);prompting(abstract)

AI总结 提出NNGPT开源框架,利用大型语言模型实现自我改进的AutoML引擎,通过生成-评估-自我改进闭环自动设计神经网络架构和超参数。

Journal ref Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition Workshops (CVPRW), pp. 5664-5674, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22925 2026-05-26 cs.IR cs.AI cs.LG 91%

BEAR: Towards Beam-Search-Aware Optimization for Recommendation with Large Language Models

BEAR:面向大语言模型推荐中束搜索感知的优化

Weiqin Yang, Bohao Wang, Zhenxiang Xu, Jiawei Chen, Shengjia Zhang, Jingbang Chen, Canghong Jin, Can Wang

机构 * Zhejiang University(浙江大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Hangzhou City University(杭州市城市大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);SFT(abstract,abstract_cn);LLM(abstract_cn)

AI总结 针对监督微调与束搜索推理之间的不一致性,提出BEAR正则化方法,通过确保正例每个token在解码步骤中排名前B来避免过早剪枝,显著提升推荐性能。

Comments Accepted by SIGIR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07127 2026-05-11 cs.LG cs.CL 91%

The Position Curse: LLMs Struggle to Locate the Last Few Items in a List

位置诅咒:LLM在列表中定位最后几个项目时表现不佳

Zhanqi Zhang, Hua-Dong Xiong, Robert C. Wilson, Mikio Aoi, Marcelo G. Mattar, Li Ji-An

机构 * UC San Diego(加州大学圣地亚哥分校) Georgia Tech(佐治亚理工学院) New York University(纽约大学)

专题命中 指令微调 :LLM(title_cn,summary_cn);large language model(abstract);language model(abstract);pretraining(abstract)

AI总结 LLM在定位长列表中单个相关项目时表现优异,但在短列表中最后几个项目定位上存在缺陷,即位置诅咒。通过构建PosBench数据集进行微调后,虽然提升了定位能力,但仍未达到理想水平。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05626 2026-05-08 cs.CL cs.AI 91%

When2Speak: A Dataset for Temporal Participation and Turn-Taking in Multi-Party Conversations for Large Language Models

When2Speak: 一个多党对话中大型语言模型的时间参与和发言时机的数据集

Vihaan Nama, Shreya Mendi, Zian Ye, Brinnae Bent

机构 * Pratt School of Engineering(普拉特工程学院) Duke University(杜克大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);SFT(abstract,abstract_cn);LLM(abstract_cn)

AI总结 本文提出When2Speak数据集,通过四阶段生成流程学习群体互动中的发言时机,通过强化学习优化模型,提升多党对话中的发言准确性与自然度。

Comments Currently under review. Dataset can be found: https://huggingface.co/datasets/duke-trust-lab/When2Speak

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11707 2026-04-24 cs.CL cs.AI 91%

Federated Co-tuning Framework for Large and Small Language Models

联邦联合微调框架用于大语言模型和小语言模型

Tao Fan, Yan Kang, Guoqiang Ma, Lixin Fan, Shuoling Liu, Kai Chen, Qiang Yang

机构 * Hong Kong University of Science and Technology(香港科技大学) WeBank Co., Ltd(WeBank公司) Hong Kong Polytechnic University(香港理工大学)

专题命中 指令微调 :language model(title,abstract);small language model(title,abstract);LLM(abstract,abstract_cn);large language model(abstract)

AI总结 本文提出FedCoLLM框架,通过轻量级适配器实现大模型与小模型的协同微调,提升小模型性能并增强大模型领域知识。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14314 2026-04-17 cs.CV cs.AI cs.CL 91%

DharmaOCR: Specialized Small Language Models for Structured OCR that outperform Open-Source and Commercial Baselines

DharmaOCR:用于结构OCR的专用小型语言模型,其性能优于开源和商业基线

Gabriel Pimenta de Freitas Cardoso, Caio Lucas da Silva Chacon, Jonas Felipe da Fonseca Oliveira, Paulo Henrique de Medeiros Araujo

机构 * Dharma-AI

专题命中 指令微调 :language model(title,abstract);small language model(title,abstract);SFT(abstract,abstract_cn);preference optimization(abstract)

AI总结 DharmaOCR通过联合优化转录质量、生成稳定性与推理成本,提出专用小型语言模型,并通过统一评估协议提升OCR性能,实现高质量低成本的文本提取。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07591 2026-04-16 cs.CL cs.AI 91%

MulDimIF: A Multi-Dimensional Constraint Framework for Evaluating and Improving Instruction Following in Large Language Models

MulDimIF:一种多维约束框架用于评估和改进大语言模型的指令遵循能力

Junjie Ye, Caishuang Huang, Zhuohan Chen, Wenjie Fu, Chenyuan Yang, Leyi Yang, Yilong Wu, Peng Wang, Meng Zhou, Xiaolong Yang, Tao Gui, Qi Zhang, Zhongchao Shi, Jianping Fan, Xuanjing Huang

机构 * Fudan University(复旦大学) Lenovo Research(联想研究院) Tencent(腾讯) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Shanghai Key Lab of Intelligent Information Processing(上海智能信息处理重点实验室)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(summary_cn,abstract_cn);分类 cs.CL、cs.AI

AI总结 本文提出MulDimIF框架,通过多维约束模式、类别和难度等级,设计可控指令生成流程,生成9106个可验证样本,评估18个LLM模型,发现不同约束设置下性能差异显著,并通过训练提升指令遵循能力而不影响通用性能。

Comments Accepted by ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15904 2026-03-10 cs.CL cs.AI 91%

More Women, Same Stereotypes: Unpacking the Gender Bias Paradox in Large Language Models

更多女性,相同刻板印象:解构大型语言模型中的性别偏见悖论

Evan Chen, Run-Jun Zhan, Yan-Bai Lin, Hung-Hsuan Chen

机构 * Computer Science and Information Engineering(计算机科学与信息工程系)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);SFT(abstract)

AI总结 本研究通过自由叙事揭示大型语言模型中的性别偏见,发现其在职业性别分布上更接近人类刻板印象,而非现实数据,强调了平衡缓解措施的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05874 2026-01-12 cs.CL cs.AI 91%

Continual-learning for Modelling Low-Resource Languages from Large Language Models

连续学习用于从大语言模型中建模低资源语言

Santosh Srinath K, Mudit Somani, Varun Reddy Padala, Prajna Devi Upadhyay, Abhijit Das

机构 * Machine Intelligence Group, Department of CS&IS, Birla Institute of Technology and Sciences, Pilani, India(机器智能组,计算机科学与信息系,比拉理工学院和科学学院,印度帕利尼)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);small language model(abstract)

AI总结 本文提出利用基于词性的代码切换和重放适配器策略,解决从大语言模型构建小语言模型时的灾难性遗忘问题,并在视觉语言任务中验证了方法的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15885 2025-12-19 cs.CV cs.AI cs.CL cs.MM 91%

Seeing Beyond Words: Self-Supervised Visual Learning for Multimodal Large Language Models

超越文字:面向多模态大语言模型的自监督视觉学习

Davide Caffagni, Sara Sarto, Marcella Cornia, Lorenzo Baraldi, Pier Luigi Dovesi, Shaghayegh Roohi, Mark Granroth-Wilding, Rita Cucchiara

机构 * University of Modena and Reggio Emilia(摩德纳和雷吉奥艾米利亚大学) AMD Silo AI

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);foundation model(abstract)

AI总结 JARVIS通过自监督视觉学习提升多模态大语言模型的视觉推理能力,无需依赖语言监督。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11028 2025-12-15 cs.CL cs.AI 91%

Mind the Confidence Gap: Overconfidence, Calibration, and Distractor Effects in Large Language Models

注意置信差距:大型语言模型中的过度自信、校准与干扰效应

Prateek Chhikara

机构 * University of Southern California(美国南加州大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);RLHF(abstract)

AI总结 本研究探讨了大型语言模型中的过度自信问题,通过引入干扰项显著改善校准,提出针对性的改进策略以提升模型可靠性。

Comments Published in Transactions on Machine Learning Research (TMLR)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05321 2025-11-25 cs.IR cs.AI cs.LG 91%

VALUE: Value-Aware Large Language Model for Query Rewriting via Weighted Trie in Sponsored Search

VALUE: 用于通过加权前缀树进行查询重写的值感知大语言模型

Xiao Zhang, Guanyu Chen, Boyang Zuo, Feng Li, Pengjie Wang, Jian Xu, Bo Zheng

机构 * Alibaba Group(阿里巴巴集团) Tsinghua University(清华大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);SFT(abstract)

AI总结 VALUE通过加权前缀树整合价值感知,提升搜索引擎广告中查询重写的语义相关性和商业价值

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12497 2025-11-18 cs.CL cs.AI cs.CR 91%

SGuard-v1: Safety Guardrail for Large Language Models

JoonHo Lee, HyeonMin Cho, Jaewoong Yun, Hyunjae Lee, JunKyu Lee, Juree Seok

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);instruction tuning(abstract)

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18762 2025-10-06 cs.CL cs.AI 91%

When Long Helps Short: How Context Length in Supervised Fine-tuning Affects Behavior of Large Language Models

Yingming Zheng, Hanqi Li, Kai Yu, Lu Chen

机构 * X-LANCE Lab(X-LANCE实验室) MoE Key Lab of Artificial Intelligence(人工智能MoE关键实验室) AI Institute(人工智能研究院) School of Computer Science(计算机科学学院) Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institution(上海创新机构) Jiangsu Key Lab of Language Computing(江苏语言计算关键实验室) Suzhou Laboratory(苏州实验室)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02194 2025-10-03 cs.AI cs.CR cs.LG 91%

UpSafe$^\circ$C: Upcycling for Controllable Safety in Large Language Models

Yuhao Sun, Zhuoer Xu, Shiwen Cui, Kun Yang, Lingyun Yu, Yongdong Zhang, Hongtao Xie

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12960 2025-10-03 cs.CL cs.AI 91%

Investigating ReLoRA: Effects on the Learning Dynamics of Small Language Models

Yuval Weiss, David Demitri Africa, Paula Buttery, Richard Diehl Martinez

机构 * University of Cambridge(剑桥大学)

专题命中 指令微调 :language model(title,abstract);small language model(title,abstract);LLM(abstract);large language model(abstract)

Comments 12 Pages, 6 Tables, 8 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏