arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-03-09 至 2026-03-09 共收录 18 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 18 篇

2506.15751 2026-03-09 cs.AI cs.CL cs.LG 90%

Sysformer: Safeguarding Frozen Large Language Models with Adaptive System Prompts

Sysformer: 通过自适应系统提示保护冻结的大语言模型

Kartik Sharma, Yiqiao Jin, Vineeth Rakesh, Yingtong Dou, Menghai Pan, Mahashweta Das, Srijan Kumar

机构 * Georgia Institute of Technology(佐治亚理工学院) Visa Research(Visa研究)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 Sysformer通过自适应系统提示提高大语言模型的安全性,显著提升对有害提示的拒绝率和对安全提示的合规性。

Comments ICLR 2026. Code available at https://github.com/Ksartik/sysformer

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20975 2026-03-09 cs.CR cs.AI 89%

REx86: A Local Large Language Model for Assisting in x86 Assembly Reverse Engineering

REx86:一种用于协助x86汇编逆向工程的本地大语言模型

Darrin Lea, James Ghawaly, Golden Richard, Aisha Ali-Gombe, Andrew Case

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 REx86是一种本地大语言模型,通过微调提升x86汇编逆向工程的效率,显著提高代码理解和解决率。

Comments Accepted in 2025 Annual Computer Security Applications Conference (ACSAC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05776 2026-03-09 cs.CL cs.AI 88%

PVminerLLM: Structured Extraction of Patient Voice from Patient-Generated Text using Large Language Models

PVminerLLM: 从患者生成的文本中使用大语言模型进行结构化提取患者声音

Samah Fodeh, Linhai Ma, Ganesh Puthiaraju, Srivani Talakokkul, Afshan Khan, Ashley Hagaman, Sarah Lowe, Aimee Roundtree

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

AI总结 PVminerLLM通过监督微调的大语言模型从患者生成的文本中提取结构化患者声音,实现高精度的F1分数,为健康公平性和护理协调提供新的分析工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22266 2026-03-09 cs.LG cs.AI 82%

LLMTM: Benchmarking and Optimizing LLMs for Temporal Motif Analysis in Dynamic Graphs

LLMTM:动态图中基于时间 motif 分析的 LLM 评估与优化

Bing Hao, Minglai Shao, Zengyi Wo, Yunlong Chu, Yuhang Liu, Ruijie Wang

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文提出 LLMTM 基准测试,评估 LLM 在动态图时间 motif 分析中的性能,并开发结构感知调度器以优化效率与精度的平衡。

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08723 2026-03-09 eess.AS eess.SP 82%

ParaS2S: Benchmarking and Aligning Spoken Language Models for Paralinguistic-aware Speech-to-Speech Interaction

ParaS2S:用于基于语篇语言模型的语音到语音交互的基准测试与对齐

Shu-wen Yang, Ming Tu, Andy T. Liu, Xinghua Qu, Hung-yi Lee, Lu Lu, Yuxuan Wang, Yonghui Wu

专题命中 指令微调 :language model(title);LLM(abstract);SFT(abstract)

AI总结 ParaS2S通过强化学习框架提升语音到语音交互中对语篇线索的处理能力,实现响应内容和风格的显著改进。

Comments To appear in ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06123 2026-03-09 cs.CL cs.LG 81%

Diffusion Language Models Are Natively Length-Aware

扩散语言模型天生具有长度感知能力

Vittorio Rossi, Giacomo Cirò, Davide Beltrame, Luca Gandolfi, Paul Röttger, Dirk Hovy

机构 * Department of Computing Sciences, Bocconi University, Milan, Italy(计算机科学系,博科尼大学,米兰,意大利)

专题命中 指令微调 :language model(title,abstract);分类 cs.CL、cs.LG

AI总结 本文提出通过动态裁剪上下文窗口减少扩散语言模型生成步骤,从而提升效率并减少计算消耗,在多个基准测试中实现显著的性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03294 2026-03-09 cs.CL cs.AI cs.LG 80%

Fine-Tuning and Evaluating Conversational AI for Agricultural Advisory

对话式农业建议的微调与评估

Sanyam Singh, Naga Ganesh, Vineet Singh, Lakshmi Pedapudi, Ritesh Kumar, SSP Jyothi, Archana Karanam, Waseem Pasha, Ekta Kumari, C. Yashoda, Mettu Vijaya Rekha Reddy, Shesha Phani Debbesa, Chandan Dash

机构 * Digital Green

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出了一种混合LLM架构,通过微调和拼接层提升农业建议的准确性与安全性,释放了farmerchat-prompts库以促进领域特定农业AI的发展。

Comments 22 pages, 5 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17095 2026-03-09 cs.LG cs.AI 79%

FLoRG: Federated Fine-tuning with Low-rank Gram Matrices and Procrustes Alignment

FLoRG: 联邦微调与低秩格拉姆矩阵及普鲁斯特对齐

Chuiyang Meng, Ming Tang, Vincent W. S. Wong

机构 * The University of British Columbia(不列颠哥伦比亚大学) Southern University of Science and Technology(南方科技大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 FLoRG通过使用单一低秩矩阵和普鲁斯特对齐方法,提高联邦微调的效率和准确性,减少通信开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.14273 2026-03-09 eess.AS cs.SD 78%

Efficient Emotion and Speaker Adaptation in LLM-Based TTS via Characteristic-Specific Partial Fine-Tuning

基于特征特定部分微调的LLM语音合成中高效情感与说话人适应

Tianrui Wang, Meng Ge, Cheng Gong, Chunyu Qiang, Haoyu Wang, Zikang Huang, Yu Jiang, Ye Ni, Yuheng Lu, Xiaobao Wang, Engsiong Chng, Xie Chen, Longbiao Wang, Jianwu Dang

机构 * Tianjin Key Laboratory of Cognitive Computing and Application(天津认知计算与应用重点实验室) College of Intelligence and Computing(智能与计算学院) Tianjin University(天津大学) TeleAI, China Telecom(TeleAI,中国电信) Southeast University(东南大学) Shanghai Jiao Tong University(上海交通大学) Huiyan Technology Co., Ltd(慧言科技有限公司) Nanyang Technological University(南洋理工大学) Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(深圳先进技术研究所,中国科学院)

专题命中 指令微调 :LLM(title,abstract)

AI总结 本文提出CSP-FT方法,通过特征特定部分微调提升LLM语音合成在情感和说话人适应中的性能,实现参数更新效率与模型表现的平衡。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02795 2026-03-09 cs.CV 75%

VSearcher: Long-Horizon Multimodal Search Agent via Reinforcement Learning

VSearcher:通过强化学习实现长周期多模态搜索代理

Ruiyang Zhang, Qianguo Sun, Chao Song, Yiyan Qi, Zhedong Zheng

机构 * University of Macau(澳门大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract)

AI总结 VSearcher通过强化学习实现多模态搜索代理,提升长周期多轮工具使用能力,在多模态网络搜索任务中表现优异。

Comments 23 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06403 2026-03-09 cs.LG 70%

Adapter-Augmented Bandits for Online Multi-Constrained Multi-Modal Inference Scheduling

适配器增强的带状机用于在线多约束多模态推断调度

Xianzhi Zhang, Yue Xu, Yinlin Zhu, Di Wu, Yipeng Zhou, Miao Hu, Guocong Quan

机构 * School of Computer Science and Engineering, Sun Yat-sen University, Guangzhou, 510006, China.(中山大学计算机科学与工程学院) School of Computing, Macquarie University, NSW 2109, Australia(麦考瑞大学计算机学院)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 M-CMAB通过多适配器增强框架,实现多模态任务调度中的多约束优化,提升推断效率和预算利用效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06492 2026-03-09 cs.LG cs.AI cs.CL cs.NE 67%

NOBLE: Accelerating Transformers with Nonlinear Low-Rank Branches

NOBLE:通过非线性低秩分支加速Transformer

Ethan Smith

机构 * Canva Research(Canva研究)

专题命中 指令微调 :pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 NOBLE通过非线性低秩分支提升Transformer训练效率,实现显著的加速效果,同时保持较低的参数开销。

Comments 14 pages, 5 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05928 2026-03-09 cs.CL cs.AI cs.HC cs.LG 67%

Addressing the Ecological Fallacy in Larger LMs with Human Context

在更大规模的语言模型中通过人类上下文解决生态谬误

Nikita Soni, Dhruv Vijay Kunjadiya, Pratham Piyush Shah, Dikshya Mohanty, H. Andrew Schwartz, Niranjan Balasubramanian

机构 * Department of Computer Science, Stony Brook University(计算机科学系,石英布鲁克大学) College of Connected Computing, Vanderbilt University, USA(连接计算学院,范德比大学,美国)

专题命中 指令微调 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 通过HuLM任务建模作者语言上下文,提升大模型在多个下游任务上的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23136 2026-03-09 cs.CL cs.AI cs.LG 67%

Modality Collapse as Mismatched Decoding: Information-Theoretic Limits of Multimodal LLMs

模态崩溃作为不匹配解码:多模态大语言模型的信息论限制

Jayadev Billa

机构 * Yahoo(雅虎) Nuance BBN

专题命中 指令微调 :LLM(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究揭示多模态大语言模型中模态崩溃现象的信息论限制,指出解码器评分规则决定了可访问信息量,通过LoRA干预验证了训练目标对情绪检测性能的提升作用。

Comments 24 pages, 11 tables, 2 figures. Code: https://github.com/jb1999/modality_collapse_paper, submitted for review COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06542 2026-03-09 cs.SD cs.AI 57%

RAMoEA-QA: Hierarchical Specialization for Robust Respiratory Audio Question Answering

RAMoEA-QA:面向呼吸音频问答的分层专业化

Gaia A. Bertolino, Yuwei Zhang, Tong Xia, Domenico Talia, Cecilia Mascolo

机构 * University of Cambridge(剑桥大学) Tsinghua University(清华大学) University of Calabria(卡拉布里亚大学)

专题命中 指令微调 :LLM(abstract);分类 cs.AI

AI总结 RAMoEA-QA通过分层专业化机制,统一处理多种呼吸音频问答任务,提升在不同领域和任务转换下的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05822 2026-03-09 cs.LG 57%

Self-Auditing Parameter-Efficient Fine-Tuning for Few-Shot 3D Medical Image Segmentation

自审计参数高效微调用于少样本3D医学图像分割

Son Thai Ly, Hien V. Nguyen

机构 * University of Houston(德克萨斯大学)

专题命中 指令微调 :foundation model(abstract);分类 cs.LG

AI总结 SEA-PEFT通过自审计参数高效微调方法,提升少样本3D医学图像分割的Dice指标,训练参数少于1%

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05654 2026-03-09 astro-ph.SR physics.space-ph 50%

Active regions and the large-scale magnetic field of solar cycle 24

第24个太阳周期中的活跃区域和大尺度磁场

Ismo Tähtinen, Timo Asikainen, Kalevi Mursula

专题命中 指令微调 :SFT(abstract)

AI总结 研究第24个太阳周期中活跃区域的经度分布对大尺度磁场的影响,发现其对磁场强度的增强具有显著作用。

Comments 13 pages, 11 figures

Journal ref Astronomy and Astrophysics, 2026, 706, A235. Astronomy and Astrophysics, 2026, 706, A235. Astronomy and Astrophysics, 2026, 706, A235

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19297 2026-03-09 cs.CV 50%

Alchemist: Turning Public Text-to-Image Data into Generative Gold

炼金术:将公共文本到图像数据转化为生成黄金

Valerii Startsev, Alexander Ustyuzhanin, Alexey Kirillov, Dmitry Baranchuk, Sergey Kastryulin

机构 * Yandex Research(Yandex研究院) HSE(莫斯科大学) Yandex MSU(莫斯科大学)

专题命中 指令微调 :SFT(abstract)

AI总结 本文提出了一种利用预训练模型生成高质量通用SFT数据集的方法,通过Alchemist数据集提升了文本到图像模型的生成质量并公开了微调权重。

Comments Accepted to the Datasets and Benchmarks Track of the 39th Conference on Neural Information Processing Systems

详情

展开后加载摘要…

URL PDF HTML 收藏