arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-07-27 至 2026-07-27 共收录 16 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 16 篇

2607.22067 2026-07-27 cs.CL cs.AI 新提交 90%

Benchmarking Fine-tuning and Retrieval Strategies for a Multimodal Language Model on the NRC Reactor Operator Licensing Examination

基于美国核管理委员会反应堆操作员执照考试的多模态语言模型微调与检索策略基准测试

Isak Hwang, Yoon Pyo Lee

机构 * organization= Department of Nuclear Engineering, Hanyang University , addressline= 222 Wangsimni-ro , postcode= 04763 , state= Seongdong-gu , city= Seoul , country= South Korea organization= The Grainger College of Engineering, Nuclear, Plasma \& Radiological Engineering, University of Illinois Urbana-Champaign , city= Urbana , state= IL , country= USA

专题命中 指令微调 :SFT(summary_cn,abstract);language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

AI总结 该研究针对美国核管理委员会反应堆操作员执照考试,评估310亿参数多模态模型应用核知识的能力,通过对比基础模型与多种微调及检索配置,发现固定大小分块RAG的SFT配置表现最佳,并揭示了分块策略规律及RAFT与SFT的性能差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01782 2026-07-27 eess.IV cs.CV 版本更新 90%

Joint Lossless Compression and Steganography for Medical Images via Large Language Models

通过大语言模型实现医学图像的联合无损压缩与隐写术

Pengcheng Zheng, Xiaorong Pu, Kecheng Chen, Jiaxin Huang, Meng Yang, Bai Feng, Yazhou Ren, Jianan Jiang, Chaoning Zhang, Yang Yang, Heng Tao Shen

机构 * Center for Future Media and School of Computer Science and Engineering, University of Electronic Science and Technology of China(未来媒体中心和电子科技大学计算机科学与工程学院) Department of Computer Science and Engineering, University of Electronic Science and Technology of China(计算机科学与工程学院,电子科技大学) Department of Electrical Engineering, and the Center for Intelligent Multidimensional Data Analysis, City University of Hong Kong(电子工程系和智能多维数据分析中心,城市大学) Department of Machine Learning, Mohamed bin Zayed University of Artificial Intelligence(机器学习系,Mohamed bin Zayed人工智能大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn)

AI总结 针对医学图像无损压缩中性能与效率权衡及安全问题,提出联合无损压缩与隐写术框架。基于位平面切片,设计自适应模态分解,创新局部模态路径分段消息隐写术算法,结合A-LoRA微调策略,提升压缩率、效率与安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21861 2026-07-27 cs.CL cs.AI 新提交 82%

Data Quality over Capacity: Internalizing Documents into LoRA Adapters for Closed-Book QA

容量之上的数据质量:将文档内化到LoRA适配器中用于闭卷问答

Joan Figuerola Hurtado

专题命中 指令微调 :LLM(summary_cn,abstract);分类 cs.CL、cs.AI

AI总结 研究将文档内化到LoRA适配器用于闭卷问答,发现适配器容量足够时,训练数据质量主导闭卷准确率,一次整理大幅提升准确率,确认容量趋势及秩与学习率耦合,内化适配器在低延迟下表现优于检索基线,还报告了调试LLM训练的过程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21694 2026-07-27 cs.CV 新提交 82%

Oxygen-TryOn: Fashion-Native Foundation Model for Any-item Virtual Try-On

Oxygen-TryOn:用于任意物品虚拟试穿的时尚原生基础模型

Yong Liu, Xiaolong Fu, Zihang Xu, Wen Xue, Xueheng Li, Lin Song, Yuan Zhang, Chuyang Zhao, Haoyang Huang, Nan Duan, Yipeng Sun, Yan Li, Simiu Gu

机构 * Oxygen AIGC Group(氧气AIGC集团) Joy Future Academy(京东探索研究院)

专题命中 指令微调 :foundation model(title,abstract);SFT(abstract)

AI总结 研究提出时尚原生的Oxygen-TryOn基础模型,用于任意物品虚拟试穿。通过专用数据引擎和特定训练构建,重新定义试穿任务,设计三阶段训练方法,在单物品和多物品试穿中取得先进成果,超越多个系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22034 2026-07-27 cs.CV cs.CL cs.LG 新提交 81%

Small Vision-Language Models Know When They Are Wrong But Cannot Say So: A Two-Model Study of Stated versus Internal Confidence Under Realistic Image Degradation

小视觉语言模型知道自己何时出错但无法表达:在现实图像退化下对陈述置信度与内部置信度的双模型研究

M M Asif Ferdous

专题命中 指令微调 :language model(title,abstract);分类 cs.CL、cs.LG

AI总结 研究小型视觉语言模型在现实图像退化下陈述置信度与内部置信度的差异,通过评估两个模型在六种退化情况及三种严重程度下的表现,发现内部概率是更好的延迟信号,严重低光时两种信号都不可信。

Comments 15 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10058 2026-07-27 cs.CV 版本更新 80%

Color Me Correctly: Bridging Perceptual Color Spaces and Text Embeddings for Improved Diffusion Generation

正确为我上色:弥合感知颜色空间与文本嵌入以改进扩散生成

Sung-Lin Tsai, Bo-Lun Huang, Yu Ting Shen, Cheng Yu Yeo, Chiang Tseng, Bo-Kai Ruan, Wen-Sheng Lien, Hong-Han Shuai

机构 * National Yang Ming Chiao Tung University

专题命中 指令微调 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 研究文本到图像生成中颜色对齐问题,提出利用大语言模型消除颜色提示歧义、在文本嵌入空间指导颜色混合操作的无需训练框架,提高了颜色准确性且不影响图像质量,弥合文本语义与视觉生成差距。

Comments Accepted to ACM Multimedia 2025 (MM '25)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22039 2026-07-27 cs.CL 新提交 77%

Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs

过犹不及:强化学习如何减轻大语言模型中任务冲突的综合分析

Zixuan Ren, Jinliang Lu, Junhong Wu, Yang Zhao, Dai Dai, Hua Wu, Haifeng Wang, Chengqing Zong

机构 * Institute of Automation, CAS(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) Baidu Inc.(百度公司)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.CL

AI总结 研究对比强化学习与监督微调训练的大语言模型的合并行为,经五项任务评估发现强化学习能减少任务冲突及合并后性能下降。通过实验和分析揭示三个关键因素,表明强化学习在模型合并中更具优势。

Comments Published in ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22397 2026-07-27 cs.HC cs.LG q-bio.NC 新提交 74%

Universal BCI Personalization: One API for Frozen EEG Trunks and Foundation Models

通用脑机接口个性化:用于冻结脑电图主干和基础模型的单一应用程序编程接口

Sergey Musienko

机构 * NimbusBCI

专题命中 指令微调 :foundation model(title);分类 cs.LG

AI总结 研究针对冻结脑电图编码器微调难的问题,提出Nimbus Personalizer,通过与主干无关的API,可在异构冻结主干上运行,在多数据集和基础编码器上验证,相比传统方法成本低且能恢复精度增益,结果具探索性。

Comments 20 pages, 12 figures. Companion paper on the control layer forthcoming

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21774 2026-07-27 cs.CL cs.AI 新提交 73%

Probing Latent Colombian Identity Inferences in Qwen2.5-7B with Natural Language Autoencoders

用自然语言自动编码器探究Qwen2.5 - 7B中潜在的哥伦比亚身份推断

Pablo Santiago Potes Velasco, María del Mar García Matabanchoy, Óscar Julián Pérez Ladino, Jhoan Stevan Mosquera Ortiz, Nicolás Lozano Mazuera, Gilber Alexis Corrales Gallego

机构 * Universidad Autónoma de Occidente(西自治大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究Qwen2.5 - 7B - Instruct处理提示时是否表征哥伦比亚相关信息,用自然语言自动编码器转化残差流激活,通过含30个提示的数据集进行研究,将激活可解释性与西班牙语变体偏差评估相联系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21612 2026-07-27 cs.AI cs.LG 新提交 73%

Procedural Knowledge Is Not Low-Rank: Why LoRA Fails to Internalize Multi-Step Procedures

过程性知识不是低秩的:为什么LoRA无法内化多步骤过程

Simon Dennis, Kevin Shabahang, Hao Guo, Rivaan Patil

机构 * University of Melbourne(墨尔本大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究发现对于过程性知识,LoRA在保持效率优势的秩上无法与完全微调匹配。通过实验表明在旅行预订等任务中LoRA配置失败,跨域复制也证实其普遍不佳,分析指出完全微调权重变化的有效秩高,LoRA难以企及,这是智能体应用的基本限制。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22035 2026-07-27 cs.LG 新提交 70%

DCS: A Unified Conditional Sensitivity Framework for Cross-Modal Copyright Infringement Detection

DCS:用于跨模态版权侵权检测的统一条件敏感度框架

Xiafeng Man

机构 * Fudan University(复旦大学)

专题命中 指令微调 :language model(abstract);foundation model(abstract);分类 cs.LG

AI总结 研究针对基础模型版权侵权检测问题,提出统一的DCS框架,将侵权证据视为反事实条件分布转移,通过条件差分隐私形式化,创建双分支并结合多种因素界定敏感度,还定义校准统计量,适用于多种模型并以不同方式评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21978 2026-07-27 cs.CL 新提交 70%

MoE$^2$-LoRA: When MoE Models Meet MoE-style Low-Rank Adaptation

MoE$^2$-LoRA:当专家混合模型遇上专家混合风格的低秩自适应

Qingyu Yang, Haonan He, Minglei Li, Jingqi Ye, Tao Chen, Lei Bai, Peng Ye

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) KTH Royal Institute of Technology(瑞典皇家理工学院) University of Science and Technology of China(中国科学技术大学) Fudan University(复旦大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究探索MoE模型的参数高效微调方法,提出MoE$^2$-LoRA,通过双通道RCP模块耦合预训练专家专业化与任务适应性,引入全局专家池,在多MoE主干上评估,能保持通用能力并实现最优下游精度。

Comments Preprint, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21680 2026-07-27 cs.LG 新提交 70%

Encoding Invisible Causation for Bridge Diagnostic Agents: Triple-Guided Retrieval-Augmented Fine-Tuning with QLoRA

为桥梁诊断代理编码无形因果关系:基于QLoRA的三重引导检索增强微调

Takato Yasuno

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 研究针对桥梁损伤原因难以肉眼察觉及专家诊断依赖隐性知识的问题,提出基于QLoRA的三重引导检索增强微调方法(含知识三元组提取等组件),能在消费级硬件上实现内存高效、高精度的桥梁诊断代理。

Comments 13 pages, 7 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05988 2026-07-27 cs.LG 版本更新 70%

Layer-wise LoRA fine-tuning: a similarity metric approach

逐层LoRA微调:相似性度量方法

Keith Ando Ogawa, Bruno Lopes Yamamoto, Lucas Lauton de Alcantara, Lucas Pellicer, Rosimeire Pereira Costa, Edson Bollis, Anna Helena Reali Costa, Artur Jordao

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出逐层LoRA微调方法,通过选择性微调部分层以减少可训练参数并保持预测性能,适用于不同架构和任务。

Comments Accepted at the International Conference on Pattern Recognition (ICPR 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22078 2026-07-27 cs.CV 新提交 67%

CommandLM: Data driven behavior level descriptor for ego vehicles

CommandLM:用于自动驾驶车辆的数据驱动行为级描述符

Boris Tokic, Constantin Selzer, Fabian B. Flohr

机构 * Munich University of Applied Sciences(慕尼黑应用技术大学)

专题命中 指令微调 :large language model(abstract);language model(abstract)

AI总结 研究针对自动驾驶系统中可解释行为级决策需求,提出多模态大语言模型CommandLM,通过融合多传感器数据生成行为描述,经特定训练和适配器处理,实验表现优于基线,人工评估显示其输出可助力行为审计,实现高效透明的行为级理解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22331 2026-07-27 hep-ph 新提交 50%

SMEFT-Pheno-Agent: a natural-language-driven AI agent for machine-learning-assisted Standard Model Effective Field Theory phenomenology

SMEFT-现象学智能体:一种由自然语言驱动的人工智能智能体,用于机器学习辅助的标准模型有效场论现象学

Yu-Chen Guo, Jie Wang, Ji-Chong Yang

专题命中 指令微调 :LLM(abstract)

AI总结 介绍SMEFT-现象学智能体这一Python工作流程,由自然语言AI引导,用于高能对撞机的SMEFT现象学研究。它协调多阶段,自动生成参数文件等,委托工具计算,记录相关工件,建立了可重复性和审核可追溯性。

Comments 10 pages, 4 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏