arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-03-17 至 2026-03-17 共收录 507 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 37 篇

2603.13425 2026-03-17 cs.LG cs.AI cs.CV physics.geo-ph 62%

Self-Flow-Matching assisted Full Waveform Inversion

自流匹配辅助的全波形反演

Xinquan Huang, Paris Perdikaris

机构 * University of Pennsylvania(宾夕法尼亚大学)

专题命中 预训练与数据 :pretraining(abstract);分类 cs.AI、cs.LG

AI总结 本文提出自流匹配辅助全波形反演方法,通过流匹配学习传输场,无需大规模离线预训练,提升反演精度与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12101 2026-03-17 cs.RO cs.AI cs.LG 62%

Decoupled Action Expert: Confining Task Knowledge to the Conditioning Pathway

解耦动作专家:将任务知识限制在条件路径中

Jian Zhou, Sihao Lin, Shuai Fu, Zerui Li, Gengze Zhou, Qi WU

专题命中 预训练与数据 :pretraining(abstract);分类 cs.AI、cs.LG

AI总结 本文提出解耦训练方法,将任务知识限制在条件路径中,使动作主干网络无任务依赖,通过Diffusion Policy验证,证明动作专家编码较少任务特定知识。

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.07615 2026-03-17 cs.CL 57%

ViWikiFC: Fact-Checking for Vietnamese Wikipedia-Based Textual Knowledge Source

ViWikiFC:基于越南维基百科的文本知识源事实核查

Hung Tuan Le, Long Truong To, Manh Trong Nguyen, Kiet Van Nguyen

专题命中 预训练与数据 :language model(abstract);分类 cs.CL

AI总结 本文提出ViWikiFC,首个越南维基百科事实核查开放域语料库,通过20000多个声明验证,采用BM25和InfoXLM(Large)模型在证据检索和判断预测中取得最佳结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14592 2026-03-17 cs.LG cs.CR 57%

A Multi-Scale Graph Learning Framework with Temporal Consistency Constraints for Financial Fraud Detection in Transaction Networks under Non-Stationary Conditions

具有时间一致性约束的多尺度图学习框架用于交易网络中非平稳条件下的金融欺诈检测

Yiming Lei, Qiannan Shen, Junhao Song

专题命中 预训练与数据 :pretraining(abstract);分类 cs.LG

AI总结 本文提出STC-MixHop框架,结合多尺度传播与轻量时间一致性建模,用于动态交易网络中的异常检测。通过多尺度邻居扩散编码、时空注意力模块和自监督预训练策略,提升欺诈检测性能,尤其在高不平衡数据中表现优异。

Comments 39 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15774 2026-03-17 cs.CV cs.LG 57%

Two-Step Data Augmentation for Masked Face Detection and Recognition: Turning Fake Masks to Real

两步数据增强用于遮挡人脸检测与识别:将假面具转为真实

Yan Yang, George Bebis, Mircea Nicolescu

机构 * Department of Computer Science and Engineering, University of Nevada, Reno(内华达大学里诺分校计算机科学与工程系)

专题命中 预训练与数据 :pretraining(abstract);分类 cs.LG

AI总结 本文提出两步生成数据增强框架,结合规则基面具变形与GANs无配对图像到图像翻译,生成超越规则基叠加的遮挡人脸样本,通过训练提升检测识别性能,展示两步方法的互补性。

Comments 9 pages, 9 figures. Conference version

Journal ref (2022) In Proceedings of the 2nd International Conference on Image Processing and Vision Engineering - IMPROVE; ISBN 978-989-758-563-0; ISSN 2795-4943, SciTePress, pages 126-134

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15478 2026-03-17 cs.CV 50%

ViFeEdit: A Video-Free Tuner of Your Video Diffusion Transformer

ViFeEdit:一种无需视频的视频扩散变换器调谐器

Ruonan Yu, Zhenxiong Tan, Zigeng Chen, Songhua Liu, Xinchao Wang

机构 * National University of Singapore(新加坡国立大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 预训练与数据 :prompting(abstract)

AI总结 本文提出ViFeEdit框架,通过2D图像实现视频生成与编辑,无需视频训练数据,采用架构重参数化解耦空间独立性与全3D注意力,实现高质量视频编辑与生成。

Comments Working in progress, code is at https://github.com/Lexie-YU/ViFeEdit

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14528 2026-03-17 cs.CV cs.RO 50%

Interp3R: Continuous-time 3D Geometry Estimation with Frames and Events

Interp3R: 基于帧和事件的连续时间3D几何估计

Shuang Guo, Filbert Febryanto, Lei Sun, Guillermo Gallego

专题命中 预训练与数据 :foundation model(abstract)

AI总结 Interp3R通过异步事件数据插值帧生成的点云,实现任意时间点的深度和相机姿态估计,优于现有两阶段流程的SOTA基线。

Comments 18 pages, 6 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 指令微调 44 篇

2603.13985 2026-03-17 cs.AI cs.CL 93%

Supervised Fine-Tuning versus Reinforcement Learning: A Study of Post-Training Methods for Large Language Models

监督微调与强化学习:大型语言模型后训练方法的探讨

Haitao Jiang, Wenbo Zhang, Jiarui Yao, Hengrui Cai, Sheng Wang, Rui Song

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);post-training(title,abstract);LLM(abstract)

AI总结 本文探讨了监督微调与强化学习在大型语言模型后训练中的联系与应用,分析了两者的方法、数据需求及整合框架,总结了混合训练趋势及未来研究方向。

Comments 26 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12932 2026-03-17 cs.CL 92%

DS$^2$-Instruct: Domain-Specific Data Synthesis for Large Language Models Instruction Tuning

DS$^2$-Instruct: 领域特定数据合成用于大语言模型指令微调

Ruiyao Xu, Noelle I. Samia, Han Liu

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);instruction tuning(title,abstract);分类 cs.CL

AI总结 DS$^2$-Instruct通过零样本方法生成领域特定指令数据集,结合任务关键词和布卢姆分类法不同认知层次,提升模型在数学、金融等七个领域性能。

Comments EACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22764 2026-03-17 cs.CL cs.AI cs.LG 90%

Boosting Large Language Models with Mask Fine-Tuning

通过掩码微调提升大语言模型

Mingyuan Zhang, Yue Bai, Huan Wang, Yizhou Wang, Qihua Dong, Yitian Zhang, Yun Fu

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出掩码微调方法,通过破坏模型结构完整性提升性能,适用于多种领域和模型架构,实现平均2.70/4.15的提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14891 2026-03-17 cs.CL cs.AI 90%

Decision-Level Ordinal Modeling for Multimodal Essay Scoring with Large Language Models

基于大语言模型的多模态作文评分的决策级序数建模

Han Zhang, Jiamin Su, Li liu

专题命中 指令微调 :language model(title,abstract);large language model(title);LLM(abstract);SFT(abstract)

AI总结 本文提出DLOM方法,通过显式序数决策提升多模态作文评分的准确性,DLOM-GF和DLOM-DA分别引入门控融合模块和距离感知正则化项,实验表明在多模态和纯文本评分任务中均取得显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15405 2026-03-17 cs.CL 89%

Fusian: Multi-LoRA Fusion for Fine-Grained Continuous MBTI Personality Control in Large Language Models

Fusian:多LoRA融合用于大语言模型中精细连续MBTI性格控制

Zehao Chen, Rong Pan

机构 * School of Computer Science and Engineering, Sun Yat-sen University(中山大学计算机科学与工程学院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);SFT(abstract);分类 cs.CL

AI总结 本文提出Fusian框架,通过轨迹收集和基于强化学习的动态融合实现大语言模型中连续性格控制,实验显示其在性格控制精度上优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17646 2026-03-17 cs.LG 88%

Unveiling the Basin-Like Loss Landscape in Large Language Models

揭示大语言模型中的盆地状损失景观

Huanran Chen, Yinpeng Dong, Zeming Wei, Yao Huang, Yichi Zhang, Hang Su, Jun Zhu

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

AI总结 研究发现大语言模型的损失景观中出现盆地结构,随着模型规模增大,模型对参数空间扰动的鲁棒性增强,但最坏方向的损失景观尖锐且有害,对抗性微调会快速降低模型能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12222 2026-03-17 cs.LG cs.AI cs.CV 87%

Towards On-Policy SFT: Distribution Discriminant Theory and its Applications in LLM Training

迈向在线策略微调:分布判别理论及其在大语言模型训练中的应用

Miaosen Zhang, Yishan Liu, Shuxia Lin, Xu Yang, Qi Dai, Chong Luo, Weihao Jiang, Peng Hou, Anxiang Zeng, Xin Geng, Baining Guo

专题命中 指令微调 :SFT(title,abstract);LLM(title);分类 cs.AI、cs.LG

AI总结 本文提出分布判别理论及两种技术,提升SFT的泛化能力,实验表明其性能超越主流离线RL方法,且保持SFT效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13790 2026-03-17 cs.LG cs.CL 86%

Greedy Information Projection for LLM Data Selection

贪心信息投影用于大语言模型数据选择

Victor Ye Dong, Kuan-Yun Lee, Jiamei Shuai, Shengfei Liu, Yi Liu, Jian Jiao

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 本文提出贪心信息投影框架,通过最大化子集与任务查询信号的互信息,平衡质量与多样性,高效选择数据集进行微调。

Comments Published as a paper at 3rd DATA-FM workshop @ ICLR 2026, Brazil

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04658 2026-03-17 cs.SD cs.AI 85%

LAMB: LLM-based Audio Captioning with Modality Gap Bridging via Cauchy-Schwarz Divergence

LAMB:基于LLM的音频描述通过Cauchy-Schwarz散度弥合模态间隙

Hyeongkeun Lee, Jongmin Choi, KiHyun Nam, Joon Son Chung

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出LAMB框架,通过Cauchy-Schwarz散度弥合音频与文本嵌入空间的模态差距,设计Two-Stream Adapter和Token Guide提升LLM解码器推理能力,在AudioCaps上取得最佳性能。

Comments 5 pages, 2 figures; Accepted to ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15237 2026-03-17 cs.CV 85%

Multi-turn Physics-informed Vision-language Model for Physics-grounded Anomaly Detection

多轮物理引导的视觉-语言模型用于物理基础的异常检测

Yao Gu, Xiaohao Xu, Yingna Wu

机构 * Shanghaitech University(上海科技大学) University of Michigan, Ann Arbor(密歇根大学安娜堡分校)

专题命中 指令微调 :language model(title,abstract);LLM(abstract);instruction tuning(abstract)

AI总结 本文提出一种多轮物理引导的视觉-语言模型,通过编码物体属性和动态约束提升物理基础异常检测性能,实验显示其在视频级检测中达到96.7%的AUROC,优于现有最佳方法。

Comments Accepted by IEEE ICASSP2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01804 2026-03-17 cs.CV 85%

V-CORE: Temporally Consistent Video Understanding for Video-LLM

V-CORE:面向视频大语言模型的时序一致视频理解

Zhengjian Kang, Qi Chen, Rui Liu, Kangtong Mo, Xingyu Zhang, Xiaoyu Deng, Ye Zhang

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 V-CORE通过引入显式时序约束提升视频理解性能,采用可学习空间聚合和因果感知时间投影器,有效解决视频时序一致性问题,在多个基准测试中取得显著成果。

Comments 7 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16917 2026-03-17 cs.SD cs.AI cs.CL eess.AS 84%

SAKE: Towards Editing Auditory Attribute Knowledge of Large Audio-Language Models

SAKE:迈向大型音频-语言模型的听觉属性知识编辑

Chih-Kai Yang, Yen-Ting Piao, Tzu-Wen Hsu, Szu-Wei Fu, Zhehuai Chen, Ke-Han Lu, Sung-Feng Huang, Chao-Han Huck Yang, Yu-Chiang Frank Wang, Yun-Nung Chen, Hung-yi Lee

专题命中 指令微调 :language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

AI总结 本文提出SAKE基准,用于评估大型音频-语言模型中听觉属性知识的编辑方法,发现多数方法在可靠性上表现良好,但在听觉泛化和多模态知识传播方面存在不足,细调模态连接器比直接编辑LLM更稳健。

Comments Work in progress. Resources: https://github.com/ckyang1124/SAKE

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12248 2026-03-17 cs.LG 83%

Matching Features, Not Tokens: Energy-Based Fine-Tuning of Language Models

匹配特征而非标记:基于能量的语言模型微调

Samy Jelassi, Mujin Kwun, Rosie Zhao, Yuanzhi Li, Nicolo Fusi, Yilun Du, Sham M. Kakade, Carles Domingo-Enrich

机构 * Harvard University, Kempner Institute(哈佛大学凯普纳研究所) Microsoft Research New England(微软研究院新英格兰分部)

专题命中 指令微调 :language model(title,abstract);SFT(abstract);分类 cs.LG

AI总结 本文提出基于能量的语言模型微调方法,通过匹配序列级统计信息提升模型表现,无需任务特定验证器或偏好模型,在多个任务中优于传统微调方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13587 2026-03-17 cs.AI cs.CV 83%

Breaking the SFT Plateau: Multimodal Structured Reinforcement Learning for Chart-to-Code Generation

突破SFT平台:面向图表到代码生成的多模态结构强化学习

Lei Chen, Xuanle Zhao, Zhixiong Zeng, Jing Huang, Liming Zheng, Yufeng Zhong, Lin Ma

专题命中 指令微调 :SFT(title,abstract);language model(abstract);分类 cs.AI

AI总结 本文提出多模态结构强化学习(MSRL)以突破SFT平台,通过大规模实验构建最大训练语料库,并采用双阶段课程训练策略,提升图表到代码生成的高阶指标。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16931 2026-03-17 cs.AI 83%

Narrow Fine-Tuning Erodes Safety Alignment in Vision-Language Agents

细粒度微调会削弱视觉语言代理的安全对齐

Idhant Gulati, Shivam Raval

专题命中 指令微调 :language agent(title);language model(abstract);post-training(abstract);分类 cs.AI

AI总结 研究发现细粒度微调在有害数据集上会导致广泛的任务和模态对齐偏差,且单模态安全基准可能低估视觉语言模型的对齐退化。

Comments 25 pages, 14 figures, Published at the Lifelong Agent Workshop at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13647 2026-03-17 cs.CL 83%

Instruction Tuning on Public Government and Cultural Data for Low-Resource Language: a Case Study in Kazakh

在公共政府和文化数据上进行指令微调以处理低资源语言:哈萨克语案例研究

Nurkhan Laiyk, Daniil Orel, Rituraj Joshi, Maiya Goloburda, Yuxia Wang, Preslav Nakov, Fajri Koto

专题命中 指令微调 :instruction tuning(title,abstract);LLM(abstract);分类 cs.CL

AI总结 本文通过构建大规模哈萨克语指令遵循数据集,提升低资源语言中政府与文化领域LLM的理解能力,并验证了基于LLM的指令微调方法在多选和生成任务中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09065 2026-03-17 cs.LG 83%

Learning Adaptive LLM Decoding

学习自适应的大语言模型解码

Chloe H. Su, Zhe Ye, Samuel Tenka, Aidan Yang, Soonho Kong, Udaya Ghai

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出学习自适应解码策略,通过强化学习和可验证终端奖励提升解码准确性与预算平衡,实验表明在数学和编程竞赛基准上显著提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15431 2026-03-17 cs.LG cs.AI cs.NA math.AP math.NA 81%

Physics-informed fine-tuning of foundation models for partial differential equations

基于物理约束的微调基础模型用于偏微分方程

Vlad Medvedev, Leon Armbruster, Christopher Straub, Georg Kruse, Andreas Rosskopf

机构 * Fraunhofer Institute for Integrated Systems and Device Technology(弗劳恩霍夫整合系统与器件技术研究所)

专题命中 指令微调 :foundation model(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种结合物理约束的微调方法,用于适应偏微分方程基础模型,提升数据稀缺情况下模型的物理一致性和泛化能力。

Comments 12 pages, 6 figures, 1 table

Journal ref ICLR 2026 Workshop on Artificial Intelligence and Partial Differential Equations

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15183 2026-03-17 cs.DC cs.AI cs.LG cs.MA 81%

Token Coherence: Adapting MESI Cache Protocols to Minimize Synchronization Overhead in Multi-Agent LLM Systems

令牌一致性:适应MESI缓存协议以最小化多智能体大语言模型系统中的同步开销

Vladyslav Parakhin

机构 * Independent Researcher(独立研究者)

专题命中 指令微调 :LLM(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出令牌一致性理论,通过将MESI协议应用于多智能体系统,减少同步开销,验证了在多智能体大语言模型中同步成本与缓存一致性问题的对应关系,并通过形式化验证协议确保安全性与一致性。

Comments 25 pages. Code and reproduction scripts at https://github.com/hipvlady/agent-coherence

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00824 2026-03-17 cs.LG cs.AI cs.CL cs.NE 80%

A Gauge Theory of Superposition: Toward a Sheaf-Theoretic Atlas of Neural Representations

超位置的规范理论:神经表示的sheaf理论地图

Hossein Javidnia

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出一种离散规范框架,用于大语言模型中的超位置,通过sheaf理论的局部语义图来替代单一全局词典。研究通过局部特征空间和信息几何度量,提出三种可测量的全局可解释性障碍。

Comments 35 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13292 2026-03-17 cs.LG cs.AI 79%

Pragma-VL: Towards a Pragmatic Arbitration of Safety and Helpfulness in MLLMs

Pragma-VL:迈向多模态大语言模型中安全与助人的务实仲裁

Ming Wen, Kun Yang, Xin Chen, Jingyu Zhang, Dingding Han, Shiwen Cui, Yuedong Xu

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) Ant Group(蚂蚁集团) Zhejiang University(浙江大学) UCLA(加州大学洛杉矶分校) Shenzhen Loop Area Institute(深圳河套学院)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.AI、cs.LG

AI总结 Pragma-VL通过引入一种端到端的对齐算法,解决了多模态大语言模型在安全与助人之间的平衡问题,通过增强视觉风险感知和理论保证的奖励模型,在多数多模态安全基准上提升了性能。

Comments 31 pages, ICLR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15003 2026-03-17 cs.CV 78%

Edit2Interp: Adapting Image Foundation Models from Spatial Editing to Video Frame Interpolation with Few-Shot Learning

Edit2Interp:从空间编辑到视频帧插值的图像基础模型适应

Nasrin Rahimi, Mısra Yavuz, Burak Can Biner, Yunus Bilge Kurt, Ahmet Rasim Emirdağı, Süleyman Aslan, Görkay Aydemir, M. Akın Yılmaz, A. Murat Tekalp

机构 * Codeway AI Research Dept. of Electrical \& Electronics Engineering, Ko c University, \. I stanbul, T\" u rkiye

专题命中 指令微调 :foundation model(title,abstract)

AI总结 本文通过少量样本学习,将图像编辑模型适应于视频帧插值,揭示了静态场景中物体变换的理解可激活潜在的时间推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06999 2026-03-17 cs.CV 78%

TrajPred: Trajectory-Conditioned Joint Embedding Prediction for Surgical Instrument-Tissue Interaction Recognition in Vision-Language Models

TrajPred: 基于轨迹的联合嵌入预测用于视觉-语言模型中手术器械-组织交互识别

Jiajun Cheng, Xiaofan Yu, Subarna Tripathi, Sainan Liu, Shan Lin

专题命中 指令微调 :language model(title,abstract)

AI总结 本文提出TrajPred框架,通过编码器械轨迹融入时间运动线索,并基于轨迹引入预测模块生成更精确的视觉语义嵌入,提升手术器械-组织交互识别的准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏