Self-Flow-Matching assisted Full Waveform Inversion
自流匹配辅助的全波形反演
机构 * University of Pennsylvania(宾夕法尼亚大学)
专题命中 预训练与数据 :pretraining(abstract);分类 cs.AI、cs.LG
AI总结 本文提出自流匹配辅助全波形反演方法,通过流匹配学习传输场,无需大规模离线预训练,提升反演精度与鲁棒性。
AI 大模型
大语言模型、预训练、指令微调、后训练和语言模型应用。
自流匹配辅助的全波形反演
机构 * University of Pennsylvania(宾夕法尼亚大学)
专题命中 预训练与数据 :pretraining(abstract);分类 cs.AI、cs.LG
AI总结 本文提出自流匹配辅助全波形反演方法,通过流匹配学习传输场,无需大规模离线预训练,提升反演精度与鲁棒性。
解耦动作专家:将任务知识限制在条件路径中
专题命中 预训练与数据 :pretraining(abstract);分类 cs.AI、cs.LG
AI总结 本文提出解耦训练方法,将任务知识限制在条件路径中,使动作主干网络无任务依赖,通过Diffusion Policy验证,证明动作专家编码较少任务特定知识。
ViWikiFC:基于越南维基百科的文本知识源事实核查
专题命中 预训练与数据 :language model(abstract);分类 cs.CL
AI总结 本文提出ViWikiFC,首个越南维基百科事实核查开放域语料库,通过20000多个声明验证,采用BM25和InfoXLM(Large)模型在证据检索和判断预测中取得最佳结果。
具有时间一致性约束的多尺度图学习框架用于交易网络中非平稳条件下的金融欺诈检测
专题命中 预训练与数据 :pretraining(abstract);分类 cs.LG
AI总结 本文提出STC-MixHop框架,结合多尺度传播与轻量时间一致性建模,用于动态交易网络中的异常检测。通过多尺度邻居扩散编码、时空注意力模块和自监督预训练策略,提升欺诈检测性能,尤其在高不平衡数据中表现优异。
Comments 39 pages, 13 figures
两步数据增强用于遮挡人脸检测与识别:将假面具转为真实
机构 * Department of Computer Science and Engineering, University of Nevada, Reno(内华达大学里诺分校计算机科学与工程系)
专题命中 预训练与数据 :pretraining(abstract);分类 cs.LG
AI总结 本文提出两步生成数据增强框架,结合规则基面具变形与GANs无配对图像到图像翻译,生成超越规则基叠加的遮挡人脸样本,通过训练提升检测识别性能,展示两步方法的互补性。
Comments 9 pages, 9 figures. Conference version
Journal ref (2022) In Proceedings of the 2nd International Conference on Image Processing and Vision Engineering - IMPROVE; ISBN 978-989-758-563-0; ISSN 2795-4943, SciTePress, pages 126-134
ViFeEdit:一种无需视频的视频扩散变换器调谐器
机构 * National University of Singapore(新加坡国立大学) ; Shanghai Jiao Tong University(上海交通大学)
专题命中 预训练与数据 :prompting(abstract)
AI总结 本文提出ViFeEdit框架,通过2D图像实现视频生成与编辑,无需视频训练数据,采用架构重参数化解耦空间独立性与全3D注意力,实现高质量视频编辑与生成。
Comments Working in progress, code is at https://github.com/Lexie-YU/ViFeEdit
Interp3R: 基于帧和事件的连续时间3D几何估计
专题命中 预训练与数据 :foundation model(abstract)
AI总结 Interp3R通过异步事件数据插值帧生成的点云,实现任意时间点的深度和相机姿态估计,优于现有两阶段流程的SOTA基线。
Comments 18 pages, 6 figures, 5 tables
监督微调与强化学习:大型语言模型后训练方法的探讨
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);post-training(title,abstract);LLM(abstract)
AI总结 本文探讨了监督微调与强化学习在大型语言模型后训练中的联系与应用,分析了两者的方法、数据需求及整合框架,总结了混合训练趋势及未来研究方向。
Comments 26 pages
DS$^2$-Instruct: 领域特定数据合成用于大语言模型指令微调
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);instruction tuning(title,abstract);分类 cs.CL
AI总结 DS$^2$-Instruct通过零样本方法生成领域特定指令数据集,结合任务关键词和布卢姆分类法不同认知层次,提升模型在数学、金融等七个领域性能。
Comments EACL 2026 Findings
通过掩码微调提升大语言模型
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 本文提出掩码微调方法,通过破坏模型结构完整性提升性能,适用于多种领域和模型架构,实现平均2.70/4.15的提升。
基于大语言模型的多模态作文评分的决策级序数建模
专题命中 指令微调 :language model(title,abstract);large language model(title);LLM(abstract);SFT(abstract)
AI总结 本文提出DLOM方法,通过显式序数决策提升多模态作文评分的准确性,DLOM-GF和DLOM-DA分别引入门控融合模块和距离感知正则化项,实验表明在多模态和纯文本评分任务中均取得显著提升。
Fusian:多LoRA融合用于大语言模型中精细连续MBTI性格控制
机构 * School of Computer Science and Engineering, Sun Yat-sen University(中山大学计算机科学与工程学院)
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);SFT(abstract);分类 cs.CL
AI总结 本文提出Fusian框架,通过轨迹收集和基于强化学习的动态融合实现大语言模型中连续性格控制,实验显示其在性格控制精度上优于基线方法。
揭示大语言模型中的盆地状损失景观
专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.LG
AI总结 研究发现大语言模型的损失景观中出现盆地结构,随着模型规模增大,模型对参数空间扰动的鲁棒性增强,但最坏方向的损失景观尖锐且有害,对抗性微调会快速降低模型能力。
迈向在线策略微调:分布判别理论及其在大语言模型训练中的应用
专题命中 指令微调 :SFT(title,abstract);LLM(title);分类 cs.AI、cs.LG
AI总结 本文提出分布判别理论及两种技术,提升SFT的泛化能力,实验表明其性能超越主流离线RL方法,且保持SFT效率。
贪心信息投影用于大语言模型数据选择
专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG
AI总结 本文提出贪心信息投影框架,通过最大化子集与任务查询信号的互信息,平衡质量与多样性,高效选择数据集进行微调。
Comments Published as a paper at 3rd DATA-FM workshop @ ICLR 2026, Brazil
LAMB:基于LLM的音频描述通过Cauchy-Schwarz散度弥合模态间隙
专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI
AI总结 本文提出LAMB框架,通过Cauchy-Schwarz散度弥合音频与文本嵌入空间的模态差距,设计Two-Stream Adapter和Token Guide提升LLM解码器推理能力,在AudioCaps上取得最佳性能。
Comments 5 pages, 2 figures; Accepted to ICASSP 2026
多轮物理引导的视觉-语言模型用于物理基础的异常检测
机构 * Shanghaitech University(上海科技大学) ; University of Michigan, Ann Arbor(密歇根大学安娜堡分校)
专题命中 指令微调 :language model(title,abstract);LLM(abstract);instruction tuning(abstract)
AI总结 本文提出一种多轮物理引导的视觉-语言模型,通过编码物体属性和动态约束提升物理基础异常检测性能,实验显示其在视频级检测中达到96.7%的AUROC,优于现有最佳方法。
Comments Accepted by IEEE ICASSP2026
V-CORE:面向视频大语言模型的时序一致视频理解
专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract)
AI总结 V-CORE通过引入显式时序约束提升视频理解性能,采用可学习空间聚合和因果感知时间投影器,有效解决视频时序一致性问题,在多个基准测试中取得显著成果。
Comments 7 pages, 4 figures
SAKE:迈向大型音频-语言模型的听觉属性知识编辑
专题命中 指令微调 :language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI
AI总结 本文提出SAKE基准,用于评估大型音频-语言模型中听觉属性知识的编辑方法,发现多数方法在可靠性上表现良好,但在听觉泛化和多模态知识传播方面存在不足,细调模态连接器比直接编辑LLM更稳健。
Comments Work in progress. Resources: https://github.com/ckyang1124/SAKE
匹配特征而非标记:基于能量的语言模型微调
机构 * Harvard University, Kempner Institute(哈佛大学凯普纳研究所) ; Microsoft Research New England(微软研究院新英格兰分部)
专题命中 指令微调 :language model(title,abstract);SFT(abstract);分类 cs.LG
AI总结 本文提出基于能量的语言模型微调方法,通过匹配序列级统计信息提升模型表现,无需任务特定验证器或偏好模型,在多个任务中优于传统微调方法。
突破SFT平台:面向图表到代码生成的多模态结构强化学习
专题命中 指令微调 :SFT(title,abstract);language model(abstract);分类 cs.AI
AI总结 本文提出多模态结构强化学习(MSRL)以突破SFT平台,通过大规模实验构建最大训练语料库,并采用双阶段课程训练策略,提升图表到代码生成的高阶指标。
Comments Accepted to ICLR 2026
细粒度微调会削弱视觉语言代理的安全对齐
专题命中 指令微调 :language agent(title);language model(abstract);post-training(abstract);分类 cs.AI
AI总结 研究发现细粒度微调在有害数据集上会导致广泛的任务和模态对齐偏差,且单模态安全基准可能低估视觉语言模型的对齐退化。
Comments 25 pages, 14 figures, Published at the Lifelong Agent Workshop at ICLR 2026
在公共政府和文化数据上进行指令微调以处理低资源语言:哈萨克语案例研究
专题命中 指令微调 :instruction tuning(title,abstract);LLM(abstract);分类 cs.CL
AI总结 本文通过构建大规模哈萨克语指令遵循数据集,提升低资源语言中政府与文化领域LLM的理解能力,并验证了基于LLM的指令微调方法在多选和生成任务中的有效性。
学习自适应的大语言模型解码
专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.LG
AI总结 本文提出学习自适应解码策略,通过强化学习和可验证终端奖励提升解码准确性与预算平衡,实验表明在数学和编程竞赛基准上显著提升性能。
基于物理约束的微调基础模型用于偏微分方程
机构 * Fraunhofer Institute for Integrated Systems and Device Technology(弗劳恩霍夫整合系统与器件技术研究所)
专题命中 指令微调 :foundation model(title,abstract);分类 cs.AI、cs.LG
AI总结 本文提出一种结合物理约束的微调方法,用于适应偏微分方程基础模型,提升数据稀缺情况下模型的物理一致性和泛化能力。
Comments 12 pages, 6 figures, 1 table
Journal ref ICLR 2026 Workshop on Artificial Intelligence and Partial Differential Equations
令牌一致性:适应MESI缓存协议以最小化多智能体大语言模型系统中的同步开销
机构 * Independent Researcher(独立研究者)
专题命中 指令微调 :LLM(title,abstract);分类 cs.AI、cs.LG
AI总结 本文提出令牌一致性理论,通过将MESI协议应用于多智能体系统,减少同步开销,验证了在多智能体大语言模型中同步成本与缓存一致性问题的对应关系,并通过形式化验证协议确保安全性与一致性。
Comments 25 pages. Code and reproduction scripts at https://github.com/hipvlady/agent-coherence
超位置的规范理论:神经表示的sheaf理论地图
专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 本文提出一种离散规范框架,用于大语言模型中的超位置,通过sheaf理论的局部语义图来替代单一全局词典。研究通过局部特征空间和信息几何度量,提出三种可测量的全局可解释性障碍。
Comments 35 pages, 4 figures
Pragma-VL:迈向多模态大语言模型中安全与助人的务实仲裁
机构 * Fudan University(复旦大学) ; Shanghai Innovation Institute(上海创新研究院) ; Ant Group(蚂蚁集团) ; Zhejiang University(浙江大学) ; UCLA(加州大学洛杉矶分校) ; Shenzhen Loop Area Institute(深圳河套学院)
专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.AI、cs.LG
AI总结 Pragma-VL通过引入一种端到端的对齐算法,解决了多模态大语言模型在安全与助人之间的平衡问题,通过增强视觉风险感知和理论保证的奖励模型,在多数多模态安全基准上提升了性能。
Comments 31 pages, ICLR2026
Edit2Interp:从空间编辑到视频帧插值的图像基础模型适应
机构 * Codeway AI Research Dept. of Electrical \& Electronics Engineering, Ko c University, \. I stanbul, T\" u rkiye
专题命中 指令微调 :foundation model(title,abstract)
AI总结 本文通过少量样本学习,将图像编辑模型适应于视频帧插值,揭示了静态场景中物体变换的理解可激活潜在的时间推理能力。
TrajPred: 基于轨迹的联合嵌入预测用于视觉-语言模型中手术器械-组织交互识别
专题命中 指令微调 :language model(title,abstract)
AI总结 本文提出TrajPred框架,通过编码器械轨迹融入时间运动线索,并基于轨迹引入预测模块生成更精确的视觉语义嵌入,提升手术器械-组织交互识别的准确率。