arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 266 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 266 篇

2503.02636 2026-06-19 q-bio.NC cs.AI 版本更新 57%

A Deep Generative Model for Resting-State EEG Synthesis and Transferable Representation Learning

一种用于静息态脑电合成与可迁移表示学习的深度生成模型

Yeganeh Farahzadi, Morteza Ansarinia, Zoltan Kekecs

机构 * Institute of Psychology, Eötvös Loránd University(埃斯特哈兹·洛朗大学心理学研究所) Doctoral School of Psychology, Eötvös Loránd University(埃斯特哈兹·洛朗大学心理学博士学院) Department of Behavioural and Cognitive Sciences, University of Luxembourg(卢森堡大学行为与认知科学系)

专题命中 知识编辑与模型理解 :foundation model(abstract);分类 cs.AI

AI总结 提出REST-GAN框架,结合对抗训练与自监督重构,从原始时域信号合成静息态EEG并学习可迁移表示,在频谱、连接性及分类任务中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04198 2026-06-17 stat.ML cs.LG 版本更新 57%

Stable and Steerable Sparse Autoencoders with Weight Regularization

基于权重正则化的稳定且可操控的稀疏自编码器

Piotr Jedryszek, Oliver M. Crook

机构 * Department of Biology, University of Oxford, Oxford, UK(牛津大学生物学系) Kavli Institute for Nanoscience Discovery, University of Oxford, Oxford, UK(牛津大学纳科学发现研究所) Department of Chemistry, University of Oxford, Oxford, UK(牛津大学化学系)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.LG

AI总结 通过L1/L2权重正则化提高稀疏自编码器的跨种子特征一致性,并在语言模型上提升操控成功率,同时保持可解释性分数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18909 2026-06-16 cs.LG cs.SY eess.SY 版本更新 57%

Descriptive versus Regulatory Uncertainty in Bounded Predictive Systems

描述性不确定性与监管性不确定性在有界预测系统中的区别

Ahmed Gamal Eldin

机构 * Nova University Lisbon – Cairo Branch (NOVA IMS)(里斯本诺瓦大学-开罗分校区(NOVA IMS))

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.LG

AI总结 本文研究了有界预测系统中描述性不确定性与监管性不确定性的区别,证明了当前Transformer架构在推理时仅限于描述性不确定性,并通过热力学原理和实验验证了这种区别,发现熵与准确性相互正交,且系统规模不影响熵的平坦性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24058 2026-06-16 cs.CV cs.AI 版本更新 57%

Mitigating Object Hallucinations in LVLMs via Attention Imbalance Rectification

通过注意力不平衡修正减轻LVLM中的对象幻觉

Han Sun, Qin Li, Peixin Wang, Min Zhang

机构 * Shanghai Key Laboratory of Trustworthy Computing, East China Normal University(上海可信计算实验室,东华大学)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.AI

AI总结 发现多模态和token间注意力不平衡是对象幻觉的因果因素,提出轻量级解码干预方法AIR,通过重新分配注意力权重修正不平衡,在多个基准上减少幻觉达35.1%,并提升通用能力。

Comments CVPR 2026 Findings Track, code is available at https://github.com/Ice-wave/AIR

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16077 2026-06-15 cs.LG 版本更新 57%

Ensembling Sparse Autoencoders

集成稀疏自编码器

Soham Gadgil, Chris Lin, Su-In Lee

机构 * Paul G. Allen School of Computer Science \& Engineering, University of Washington

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.LG

AI总结 针对单个稀疏自编码器只能捕获激活空间中有限特征的问题,提出通过朴素Bagging和Boosting集成多个SAE,理论证明可降低重构误差,实验表明集成方法在重构质量、稳定性和下游任务上优于扩展单个SAE。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20076 2026-06-12 cs.LG 版本更新 57%

ExPLAIND: Unifying Model, Data, and Training Attribution to Study Model Behavior

ExPLAIND:统一模型、数据和训练归因以研究模型行为

Florian Eichin, Yupei Du, Philipp Mondorf, Maria Matveev, Barbara Plank, Michael A. Hedderich

机构 * University of Michigan(密歇根大学)

专题命中 知识编辑与模型理解 :pretraining(abstract);分类 cs.LG

AI总结 提出ExPLAIND框架,统一归因于模型组件、数据和训练轨迹,支持跨粒度解释,通过梯度路径核和AdamW核机器推导参数级和步骤级影响分数,验证了Transformer的Grokking和EuroLLM预训练中的两阶段动态。

Comments published at ICML 2026, code at https://github.com/mainlp/explaind

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22050 2026-06-12 cs.LG 版本更新 57%

BrainPro: Towards Large-scale Brain State-aware EEG Representation Learning

BrainPro:迈向大规模脑状态感知的脑电图表征学习

Yi Ding, Muyun Jiang, Weibang Jiang, Shuailei Zhang, Xinliang Zhou, Chenyu Liu, Shanglin Li, Yong Li, Cuntai Guan

机构 * Nanyang Technological University(南洋理工大学) Shanghai Jiao Tong University(上海交通大学) Advanced Telecommunications Research Institute International(先进电信研究院) Southeast University(东南大学)

专题命中 知识编辑与模型理解 :foundation model(abstract);分类 cs.LG

AI总结 提出BrainPro模型,通过检索式空间对齐和脑状态解耦模块,学习共享与特定状态表征,在9个公共BCI数据集上取得最优性能。

Comments 31 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22397 2026-06-11 cs.NI cs.LG 版本更新 57%

NetBurst: Event-Centric Forecasting of Bursty, Intermittent Time Series

NetBurst: 以事件为中心的突发间歇性时间序列预测

Satyandra Guthula, Jaber Daneshamooz, Charles Fleming, Kesheng Wu, Walter Willinger, Arpit Gupta

机构 * University of California, Santa Barbara(加州大学圣巴bara分校) Cisco Research(思科研究) Lawrence Berkeley National Laboratory(伯克利国家实验室) Northwestern University(西北大学)

专题命中 知识编辑与模型理解 :foundation model(abstract);分类 cs.LG

AI总结 针对网络遥测数据中罕见突发和长间隔低活动的“野性”统计特性,提出NetBurst事件中心管道,通过压缩低活动期、分离突发时序和幅度流学习统一表示,在预测误差、突发分布匹配和异常描述性上显著优于Chronos-2等基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06735 2026-06-10 cs.AI 版本更新 57%

A Geometric Account of Activation Steering through Angle-Norm Decomposition

通过角度-范数分解的激活引导的几何解释

Georgii Aparin, Tatiana Gaintseva

机构 * Huawei Noah’s Ark Lab(华为诺亚实验室) Queen Mary University of London(女王玛丽大学)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.AI

AI总结 本文通过控制实验分离角度和径向分量,发现概念主要编码在角度结构中,但范数对引导的稳定性和下游效应至关重要,建议将激活引导参数化为可解释的角度和径向分量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22697 2026-06-09 q-bio.NC cs.AI cs.CV 版本更新 57%

Brain2Text Decoding Model Reveals the Neural Mechanisms of Visual Semantic Processing

Brain2Text解码模型揭示视觉语义处理的神经机制

Feihan Feng, Jingxin Nie

机构 * Ministry of Education Center for Studies of Psychological Application(教育部心理应用研究中心) Center for Studies of Psychological Application(心理应用研究中心) Key Laboratory of Brain, Cognition and Education Sciences(脑认知与教育科学重点实验室) School of Psychology(心理学学院) Guangdong Key Laboratory of Mental Health and Cognitive Science(广东省心理健康与认知科学重点实验室)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.AI

AI总结 提出一种直接从fMRI信号解码自然图像语义描述的深度学习模型,揭示了高级视觉皮层在语义处理中的关键作用,并展示了类别特异性神经表征。

Comments 39 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11402 2026-08-07 cs.CV 版本更新 50%

SCD4VPR: Multi-modal Scene Change Detection for Long-term Visual Place Recognition Database Update

基于视觉-语言表示学习的场景变化检测

Diwei Sheng, Vijayraj Gohil, Satyam Gaba, Zihan Liu, Giles Hamilton-Fletcher, John-Ross Rizzo, Yongqing Liang, Chen Feng

机构 * New York University(纽约大学)

专题命中 知识编辑与模型理解 :language model(abstract)

AI总结 本文提出LangSCD框架,通过融合语言和视觉信息提升场景变化检测的鲁棒性,引入几何-语义匹配模块和多类标注数据集NYC-CD,实验证明其在多个基准上的优越性能。

Comments 9 pages, 6 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08575 2026-08-04 cs.RO 版本更新 50%

FabriVLA: A Lightweight Vision-Language-Action Model with Conformal Action Chunk Uncertainty

FabriVLA:用于精确多任务操作的轻量级视觉-语言-动作模型

Shiyuan Yang, Borong Zhang, Jizheng Zhang, Zhijia Tao, Junfei Guo, Donglai Ran, Xu Bian, Qingbiao Li

专题命中 知识编辑与模型理解 :post-training(abstract)

AI总结 研究提出FabriVLA模型,结合视觉-语言主干与流匹配动作头,经单阶段联合优化训练。在Meta-World MT50基准测试中,该模型基于1B规模VLM,不依赖数十亿参数主干,实现90.0%平均成功率,展现强大性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28828 2026-07-28 cs.CV 版本更新 50%

Ground4D: Consistency-Aware 4D Reconstruction from Monocular Video

Ground4D: 从单目视频进行一致性感知的四维重建

Qing Zhao, Weijian Deng, Pengxu Wei, Liang Lin

机构 * School of Computer Science and Engineering, Sun Yat-sen University, China(中山大学计算机科学与工程学院) Tsinghua Shenzhen International Graduate School, Tsinghua University, China(清华大学深圳国际研究生院)

专题命中 知识编辑与模型理解 :foundation model(abstract)

AI总结 提出Ground4D框架,结合3D基础模型进行几何初始化与动态高斯泼溅进行一致性优化,实现从单目视频的高保真4D重建与新视角渲染。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15423 2026-07-27 cs.CV cs.RO 版本更新 50%

The 3D Mirage: Probing and Taming 3D Hallucinations

真实场景中的逼真幻影道路:从物理几何中解构3D幻觉

Hoang Nguyen, Xiaohao Xu, Xiaonan Huang

机构 * University of Michigan(密歇根大学)

专题命中 知识编辑与模型理解 :foundation model(abstract)

AI总结 本文提出首个端到端框架,用于探测、量化和抑制单目深度模型中因几何平面输入而产生的3D幻觉现象,通过引入3D-幻影基准和基于拉普拉斯的评估框架,提升深度模型的结构和上下文鲁棒性。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16577 2026-07-22 cs.CV cs.GR 版本更新 50%

CNS-Edit++: Category-Agnostic 3D Editing with Coupled Neural Shape Representation

CNS-Edit++:基于耦合神经形状表示的类别无关3D编辑

Jingyu Hu, Weilong Yan, Zhengzhe Liu, Haipeng Li, Ka-Hei Hui, Hao Zhang, Chi-Wing Fu

机构 * The Chinese University of Hong Kong(香港中文大学) Lingnan University(岭南大学) National University of Singapore(新加坡国立大学) The Hong Kong University of Science and Technology(香港科技大学) Autodesk AI Lab(欧特克人工智能实验室) Simon Fraser University(西蒙弗雷泽大学)

专题命中 知识编辑与模型理解 :foundation model(abstract)

AI总结 研究提出基于耦合神经形状表示和神经特征体积优化的潜在空间3D形状编辑框架CNS-Edit++,能在特定类别和类别无关模型上实例化,有多种编辑操作符及区域控制机制,经评估其性能优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19504 2026-07-21 cs.CV 版本更新 50%

FusionNet: Physics-Aware Representation Learning for Multi-Spectral and Thermal Data via Trainable Signal-Processing Priors

FusionNet:通过可训练信号处理先验对多光谱和热数据进行物理感知表示学习

Georgios Voulgaris

机构 * University of Oxford(牛津大学)

专题命中 知识编辑与模型理解 :pretraining(abstract)

AI总结 研究针对水泥生产设施监测难题,提出FusionNet框架,通过整合多光谱数据,嵌入信号处理先验,经消融研究等实验验证,该框架能结合物理感知特征选择与深度学习架构,高精度检测水泥生产设施,为工业监测提供可靠框架。

Comments Accepted for publication in the IEEE Journal of Selected Topics in Applied Earth Observations and Remote Sensing (JSTARS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08982 2026-07-21 cs.CV 版本更新 50%

CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation

CityLoc:基于高斯表示的大规模场景文本描述的6自由度姿态分布定位

Qi Ma, Runyi Yang, Bin Ren, Nicu Sebe, Ender Konukoglu, Luc Van Gool, Danda Pani Paudel

机构 * Computer Vision Lab, ETH Zurich(苏黎世联邦理工学院计算机视觉实验室) University of Pisa(比萨大学) University of Trento(特伦托大学)

专题命中 知识编辑与模型理解 :language model(abstract)

AI总结 研究大规模场景文本描述的6自由度姿态分布定位问题,核心方法是用基于扩散架构结合预训练文本编码器细化姿态,经3D高斯渲染提高精度,通过与标准方法对比验证其在多数据集上的优越性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01360 2026-07-20 physics.geo-ph 版本更新 50%

Modelling ductile strain localization with evolutive stochastic rheologies

用演化随机流变学模拟韧性应变局部化

Andréa Tommasi, Felipe Sáez-Leiva, Lilou Zeller, Michel Peyret, Riad Hassani, Maurine Montagnat

专题命中 知识编辑与模型理解 :prompting(abstract)

AI总结 该研究针对板块深部韧性应变局部化建模难题,采用流变学随机描述,依局部功率时空演化,利用三个无量纲参数构建状态图,可重现多样响应,预测局部化强度等,为地球动力学板块边界自洽建模提供方法。

Comments 24 pages, 7 figures, 3 tables, article in press in Earth and Planetary Science Letters

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13805 2026-07-17 cs.CV 版本更新 50%

AspectCLIP: Optimizing CLIP Representation Space via Aspect-Guided Consistency Regularization

AspectCLIP:通过方面引导的一致性正则化优化CLIP表示空间

Yiyang Yao, Shanglin Liu, Jianming Lv, Chengjun Wang, Jinyi Li, Yuchan Jie, Zhihua Jin

机构 * School of Computer Science and Technology, South China University of Technology(华南理工大学计算机科学与工程学院)

专题命中 知识编辑与模型理解 :pretraining(abstract)

AI总结 研究针对图像与文本信息不对称问题,提出AspectCLIP框架,通过基于文本相似性划分样本为属性簇,在簇内应用循环一致性并限制跨簇正则化,实现更优的表示空间,在下游任务中性能超传统方法。

Comments PRCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12308 2026-07-16 cs.PL cs.SE 版本更新 50%

Mystra: Declarative Dynamic Taint Analysis via Shadow Virtual Machine

Mystra:通过影子虚拟机进行声明式动态污点分析

Zhuohao Zhang, Junkun Liu, Rui Yang, Yinzhi Cao, Ziyang Li

专题命中 知识编辑与模型理解 :language model(abstract)

AI总结 研究针对解释型语言的动态污点分析问题,核心方法是引入影子虚拟机并设计声明式污点规范语言Mystra,主要贡献是实现工具Shar,在准确性和性能上均有出色表现,如V8实例召回率高且零误报,运行时开销低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25753 2026-07-16 math.NA cs.CE cs.NA stat.CO 版本更新 50%

Quasi-Monte Carlo methods for uncertainty quantification of tumor growth modeled by a parametric semi-linear parabolic reaction-diffusion equation

用于参数半线性抛物型反应扩散方程肿瘤生长不确定性量化的小麦-蒙特卡洛方法

Alexander D. Gilbert, Frances Y. Kuo, Dirk Nuyens, Graham Pash, Ian H. Sloan, Karen E. Willcox

专题命中 知识编辑与模型理解 :prompting(abstract)

AI总结 本文提出利用准蒙特卡洛方法对参数半线性抛物型反应扩散方程建模的肿瘤生长进行不确定性量化,通过理论分析和数值实验验证了其在计算感兴趣量方面的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01452 2026-07-01 cs.CR 版本更新 50%

NetVAD: Foundation-Model Representation Learning for Identifier-Free Unsupervised Intrusion Detection

NetVAD: 用于无标识符无监督入侵检测的基础模型表示学习

Darren Fürst, Patrick Levi, Sebastian Steindl

专题命中 知识编辑与模型理解 :foundation model(abstract)

AI总结 提出NetVAD,一种严格无标识符的变分自编码器,利用冻结的基础模型表示,仅通过良性流量训练,在无监督入侵检测中达到与监督方法竞争的性能。

Comments Accepted at IEEE Intelligent Conference on Intelligence and Security Informatics (ISI)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09930 2026-07-01 cs.CV cs.IR 版本更新 50%

Fine-grained Motion Retrieval via Joint-Angle Motion Images and Token-Patch Late Interaction

基于关节角度运动图像与令牌-补丁后期交互的细粒度运动检索

Yao Zhang, Zhuchenyang Liu, Yanlan He, Thomas Ploetz, Yu Xiao

机构 * Aalto University(阿尔托大学) Fudan University(复旦大学) Georgia Institute of Technology(佐治亚理工学院)

专题命中 知识编辑与模型理解 :language model(abstract)

AI总结 提出一种可解释的关节角度运动表示,结合预训练视觉Transformer和令牌级后期交互机制,实现文本与3D运动之间的细粒度对齐,在HumanML3D和KIT-ML上超越现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11270 2026-07-01 cs.CV 版本更新 50%

Φeat: Physically Grounded Material Feature Representation

Φeat: 物理基础的材料特征表示

Giuseppe Vecchio, Adrien Kaiser, Claudia Cuttano, Rouffet Romain, Rosalie Martin, Elena Garces, Tamy Boubekeur

机构 * Adobe Research, France(Adobe研究院(法国))

专题命中 知识编辑与模型理解 :foundation model(abstract)

AI总结 提出Φeat视觉骨干网络,通过对比同一材料在不同光照和几何下的观测,学习对材料身份敏感的表征,提升材料选择与分类等任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15347 2026-06-26 eess.IV cs.MM 版本更新 50%

Symmetric Entropy-Constrained Video Coding for Machines

面向机器的对称熵约束视频编码

Yuxiao Sun, Meiqin Liu, Chao Yao, Qi Tang, Jian Jin, Weisi Lin, Frederic Dufaux, Yao Zhao

专题命中 知识编辑与模型理解 :foundation model(abstract)

AI总结 提出SEC-VCM框架,通过双向熵约束机制对称对齐视频编解码器与视觉骨干网络,保留语义并丢弃无关信息,结合语义-像素双路径融合提升机器视觉任务性能,在多项任务上显著优于H.266/VVC。

Comments Accepted by IEEE Transactions on Image Processing. This is the author's accepted manuscript (AAM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18020 2026-06-09 cs.CV cs.RO 版本更新 50%

UAOR: Uncertainty-aware Observation Reinjection for Vision-Language-Action Models

UAOR: 面向视觉-语言-动作模型的不确定性感知观测重注入

Jiabing Yang, Yixiang Chen, Yuan Xu, Peiyan Li, Zichen Wen, Bowen Fang, Tao Yu, Xiangnan Wu, Qisen Ma, Kai Wang, Ziheng He, Yingda Li, Zhengbo Zhang, Jing Liu, Nianfeng Liu, Yan Huang, Liang Wang

机构 * School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) New Laboratory of Pattern Recognition (NLPR), Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所模式识别新技术实验室) Shanghai Jiao Tong University(上海交通大学) FiveAges(五代)

专题命中 知识编辑与模型理解 :language model(abstract)

AI总结 提出UAOR模块,通过动作熵检测不确定性,在语言模型高不确定层重注入观测信息,无需额外训练或数据,提升VLA模型在仿真和真实任务中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏