arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 582 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 582 篇

2606.17417 2026-06-17 cs.SD cs.LG 新提交 79%

A Closer Look at Failure Modes in Temporal Understanding of Large Audio-Language Models

大型音频语言模型时间理解失败模式的深入分析

Apoorva Kulkarni, Kaousheik Jayakumar, Sreyan Ghosh, Sarah Wiegreffe, Dinesh Manocha, Ramani Duraiswami

机构 * University of Maryland, College Park(马里兰大学帕克分校)

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.LG

AI总结 本文通过行为与因果机制分析,揭示大型音频语言模型在时间推理中因模态不平衡而失败,并提出注意力重分配方法提升准确率。

Comments Accepted to Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16044 2026-06-16 cs.LG q-bio.QM 新提交 79%

Circuit Tracing in Autoregressive Protein Language Models

自回归蛋白质语言模型中的电路追踪

Darin Tsui, William Deinzer, Daniel Saeedi, Amirali Aghazadeh

机构 * Stanford University(斯坦福大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.LG

AI总结 提出ProGenMech框架,通过跨层稀疏编码器忠实恢复ProGen3的生成计算,并零样本发现与蛋白质生成和适应性预测相关的稀疏电路,揭示生物意义基序。

Comments Accepted into the Mechanistic Interpretability Workshop at ICML 2026. 24 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14373 2026-06-15 hep-ex cs.LG hep-ph physics.data-an physics.ins-det 新提交 79%

Machine-learned particle flow as a foundation model for collider physics

机器学习粒子流作为对撞机物理学的基础模型

Farouk Mokhtar, Joosep Pata, Michael Kagan, Javier Duarte

机构 * University of California San Diego(加州大学圣地亚哥分校) National Institute of Chemical Physics and Biophysics(化学物理与生物物理国家研究所) SLAC National Accelerator Laboratory(斯坦福线性加速器中心国家加速器实验室)

专题命中 知识编辑与模型理解 :foundation model(title,abstract);分类 cs.LG

AI总结 将事件重建视为机器学习问题,利用MLPF模型学习到的潜在表示,在喷注味识别、喷注能量回归和缺失动量回归三项分析任务上显著提升性能,且单线性层即可媲美先进架构,参数减少约35倍。

Comments 15 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08394 2026-06-09 cs.CL 新提交 79%

When Correct Decisions Hide Internal Stress: Decision-State Probing in Multimodal Language Models

当正确决策隐藏内部压力:多模态语言模型中的决策状态探测

Haoran Zhao, Soyeon Caren Han, Eduard Hovy

机构 * The University of Melbourne(墨尔本大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL

AI总结 提出S³E框架,通过正锚定A/B强制选择任务和隐藏状态分析,发现多模态语言模型在正确行为下仍存在语义压力导致的决策状态位移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07861 2026-06-09 cs.CV cs.AI 新提交 79%

The Last Visible Pixel: Probing Fine-Scale Perception in Vision-Language Models

最后一个可见像素:探究视觉-语言模型中的精细尺度感知

Lujun Li, Lama Sleem, Niccolo Gentile, Yangjie Xu, Yewei Song, Wenbo Wu, Radu State

机构 * University of Luxembourg(卢森堡大学) Foyer S.A. Université Paris-Saclay(巴黎-萨克雷大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.AI

AI总结 提出FineSightBench基准,通过4-48像素尺度分离感知与推理任务,发现视觉-语言模型感知在12像素饱和,推理在更大尺度仍受限,揭示精细视觉推理的根本缺陷。

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07771 2026-06-09 astro-ph.IM astro-ph.GA cs.AI 新提交 79%

Beyond Point Estimates: Benchmarking Uncertainty Quantification Methods on the AION-1 Astronomical Foundation Model

超越点估计:在AION-1天文基础模型上基准测试不确定性量化方法

Karla Tame-Narvaez, Aleksandra Ćiprijanović, Shubhendu Trivedi

机构 * Scientific Computing Division Fermi National Accelerator Laboratory(费米国家加速器实验室科学计算部) Fermi National Accelerator Laboratory(费米国家加速器实验室) Department of Astronomy and Astrophysics University of Chicago(芝加哥大学天文学与天体物理学系) NSF and Simons SkAI Institute(国家科学基金会与Simons SkAI研究所) Google DeepMind(谷歌DeepMind)

专题命中 知识编辑与模型理解 :foundation model(title,abstract);分类 cs.AI

AI总结 本文在AION-1基础模型嵌入上比较七种不确定性量化方法,发现共形预测(尤其是LVD框架)在星系属性回归中提供可靠的边际和局部覆盖,优于非共形基线。

Comments 7 pages, 1 table, 1 figure

Journal ref Contribution to Conference on Physics and AI at Stanford University (PAI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07531 2026-08-11 cs.CL cs.AI 新提交 79%

Search-G1: Grounded Search Agents via Representation-Based Intrinsic Rewards

Search-G1:基于表征内在奖励的接地搜索智能体

Cheng Ruoxi, Ma Haoxuan, Zhang Hongyi, Zhang Junming, Duan Ranjie, Xia Qiaolin, Wang Hao, Lu Yu, Shi Haibo, Ma Xingjun

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);language agent(abstract);分类 cs.CL、cs.AI

AI总结 该研究提出Search-G1框架,通过两个经干预校准的读数构成的表征内在奖励,改善了搜索增强语言智能体的接地性与搜索成本的权衡,在多基准和模型规模上验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17883 2026-07-21 cs.CL cs.AI 新提交 79%

Zero Hallucination, by Construction: Hallucination-Aware Layered Oversight for Trustworthy Enterprise AI

通过构建实现零幻觉:用于可信企业人工智能的幻觉感知分层监督

Bogdan Raduta, Horia Velicu, Alexandru Preda, Serban Chiricescu

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究企业AI因幻觉难以被信任的问题时,提出HALO架构,通过六层防御将幻觉视为可控制故障模式,详细介绍各层并关注基于证据的置信度,以实现可信企业AI,在索赔提取工作负载上进行了架构说明。

Comments 12 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16262 2026-07-21 cs.LG cs.AI 新提交 79%

Autonomous mechanistic discovery of colorectal cancer vulnerabilities via multi-scale AI swarms

通过多尺度人工智能群体自主进行结直肠癌脆弱性的机制发现

Christopher Baker, Tianyu Ren, Karen Rafferty, Hui Wang, Simon McDade

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究旨在解决自动化科学发现中语言模型与生物物理的认知差距。通过多尺度自主发现引擎Octopus,结合大语言模型群体和算法物理引擎,针对结直肠癌转录组进行无监督扫描,发现IGF2是5-氟尿嘧啶耐药脆弱性,建立了可验证的生物医学发现范式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09706 2026-07-14 cs.AI cs.GT cs.LG 新提交 79%

YUKTI: From Natural-Language Situations to Robust, Verifiable Decisions An Uncertainty-Typed Proposition IR, Assumption-Robust Pareto Frontiers, and a Regret Certificate

YUKTI:从自然语言情境到稳健、可验证的决策——一种不确定性类型的命题IR、假设稳健帕累托前沿和遗憾证书

Suyash Mishra

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究从自然语言情境生成稳健决策,核心方法是用类型命题图表示,经多求解器及分布帕累托交接耦合,并引入ARPF等。主要贡献是证明rho与决策遗憾关系,增加可追溯性,合成数据基础,通过多种验证方式展示方法有效性。

Comments 19 Pages , 21 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03325 2026-07-07 cs.CL cs.AI cs.IR 新提交 79%

From Judgments to Issues: Structured Extraction of Legal Reasoning with Citation-Hallucination Control

从判决到问题:具有引用幻觉控制的法律推理结构化提取

Giovanni Piccioli, Alessia Fidelangeli, Piera Santin, Pierpaolo Vivo

机构 * Quantitative and Digital Law Laboratory(量化与数字法律实验室) CIRSFID - Alma AI, Faculty of Law University of Bologna(CIRSFID - 阿尔玛AI,博洛尼亚大学法学院) Robert Schuman Centre European University Institute(罗伯特·施曼中心欧洲大学研究所)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 提出自动化流程,将意大利税务法庭判决分解为法律问题,基于IRAC框架和法律三段论提取结构化XML表示,用通用模型并结合幻觉检测过滤器处理大量判决,经专家验证,为下游应用提供起点。

Comments 33 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23989 2026-07-02 cs.CL cs.AI 新提交 79%

Faithful by Construction: Claim-Anchored Attribution for Multi-Document Summarization

通过构造忠实:面向多文档摘要的基于主张的归因

Shuo Guan

机构 * UBS AG(瑞银集团)

专题命中 知识编辑与模型理解 :LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 提出CAMS框架,通过提取原子主张、聚类、选择并重写为摘要,实现细粒度、多源可追溯的归因,显著提升忠实度和引用精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22686 2026-07-01 cs.CR cs.AI cs.LG 新提交 79%

The Geometry of Refusal: Linear Instability in Safety-Aligned LLMs

拒绝的几何:安全对齐大语言模型中的线性不稳定性

Shivam Ratnakar, Kartikeya Vats

机构 * University of Southern California(南加州大学) Independent Researcher(独立研究员)

专题命中 知识编辑与模型理解 :LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究通过对比安全与不安全系统提示的隐藏状态,提出对比逻辑操控(CLS)框架,揭示安全对齐的线性脆弱性,并证明逻辑级干预比隐藏状态方法更有效,同时可实现双向控制。

Comments Accepted at TrustNLP 2026 (Sixth Workshop on Trustworthy Natural Language Processing, ACL 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23276 2026-06-25 cs.LG cs.AI cs.CR 新提交 79%

Exposing the Illusion of Erasure in Knowledge Editing for LLMs

揭露大语言模型知识编辑中的擦除幻象

Advik Raj Basani, Anshuman Chhabra

机构 * Birla Institute of Technology and Science, Goa(比拉理工学院与科学学院,果阿校区) University of South Florida(南佛罗里达大学)

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);prompting(abstract);分类 cs.AI、cs.LG

AI总结 本文从对抗性诱发角度揭示知识编辑并未真正擦除旧知识,而是将其重新分布并抑制表达,且易受间接提示和对抗攻击,证明知识编辑算法本质上可被绕过。

Comments Preprint, 26 pages + 22 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11474 2026-08-13 cs.CV 新提交 78%

Test-Time Hallucination Control in Large Vision-Language Models

大型视觉语言模型的测试时幻觉控制

Mehran Tamjidi, Hamidreza Dastmalchi, Ali Cheraghian, Mohammadreza Alimoradijazi, Aijun An, Hossein Rahmani

机构 * Australian National University(澳大利亚国立大学) The University of New South Wales(新南威尔士大学) University of Technology Sydney(悉尼科技大学) York University(约克大学) Lancaster University(兰卡斯特大学)

专题命中 知识编辑与模型理解 :language model(title,abstract)

AI总结 针对大型视觉语言模型的物体幻觉问题,提出无训练的测试时幻觉缓解(TTH)方法,通过令牌验证器模块等技术提升模型准确性与稳健性,通用性和实用性良好。

Comments Accepted at ECCV 2026 MUCG

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11024 2026-08-12 cs.CV 新提交 78%

When Visual Signals Mislead: A Mechanistic Study of Attribute Hallucination in Vision-Language Models

当视觉信号产生误导:视觉语言模型中属性幻觉的机制研究

Yufei Zhang, Chenlu Zhan, Hongwei Wang

机构 * Zhejiang University(浙江大学)

专题命中 知识编辑与模型理解 :language model(title,abstract)

AI总结 针对视觉语言模型的属性幻觉问题,提出VISOR框架,通过VSNR诊断区分失败模式并路由适配操作,在三类模型上减少属性假阳性且不依赖先验主导假设。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09427 2026-08-11 cs.CV 新提交 78%

Foundation Models are Implicit Deepfake Detectors

基础模型是隐式深度伪造检测器

Stefan Smeu, Dragos-Alexandru Boldisor, Elisabeta Oneata, Dan Oneata

机构 * AAAI Press(AAAI出版社)

专题命中 知识编辑与模型理解 :foundation model(title,abstract)

AI总结 该研究发现基础模型的特征幅度可区分真实与伪造媒体,将深度伪造检测建模为异常检测,简单统计指标即可达到竞争性能,且模型规模越大判别信号越强。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05945 2026-08-07 cs.CV 新提交 78%

Respect Your Zero-Shot Uncertainty: Conservative Calibration for Test-Time-Adapted Vision-Language Models

重视零样本不确定性:面向测试时自适应视觉-语言模型的保守校准

Jingyan Jiang, Yaru Sun, Xiao Chen, Jiazhen Huang, Caiting Li, Zhijian He, Yin Chen, Pingting Hao

专题命中 知识编辑与模型理解 :language model(title,abstract)

AI总结 针对测试时自适应(TTA)视觉-语言模型校准度下降的问题,提出零样本锚定熵校准(ZAEC)方法,通过最小温度缩放恢复锐化预测的零样本熵,在多模型多数据集上实现了更低的期望校准误差(ECE)。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05578 2026-08-07 cs.CR 新提交 78%

Detecting Safety Training Modification in Language Models via Activation Analysis

通过激活分析检测语言模型中的安全训练修改

Glen Messenger

专题命中 知识编辑与模型理解 :language model(title,abstract)

AI总结 本研究提出AMS工具,通过激活空间几何结构检测语言模型的安全训练修改,在14种模型配置上验证了其有效性,可区分四类安全训练修改中的前三者。

Journal ref IEEE Access, vol. 14, pp. 91723-91737, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29370 2026-08-03 cs.CV 新提交 78%

VFAD: Variational Semantic Prompting Meets Frequency-Adaptive Representation Learning for Zero-Shot Anomaly Detection

VFAD:变分语义提示与频率自适应表示学习结合的零样本异常检测

Peng Chen, Kaige Li, Wei Wang, Mingbo Yang, Wenqiang Wang, Li Shen, Fangjun Huang, Chao Huang

专题命中 知识编辑与模型理解 :prompting(title,abstract)

AI总结 该研究提出VFAD框架,结合变分语义提示与频率自适应表示学习,在13个工业和医学基准上,其零样本异常检测性能优于现有最先进方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29200 2026-08-03 cs.CV 新提交 78%

UltraSAM3: A Concept-Driven Foundation Model for Universal Ultrasound Image Segmentation

UltraSAM3:一种用于通用超声图像分割的概念驱动基础模型

Bo Xu, Quanhao Zhu, Rui Lin, Boling Zhu, Chenyuan Wang, Hongfei Lin, Feng Xia, Chenhua Ji

机构 * Dalian University of Technology Affiliated Center Hospital(大连大学附属中心医院)

专题命中 知识编辑与模型理解 :foundation model(title,abstract)

AI总结 针对现有超声分割方法的任务局限或需专家视觉提示问题,提出概念驱动的UltraSAM3模型及指令引导智能体,在多基准测试中性能优于同类模型,提升了临床交互的实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23169 2026-07-28 cs.SE 新提交 78%

Bifrost: Empowering Pretrained Language Model with Fallibility Representation for Log-Based Fault Diagnosis

Bifrost:利用基于日志的故障诊断的可错性表示赋能预训练语言模型

Minghua He, Tong Jia, Lingzhe Zhang, Chiming Duan, Xinlong Zhao, Leyi Pan, Cheng Wang, Kangjin Wang, Yinghao Yu, Liping Zhang, Yifan Wu, Ying Li

专题命中 知识编辑与模型理解 :language model(title,abstract)

AI总结 研究基于日志的故障诊断问题,提出Bifrost方法,借鉴站点可靠性工程师经验,基于自监督对比学习设计策略学习日志可错性表示,在多个系统中其生成的日志表示在故障诊断相关指标上优于现有PLMs。

Comments Accepted by ASE 2026 (Research Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23054 2026-07-28 cs.LG cs.AI cs.CL 新提交 78%

Through the Bottleneck: How Multi-head Latent Attention Separates Content from Position in Language Models

穿越瓶颈:多头潜在注意力如何在语言模型中分离内容与位置

Dhruvil S, Fenil Sojitra, Ravirajsinh Chauhan

机构 * Indian Institute of Technology Madras(印度理工学院马德拉斯分校) P P Savani University(P P萨瓦尼大学)

专题命中 知识编辑与模型理解 :language model(title);分类 cs.CL、cs.AI、cs.LG

AI总结 研究多头潜在注意力(MLA)在语言模型中如何分离内容与位置。通过训练特定Transformer并运用多种分析方法,发现其瓶颈能保留内容丢弃位置信息,归纳头集中在单层,有“语义中心”层,且瓶颈容量供应过剩,重塑了模型相关结构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20202 2026-07-23 eess.SP 新提交 78%

JEPA-CFM: A Joint Embedding Predictive Architecture-based Channel Foundation Model for Robust Fluid Antenna Systems

JEPA-CFM:一种基于联合嵌入预测架构的稳健流体天线系统信道基础模型

Yuan Gao, Yiming Liu, Jun Jiang, Jianbo Du, Shunqing Zhang, Xiaoli Chu, Kai-Kit Wong

专题命中 知识编辑与模型理解 :foundation model(title,abstract)

AI总结 针对流体天线系统获取信道信息及定位的障碍,提出基于联合嵌入预测架构的信道基础模型,通过提取潜在嵌入学习通用表示,结合互补损失项训练,经仿真验证其在信道外推和无线定位上优于传统基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19977 2026-07-23 physics.chem-ph physics.atm-clus physics.comp-ph 新提交 78%

Rem3Di: Learning smooth, chiral 3D molecular descriptors from atomistic foundation models

Rem3Di:从原子基础模型学习平滑、手性3D分子描述符

Steffen Wedig, Felix Burton, Rokas Elijošius, Christoph Schran, Lars L. Schaaf

专题命中 知识编辑与模型理解 :foundation model(title,abstract)

AI总结 Rem3Di是一种表征学习框架,利用原子基础模型潜在特征生成可转移分子描述符,用于性质预测和虚拟筛选。它能捕捉分子手性,在药物性质基准测试中表现出色,还能区分过渡金属配合物,为化学机器学习提供新途径。

Comments An earlier version of this work appeared at the NeurIPS 2025 Workshop on Symmetry and Geometry in Neural Representations (NeurReps). Workshop version: https://openreview.net/forum?id=jOmZsvXoK5

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19120 2026-07-22 cs.CV 新提交 78%

Latent Riemannian Flow Matching for Geometry-Grounded 3D Foundation Models

用于几何基础3D基础模型的潜在黎曼流匹配

Lisa Weijler, Irene Ballester, Guofeng Mei, Tolga Birdal, Pedro Hermosilla

机构 * TU Wien(维也纳工业大学) Fondazione Bruno Kessler(布鲁诺·凯斯勒基金会) Imperial College London(伦敦帝国理工学院)

专题命中 知识编辑与模型理解 :foundation model(title,abstract)

AI总结 研究如何弥合几何基础模型与3D场景生成模型的范式差异,通过在VGGT潜在空间进行黎曼流匹配,利用其3D先验,不依赖明确下游表示,在多个数据集上取得良好性能,确立该方法为3D生成的可行范式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14088 2026-07-16 cs.CV 新提交 78%

VideoRAE: Taming Video Foundation Models for Generative Modeling via Representation Autoencoders

VideoRAE:通过表示自动编码器驯服用于生成建模的视频基础模型

Zhihao Xie, Junfeng Wu, Xinting Hu, Junchao Huang, Li Jiang

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Huazhong University of Science and Technology(华中科技大学) Shenzhen Loop Area Institute(深圳河套学院) University of Science and Technology of China(中国科学技术大学)

专题命中 知识编辑与模型理解 :foundation model(title,abstract)

AI总结 研究视频生成模型潜在空间问题,提出VideoRAE,利用冻结视频基础编码器特征经1D自注意力投影仪压缩,支持多种潜在空间,通过多码本高维量化等实现强大重建,收敛快,验证了冻结VFM表示的有效性。

Comments Home page: https://zhxie0117.github.io/VideoRAE

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12507 2026-07-15 cs.CR 新提交 78%

When Binaries Talk Back: Representation-Confusion Attacks on LLM-Assisted Reverse Engineering

当二进制文件进行反击:对大语言模型辅助逆向工程的表示混淆攻击

Igor Santos-Grueiro

专题命中 知识编辑与模型理解 :LLM(title,abstract)

AI总结 研究大语言模型辅助逆向工程中的表示混淆攻击,通过RARE-Bench衡量,测试RARE-Guard控制,发现无运行时控制时模型有不安全提议,工具授权、支持门和来源门在处理虚假声明上表现不同,二进制派生内容可指导分析且多工具视图不一定提供独立证据。

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26287 2026-06-26 cs.CV 新提交 78%

GeMoE: Gating Entropy is All You Need for Uncertainty-aware Adaptive Routing in MoE-based Large Vision-Language Models

GeMoE:基于门控熵的MoE大视觉语言模型中不确定性感知自适应路由

Chaoxiang Cai, Minghe Weng, Jie Li, Yibo Jiang, Longrong Yang, Zequn Qin, Xi Li

机构 * School of Software Technology, Zhejiang University(浙江大学软件学院) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院)

专题命中 知识编辑与模型理解 :language model(title,abstract)

AI总结 针对MoE架构中静态路由无法自适应选择专家的问题,提出基于门控熵的不确定性感知自适应路由方法GeMoE,通过最小描述长度原理建模复杂度与性能的权衡,在保持99.5%性能的同时提升36.5%专家激活稀疏性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20479 2026-06-19 cs.RO 新提交 78%

GroundControl: Anticipating Navigation Failures in Vision-Language Agents via Trajectory-Consistent Uncertainty Estimates

GroundControl: 通过轨迹一致的不确定性估计预测视觉语言智能体中的导航失败

Nastaran Darabi, Divake Kumar, Sina Tayebati, Devashri Naik, Amit Ranjan Trivedi

机构 * University of Illinois at Chicago (UIC)(伊利诺伊大学芝加哥分校)

专题命中 知识编辑与模型理解 :language agent(title,abstract)

AI总结 提出轨迹一致的不确定性估计方法GroundControl,通过卡尔曼滤波建模距离变化并结合轨迹特征,有效预测导航失败,在选择性风险-覆盖评估中优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏