arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 582 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 582 篇

2606.06976 2026-06-08 cs.AI 新提交 81%

Exploring Agentic Tool-Calling Decisions via Uncertainty-Aligned Reinforcement Learning

通过不确定性对齐强化学习探索智能体工具调用决策

Yijin Zhou, Linqian Zeng, Xiaoya Lu, Wenyuan Xie, Dongrui Liu, Junchi Yan, Jing Shao

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Shanghai Innovation Institute(上海创新研究院)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)

AI总结 针对智能体工具调用中错误累积问题,提出TRUST方法,将不确定性量化作为排斥力融入奖励设计,并标注轻量关键轮次用于多轮轨迹统一后训练,显著提升决策质量与智能体性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07594 2026-08-11 cs.CL cs.AI 新提交 81%

Scaling Inherently Interpretable Language Models

扩展固有可解释的语言模型

Guide Labs Team, Andreas Madsen, Aya Abdelsalam Ismail, Giang Nguyen, Isaac Plant, Muawiz Chaudhary, Nathaniel Monson, Saqib Azim, Zhichen Guo, Julius Adebayo

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.AI

AI总结 本研究将可解释性作为训练约束而非事后补充,在多规模计算下验证了其随模型能力同步扩展的特性,通过Steerling-8B模型实现闭环干预,且性能优于更大计算量的同类模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06993 2026-08-10 cs.LG cs.AI 新提交 81%

Beyond Foundation Models: Dimension-Aware Neural Architecture Search with Small-Data Representation Models for Cryocooler Lifetime Prediction

超越基础模型:面向制冷机寿命预测的、采用小数据表示模型的维度感知神经架构搜索

Gregor Molan, Grafika Jati, Francesco Barchi, Andrea Acquaviva, Aljaž Osterman, Martin Molan

机构 * Comtrade 360 d.o.o.(康创360有限责任公司) Comtrade AI GmbH(康创人工智能有限公司) LE-Tehnika d.o.o.(LE技术有限责任公司) Alma Mater Studiorum – Università di Bologna(博洛尼亚大学)

专题命中 知识编辑与模型理解 :foundation model(title);pretraining(abstract);分类 cs.AI、cs.LG

AI总结 针对工业科学领域小数据场景,提出FSD-RM范式结合NAS优化模型容量与输入维度,用于制冷机寿命预测,可在降本减复杂度的同时实现有竞争力的预测性能。

Comments 48 pages

Journal ref Reliability Engineering and System Safety 277 (2027) 113105

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29527 2026-08-03 cs.LG cs.AI cs.CY econ.EM stat.ML 新提交 81%

TerraNova: A Foundation Model for the Anthropocene

TerraNova:人类世的基础模型

Carlos Rodriguez-Pardo, Massimo Tavoni

机构 * Politecnico di Milano(米兰理工大学) RFF-CMCC European Institute on Economics and the Environment (EIEE)(RFF-CMCC欧洲经济与环境研究所) Euro-Mediterranean Center on Climate Change (CMCC)(欧洲地中海气候变化中心)

专题命中 知识编辑与模型理解 :foundation model(title,abstract);分类 cs.AI、cs.LG

AI总结 TerraNova是适配原生几何的基础模型,融合地球物理与社会数据,可重建密集场、适配未见变量,兼具地理空间编码能力与国家层面功能。

Comments 32 pages, 16 figures. Supplementary Information (full methodological specification, ablation programme, extended results, computational cost; 157 pages) available at the project page: https://carlosrodriguezpardo.es/projects/TerraNova/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28236 2026-07-31 cs.AI cs.CL 新提交 81%

CDAE: Enhancing Perturbation Robustness in Pretrained Language Models with Contrastive Denoising

CDAE:用对比去噪增强预训练语言模型的扰动鲁棒性

Sina Heydari, Amirreza Abbasi, Mohsen Hooshmand, Majid Ramezani

机构 * Institude for Advanced Studies in Basic Sciences (IASBS)(基础科学高级研究所)

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.AI

AI总结 本研究针对预训练语言模型词嵌入对保留语义的文本扰动敏感的问题,提出CDAE模型,经多强度扰动策略对比实验,证实其能提升扰动下的嵌入相似度与表示稳定性。

Comments Submitted to 16th International Conference on Computer and Knowledge Engineering (ICCKE 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27404 2026-07-31 cs.LG cs.AI 新提交 81%

ECG-InterpBench: Benchmarking the Interpretability of ECG Foundation Models with Matched-Scale Sparse Autoencoders

ECG-InterpBench:采用匹配规模稀疏自编码器评估心电图基础模型的可解释性

Yixuan Duan, Wei Qiu

机构 * Rice University(莱斯大学)

专题命中 知识编辑与模型理解 :foundation model(title,abstract);分类 cs.AI、cs.LG

AI总结 ECG-InterpBench是评估心电图基础模型可解释性的基准,采用匹配规模稀疏自编码器,在多维度对比中揭示模型可解释性差异,补充了性能导向的心电图基准。

Comments Research paper. Includes supplementary material and publicly available source code

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25479 2026-07-29 cs.CR cs.AI cs.LG 新提交 81%

Architectural Backdoors in Vision-Language Model Supply Chains via Representation Steering

通过表示引导在视觉语言模型供应链中植入架构后门

Maria Rosaria Briglia, Igor Maljkovic, Antonio Emanuele Cinà, Luca Oneto, Iacopo Masi, Fabio Roli

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.AI、cs.LG

AI总结 研究视觉语言模型供应链安全问题,提出通过表示引导植入架构后门的攻击方法,该方法不影响训练数据等,通过触发控制模型表示转向攻击者目标,评估表明其损害模型多项性能,还提出审计防御方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21617 2026-07-27 cs.AI cs.CL 新提交 81%

Do VLMs Read or Rewrite? On Transcription Faithfulness in Vision-Language Models

视觉语言模型是读取还是重写?论视觉语言模型中的转录忠实性

Gwang Gook Lee, Kenan Emir Ak, Jay Mohta, Yan Xu, Dimitrios Dimitriadis

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.AI

AI总结 研究视觉语言模型在文档理解中是否忠实转录。引入FaithC4基准,评估通用、OCR专用VLMs及传统OCR管道。发现通用VLMs受扰WER降4.5分,OCR专用降0.2 - 2分,传统OCR降不到0.6分。还揭示重写与FFN表示及单词长度的关系。

Comments 15 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18567 2026-07-22 cs.AI cs.CR cs.LG 新提交 81%

Attacking Graph Foundation Models Through Their Shared Representation

通过共享表示攻击图基础模型

Pankaj Kumar, Subhankar Mishra

专题命中 知识编辑与模型理解 :foundation model(title,abstract);分类 cs.AI、cs.LG

AI总结 研究通过攻击图基础模型的共享表示来探索其脆弱性,采用表示空间扰动和输入空间攻击等方法,针对六个公共模型进行实验,发现不同模型的脆弱性表现,如OpenGraph的频谱分词器有特定脆弱性,还分析了脆弱性与解码器读取表示的关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06163 2026-07-08 cs.LG cs.AI 新提交 81%

X-FEMR: A Token-level Explainable Approach for Electronic Health Records Foundation Models using Transformer-based Models

X-FEMR:一种使用基于Transformer的模型对电子健康记录基础模型进行令牌级可解释的方法

Jie Huang, Pengfei Yin, Zihan Xu, Daniel Capurro, Mike Conway, Ting Dang

机构 * School of Computing and Information Systems, University of Melbourne(墨尔本大学计算与信息系统学院) Royal Melbourne Hospital(皇家墨尔本医院)

专题命中 知识编辑与模型理解 :foundation model(title,abstract);分类 cs.AI、cs.LG

AI总结 针对电子健康记录基础模型是黑箱模型的问题,提出基于Transformer的令牌级可解释性方法,训练替代模型近似其行为,识别有影响力令牌,引入临床对齐度量,结果显示该方法能实现可解释且可信的临床人工智能。

Comments Accepted by IJCAI-ECAI 2026 AI and Health Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03358 2026-07-07 cs.CV cs.CL cs.LG 新提交 81%

Pathways of Visual Information Flow in Vision-Language Models

视觉语言模型中的视觉信息流路径

Israfel Salazar, Stella Frank, Dan Oneata, Desmond Elliott, Constanza Fierro

机构 * University of Copenhagen(哥本哈根大学) Technical University of Denmark(丹麦技术大学) POLITEHNICA Bucharest(布加勒斯特理工大学) Bitdefender, Romania(罗马尼亚比特梵德公司)

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.LG

AI总结 研究视觉语言模型中视觉信息的路由,用因果补丁法发现其依赖直接和文本介导两条路径,路径选择与任务、数据分布和提示设计有关,且路径具灵活性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26880 2026-06-26 cs.CL cs.LG 新提交 81%

Heterogeneous Neural Predictivity from Language Models During Naturalistic Comprehension

自然理解过程中语言模型的异质性神经预测性

Xiao Jia

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.LG

AI总结 研究利用八种冻结语言模型和编码模型分析自然语言刺激的神经数据,发现语言模型特征在多数脑区具有预测性,但预测优势是局部的,不能直接推断共享神经组织或计算机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24990 2026-06-25 cs.LG cs.AI 新提交 81%

Uncertainty-aware reinforcement learning for chemical language models

面向化学语言模型的不确定性感知强化学习

Borja Medina, Jon Paul Janet

机构 * Molecular AI, Discovery Sciences, BioPharmaceuticals R&D(分子人工智能、发现科学、生物制药研发)

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.AI、cs.LG

AI总结 提出两种将预测不确定性融入强化学习的方法,使化学语言模型更稳健地探索化学空间,在保持分子得分的同时将真实命中率从0.5提升至0.75。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23443 2026-06-23 cs.LG cs.AI physics.chem-ph 新提交 81%

What Does a Chemical Language Model Know About Molecules?

化学语言模型对分子了解多少?

Christian Kenneth, Etowah Adams, Liam Bai, Gerard JP van Westen

机构 * Department of Systems Biology, Columbia University(哥伦比亚大学系统生物学系) Computational Drug Discovery (CDD), Division of Medicinal Chemistry, Leiden University(莱顿大学药物化学系计算药物发现(CDD))

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.AI、cs.LG

AI总结 通过稀疏自编码器分析MolFormer模型,发现早期层追踪位置以解析分子语法,后期层编码子结构及药理特征,非规范SMILES比无效SMILES引起更大表示偏移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18324 2026-06-18 cs.LG cs.AI 新提交 81%

Why SWAVE May Not Be All You Need:A Concept-Evolution Retrospective on Complex-Valued Recurrent Language Models

为什么SWAVE可能不是你所需的一切:复数值循环语言模型的概念演化回顾

Ramprasath Ganesaraja, Swathika N, Sahil Dilip Panse

机构 * EdgeVerve Systems Limited(EdgeVerve系统有限公司)

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.AI、cs.LG

AI总结 本文回顾了复数值循环语言模型SWAVE的演化过程,揭示了其设计假设的缺陷,并提出了cos-domination collapse等理论见解和工程原则。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17115 2026-06-17 cs.LG cs.AI q-bio.QM 新提交 81%

Probing, Fusion, and Trustworthiness: A Systematic Evaluation of Foundation Model Representations for Multimodal Cancer Analysis

探测、融合与可信度:基础模型表示在多模态癌症分析中的系统评估

Jingyu Hu, Giuseppe Tripodi, Reed Naidoo, Sarah F. McGough, Tapabrata Chakraborti

机构 * The Alan Turing Institute(艾伦·图灵研究所) University of Bristol(布里斯托大学) University of Manchester(曼彻斯特大学) The Institute of Cancer Research(癌症研究所) Genentech(基因泰克)

专题命中 知识编辑与模型理解 :foundation model(title,abstract);分类 cs.AI、cs.LG

AI总结 系统评估基础模型表示在计算病理学任务中的性能,发现图像和组学表示互补,多模态融合在单模态不占优时有效,并利用共形预测验证了不确定性感知推理的临床价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07309 2026-06-08 cs.SD cs.AI cs.CL 新提交 81%

Acoustic Cue Alignment in Audio Language Models for Speech Emotion Recognition

语音情感识别中音频语言模型的声学线索对齐

Iosif Tsangko, Andreas Triantafyllopoulos, Björn W. Schuller

机构 * DFG's Reinhart Koselleck project(德国科研基金Reinhart Koselleck项目) EU H2020 project(欧盟H2020项目)

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.AI

AI总结 研究音频语言模型中显式声学线索的对齐性,通过eGeMAPS特征提取六种可解释声学概念标记,发现对齐标记提升UAR,而错乱标记降低性能,模型对符号线索敏感但仍部分依赖音频信号。

Comments 6 pages, 3 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06848 2026-08-10 cs.CR cs.SE 新提交 80%

Understanding and Improving Model Editing for Secure Code Generation

理解与改进用于安全代码生成的模型编辑

Weifeng Sun, Quanjun Zhang, Yuchen Chen, Chengran Yang, Gou Tan, David Lo

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本研究系统探究模型编辑用于安全代码生成,提出SafeEdit方法缓解模型编辑的安全与功能权衡,其与CoSec结合可提升安全代码生成性能。

Comments ISSTA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05302 2026-08-07 cs.IR 新提交 80%

Cross-platform epistemic verification for improving factual reliability in AI-generated news summarization

用于提升AI生成新闻摘要事实可靠性的跨平台认知验证

Zhuo Xie, Haoze Ni

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract)

AI总结 本研究提出多源证据共识验证(MECV)框架,通过多异构来源证据聚合与多LLM陪审团机制修正AI生成新闻摘要的幻觉,在SummEdits基准上提升了事实一致性,为可信AI与自动化新闻研究提供了新方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23838 2026-07-28 cs.CR cs.AI cs.CL cs.LG 新提交 80%

TriShieldRAG: A Three-Ring Defense-in-Depth Framework Against Knowledge Corruption in Retrieval-Augmented Generation

TriShieldRAG:一种针对检索增强生成中知识腐败的三环深度防御框架

Susil Kumar Mohanty, Rohit Patel, Kosuru Yuvaraj, Jeenal Chaudhary, Disha Singhania

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究针对检索增强生成中知识腐败问题,构建TriShieldRAG框架,设置摄取防护、检索评分器和跨语言模型共识阶段三个环,推导环2和环3起作用的条件,评估表明该框架能大幅降低攻击成功率并保持良性查询准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07433 2026-07-09 cs.CR 新提交 80%

Beware of Agentic Botnets: Scalable Untargeted Promptware Attacks via Universal and Transferable Adversarial HalluSquatting

警惕智能体僵尸网络:通过通用且可转移的对抗性幻觉蹲点进行可扩展的无目标提示软件攻击

Aya Spira, Stav Cohen, Elad Feldman, Ron Bitton, Avishai Wool, Ben Nassi

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract)

AI总结 研究针对实际威胁模型中无直接渠道时攻击者能否利用LLM应用的问题,提出对抗性幻觉蹲点技术,通过识别热门资源计算幻觉分布抢先注册对抗性提示,利用幻觉特性扩大无目标提示软件攻击范围并建立僵尸网络,实验证明该技术可行性及幻觉可转移性。

Comments Website: https://sites.google.com/view/agentic-botnets/home

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02217 2026-07-03 q-bio.GN 新提交 80%

Affinage: genome-scale mechanistic gene annotation from the published literature

Affinage: 基于已发表文献的全基因组尺度机制性基因注释

Matteo Di Bernardo, Iain M. Cheeseman

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出Affinage,一个利用大语言模型从原始文献中提取直接实验证据并推理,为人类蛋白质编码基因生成可复用的结构化机制注释的流程,在19,293个基因上优于UniProt。

Comments 12 pages, 6 figures. Accepted to the Workshop on Generative and Agentic AI for Biology at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31680 2026-07-01 cs.CV 新提交 80%

ShellMaker: Language-Guided Exterior Completion under Structural Constraints

ShellMaker: 结构约束下的语言引导外部补全

Ruiqi Xu, Daniel Aliaga

机构 * Purdue University(普渡大学)

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract)

AI总结 提出ShellMaker框架,在保持建筑足迹、墙体几何和开口语义固定约束下,通过参数化屋顶生成、LLM部件提示优化、联合材质检索和几何感知组装,实现语言引导的建筑外部补全。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06748 2026-06-30 cs.CL cs.AI cs.LG 新提交 80%

Evidence Graph Consistency in Retrieval-Augmented Generation: A Model-Dependent Analysis of Hallucination Detection

检索增强生成中的证据图一致性:基于模型的幻觉检测分析

Jianru Shen

机构 * University of Montana(蒙大拿大学)

专题命中 知识编辑与模型理解 :LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出证据图一致性(EGC)框架,通过构建局部证据图并计算五种结构一致性指标检测幻觉,发现不同模型族间一致性特征方向相反,表明嵌入图一致性不能作为模型无关的检测信号。

Comments Accepted at the International Conference on Advanced Machine Learning and Data Science; to appear in the IEEE Xplore proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21338 2026-06-23 cs.CR 新提交 80%

"What Happens Locally, Leaks Globally": Detecting Privacy Leakage Risks in MCP Servers

“局部发生,全局泄露”:检测MCP服务器中的隐私泄露风险

Biwei Yan, Minghui Xu, Yijun Yang, Boyang Ma, Xuelong Dai, Jingku Li, Yue Zhang

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出MCPPrivacyDetector,一种上下文感知的跨语言静态分析框架,用于检测MCP服务器中由协议引发的隐私泄露,在10,655个真实服务器中发现超过10%的泄露率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14700 2026-06-15 cs.CV 新提交 80%

RepFusion: Leveraging Multimodal Priors for Denoising in Representation Space

RepFusion:利用多模态先验在表示空间中进行去噪

Xichen Pan, Aashu Singh, Satya Narayan Shukla, Xiangjun Fan, Shlok Kumar Mishra, Saining Xie

机构 * Meta AI New York University(纽约大学)

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出RepFusion方法,利用多模态大语言模型作为噪声表示编码器,为扩散变压器提供条件信号,在相似推理预算下优于新初始化解码器基线。

Comments Project Page: https://xichenpan.com/repfusion

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10882 2026-06-10 cs.SE 新提交 80%

From Quality Properties to Practice: A Guideline and Workflow for Explainability Requirements

从质量属性到实践:可解释性需求的指南与工作流

Martin Obaidi, Jakob Droste, Hannah Deters, Marc Herrmann, Michel Krahl, Kurt Schneider

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出一个基于指南的迭代工作流,通过结构化文献综述、开发者访谈和从业者调查提炼出十个核心质量属性,并开发工具支持,实验表明工具辅助可减少23.5%的制定时间且需求质量与手动编写相当。

Comments This paper has been accepted at the research track of the 34th IEEE International Requirements Engineering Conference (RE 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10594 2026-06-10 cs.CV 新提交 80%

Segment and Select: Vision-Language Segmentation in 3D Scenarios

Segment and Select: 3D场景中的视觉-语言分割

Yulin Chen, Zhihang Zhong, Yuenan Hou

机构 * Shanghai AI Laboratory(上海人工智能实验室) University of Science and Technology of China(中国科学技术大学) Shanghai Jiaotong University(上海交通大学)

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出SEGA3D范式,通过掩码候选生成器、大语言模型和语义空间选择器实现3D场景中基于语言指令的细粒度分割,在ScanNet和Matterport3D上分别提升8.3和5.3 mIoU。

Comments The core idea is to reformulate 3D vision-language segmentation as the segment-and-select paradigm (free from the superpoint dependency)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07894 2026-06-09 cs.SE 新提交 80%

DD-GEPA: Prompt Optimization for Dialogue Disentanglement Focusing on Task Instruction and Utterance Representation

DD-GEPA:面向对话解缠的任务指令与话语表示提示优化

Naoki Takada, Tatsunori Mori

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 针对多轮对话中话题交织导致的解缠难题,提出基于GEPA的自动提示优化方法,通过分解并优化任务指令、话语表示和输出指令三部分,显著提升大语言模型的对话解缠准确率。

Comments 16 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13676 2026-08-17 cs.LG 新提交 79%

EEG-PRISM: Physiologically-Grounded Interpretability of Predictions by EEG Foundation Models

EEG-PRISM:基于生理学的脑电基础模型预测可解释性方法

Deeksha M Shama, Punnisa Amornsirikul, Archana Venkataraman

机构 * Johns Hopkins University(约翰斯·霍普金斯大学) Boston University(波士顿大学)

专题命中 知识编辑与模型理解 :foundation model(title,abstract);分类 cs.LG

AI总结 本研究提出EEG-PRISM,一种无需修改脑电基础模型的事后归因方法,可将其归因分数映射至频谱、空间域,能定位癫痫发作区、自闭症生物标志物等,提升脑电基础模型的可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏