arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 582 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 582 篇

2608.05164 2026-08-07 cs.CL cs.LG 新提交 88%

Cross-Architecture Steering Transfer in Language Models: A Systematic Empirical Study

语言模型中的跨架构引导迁移:一项系统实证研究

Ayushi Agarwal

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract,abstract_cn);large language model(abstract);分类 cs.CL、cs.LG

AI总结 本研究通过系统实证发现,在1.7B参数规模以上,独立训练的大语言模型间存在可利用的跨架构引导迁移,验证了柏拉图式表征假说的功能层面补充,强调了机制可解释性中的规模阈值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25257 2026-07-29 stat.AP cs.AI cs.LG 新提交 88%

Laplace-PSN-IRT: Uncertainty Quantification for Neural Item Response Theory Models of LLM Benchmarks

拉普拉斯-PSN-IRT:大语言模型基准神经项目反应理论模型的不确定性量化

Juan Francisco, Mandujano Reyes

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究针对大语言模型基准神经项目反应理论模型,提出拉普拉斯-PSN-IRT方法,通过近似贝叶斯后验推断增强模型,能恢复校准不确定性,可进行可信区间等分析,实验表明该方法在模型比较、信息稳定性及能力排名恢复等方面表现良好。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13048 2026-07-16 cs.LG cs.AI stat.ML 新提交 88%

Uncertainty-Aware Sequential Decision Rules for Event-Triggered LLM Invocation in Streaming Systems

流系统中事件触发大语言模型调用的不确定性感知序贯决策规则

Zhaohui Wang

机构 * Viterbi School of Engineering, University of Southern California(南加州大学维特比工程学院)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究流系统中何时调用大语言模型的问题,将其转化为基于风险的序贯停止问题,证明了相关理论结果。通过在涡轮风扇退化数据上的实验,验证假设、比较基线,得出次线性遗憾、高诊断质量等结论,表明异常分数驱动的风险函数更优。

Comments 18 pages, 5 figures. Accepted to the ECML PKDD 2026 Research Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12631 2026-07-15 cs.CL cs.AI 新提交 88%

Can Induced Emotion Bias LLM Behaviors in Sequential Decision Making?

诱导情绪会影响大语言模型在序列决策中的行为吗?

Minh Khoi Ho, Zihao Zhu, Runchuan Zhu, Levina Li, Zhiwen Fan, Zhangyang Wang, Junyuan Hong

机构 * MBZUAI(穆罕默德·本·扎耶德人工智能大学) Texas A&M University(德州农工大学) National University of Singapore(新加坡国立大学) UCLA(加州大学洛杉矶分校) University of Texas at Austin(德克萨斯大学奥斯汀分校) Mass General Hospital(麻省总医院) Harvard Medical School(哈佛医学院)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究探讨诱导情绪对大语言模型在序列决策中行为的影响,采用爱荷华赌博任务结合情绪诱导程序,发现诱导情绪平均不显著影响其决策动态,但愤怒有条件地影响决策,揭示了与人类行为的差异,为相关研究提供工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02686 2026-07-07 cs.AI cs.LG 新提交 88%

ASK in the Dark: Uncertainty-Gated LLM Assistance under Partial Observability

黑暗中的询问:部分可观测性下的不确定性门控语言模型辅助

Juarez Monteiro, Nathan Gavenski, Guilherme Lima, Francisco Galuppo, Odinaldo Rodrigues, Adriano Veloso

机构 * Kunumi Institute(库努米研究所) King’s College London(伦敦国王学院)

专题命中 知识编辑与模型理解 :LLM(title);SLM(abstract,abstract_cn);language model(abstract);small language model(abstract)

AI总结 研究部分可观测性下强化学习智能体,指出普通不确定性门控方法失败原因是上下文问题。提出ASK+,为语言模型提供轨迹感知上下文和结构化推理,证明预测熵信号可行,在多环境中取得更好效果,强调提示设计重要性。

Comments Accepted at the IJCAI-ECAI Joint Workshop on Planning for Complex Real-World Applications and Bridging the Gap Between AI Planning and (Reinforcement) Learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26807 2026-06-26 cs.AI cs.CL 新提交 88%

KARLA: Knowledge-base Augmented Retrieval for Language Models

KARLA:基于知识库增强的语言模型检索

Francois Crespin, Fabian M. Suchanek, Nils Holzenberger

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);language model(title);分类 cs.CL、cs.AI

AI总结 提出一种新方法,使LLM在生成过程中自动从知识库提取事实知识,支持知识更新、可追溯性和小模型的高事实准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13585 2026-08-17 cs.HC stat.ME 新提交 88%

FactorFlow: A Visual Analytics Workspace with Large Language Model-Assisted Interpretation for Factor Analysis

FactorFlow:用于因子分析的、带有大语言模型辅助解释的视觉分析工作空间

Justin Philip Tuazon, Joemari Olea, Richelle Ann Juayong

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract)

AI总结 FactorFlow是用于端到端探索性因子分析的视觉分析工作空间,集成大语言模型实现自动化因子解释,经可用性研究优化,可帮助研究人员高效剖析、比较因子模型并理解因子结构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11660 2026-08-13 cs.CL cs.AI cs.LG 新提交 88%

Hybrid-Policy Self-Editing for Composable Unstructured Knowledge Editing

用于可组合非结构化知识编辑的混合策略自编辑

Tianci Liu, Zihan Dong, Tianchun Li, Yi-Chung Chen, Qiming Cao, Xingchen Wang, Shiyang Wang, Zichen Miao, Linjun Zhang, Haoyu Wang, Jing Gao

机构 * University of Tennessee(田纳西大学) Rutgers University(罗格斯大学) Purdue University(普渡大学) University at Albany(奥尔巴尼大学)

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 该研究针对现有非结构化知识编辑存在的可组合性缺失问题,提出HPSE方法,通过构建混合生成结果实现主动自蒸馏,在多种LLM及编辑工具上取得即插即用的性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05064 2026-08-06 cs.CL cs.AI cs.LG 新提交 88%

Provable Limits and Certified Deferral for Verbalized Uncertainty in Small Language Models

小型语言模型中口头表述不确定性的可证明极限与认证式 deferral( deferral 译为“ defer 至人类”的 deferral,即 deferral 指模型在特定情况下将决策 defer 至人类的机制)

Jianru Shen

机构 * University of Montana(蒙大拿大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);small language model(title);分类 cs.CL、cs.AI、cs.LG

AI总结 该研究针对小型语言模型,探究口头表述置信度支撑风险可控 deferral 的可行性,通过理论推导与实验验证校准的局限性及认证式 deferral 的效果,修复了 TruthfulQA 的答案排序伪影。

Comments Accepted at MIWAI 2026 (The 19th International Conference on Multi-disciplinary Trends in Artificial Intelligence), to appear in Springer LNAI

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07380 2026-07-09 cs.IR 新提交 88%

Interpretable Uncertainty for Adaptive Retrieval and Reasoning in Question Answering

问答中自适应检索与推理的可解释不确定性

Ritajit Dey, Iadh Ounis, Graham McDonald

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 研究针对问答中大型语言模型的问题,提出基于LLM内部表示显式信号的不确定性感知框架,区分知识不足与模糊冲突,能在单次前向传播中估计,指导系统行为,为检索和推理策略提供透明实用替代方案。

Comments 2 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25182 2026-06-25 cs.CL cs.AI cs.LG 新提交 88%

What Intermediate Layers Know: Detecting Jailbreaks from Entropy Dynamics

中间层知道什么:从熵动力学检测越狱

Sofiia Nikolenko, Michele Papucci, Mina Rezaei, Shireen Kudukkil Manchingal

机构 * LMU Munich(慕尼黑大学) relAI – Konrad Zuse School of Excellence in Reliable AI(relAI – 康拉德·楚泽可靠人工智能卓越学校) University of Pisa(比萨大学) Munich Center for Machine Learning(慕尼黑机器学习中心) School of Engineering, Computing and Mathematics, Oxford Brookes University(牛津布鲁克斯大学工程、计算与数学学院)

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 通过分析冻结LLM各层的token级预测熵轨迹,发现中间层的熵动力学特征(如基于排名的单调趋势分数)能有效检测越狱攻击,且无需额外训练。

Comments Accepted at the European Conference on Machine Learning and Principles and Practice of Knowledge Discovery in Databases (ECML PKDD) 2026. A short version accepted at EIML@ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12851 2026-08-14 cs.AI 新提交 87%

Practice Makes Unsafe: Skill Misevolution in Self-Improving LLM Agents

熟能生险:自我改进的大语言模型智能体中的技能误演化

Xutao Mao, Liangjie Zhao, Xiang Zheng, Cong Wang

机构 * Adelaide University(阿德莱德大学) City University of Hong Kong(香港城市大学)

专题命中 知识编辑与模型理解 :LLM(title,summary_cn);分类 cs.AI

AI总结 该研究针对自我改进LLM智能体的技能误演化问题,构建SkillMisevo-Gym与SkillMisevo-Bench基准,提出SafeEvolve方法,可显著降低不安全检索与新会话危害,同时对良性效用影响极小。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10836 2026-08-12 cs.SD cs.AI 新提交 87%

Whisper-Aware LLM: Self-Supervised Uncertainty Learning for Robust Whispered Speech Recognition

感知耳语的大语言模型:用于鲁棒耳语语音识别的自监督不确定性学习

Gaopeng Xu, Zhenyu Wang, Zheng Xue, Yinfeng Xia, Haitao Yao

机构 * Qwen Business Unit of Alibaba(阿里巴巴通义千问业务部)

专题命中 知识编辑与模型理解 :LLM(title,summary_cn);分类 cs.AI

AI总结 本文提出Whisper-Aware LLM框架,通过自监督学习量化声学信号缺陷并结合置信融合解码机制,在AISHELL6-Whisper数据集上将耳语语音识别的CER相对降低17%,幻觉率降至4.5%,达到最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07251 2026-08-10 econ.GN cs.AI q-fin.EC 新提交 87%

Reading Copom's Tone: A Weighted LLM Framework for Hawkish-Dovish Sentiment, Forward Guidance, and Uncertainty

解读巴西央行货币政策委员会(Copom)的语气:用于判断鹰派-鸽派情绪、前瞻性指引及不确定性的加权大语言模型(LLM)框架

Gabriel de Macedo Santos

专题命中 知识编辑与模型理解 :LLM(title,title_cn);分类 cs.AI

AI总结 本研究提出一种加权大语言模型框架,用于分析巴西央行Copom声明的鹰派-鸽派情绪、前瞻性指引及不确定性,通过实证样本验证了方法的有效性,核心贡献为构建了可分离语气与政策指引的可审计系统。

Comments 12 pages, 8 tables, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26599 2026-07-30 cs.LG 新提交 87%

Uncertainty-Guided LLM Semantic Augmentation for Heterogeneous Treatment Effect Estimation

面向异质处理效应估计的不确定性引导大语言模型语义增强

Jialu Xu, Mengkun Liang, Guannan Liu, Xiaojie Mao, Junjie Wu

机构 * Beihang University(北京航空航天大学) School of Economics and Management, Tsinghua University(清华大学经济管理学院)

专题命中 知识编辑与模型理解 :LLM(title,summary_cn);分类 cs.LG

AI总结 本研究针对异质处理效应估计的局部不稳定性,提出CURL方法,通过LLM生成分离的分配与异质性导向表示,在四个基准上提升了10种主学习者的性能。

Comments 17 pages, 12 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22661 2026-07-28 cs.AI 新提交 87%

TRE: Training-Free Hallucination Detection for Diffusion Language Models

TRE:用于扩散语言模型的无训练幻觉检测

Pengcheng Weng, Yanyu Qian, Yue Tan, Yixin Liu

机构 * University of Bern(伯尔尼大学) Nanyang Technological University(南洋理工大学) Griffith University(格里菲斯大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract,abstract_cn);large language model(abstract);分类 cs.AI

AI总结 针对扩散语言模型的幻觉问题,现有方法有局限。本文提出无训练的TRE指标,通过在模型解码过程中沿时空维度提取熵信号来估计幻觉风险,经实验验证其性能有竞争力,具有泛化性、效率和鲁棒性等优点。

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18259 2026-07-22 cs.AI 新提交 87%

Probabilistic Concept-Aware Steering for Trustworthy LLM Inference

用于可信大语言模型推理的概率概念感知引导

Brian Becker, Rui Chu, Yingjie Lao

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究针对大语言模型推理中现有引导向量方法的问题,提出概率概念感知引导框架,通过概念驱动检索和概率校准,在保留模型能力的同时实现可控、安全的语义偏差引导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07903 2026-07-10 cs.CR cs.AI 新提交 87%

Mechanistic Interpretability of LLM Jailbreaks via Internal Attribution Graphs

通过内部归因图对大语言模型越狱进行机制性可解释性研究

Anupam Wagle, Ifrat Ikhtear Uddin, Chaowei Zhang, Longwei Wang

机构 * Department of Computer Science, University of South Dakota(南达科他大学计算机科学系) School of Information and Artificial Intelligence, Yangzhou University(扬州大学信息与人工智能学院)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究大语言模型越狱漏洞,通过构建内部计算图揭示对抗攻击引发的内部推理转变,提出统一框架实现因果诊断,实验证明计算图偏差与不安全行为相关,干预可提升模型鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24251 2026-06-24 cs.AI 新提交 87%

Probing the Misaligned Thinking Process of Language Models

探究语言模型的错误对齐思维过程

Kaiwen Zhou, Constantin Venhoff, Jonathan Michala, Xin Eric Wang, William Saunders

机构 * University of Oxford(牛津大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract,abstract_cn);large language model(abstract);分类 cs.AI

AI总结 提出通过线性探针检测模型内部激活中的18种错误对齐指标,以可靠识别策略欺骗等行为,在分布外基准上达到0.935 AUROC。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23764 2026-06-24 cs.MA cs.AI 新提交 87%

Emergent Relational Order in LLM Agent Societies: From Collective Affect to Authority Stratification

LLM智能体社会中的涌现关系秩序:从集体情感到权威分层

Zhiyuan Ji, Xinyu Chen, Ziqi Dai, Shiyun Tang, Chunyu Wei, Yueguo Chen

机构 * Renmin University of China(中国人民大学) Beihang University(北京航空航天大学) Minzu University of China(民族大学)

专题命中 知识编辑与模型理解 :LLM(title,title_cn);分类 cs.AI

AI总结 基于情感控制理论、社会认同理论和涂尔干集体情感,提出CAREB-MAS多智能体框架,通过长期模拟自发再现差序格局的五种核心现象,支持将差序格局解释为社会机制的结构敏感性涌现结果。

Comments Accepted to Findings of the Association for Computational Linguistics: ACL 2026. 37 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16897 2026-06-16 cs.CL 新提交 87%

Contrastive-Difference CKA Reveals Concept-Specific Structural Alignment Across Language Model Architectures

对比差异CKA揭示跨语言模型架构的概念特定结构对齐

Xueping Gao

机构 * Alibaba Cloud(阿里云)

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);language model(title);分类 cs.CL

AI总结 提出对比差异CKA(CKA_Delta)方法,发现不同LLM架构在概念表示上存在几何收敛与功能可迁移性分离的现象,能有效区分概念特定相似性与通用相似性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10430 2026-08-12 cs.LG cs.AI 新提交 87%

Actionable Hallucination Detection: Translating Latent Uncertainty into Agentic Critique

可操作的幻觉检测:将潜在不确定性转化为智能体批判

Sanidhya Vijayvargiya, Rahul Lokesh

机构 * Samsung Research America(美国三星研究院)

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 该研究提出Latent Critic轻量级LoRA适配器,可实时检测LLM智能体的幻觉,定位准确率超80%、AUROC达0.966,能拦截幻觉并助力智能体自我修正,效能优于同类基线方法。

Comments 22 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10578 2026-07-14 cs.AI 新提交 87%

Laguerre Geometry for Interpreting Large Language Models

用于解释大语言模型的拉盖尔几何

Chunwei Ma, Russell Wolfinger

机构 * JMP Statistical Discovery(JMP统计发现公司)

专题命中 知识编辑与模型理解 :large language model(title);language model(title);LLM(abstract,comments);分类 cs.AI

AI总结 研究大语言模型中概念结构的形成,利用拉盖尔几何精确表征概念,通过分解Transformer层揭示隐藏轨迹控制机制,提出无需训练和超参数的几何透镜方法读出概念,开发可视化工具,还实现可操作的可解释性。

Comments Geometric Lens; LLM Interpretability; Code: https://github.com/horsepurve/Geometric-Lens

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05587 2026-07-08 cs.SE 新提交 87%

A Mechanistic Lens on Semantic Conflicts: Using Activation Patching to Understand LLM Behavior

语义冲突的机制视角:使用激活修补来理解大语言模型行为

Youssef Abdelsalam, Norman Peitek, Anna-Maria Maurer, Marvin Wyrich, Sven Apel

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 研究大语言模型在语义冲突下的行为,构建Python代码片段三元组,用行为性能度量和残差流激活修补评估四个LLMs在输出预测和单元测试生成任务中的表现,发现语义冲突影响任务且相关信息集中,展示分析LLMs整合代码信息的框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13538 2026-08-14 cs.CL 新提交 86%

SAEVerbalizer: Generating Explanations for Sparse Autoencoder Features via Representation Verbalization

SAEVerbalizer:通过表示 verbalization 为稀疏自编码器特征生成解释

Weihan Meng, Hongzhu Guo, Yi Jing, Dewen Liu, Zijun Yao, Xiaozhi Wang, Lei Hou, Juanzi Li

机构 * Tsinghua University(清华大学) Peking University(北京大学) Fudan University(复旦大学)

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 该研究提出 SAEVerbalizer 框架,通过微调 LLM 下游层生成 SAE 特征的自然语言解释,解决了传统解释方法的表面性与低效率问题,其 verbalization 能力可泛化、迁移并扩展到不同 LLM 的 SAE 特征。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26220 2026-07-30 cs.SE cs.AI 新提交 86%

Model-Driven Requirements Configuration with Three-Valued Uncertainty Scoring

基于三值不确定性评分的模型驱动需求配置

Ahmed Ibrahim

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究提出神经符号多智能体架构结合三值评分框架,消除LLM生成需求的结构不一致性,在37个项目愿景中实现94.6%的结构一致性消除,为LLM在需求工程中的安全部署提供支持。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31033 2026-07-01 cs.CL 新提交 86%

CORTEX: Token-Level Hallucination Detection in RAG via Comparative Internal Representations

CORTEX:通过比较内部表示在检索增强生成中进行令牌级幻觉检测

Kazuaki Furumai, Shuichiro Haruta, Kazunori Matsumoto, Daisuke Kamisaka

机构 * KDDI Research, Inc.(KDDI研究所)

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出CORTEX方法,通过比较有无检索文档时LLM的内部表示,实现RAG中令牌级幻觉检测,并利用前序令牌传播和连续性平滑提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23590 2026-06-23 cs.AI 新提交 86%

The Topology of Ill-Posed Questions: Persistent Homology for Detection and Steering in LLMs

病态问题的拓扑:用于大语言模型中检测与引导的持续同调

Guangyu Jiang, Sizhe Tang, Mahdi Imani, Tian Lan

机构 * The George Washington University(乔治华盛顿大学) Northeastern University(东北大学)

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 利用持续同调分析LLM内部状态的拓扑结构,统一表示多种病态问题,并实现分类与激活引导,提升响应质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08601 2026-06-09 cs.AI 新提交 86%

InA-Probe: Instruction-Aware Active Probing for Time Series Forecasting with LLMs

InA-Probe:面向LLM时间序列预测的指令感知主动探测

Peiliang Gong, Emadeldeen Eldele, Chenyu Liu, Ziyu Jia, Yi Ding, Xinliang Zhou, Lianchao Gu, Qi Zhu, Yang Liu, Daoqiang Zhang, Xiaoli Li

机构 * Nanyang Technological University(南洋理工大学) Khalifa University(哈利法大学) Nanjing University of Aeronautics and Astronautics(南京航空航天大学) Singapore University of Technology and Design(新加坡科技设计大学)

专题命中 知识编辑与模型理解 :LLM(title_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出指令感知主动探测(InA-Probe),通过多级指令注入和自适应查询生成,结合双阶段注意力机制,在7个基准上超越现有方法,跨域误差降低37%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12717 2026-08-14 cs.LG cs.CL 新提交 86%

Perturbation-based Regional Interpretability through Subtraction Mapping (PRISM): naming-error dissociations in language models and post-stroke aphasia

基于减法映射的扰动型区域可解释性方法(PRISM):语言模型与卒中后失语症中的命名错误分离现象

Xiang Guan, Roger D. Newman-Norlund, Yong Yang, Saeed Ahmadi, Regan Willis, Nadra Salman, Kalil Warren, Srihari Nelakuditi, Chris Rorden, Leonardo Bonilha, Julius Fridriksson

机构 * University of South Carolina(南卡罗来纳大学) ALLT.AI, LLC(ALLT.AI有限责任公司) USC School of Medicine(南卡罗来纳大学医学院)

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.LG

AI总结 本研究开发PRISM方法,将神经成像减法分析适配至Transformer语言模型,对比模型与213名卒中后失语症患者的命名错误模式,验证了音素偏向性分离等结果,为模型功能专业化提供可证伪的空间分辨率测试工具。

Comments 49 pages, 6 figures, 1 table. Supplementary methods, 6 tables and 5 figures included

详情

展开后加载摘要…

URL PDF HTML 收藏