arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7505 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7505 篇

2504.12585 2025-04-18 cs.CL cs.AI cs.LG 91%

Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models

Liyi Zhang, Veniamin Veselovsky, R. Thomas McCoy, Thomas L. Griffiths

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments 16 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11233 2024-12-11 cs.LG cs.AI cs.CL 91%

Probing the Decision Boundaries of In-context Learning in Large Language Models

Siyan Zhao, Tung Nguyen, Aditya Grover

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);pretraining(abstract);prompting(abstract)

Comments Accepted at NeurIPS 2024, code at https://github.com/siyan-zhao/ICL_decision_boundary

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21048 2026-06-23 cs.CL 新提交 91%

Event Ontology Expansion via LLM-Based Conceptualization

基于LLM概念化的事件本体扩展

Weicheng Ren, Zixuan Li, Long Bai, Xiaolong Jin, Jiafeng Guo, Xueqi Cheng

机构 * State Key Laboratory of AI Safety(人工智能安全国家重点实验室) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) School of Computer Science and Technology, University of Chinese Academy of Sciences(中国科学院大学计算机科学与技术学院)

专题命中 知识编辑与模型理解 :LLM(title,title_cn);prompting(abstract);分类 cs.CL

AI总结 提出ConceptE框架,利用LLM从句子和触发词中提取概念级语义,增强事件聚类和层次扩展,在ACE、ERE和MAVEN上显著优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24919 2026-05-26 cs.CL 91%

MultiHaluDet: Multilingual Hallucination Detection via LLM Hidden State Probing

MultiHaluDet: 通过LLM隐藏状态探测实现多语言幻觉检测

Riasad Alvi, Nurul Labib Sayeedi, Md. Faiyaz Abdullah Sayeedi

机构 * United International University(国际联合大学) BRAC University(布拉克大学)

专题命中 知识编辑与模型理解 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出MultiHaluDet框架,通过探测冻结LLM的全隐藏状态轨迹,结合多尺度注意力和自注意力池化的混合架构,以及校准的经典分类器集成,实现跨语言的高精度幻觉检测,在英语基准上达到98.55% AUROC,并展现出对高、中、低资源语言的强泛化能力。

Comments MeLLM @ ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19162 2026-04-22 cs.CL stat.AP 91%

Mind the Unseen Mass: Unmasking LLM Hallucinations via Soft-Hybrid Alphabet Estimation

注意未见的质量:通过软混合字母估计揭示LLM幻觉

Hongxing Pan, Yingying Guo, Wenqing Kuang, Jiashi Lu

机构 * School of Data Science(数据科学学院)

专题命中 知识编辑与模型理解 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出SHADE方法,通过结合通用Good-Turing覆盖与图谱特征,解决小样本下LLM语义字母估计问题,提升不确定性量化性能。

Comments 7 pages, 1 figure, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17293 2026-04-21 cs.CL 91%

Beyond "I Don't Know": Evaluating LLM Self-Awareness in Discriminating Data and Model Uncertainty

超越“我不知道”:评估LLM在区分数据和模型不确定性中的自我意识

Jingyi Ren, Ante Wang, Yunghwei Lai, Xiaolong Wang, Linlu Gong, Weitao Li, Weizhi Ma, Yang Liu

机构 * Dept. of Comp. Sci. & Tech., Institute for AI, Tsinghua University, Beijing, China(计算机科学与技术系,人工智能研究院,清华大学,北京,中国) Institute for AI Industry Research (AIR), Tsinghua University, Beijing, China(人工智能产业研究院(AIR),清华大学,北京,中国)

专题命中 知识编辑与模型理解 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出UA-Bench基准测试,评估LLM在区分数据不确定性和模型不确定性方面的能力,发现即使先进模型也难以可靠区分,并提出轻量数据合成与强化学习策略提升不确定性判断。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13258 2026-08-14 cs.CL cs.AI 新提交 91%

Self-Referential Induction Increases Response Instability Relative to Unresolvable and Verifiable Questions in Large Language Models

自指式归纳相比大型语言模型中不可解决问题和可验证问题会增加响应不稳定性

Paras Balani, Subhrakanta Panda

机构 * Birla Institute of Technology and Science, Pilani(比拉理工学院(皮拉尼))

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);prompting(abstract,abstract_cn);分类 cs.CL、cs.AI

AI总结 该研究通过Gemini API实验发现,大型语言模型对自指式问题的响应不稳定性高于不可解决哲学问题和可验证问题,为其诱导的主观体验报告提供了定量基线。

Comments 4 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07406 2026-07-07 cs.LG cs.AI 版本更新 91%

InverseScope: Scalable Activation Inversion for Interpreting Large Language Models

InverseScope:用于解释大语言模型的可扩展激活反演

Yifan Luo, Zhennan Zhou, Bin Dong

机构 * School of Mathematical Science, Peking University(北京大学数学科学学院) School of Science, Westlake University(西湖大学理学院) Beijing International Center for Mathematical Research(北京国际数学研究中心) New Cornerstone Science Laboratory, Peking University(北京大学新基石科学实验室)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.AI、cs.LG

AI总结 研究大语言模型内部表征解释难题,提出InverseScope框架,通过输入反演解释神经激活,用新颖架构提高采样效率,揭示模型表征空间结构,可扩展到14B参数模型并推广到分布外输入。

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02182 2026-07-03 cs.LG cs.CL 新提交 91%

Bayesian Sparse Low-Rank Adaptation for Large Language Model Uncertainty Estimation

贝叶斯稀疏低秩自适应用于大语言模型不确定性估计

Jijie Zhang, Zhe Ren, Quan Zhang, Dandan Guo

机构 * School of Artificial Intelligence, Jilin University(吉林大学人工智能学院) Michigan State University(密歇根州立大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(summary_cn);分类 cs.CL、cs.LG

AI总结 提出DALorRA,一种变分贝叶斯稀疏框架,通过随机掩码低秩适应中的秩维度实现模型容量正则化和校准,在不牺牲推理精度下提升LLM校准性能。

Comments Preprint. 16 pages, 7 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16939 2026-06-16 cs.LG cs.AI 新提交 91%

Scalable Circuit Learning for Interpreting Large Language Models

可扩展的电路学习用于解释大型语言模型

Naiyu Yin, Dennis Wei, Tian Gao, Amit Dhurandhar, Karthikeyan Natesan Ramamurthy, Yue Yu

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);large language model(title);language model(title);分类 cs.AI、cs.LG

AI总结 提出CircuitLasso方法,基于稀疏线性回归高效学习LLM中的稀疏电路,以SAE特征为单元,在保持结构准确性的同时大幅降低计算成本,并揭示语义特征传播机制。

Comments Accepted to the Mechanistic Interpretability Workshop at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.00396 2026-06-09 cs.CL cs.AI 91%

A Study on Effect of Reference Knowledge Choice in Generating Technical Content Relevant to SAPPhIRE Model Using Large Language Model

基于SAPPhIRE模型因果关系的生成技术内容参考知识选择研究

Kausik Bhattacharya, Anubhab Majumder, Amaresh Chakrabarti

机构 * Indian Institute of Science(印度科学研究院)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.CL、cs.AI

AI总结 本文研究如何利用大语言模型生成与SAPPhIRE因果关系模型相关的技术内容,通过检索增强生成方法抑制幻觉,强调参考知识选择对生成准确性的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16275 2026-06-03 cs.CL cs.AI 91%

SeSE: Black-Box Uncertainty Quantification for Large Language Models Based on Structural Information Theory

SeSE: 基于结构信息理论的大语言模型黑盒不确定性量化

Xingtao Zhao, Hao Peng, Dingli Su, Xianghua Zeng, Chunyang Liu, Jinzhi Liao, Philip S. Yu

机构 * School of Cyber Science and Technology Beihang University(北航信息科学与技术学院) School of Computer Science and Engineering Beihang University(北航计算机科学与工程学院) Didi Chuxing(滴滴出行) Laboratory for Big Data and Decision National University of Defense Technology(国防科技大学大数据与决策实验室) Department of Computer Science University of Illinois Chicago(伊利诺伊大学芝加哥分校计算机科学系)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.CL、cs.AI

AI总结 提出SeSE框架,通过构建语义空间的最优层次抽象并计算结构熵,实现大语言模型的黑盒不确定性量化,理论推广了语义熵并在长文本生成中优于现有方法。

Comments Accepted by UAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00570 2026-06-02 cs.CL cs.AI 91%

Revisiting Parameter-Based Knowledge Editing in Large Language Models: Theoretical Limits and Empirical Evidence

重新审视大型语言模型中基于参数的知识编辑:理论极限与实证证据

Wanying Ren, Xin Song, Futing Wang, Guoxiu He, Aixin Sun

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.CL、cs.AI

AI总结 本文通过理论分析和实证评估,揭示了基于参数的知识编辑方法会因维度坍缩假设导致全局干扰和推理崩溃,而简单的检索基线方法在所有条件下均表现更优。

Comments Accepted to ICML 2026. Equal contribution by the first two authors. 9 pages main paper, 10 figures, with appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04931 2026-05-27 cs.LG cs.AI 91%

Emergent Causal-Geometric Dynamics Across Depth in Large Language Models

大型语言模型中跨深度的涌现因果几何动力学

Shahar Haim, Daniel C McNamee

机构 * Champalimaud Centre for the Unknown(查普拉米乌德未知中心)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.AI、cs.LG

AI总结 通过结合几何分析与因果干预,揭示了解码器-only大型语言模型中从上下文处理到预测形成的跨层转变,并发现后期层中角度结构参数化下一词分布相似性并实现选择性因果控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.21726 2026-05-22 cs.CL cs.AI 91%

Probabilistic Attribution For Large Language Models

基于概率的大型语言模型归因

Shilpika Shilpika, Carlo Graziani, Bethany Lusch, Venkatram Vishwanath, Michael E. Papka

机构 * Argonne Leadership Computing Facility(阿贡领导计算设施) Argonne National Laboratory(阿贡国家实验室) Mathematics and Computer Science Division(数学与计算机科学 division) Department of Computer Science(计算机科学系)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.CL、cs.AI

AI总结 本文提出了一种模型无关的概率性token归因度量,通过贝叶斯法则反向计算下一个token的对数概率,以捕捉模型对token序列分布的内部表示,从而提高大型语言模型的可解释性。

Comments 29 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20207 2026-05-18 cs.LG cs.AI 91%

Golden Layers and Where to Find Them: Improved Knowledge Editing for Large Language Models Via Layer Gradient Analysis

黄金层与寻找它们的位置:通过层梯度分析改进大型语言模型的知识编辑

Shrestha Datta, Hongfu Liu, Anshuman Chhabra

机构 * University of South Florida(佛罗里达州立大学) Brandeis University(布兰迪大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.AI、cs.LG

AI总结 本文提出通过层梯度分析(LGA)识别高效知识编辑的黄金层,验证其在不同数据集和模型类型中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07271 2026-05-11 cs.CL cs.AI 91%

Understanding Performance Collapse in Layer-Pruned Large Language Models via Decision Representation Transitions

通过决策表示过渡理解层剪枝大型语言模型中的性能崩溃

Boyu Shi, Chang Liu, ChuanBao Gao, Xu Yang, Xin Geng

机构 * School of Computer Science and Engineering, Southeast University, Nanjing, China(东南大学计算机科学与工程学院,南京,中国) Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications (Southeast University), Ministry of Education, China(新一代人工智能技术及其交叉应用重点实验室(东南大学),教育部,中国)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.CL、cs.AI

AI总结 本文通过决策表示过渡分析层剪枝对大型语言模型性能的影响,提出决策边际和选项频率两个指标,揭示剪枝导致决策阶段转变的机制,发现剪枝沉默阶段会引发性能崩溃。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20340 2026-05-05 cs.CL cs.AI 91%

Latent Trajectory Dynamics in Large Language Models: A Manifold Evolution Framework with Empirical Validation

大语言模型中的潜在轨迹动力学:一种具有实证验证的流形演化框架

Yukun Zhang, Qi Dong, Mengkang Li

机构 * The Chinese University Of Hongkong(香港中文大学) Fudan University(复旦大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.CL、cs.AI

AI总结 本文提出DMET框架,通过轨迹几何指标分析大语言模型生成过程中的潜在表示演化,实验证明其能有效预测文本质量并提升生成控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27401 2026-05-01 cs.CL cs.LG 91%

Perturbation Probing: A Two-Pass-per-Prompt Diagnostic for FFN Behavioral Circuits in Aligned LLMs

扰动探测:对齐语言模型中FFN行为电路的双次提示诊断

Hongliang Liu, Tung-Ling Li, Yuhao Wu

机构 * Palo Alto Networks(帕洛阿尔托网络公司)

专题命中 知识编辑与模型理解 :RLHF(summary_cn,abstract);LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 通过双次提示传递和无反向传播的扰动探测,识别LLM中两种行为电路结构,揭示RLHF组织的行为机制及模板层编辑工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16421 2026-04-21 cs.CL cs.AI 91%

Measuring Representation Robustness in Large Language Models for Geometry

在大型语言模型中测量几何表示的鲁棒性

Vedant Jawandhia, Yash Sinha, Murari Mandal, Ankan Pal, Dhruv Kumar

机构 * Department of Computer Science and Information Systems, BITS Pilani(比特学院计算机科学与信息系统系) School of Computer Science, KIIT University(KIIT大学计算机科学学院) Department of Mathematics, BITS Pilani(比特学院数学系)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract_cn);prompting(abstract)

AI总结 本文提出GeoRepEval框架,评估几何问题在不同表示形式下的正确性、不变性和一致性,发现表示选择对模型性能有显著影响,尤其在向量形式上表现脆弱,通过提示干预可提升高容量模型性能,但低容量模型无明显改进。

Comments 20 pages, 7 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00279 2026-02-03 cs.CL cs.LG 91%

Benchmarking Uncertainty Calibration in Large Language Model Long-Form Question Answering

在大型语言模型长格式问答中评估不确定性校准的基准测试

Philip Müller, Nicholas Popovič, Michael Färber, Peter Steinbach

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);instruction tuning(abstract);prompting(abstract)

AI总结 本研究提出首个大规模基准,评估大型语言模型在长格式问答中不确定性校准的可靠性,揭示了指令调优和推理过程对校准的影响及ECE指标的局限性。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19700 2026-02-02 cs.LG cs.AI 91%

Generalizable Multimodal Large Language Model Editing via Invariant Trajectory Learning

通过不变轨迹学习实现通用的多模态大语言模型编辑

Jiajie Su, Haoyuan Wang, Xiaohua Feng, Yunshan Ma, Xiaobo Xia, Yuyuan Li, Xiaolin Zheng, Jianmao Xiao, Chaochao Chen

机构 * Zhejiang University, China(浙江大学) Singapore Management University, Singapore(新加坡管理学院) National University of Singapore, Singapore(新加坡国立大学) Hangzhou Dianzi University, China(杭州电子科技大学) Jiangxi Normal University, China(江西师范大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

AI总结 本文提出ODEit框架,通过不变轨迹学习提升多模态大语言模型的编辑可靠性、局部性和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00348 2026-01-05 cs.CL cs.AI 91%

Robust Uncertainty Quantification for Factual Generation of Large Language Models

面向大型语言模型事实生成的鲁棒不确定性量化

Yuhao Zhang, Zhongliang Yang, Linna Zhou

机构 * School of Cyberspace Security, Beijing University of Posts and Telecommunications(网络安全学院,北京邮电大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

AI总结 本文提出了一种新颖的鲁棒不确定性量化方法,用于评估大型语言模型在生成多事实任务中的可靠性,通过构建陷阱问题集验证了其有效性,提升了对抗性提问下的模型鲁棒性。

Comments 9 pages, 5 tables, 5 figures, accepted to IJCNN 2025

Journal ref 2025 International Joint Conference on Neural Networks (IJCNN), Rome, Italy, 2025, pp. 1-9

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24202 2025-09-30 cs.CL cs.AI 91%

Can Large Language Models Express Uncertainty Like Human?

Linwei Tao, Yi-Fan Yeh, Bo Kai, Minjing Dong, Tao Huang, Tom A. Lamb, Jialin Yu, Philip H. S. Torr, Chang Xu

机构 * School of Computer Science, University of Sydney(悉尼大学计算机科学学院) City University of Hong Kong(香港城市大学) Shanghai Jiao Tong University(上海交通大学) Department of Engineering Science, University of Oxford(牛津大学工程科学系)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07853 2025-05-14 cs.CL cs.AI 91%

CrashSage: A Large Language Model-Centered Framework for Contextual and Interpretable Traffic Crash Analysis

Hao Zhen, Jidong J. Yang

机构 * Smart Mobility and Infrastructure Lab College of Engineering University of Georgia(智能移动与基础设施实验室 工程学院 佐治亚大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments 20 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13555 2025-02-20 cs.LG cs.AI 91%

Democratizing Large Language Model-Based Graph Data Augmentation via Latent Knowledge Graphs

Yushi Feng, Tsai Hor Chan, Guosheng Yin, Lequan Yu

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.17598 2025-01-30 cs.CL cs.LG 91%

Semantic Consistency Regularization with Large Language Models for Semi-supervised Sentiment Analysis

Kunrong Li, Xinyu Liu, Zhen Chen

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments ICONIP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15211 2024-11-26 cs.LG cs.AI cs.CV eess.SP 91%

LightLLM: A Versatile Large Language Model for Predictive Light Sensing

Jiawei Hu, Hong Jia, Mahbub Hassan, Lina Yao, Brano Kusy, Wen Hu

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments 15 pages, 14 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02435 2024-11-06 cs.CL cs.LG 91%

Narrative Analysis of True Crime Podcasts With Knowledge Graph-Augmented Large Language Models

Xinyi Leng, Jason Liang, Jack Mauro, Xu Wang, Andrea L. Bertozzi, James Chapman, Junyuan Lin, Bohan Chen, Chenchen Ye, Temple Daniel, P. Jeffrey Brantingham

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments 9 Pages, 3 Figures, GTA3 Workshop-2024, October 2024, 33rd International Conference on Information and Knowledge Management, Boise, Idaho, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05954 2024-11-05 cs.AI cs.LG cs.SY eess.SY 91%

Aligning Large Language Models with Representation Editing: A Control Perspective

Lingkai Kong, Haorui Wang, Wenhao Mu, Yuanqi Du, Yuchen Zhuang, Yifei Zhou, Yue Song, Rongzhi Zhang, Kai Wang, Chao Zhang

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏