arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7527 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7527 篇

2606.23590 2026-06-23 cs.AI 新提交 86%

The Topology of Ill-Posed Questions: Persistent Homology for Detection and Steering in LLMs

病态问题的拓扑:用于大语言模型中检测与引导的持续同调

Guangyu Jiang, Sizhe Tang, Mahdi Imani, Tian Lan

机构 * The George Washington University(乔治华盛顿大学) Northeastern University(东北大学)

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 利用持续同调分析LLM内部状态的拓扑结构,统一表示多种病态问题,并实现分类与激活引导,提升响应质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01455 2026-06-15 cs.CL 版本更新 86%

Trusted Uncertainty in Large Language Models: A Unified Framework for Confidence Calibration and Risk-Controlled Refusal

大型语言模型中的可信不确定性:置信度校准与风险控制拒绝的统一框架

Markus Oehri, Giulia Conti, Kaviraj Pather, Alexandre Rossi, Laia Serra, Adrian Parody, Rogvi Johannesen, Aviaja Petersen, Arben Krasniqi

机构 * University of Liechtenstein(列支敦士登大学) University of the Republic of San Marino(圣马尔科共和国大学) University of Mauritius(毛里求斯大学) International University of Monaco(摩纳哥国际大学) University of Andorra(安道尔大学) University of Gibraltar(直布罗陀大学) University of the Faroe Islands(法罗群岛大学) Ilisimatusarfik (University of Greenland)(格陵兰岛研究所(格陵兰大学)) University of Prizren(普里兹伦大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(title);分类 cs.CL

AI总结 提出UniCR框架,融合多种不确定性证据为校准的正确概率,并通过原则性拒绝满足用户指定的错误预算,无需微调基础模型,在短问答、代码生成和检索增强长问答中提升校准指标并降低风险-覆盖曲线下面积。

Comments arXiv admin note: This paper has been withdrawn by arXiv due to unverifiable authorship and affiliation

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.03217 2026-06-10 cs.LG cs.CY 版本更新 86%

Moral Sensitivity in LLMs: A Tiered Evaluation of Contextual Bias via Behavioral Profiling and Mechanistic Interpretability

大语言模型中的道德敏感性:通过行为剖析和机制可解释性对上下文偏见进行分层评估

Yash Aggarwal, Atmika Gorti, Vinija Jain, Aman Chadha, Krishnaprasad Thirunarayan, Manas Gaur

机构 * University of Maryland, College Park(马里兰大学学院公园分校) Purdue University(普渡大学) Meta Apple(苹果公司) Wright State University(怀特州立大学) University of Maryland, Baltimore County(马里兰大学巴尔的摩县分校)

专题命中 知识编辑与模型理解 :SLM(abstract,abstract_cn);LLM(abstract_cn);large language model(abstract);language model(abstract)

AI总结 提出道德敏感性指数(MSI)量化大语言模型在七级压力测试中的偏见概率,并通过行为剖析和机制验证揭示模型偏见随情境变化的U型曲线,发现推理蒸馏会重新激活浅层统计关联。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08601 2026-06-09 cs.AI 新提交 86%

InA-Probe: Instruction-Aware Active Probing for Time Series Forecasting with LLMs

InA-Probe:面向LLM时间序列预测的指令感知主动探测

Peiliang Gong, Emadeldeen Eldele, Chenyu Liu, Ziyu Jia, Yi Ding, Xinliang Zhou, Lianchao Gu, Qi Zhu, Yang Liu, Daoqiang Zhang, Xiaoli Li

机构 * Nanyang Technological University(南洋理工大学) Khalifa University(哈利法大学) Nanjing University of Aeronautics and Astronautics(南京航空航天大学) Singapore University of Technology and Design(新加坡科技设计大学)

专题命中 知识编辑与模型理解 :LLM(title_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出指令感知主动探测(InA-Probe),通过多级指令注入和自适应查询生成,结合双阶段注意力机制,在7个基准上超越现有方法,跨域误差降低37%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26233 2026-06-05 cs.CL 86%

Ask or Assume? Uncertainty-Aware Clarification-Seeking in Coding Agents

提问还是假设?编码代理中的不确定性意识澄清寻求

Nicholas Edwards, Sebastian Schuster

机构 * Faculty of Computer Science, University of Vienna(维也纳大学计算机科学系) UniVie Doctoral School Computer Science, University of Vienna(维也纳大学计算机科学博士学院)

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本研究评估了LLM代理在未指定任务中的澄清能力,提出了一种不确定性意识的多代理框架,提高了任务解决率,并展示了多代理系统在复杂任务中主动寻求信息的行为。

Comments 18 pages, 7 figures; added experiments evaluating open-weight models (Kimi K2.6), expanded related work, and included dataset validation details

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00328 2026-06-02 cs.LG 86%

KG-Guard: Graph-Based Hallucination Detection for Knowledge Base Question Answering

KG-Guard: 基于图的知识库问答幻觉检测

Albert Sawczyn, Piotr Bielak, Tomasz Kajdanowicz

机构 * Department of Artificial Intelligence(人工智能系) Wroclaw University of Science and Technology(波兹南科技大学)

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 针对知识库问答中LLM的幻觉问题,提出一种轻量级图框架,将问答实例构建为增强图,通过图编码器和MLP分类器检测幻觉答案节点,在三个基准上取得最高F1并显著提升下游KBQA性能。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03134 2026-05-29 cs.CL 86%

The Anatomy of Conversational Scams: A Topic-Based Red Teaming Analysis of Multi-Turn Interactions in LLMs

对话式诈骗的剖析:基于主题的LLM多轮交互红队分析

Xiangzhe Yuan, Zhenhao Zhang, Haoming Tang, Siying Hu

机构 * Department of Computer Science, University of Iowa(爱荷华大学计算机科学系) Department of Computer Science, City University of Hong Kong(香港城市大学计算机科学系)

专题命中 知识编辑与模型理解 :LLM(title_cn,summary_cn);分类 cs.CL

AI总结 通过LLM间模拟框架研究多轮社交工程对话中的对抗动态,分析攻击与防御策略,发现跨模型和跨语言的结果差异及策略转换的结构性变化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25404 2026-05-26 cs.CL eess.AS 86%

Proactive for Uncertainty: Cause-Aware Error Diagnosis and Interactive Clarification for Spoken Dialogue Systems

主动应对不确定性:面向口语对话系统的因果感知错误诊断与交互式澄清

Yizhou Peng, Ziyang Ma, Changsong Liu, Yi-Wen Chao, Xie Chen, Eng Siong Chng

机构 * Nanyang Technological University, Singapore(南洋理工大学,新加坡) Shanghai Jiao Tong University, China(上海交通大学,中国)

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出一种因果感知的错误恢复范式,通过细粒度检测器解耦ASR中的感知、理解和删除错误,使LLM能够执行多轮针对性澄清策略,从而显著降低词错误率并提升下游任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16686 2026-05-19 cs.LG 86%

Scalable Knowledge Editing for Mixture-of-Experts LLMs via Tensor-Structured Updates

基于张量结构更新的混合专家LLM可扩展知识编辑

Roman Maksimov, Vladimir Aletov, Dmitry Bylinkin, Daniil Medyakov, Vladimir Solodkin, Aleksandr Beznosikov

机构 * OpenAI DeepSeek-AI Qwen Team(Qwen团队) Shazeer et al.(Shazeer等人) Molodtsov et al.(Molodtsov等人)

专题命中 知识编辑与模型理解 :LLM(title_cn,summary_cn);分类 cs.LG

AI总结 本文提出一种针对混合专家架构LLM的知识编辑方法,通过张量结构和Woodbury矩阵恒等式实现高效参数更新,提升编辑效率6倍,扩展了知识编辑的应用范围。

Comments 17 pages, 3 architectures, 1 figure, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01235 2026-05-19 cs.SD cs.AI 86%

MindMelody: A Closed-Loop EEG-Driven System for Personalized Music Intervention

MindMelody:一种基于EEG的闭环个性化音乐干预系统

Yimeng Zhang, Yueru Sun, Haoyu Gu, Zhanpeng Jin

机构 * South China University of Technology(南方科技大学)

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出MindMelody系统,通过EEG信号实时生成个性化音乐,结合Transformer-GNN和RAG-LLM实现情绪感知与音乐生成的闭环控制,提升情感适应性与用户参与度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01562 2026-05-05 cs.SE cs.AI 86%

Neuro-Symbolic Agents for Hallucination-Free Requirements Reuse

神经符号代理用于无幻觉要求重用

Ahmed Ibrahim

机构 * Western University(西部大学)

专题命中 知识编辑与模型理解 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出神经符号多代理系统,通过模型驱动 elicitation 过程实现无幻觉的要求重用,结合 LLM 和符号验证器确保结构有效性,实验显示 100% 覆盖率和 0.2% 违规率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03335 2026-04-23 cs.LG 86%

EvolveSignal: A Large Language Model Powered Coding Agent for Discovering Traffic Signal Control Strategies

EvolveSignal:一种基于大语言模型的编程代理,用于发现交通信号控制策略

Leizhen Wang, Peibo Duan, Hao Wang, Yue Wang, Jian Xu, Nan Zheng, Zhenliang Ma

机构 * Department of Data Science and Artificial Intelligence, Monash University(数据科学与人工智能系,墨尔本大学) School of Transportation, Southeast University(交通学院,东南大学) Institute of Automation, Chinese Academy of Sciences(自动化研究所,中国科学院) Department of Civil and Environmental Engineering, Monash University(土木与环境工程系,墨尔本大学) Department of Civil and Architectural Engineering, KTH Royal Institute of Technology(土木与建筑工程系,皇家理工学院)

专题命中 知识编辑与模型理解 :large language model(title);language model(title);LLM(abstract);分类 cs.LG

AI总结 本文提出EvolveSignal,利用大语言模型自动发现可解释的启发式策略,通过程序合成方法优化交通信号控制,实验表明其在减少延误和停车次数方面优于传统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.05036 2025-12-03 cs.CL 86%

From Word Vectors to Multimodal Embeddings: Techniques, Applications, and Future Directions For Large Language Models

从词向量到多模态嵌入:大型语言模型的技术、应用与未来方向

Charles Zhang, Benji Peng, Xintian Sun, Qian Niu, Junyu Liu, Keyu Chen, Ming Li, Pohsun Feng, Ziqian Bi, Ming Liu, Yichao Zhang, Xinyuan Song, Cheng Fei, Caitlyn Heqi Yin, Lawrence KQ Yan, Hongyang He, Tianyang Wang

机构 * Georgia Institute of Technology(佐治亚理工学院) Simon Fraser University(西蒙弗雷泽大学) Kyoto University(京都大学) National Taiwan Normal University(台湾师范大学) Purdue University(普渡大学) The University of Texas at Dallas(德克萨斯大学达拉斯分校) Emory University(埃默里大学) Cornell University(康奈尔大学) University of Wisconsin-Madison(威斯康星大学麦迪逊分校) The Hong Kong University of Science(香港科学大学) University of Liverpool(利物浦大学) University of Warwick(沃里克大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(title);分类 cs.CL

AI总结 本文综述了从词向量到多模态嵌入的发展,探讨了大型语言模型的技术、应用及未来方向。

Comments 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17345 2025-11-06 cs.CL 86%

The Case for Repeatable, Open, and Expert-Grounded Hallucination Benchmarks in Large Language Models

Justin D. Norman, Michael U. Rivera, D. Alex Hughes

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(title);分类 cs.CL

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09350 2025-10-23 cs.CL 86%

Flow-SLM: Joint Learning of Linguistic and Acoustic Information for Spoken Language Modeling

Ju-Chieh Chou, Jiawei Zhou, Karen Livescu

机构 * Toyota Technological Institute at Chicago(芝加哥技术学院) Stony Brook University(石溪大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);SLM(title);分类 cs.CL

Comments ASRU 2025. Project page: https://jjery2243542.github.io/flowslm.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09815 2025-08-11 cs.CL 86%

Statistical Coherence Alignment for Large Language Model Representation Learning Through Tensor Field Convergence

Jonathan Gale, Godfrey Aldington, Harriet Thistlewood, Thomas Tattershall, Basil Wentworth, Vincent Enoasmo

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(title);分类 cs.CL

Comments arXiv admin note: This paper has been withdrawn by arXiv due to disputed and unverifiable authorship

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01615 2025-07-29 cs.CL 86%

Large Language Models Are Human-Like Internally

Tatsuki Kuribayashi, Yohei Oseki, Souhaib Ben Taieb, Kentaro Inui, Timothy Baldwin

机构 * MBZUAI The University of Tokyo(东京大学) University of Mons(蒙斯大学) Tohoku University(东北大学) RIKEN(日本理化学研究所) The University of Melbourne(墨尔本大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(title);分类 cs.CL

Comments This is a pre-MIT Press publication version of the paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01882 2025-03-26 cs.CL 86%

Latent Lexical Projection in Large Language Models: A Novel Approach to Implicit Representation Refinement

Ziad Shaker, Brendan Ashdown, Hugo Fitzalan, Alistair Heathcote, Jocasta Huntington

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(title);分类 cs.CL

Comments arXiv admin note: This paper has been withdrawn by arXiv due to disputed and unverifiable authorship

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12490 2025-03-18 cs.CV cs.AI 86%

GeoRSMLLM: A Multimodal Large Language Model for Vision-Language Tasks in Geoscience and Remote Sensing

Zilun Zhang, Haozhan Shen, Tiancheng Zhao, Bin Chen, Zian Guan, Yuhao Wang, Xu Jia, Yuxiang Cai, Yongheng Shang, Jianwei Yin

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(title);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01487 2025-01-07 cs.CL 86%

Small Language Models Also Work With Small Vocabularies: Probing the Linguistic Abilities of Grapheme- and Phoneme-Based Baby Llamas

Bastian Bunzeck, Daniel Duran, Leonie Schade, Sina Zarrieß

专题命中 知识编辑与模型理解 :language model(title,abstract);small language model(title);分类 cs.CL

Comments Accepted at COLING 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.18120 2024-10-03 cs.CL 86%

Exploring Multilingual Concepts of Human Value in Large Language Models: Is Value Alignment Consistent, Transferable and Controllable across Languages?

Shaoyang Xu, Weilong Dong, Zishan Guo, Xinwei Wu, Deyi Xiong

专题命中 知识编辑与模型理解 :large language model(title);language model(title);LLM(abstract);分类 cs.CL

Comments EMNLP 2024 findings, code&dataset: https://github.com/shaoyangxu/Multilingual-Human-Value-Concepts

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16333 2024-09-26 q-bio.BM cs.CV cs.LG q-fin.CP 86%

Predicting Distance matrix with large language models

Jiaxing Yang

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(title);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.01821 2024-09-05 cs.CV cs.LG 86%

When Does Visual Prompting Outperform Linear Probing for Vision-Language Models? A Likelihood Perspective

Hsi-Ai Tsao, Lei Hsiung, Pin-Yu Chen, Tsung-Yi Ho

专题命中 知识编辑与模型理解 :prompting(title,abstract);language model(title);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14292 2024-05-17 cs.CL 86%

WikiChat: Stopping the Hallucination of Large Language Model Chatbots by Few-Shot Grounding on Wikipedia

Sina J. Semnani, Violet Z. Yao, Heidi C. Zhang, Monica S. Lam

专题命中 知识编辑与模型理解 :large language model(title);language model(title);LLM(abstract);分类 cs.CL

Comments Findings of EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.08123 2023-10-13 cs.CL 86%

Who Wrote it and Why? Prompting Large-Language Models for Authorship Verification

Chia-Yu Hung, Zhiqiang Hu, Yujia Hu, Roy Ka-Wei Lee

专题命中 知识编辑与模型理解 :language model(title,abstract);prompting(title);分类 cs.CL

Comments 7 pages,1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.10415 2022-03-22 cs.CL 86%

How does the pre-training objective affect what large language models learn about linguistic properties?

Ahmed Alajrami, Nikolaos Aletras

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(title);分类 cs.CL

Comments Accepted at ACL 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14632 2026-08-18 cs.CL cs.AI 新提交 86%

DeMTS: Denoising Trajectories as Multivariate Time Series for Hallucination Detection in Diffusion Language Models

DeMTS:将去噪轨迹作为多元时间序列用于扩散语言模型的幻觉检测

Xin Zhang, Yili Wang, Yue Tan, Xin He, Yanyu Qian, Yixin Liu, Yi Chang, Shirui Pan, Xin Wang

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI

AI总结 针对现有D-LLMs幻觉检测方法压缩轨迹丢失关键信息的问题,提出DeMTS框架,将去噪轨迹作为多元时间序列,实验显示其性能优于现有方法且兼具鲁棒性、效率与迁移性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12717 2026-08-14 cs.LG cs.CL 新提交 86%

Perturbation-based Regional Interpretability through Subtraction Mapping (PRISM): naming-error dissociations in language models and post-stroke aphasia

基于减法映射的扰动型区域可解释性方法(PRISM):语言模型与卒中后失语症中的命名错误分离现象

Xiang Guan, Roger D. Newman-Norlund, Yong Yang, Saeed Ahmadi, Regan Willis, Nadra Salman, Kalil Warren, Srihari Nelakuditi, Chris Rorden, Leonardo Bonilha, Julius Fridriksson

机构 * University of South Carolina(南卡罗来纳大学) ALLT.AI, LLC(ALLT.AI有限责任公司) USC School of Medicine(南卡罗来纳大学医学院)

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.LG

AI总结 本研究开发PRISM方法,将神经成像减法分析适配至Transformer语言模型,对比模型与213名卒中后失语症患者的命名错误模式,验证了音素偏向性分离等结果,为模型功能专业化提供可证伪的空间分辨率测试工具。

Comments 49 pages, 6 figures, 1 table. Supplementary methods, 6 tables and 5 figures included

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24435 2026-08-03 cs.CL cs.AI 版本更新 86%

LEX-EC: A Lexical Evidence-Channel Audit Framework for Zero-Shot LLM Personality Classification in Black-Box Settings

LEX-EC:黑盒设置下用于零样本大语言模型人格分类的词汇证据通道审计框架

Brittany Harbison, Ashok K. Goel

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 研究针对大语言模型人格分类可解释性问题,提出LEX-EC框架,结合多种诊断与词汇消融,通过对不同文本体裁分析,展示特质关联与词汇证据关系,联合评估多项指标,将词汇方法应用于黑盒人格标签可解释性。

Comments Appendix and link to Code repo provided; this version also contains a refined Discussion section and a small error regarding Table 1 was corrected

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20529 2026-07-24 cs.LG cs.AI 新提交 86%

Uncertainty-Aware Trust Estimation for Multi-LLM Systems via Structured Expert Judgement

通过结构化专家判断对多语言模型系统进行不确定性感知信任估计

Jiawei Zheng, Jiazhen Zhang

机构 * DigitLab, University of Exeter(数字实验室,埃克塞特大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究多语言模型聚合问题,核心方法是采用结构化专家判断,通过上下文感知校准问题及库克式对数加权估计专家可靠性,主要贡献是在异构和受污染情况下实现更好的准确性-可靠性平衡,强调聚合时需校准信任。

详情

展开后加载摘要…

URL PDF HTML 收藏