arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7527 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7527 篇

2602.11737 2026-02-13 cs.CV cs.CL 88%

Mask What Matters: Mitigating Object Hallucinations in Multimodal Large Language Models with Object-Aligned Visual Contrastive Decoding

关注关键要素:通过对象对齐的视觉对比解码缓解多模态大语言模型中的对象幻觉

Boqi Chen, Xudong Liu, Jianing Qiu

机构 * ETH Zurich(苏黎世联邦理工学院) Amazon(亚马逊) MBZUAI(穆罕默德·本·拉什德智能科学技术研究院)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文提出了一种通过对象对齐的视觉对比解码缓解多模态大语言模型中对象幻觉的方法,具有计算开销低且兼容性强的特点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06852 2026-02-09 quant-ph cs.AI 88%

The Quantum Sieve Tracer: A Hybrid Framework for Layer-Wise Activation Tracing in Large Language Models

量子筛子追踪器:一种用于大语言模型分层激活追踪的混合框架

Jonathan Pan

机构 * Jonathan Pan

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 量子筛子追踪器通过混合量子-经典方法揭示大语言模型中分层激活机制的差异,发现不同模型层在事实回忆和干扰抑制中的不同作用。

Comments 4 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20977 2026-02-05 cs.CL 88%

Evaluating and Steering Modality Preferences in Multimodal Large Language Model

评估和引导多模态大语言模型中的模态偏好

Yu Zhang, Jinlong Ma, Yongshuai Hou, Xuefeng Bai, Kehai Chen, Yang Xiang, Jun Yu, Min Zhang

机构 * Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳)) Peng Cheng Laboratory, Shenzhen, China(鹏城实验室)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文提出MC²基准测试,通过受控证据冲突场景评估和引导多模态大语言模型的模态偏好,揭示了其可通过指令引导和潜在表示控制,并展示了通过表示工程方法提升多模态任务性能的潜力。

Comments Modality Preference

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02537 2026-02-04 cs.CV cs.LG 88%

WorldVQA: Measuring Atomic World Knowledge in Multimodal Large Language Models

WorldVQA:评估多模态大语言模型的原子视觉世界知识

Runjie Zhou, Youbo Shao, Haoyu Lu, Bowei Xing, Tongtong Bai, Yujie Chen, Jie Zhao, Lin Sui, Haotian Yao, Zijia Zhao, Hao Yang, Haoning Wu, Zaida Zhou, Jinguo Zhu, Zhiqi Huang, Yiping Bao, Yangyang Liu, Y. Charles, Xinyu Zhou

机构 * Moonshot AI

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

AI总结 WorldVQA通过评估多模态大语言模型的原子视觉知识,建立衡量其事实性和百科全书广度的基准测试。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21129 2026-02-04 cs.AI 88%

Measuring and Analyzing Intelligence via Contextual Uncertainty in Large Language Models using Information-Theoretic Metrics

通过信息论度量在大语言模型中通过上下文不确定性测量和分析智能

Jae Wan Shim

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本文提出通过熵衰减曲线和信息增益跨度分析大语言模型的内部动态,揭示模型规模与文本复杂性对认知档案的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00559 2026-02-03 cs.CV cs.AI 88%

Learning to Decode Against Compositional Hallucination in Video Multimodal Large Language Models

在视频多模态大语言模型中学习对抗组合性幻觉

Wenbin Xing, Quanxing Zha, Lizheng Zu, Mengran Li, Ming Li, Junchi Yan

机构 * Sun Yat-sen University(中山大学) Huaqiao University(华侨大学) Shenzhen University(深圳大学) Guangming Laboratory(光明实验室) Shanghai Jiao Tong University(上海交通大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 针对视频多模态大语言模型中的组合性幻觉问题,提出TriCD框架,通过对比解码和三路径校准机制提升模型在对抗幻觉时的准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14007 2026-01-21 cs.CL 88%

BACH-V: Bridging Abstract and Concrete Human-Values in Large Language Models

BACH-V: 联结抽象与具体的人类价值观在大语言模型中

Junyu Zhang, Yipeng Kang, Jiong Guo, Jiayu Zhan, Junqi Wang

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 BACH-V研究通过探测和引导方法揭示大语言模型中抽象与具体价值观的联结机制,发现其能稳定锚定抽象价值观以影响具体决策。

Comments 34 pagess, 16 figures, 6 tables, submitted to ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09929 2026-01-16 cs.AI 88%

Hallucination Detection and Mitigation in Large Language Models

大语言模型中的幻觉检测与缓解

Ahmad Pesaranghader, Erin Li

机构 * CIBC(加拿大帝国商业银行)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本文提出了一种系统化的框架,通过分层架构和闭环反馈机制,提升大语言模型在金融等高风险领域的可靠性,减少幻觉问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02973 2026-01-13 cs.CL 88%

Expanding before Inferring: Enhancing Factuality in Large Language Models through Premature Layers Interpolation

在推断前扩展:通过提前层插值增强大语言模型的事实性

Dingwei Chen, Ziqiang Liu, Feiteng Fang, Chak Tou Leong, Shiwen Ni, Ahmadreza Argha, Hamid Alinejad-Rokny, Min Yang, Chengming Li

机构 * Sun Yat-Sen University(中山大学) Shenzhen MSU-BIT University(深圳MSU-BIT大学) The Hong Kong Polytechnic University(香港理工大学) UNSW, Sydney, NSW 2052, Australia(新南威尔士大学) Shenzhen Key Laboratory for High Performance Data Mining, Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳高性能数据挖掘重点实验室,深圳先进技术研究院,中国科学院)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文提出PLI方法,通过提前层插值提升大语言模型的事实一致性,有效减少幻觉并优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03295 2026-01-08 q-bio.GN cs.LG 88%

MetagenBERT: a Transformer-based Architecture using Foundational genomic Large Language Models for novel Metagenome Representation

MetagenBERT: 一种基于Transformer的架构,利用基础基因大语言模型进行新颖的宏基因组表示

Gaspar Roy, Eugeni Belda, Baptiste Hennecart, Yann Chevaleyre, Edi Prifti, Jean-Daniel Zucker

机构 * IRD, Sorbonne University, UMMISCO(IRD、索邦大学、UMMISCO) Sorbonne University, INSERM, Nutriomics(索邦大学、国家卫生研究院、Nutriomics) LAMSADE, Dauphine University, PSL Research University(LAMSADE、达菲大学、PSL研究大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(title);foundation model(abstract);分类 cs.LG

AI总结 MetagenBERT通过端到端的DNA序列嵌入和聚类策略,无需注释即可实现宏基因组的高效表示,展示了在疾病预测中的优越性能和跨队列的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17385 2025-12-22 cs.CL 88%

UCoder: Unsupervised Code Generation by Internal Probing of Large Language Models

UCoder: 通过大型语言模型的内部探测实现无监督代码生成

Jiajun Wu, Jian Yang, Wei Zhang, Lin Jing, Yuqing Ma, Ensheng Shi, Yuchi Ma, Zhoujun Li, Xianglong Liu

机构 * Beihang University(北航大学) Huawei(华为)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 UCoder通过内部探测大型语言模型实现无监督代码生成,利用自一致性机制和表示质量估计训练,减少对标记数据的依赖,提升资源受限场景下的代码生成能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09444 2025-12-11 cs.CL 88%

Advancing Text Classification with Large Language Models and Neural Attention Mechanisms

基于大语言模型和神经注意力机制的文本分类进展

Ning Lyu, Yuxi Wang, Feng Chen, Qingyuan Zhang

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本研究提出基于大语言模型和神经注意力机制的文本分类方法,通过改进表示和聚合策略,提升分类性能并增强模型鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09440 2025-12-11 cs.CL 88%

Knowledge-Augmented Large Language Model Agents for Explainable Financial Decision-Making

基于知识增强的大语言模型代理的可解释金融决策方法

Qingyuan Zhang, Yuxi Wang, Cancan Hua, Yulin Huang, Ning Lyu

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文提出基于知识增强的大语言模型代理,通过整合外部知识检索、语义表示和推理生成,提升金融决策的可解释性和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12758 2025-12-09 cs.CL 88%

Democratic or Authoritarian? Probing a New Dimension of Political Biases in Large Language Models

民主或威权?探讨大型语言模型中政治偏见的新维度

David Guzman Piedrahita, Irene Strauss, Bernhard Schölkopf, Rada Mihalcea, Zhijing Jin

机构 * University of Zürich(苏黎世大学) ETH Zürich(苏黎世联邦理工学院) MPI for Intelligent Systems(智能系统研究所) University of Michigan(密歇根大学) University of Toronto(多伦多大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文探讨了大型语言模型在民主与威权政治偏见方面的表现,通过引入F-scale、FavScore和角色模型探测方法,揭示了模型在不同语言提示下对民主与威权倾向性的差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04841 2025-12-05 cs.CR cs.AI 88%

SoK: a Comprehensive Causality Analysis Framework for Large Language Model Security

SoK:面向大语言模型安全的综合因果分析框架

Wei Zhao, Zhe Li, Jun Sun

机构 * Singapore Management University(新加坡管理大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本文提出一个综合因果分析框架,用于研究大语言模型安全问题,通过系统分析因果因素提升模型安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22146 2025-12-01 cs.CL 88%

C$^2$DLM: Causal Concept-Guided Diffusion Large Language Models

C$^2$DLM: 基于因果概念的扩散大语言模型

Kairong Han, Nuanqiao Shan, Ziyu Zhao, Zijing Hu, Xinpeng Dong, Junjian Ye, Lujia Pan, Fei Wu, Kun Kuang

机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) Noah’s Ark Lab, Huawei Technologies(华为技术有限公司诺亚实验室)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 C$^2$DLM通过引入因果概念引导机制,提升大语言模型在推理任务中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21756 2025-12-01 cs.CL cs.CE 88%

Dissecting the Ledger: Locating and Suppressing "Liar Circuits" in Financial Large Language Models

拆解账本:在金融大型语言模型中定位并抑制‘骗子电路’

Soham Mirajkar

机构 * Soham Mirajkar ( November 24, 2025 )(Soham Mirajkar)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本研究提出通过因果追溯在金融LLM中定位并抑制导致算术幻觉的'骗子电路',通过实验验证了中间层和晚期层的双阶段机制,并展示了抑制特定层可显著降低幻觉输出的置信度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19423 2025-11-25 q-bio.QM cs.AI 88%

Beyond Protein Language Models: An Agentic LLM Framework for Mechanistic Enzyme Design

超越蛋白质语言模型:一种用于机制酶设计的代理LLM框架

Bruno Jacob, Khushbu Agarwal, Marcel Baer, Peter Rice, Simone Raugei

机构 * Pacific Northwest National Laboratory(太平洋西北国家实验室)

专题命中 知识编辑与模型理解 :LLM(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 Genie-CAT通过整合文献推理、结构解析、静电势计算和机器学习预测,实现蛋白质设计中可解释的科学假设生成,提升计算发现效率。

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22272 2025-11-18 cs.LG 88%

Fine-Grained Uncertainty Decomposition in Large Language Models: A Spectral Approach

Nassim Walha, Sebastian G. Gruber, Thomas Decker, Yinchong Yang, Alireza Javanmardi, Eyke Hüllermeier, Florian Buettner

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09864 2025-11-14 cs.LG 88%

Uncertainty-Guided Checkpoint Selection for Reinforcement Finetuning of Large Language Models

Manh Nguyen, Dung Nguyen, Dai Do, Svetha Venkatesh, Hung Le

机构 * Applied Artificial Intelligence Initiative(应用人工智能计划) Deakin University(德肯大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02087 2025-11-13 cs.CL 88%

When Truth Is Overridden: Uncovering the Internal Origins of Sycophancy in Large Language Models

Keyu Wang, Jin Li, Shu Yang, Zhuoran Zhang, Di Wang

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04179 2025-11-07 cs.SE cs.AI 88%

Explaining Software Vulnerabilities with Large Language Models

Oshando Johnson, Alexandra Fomina, Ranjith Krishnamurthy, Vaibhav Chaudhari, Rohith Kumar Shanmuganathan, Eric Bodden

机构 * Chapman University(查普曼大学) Paderborn University(帕德博恩大学) University of Oldenburg(奥尔登堡大学) Paderborn University and Fraunhofer IEM(帕德博恩大学和弗劳恩霍夫IEM研究所)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27328 2025-11-05 cs.CL 88%

A Unified Representation Underlying the Judgment of Large Language Models

Yi-Long Lu, Jiajun Song, Wei Wang

机构 * State Key Laboratory of General Artificial Intelligence(人工智能通用技术国家重点实验室) BIGAI

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01363 2025-11-04 cs.AI 88%

Automatic Minds: Cognitive Parallels Between Hypnotic States and Large Language Model Processing

Giuseppe Riva, Brenda K. Wiederhold, Fabrizia Mantovani

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments 4 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15702 2025-10-28 cs.CL 88%

LyapLock: Bounded Knowledge Preservation in Sequential Large Language Model Editing

Peng Wang, Biyu Zhou, Xuehai Tang, Jizhong Han, Songlin Hu

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络空间安全学院)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments EMNLP 2025 main

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20252 2025-10-24 cs.AI 88%

Individualized Cognitive Simulation in Large Language Models: Evaluating Different Cognitive Representation Methods

Tianyi Zhang, Xiaolin Zhou, Yunzhe Wang, Erik Cambria, David Traum, Rui Mao

机构 * Department of Computer Science, University of Southern California(计算机科学系,南加州大学) College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学) USC Institute for Creative Technologies(南加州大学创意技术研究所)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14045 2025-10-14 cs.AI cs.HC 88%

Metacognition and Uncertainty Communication in Humans and Large Language Models

Mark Steyvers, Megan A. K. Peters

机构 * Department of Cognitive Sciences University of California, Irvine(认知科学系 加州大学尔湾分校)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Journal ref Current Directions in Psychological Science, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06912 2025-10-09 cs.LG 88%

Utilizing Large Language Models for Machine Learning Explainability

Alexandros Vassiliades, Nikolaos Polatidis, Stamatios Samaras, Sotiris Diplaris, Ignacio Cabrera Martin, Yannis Manolopoulos, Stefanos Vrochidis, Ioannis Kompatsiaris

机构 * Centre for Research \& Technology, Hellas School of Architecture Technology Engineering, University of Brighton, BN2 4GJ, United Kingdom University of Nicosia, 2417 Cyprus

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25252 2025-10-03 cs.AI 88%

Fact Grounded Attention: Eliminating Hallucination in Large Language Models Through Attention Level Knowledge Integration

Aayush Gupta

机构 * Aayush Gupta(独立研究者)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments 15 pages, 3 figures, 4 tables. Code and dataset available at https://github.com/ayushgupta4897/FGA

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24338 2025-09-30 cs.CL 88%

AlignX: Advancing Multilingual Large Language Models with Multilingual Representation Alignment

Mengyu Bu, Shaolei Zhang, Zhongjun He, Hua Wu, Yang Feng

机构 * Key Laboratory of Intelligent Information Processing, Institute of Computing Technology, Chinese Academy of Sciences (ICT/CAS)(智能信息处理重点实验室,计算技术研究所,中国科学院) Key Laboratory of AI Safety, Chinese Academy of Sciences(人工智能安全重点实验室,中国科学院) University of Chinese Academy of Sciences, Beijing, China(中国科学院大学,北京,中国) Baidu Inc.(百度公司)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments Accepted to EMNLP 2025 Main Conference. The code will be available at https://github.com/ictnlp/AlignX

详情

展开后加载摘要…

URL PDF HTML 收藏