arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7552 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7552 篇

2512.00663 2025-12-03 cs.CL cs.AI 73%

Graphing the Truth: Structured Visualizations for Automated Hallucination Detection in LLMs

图示真相:用于自动幻觉检测的结构化可视化

Tanmay Agrawal

机构 * Department of Computer Science, University of Arizona(计算机科学系,亚利桑那大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出通过结构化可视化技术,帮助自动检测大型语言模型中的幻觉问题,提升模型可靠性和响应质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22402 2025-12-01 cs.CL cs.AI 73%

Mapping Clinical Doubt: Locating Linguistic Uncertainty in LLMs

临床怀疑的映射:在大语言模型中定位语言不确定性

Srivarshinee Sridhar, Raghav Kaushik Ravi, Kripabandhu Ghosh

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本研究探讨了大语言模型在医疗文本中对语言不确定性的表示敏感性,提出MSU指标以量化模型对不确定性的响应,揭示了认知信息在模型深度中的逐步编码过程。

Comments Accepted to AAAI'26 SECURE-AI4H Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13246 2025-11-21 cs.CL cs.AI 73%

Atomic Calibration of LLMs in Long-Form Generations

大语言模型在长文本生成中的原子校准

Caiqi Zhang, Ruihan Yang, Zhisong Zhang, Xinting Huang, Sen Yang, Dong Yu, Nigel Collier

机构 * University of Cambridge(剑桥大学) Fudan University(复旦大学) Tencent AI Lab(腾讯AI实验室) The Chinese University of Hong Kong(香港中文大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本研究提出原子校准方法,用于改进大语言模型在长文本生成中的校准能力,揭示置信度方法与生成过程中置信度变化的关联。

Comments ACL 2025 KnowFM Oral / AACL-IJCNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11305 2025-11-19 cs.IR cs.AI cs.CV cs.LG 73%

MOON Embedding: Multimodal Representation Learning for E-commerce Search Advertising

Chenghan Fu, Daoze Zhang, Yukang Lin, Zhanheng Nie, Xiang Zhang, Jianyu Liu, Yueran Liu, Wanxian Guan, Pengjie Wang, Jian Xu, Bo Zheng

机构 * Alibaba Group(阿里巴巴集团) Taobao(淘宝)

专题命中 知识编辑与模型理解 :pretraining(abstract);post-training(abstract);分类 cs.AI、cs.LG

Comments 31 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12381 2025-11-18 cs.CL cs.AI 73%

Don't Think of the White Bear: Ironic Negation in Transformer Models Under Cognitive Load

Logan Mann, Nayan Saxena, Sarah Tandon, Chenhao Sun, Savar Toteja, Kevin Zhu

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11182 2025-11-17 cs.AI cs.CL cs.MA cs.MM 73%

Multi-agent Undercover Gaming: Hallucination Removal via Counterfactual Test for Multimodal Reasoning

Dayong Liang, Xiao-Yong Wei, Changmeng Zheng

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10879 2025-11-17 cs.CL cs.LG 73%

ICX360: In-Context eXplainability 360 Toolkit

Dennis Wei, Ronny Luss, Xiaomeng Hu, Lucas Monteiro Paes, Pin-Yu Chen, Karthikeyan Natesan Ramamurthy, Erik Miehling, Inge Vejsbjerg, Hendrik Strobelt

机构 * IBM Research(IBM研究院)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 14 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15267 2025-11-12 cs.CL cs.AI 73%

TraceCoder: Towards Traceable ICD Coding via Multi-Source Knowledge Integration

Mucheng Ren, He Chen, Yuchen Yan, Danqing Hu, Jun Xu, Xian Zeng

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accpeted as BIBM 2025 Regular. 6 pages. Camera-Ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06048 2025-11-11 cs.CL cs.LG 73%

Visual Exploration of Feature Relationships in Sparse Autoencoders with Curated Concepts

Xinyuan Yan, Shusen Liu, Kowshik Thopalli, Bei Wang

机构 * University of Utah(犹他大学) Lawrence Livermore National Laboratory(劳伦斯利弗莫尔国家实验室)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 8 pages (5 main paper+3 refernce), 2 figures, pulished at Mechanistic Interpretability Workshop at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05583 2025-11-10 cs.LG cs.AI stat.ML 73%

Conformal Prediction Adaptive to Unknown Subpopulation Shifts

Nien-Shao Wang, Duygu Nur Yaldiz, Yavuz Faruk Bakman, Sai Praneeth Karimireddy

机构 * University of Southern California(南加州大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 21 pages, 7 figures, 5 tables, submitted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24630 2025-11-07 cs.CL cs.AI 73%

Reasoning Models Hallucinate More: Factuality-Aware Reinforcement Learning for Large Reasoning Models

Junyi Li, Hwee Tou Ng

机构 * Department of Computer Science, National University of Singapore(计算机科学系,新加坡国立大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03635 2025-11-06 cs.CL cs.LG 73%

Towards Transparent Stance Detection: A Zero-Shot Approach Using Implicit and Explicit Interpretability

Apoorva Upadhyaya, Wolfgang Nejdl, Marco Fisichella

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Accepted in AAAI CONFERENCE ON WEB AND SOCIAL MEDIA (ICWSM 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12839 2025-11-06 cs.CL cs.AI cs.CE cs.CY 73%

FaStfact: Faster, Stronger Long-Form Factuality Evaluations in LLMs

Yingjia Wan, Haochen Tan, Xiao Zhu, Xinyu Zhou, Zhiwei Li, Qingsong Lv, Changxuan Sun, Jiaqi Zeng, Yi Xu, Jianqiao Lu, Yinhong Liu, Zhijiang Guo

机构 * UCLA(美国大学洛杉矶分校) CUHK(香港中文大学) HKUST (GZ)(香港科技大学(广州)) HKUST(香港科技大学) Tsinghua University(清华大学) ECNU(华东师范大学) NVIDIA(英伟达) UCL(伦敦大学学院) HKU(香港大学) University of Cambridge(剑桥大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2025 (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02022 2025-11-05 cs.LG cs.AI 73%

Shared Parameter Subspaces and Cross-Task Linearity in Emergently Misaligned Behavior

Daniel Aarao Reis Arturi, Eric Zhang, Andrew Ansah, Kevin Zhu, Ashwinee Panda, Aishwarya Balwani

机构 * McGill University(麦吉尔大学) McMaster University(麦马斯特大学) University of Alberta(阿尔伯塔大学) Algoverse AI Research(Algoverse AI研究) St. Jude Children’s Research Hospital(圣犹大儿童研究医院)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00333 2025-11-03 cs.CL cs.AI 73%

More of the Same: Persistent Representational Harms Under Increased Representation

Jennifer Mickel, Maria De-Arteaga, Leqi Liu, Kevin Tian

机构 * EleutherAI Universitat Ramon Llull, ESADE(拉蒙·拉鲁尔大学,ESADE) UT Austin(德克萨斯大学奥斯汀分校)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Proceedings of the Neural Information Processing Systems (NeurIPS) 2025; 39 pages, 7 figures, 15 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.22366 2025-10-29 cs.LG cs.AI cs.CV 73%

One-Step is Enough: Sparse Autoencoders for Text-to-Image Diffusion Models

Viacheslav Surkov, Chris Wendler, Antonio Mari, Mikhail Terekhov, Justin Deschenaux, Robert West, Caglar Gulcehre, David Bau

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22866 2025-10-28 cs.CL cs.LG 73%

Interpreting and Mitigating Unwanted Uncertainty in LLMs

Tiasa Singha Roy, Ayush Rajesh Jhaveri, Ilias Triantafyllopoulos

机构 * New York University(纽约大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22139 2025-10-28 cs.LG cs.CL 73%

Edit Less, Achieve More: Dynamic Sparse Neuron Masking for Lifelong Knowledge Editing in LLMs

Jinzhe Liu, Junshu Sun, Shufan Shen, Chenxue Yang, Shuhui Wang

机构 * Key Lab of Intell. Info. Process., Inst. of Comput. Tech., CAS(智能信息处理重点实验室,计算技术研究所,中国科学院) University of Chinese Academy of Sciences(中国科学院大学) Agriculture Information Institute, CAAS(农业信息研究所,中国农业科学院)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 19 pages, 11 figures, Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07036 2025-10-27 cs.LG cs.AI 73%

Methodological Insights into Structural Causal Modelling and Uncertainty-Aware Forecasting for Economic Indicators

Federico Cerutti

机构 * University of Brescia, Italy(意大利布雷西亚大学) Imperial College London, UK(伦敦帝国理工学院) Cardiff University, UK(卡迪夫大学) University of Southampton, UK(南安普顿大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted at the 2nd edition of the Workshop in AI and Finance at ECAI-2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20479 2025-10-24 cs.CL cs.AI 73%

RECALL: REpresentation-aligned Catastrophic-forgetting ALLeviation via Hierarchical Model Merging

Bowen Wang, Haiyuan Wan, Liwen Shi, Chen Yang, Peng He, Yue Ma, Haochen Han, Wenhao Li, Tiao Tan, Yongjian Li, Fangming Liu, Yifan Gong, Sheng Zhang

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Peng Cheng Laboratory(鹏城实验室) Huazhong University of Science and Technology(华中科技大学) Xiamen University(厦门大学) The Hong Kong University of Science and Technology, Guangzhou(香港科技大学(广州)) School of Biomedical Engineering, Tsinghua University(清华大学生物医学工程学院)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11576 2025-10-23 cs.LG cs.AI cs.CV 73%

Concept-Guided Interpretability via Neural Chunking

Shuchen Wu, Stephan Alaniz, Shyamgopal Karthik, Peter Dayan, Eric Schulz, Zeynep Akata

机构 * Allen Institute(阿伦研究所) University of Washington(华盛顿大学) Télécom Paris, Institut Polytechnique de Paris(巴黎高等电信学院) Institute of Explainable Machine Learning, Helmholtz Munich(可解释机器学习研究所,海德堡大学) Department of Computational Neuroscience, Max Planck Institute for Biological Cybernetics(生物信息学研究所,马克斯·普朗克研究院) Institute for Human-Centered AI, Helmholtz Munich(以人为中心的人工智能研究所,海德堡大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15543 2025-10-20 cs.CL cs.AI cs.IR cs.MM 73%

MCA: Modality Composition Awareness for Robust Composed Multimodal Retrieval

Qiyu Wu, Shuyang Cui, Satoshi Hayakawa, Wei-Yao Wang, Hiromi Wakaki, Yuki Mitsufuji

机构 * Sony Group Corporation(索尼集团公司) Sony AI(索尼人工智能)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04886 2025-10-16 cs.CL cs.AI 73%

Emergent Semantics Beyond Token Embeddings: Transformer LMs with Frozen Visual Unicode Representations

A. Bochkov

机构 * Moscow Institute of Physics and Technology (MIPT)(莫斯科物理技术学院)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Published in Transactions on Machine Learning Research (10/2025). OpenReview: https://openreview.net/forum?id=Odh8IynO1o

Journal ref Transactions on Machine Learning Research (TMLR), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17281 2025-10-10 cs.CL cs.AI 73%

Search Wisely: Mitigating Sub-optimal Agentic Searches By Reducing Uncertainty

Peilin Wu, Mian Zhang, Xinlu Zhang, Xinya Du, Zhiyu Zoey Chen

机构 * Department of Computer Science, The University of Texas at Dallas(德克萨斯大学达拉斯分校计算机科学系) Department of Computer Science, University of California, Santa Barbara(加州大学圣巴巴拉分校计算机科学系)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to EMNLP 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14420 2025-10-08 q-fin.CP cs.CL cs.LG 73%

SAE-FiRE: Enhancing Earnings Surprise Predictions Through Sparse Autoencoder Feature Selection

Huopu Zhang, Yanguang Liu, Miao Zhang, Zirui He, Mengnan Du

机构 * Georgia Institute of Technology(佐治亚理工学院) New Jersey Institute of Technology(新泽西理工学院)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12324 2025-10-08 cs.CL cs.AI 73%

Cross-Document Cross-Lingual NLI via RST-Enhanced Graph Fusion and Interpretability Prediction

Mengying Yuan, Wenhao Wang, Zixuan Wang, Yujie Huang, Kangli Wei, Fei Li, Chong Teng, Donghong Ji

机构 * Key Laboratory of Aerospace Information Security and Trusted Computing, Ministry of Education, School of Cyber Science and Engineering, Wuhan University(航空信息安全与可信计算重点实验室,教育部,网络安全与工程学院,武汉大学) Zhejiang University(浙江大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2025 Main (Camera Ready)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05116 2025-10-08 cs.CL cs.AI 73%

Hallucination is Inevitable for LLMs with the Open World Assumption

Bowen Xu

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20836 2025-10-07 cs.LG cs.AI 73%

First Hallucination Tokens Are Different from Conditional Ones

Jakob Snel, Seong Joon Oh

机构 * University of Tübingen, Germany(图宾根大学) Tübingen AI Center(图宾根人工智能中心)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 4.5 pages, 3 figures, Dataset, Knowledge Paper, Hallucination, Trustworthiness

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04285 2025-10-07 cs.CL cond-mat.stat-mech cs.LG stat.ML 73%

Probing Geometry of Next Token Prediction Using Cumulant Expansion of the Softmax Entropy

Karthik Viswanathan, Sang Eon Park

机构 * Institute of Physics, University of Amsterdam(阿姆斯特丹大学物理研究所) Massachusetts Institute of Technology(麻省理工学院)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 14 pages, 7 figures. Poster at HiLD 2025: 3rd Workshop on High-dimensional Learning Dynamics

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03351 2025-10-07 cs.LG cs.AI eess.IV 73%

Interpretable Neuropsychiatric Diagnosis via Concept-Guided Graph Neural Networks

Song Wang, Zhenyu Lei, Zhen Tan, Jundong Li, Javier Rasero, Aiying Zhang, Chirag Agarwal

机构 * University of Central Florida(中央佛罗里达大学) University of Virginia(弗吉尼亚大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏