arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7505 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7505 篇

2509.06596 2025-09-09 cs.CL cs.AI 90%

HAVE: Head-Adaptive Gating and ValuE Calibration for Hallucination Mitigation in Large Language Models

Xin Tong, Zhi Lin, Jingya Wang, Bo Jin

机构 * Xin Tong School of Information and Cyber Security People’s Public Security University of China(信息与网络安全学院 中国人民公安大学) Zhi Lin School of Safety Science Tsinghua University(安全科学学院 清华大学) Jingya Wang School of Information and Cyber Security People’s Public Security University of China(信息与网络安全学院 中国人民公安大学) Bo Jin* The Third Research Institute of the Ministry of Public Security of China(公安部第三研究所)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09997 2025-09-04 cs.CL cs.AI 90%

Attention-guided Self-reflection for Zero-shot Hallucination Detection in Large Language Models

Qiang Liu, Xinlong Chen, Yue Ding, Bowen Song, Weiqiang Wang, Shu Wu, Liang Wang

机构 * New Laboratory of Pattern Recognition (NLPR), State Key Laboratory of Multimodal Artificial Intelligence Systems (MAIS), Institute of Automation, Chinese Academy of Sciences (CASIA)(模式识别新实验室、多模态人工智能系统国家重点实验室、自动化研究所、中国科学院)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08100 2025-09-03 cs.LG cs.AI 90%

Grid2Guide: A* Enabled Small Language Model for Indoor Navigation

Md. Wasiul Haque, Sagar Dasgupta, Mizanur Rahman

机构 * The University of Alabama(阿拉巴马大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);small language model(title,abstract);SLM(abstract);分类 cs.AI、cs.LG

Comments 17 pages, 9 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15841 2025-08-25 cs.CL cs.LG 90%

A Review of Developmental Interpretability in Large Language Models

Ihor Kendiukhov

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02433 2025-08-21 cs.CL cs.AI stat.ML 90%

SLED: Self Logits Evolution Decoding for Improving Factuality in Large Language Models

Jianyi Zhang, Da-Cheng Juan, Cyrus Rashtchian, Chun-Sung Ferng, Heinrich Jiang, Yiran Chen

机构 * Duke University(杜克大学) Google Research(谷歌研究)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments Accepted at NeurIPS 2024; project page is available at https://jayzhang42.github.io/sled_page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05328 2025-08-19 cs.CL cs.LG 90%

FacLens: Transferable Probe for Foreseeing Non-Factuality in Fact-Seeking Question Answering of Large Language Models

Yanling Wang, Haoyang Li, Hao Zou, Jing Zhang, Xinlei He, Qi Li, Ke Xu

机构 * Zhipu AI(智谱AI) Zhongguancun Laboratory(中关村实验室) Renmin University of China(中国人民大学) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Tsinghua University(清华大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03741 2025-08-07 cs.LG cs.AI 90%

Latent Knowledge Scalpel: Precise and Massive Knowledge Editing for Large Language Models

Xin Liu, Qiyang Song, Shaowen Xu, Kerou Zhou, Wenbo Jiang, Xiaoqi Jia, Weijuan Zhang, Heqing Huang, Yakai Li

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院) Tsinghua University(清华大学) University of Electronic Science and Technology of China(电子科技大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

Comments Accepted by ECAI 2025 - 28th European Conference on Artificial Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01862 2025-08-05 cs.CL cs.AI 90%

Counterfactual Probing for Hallucination Detection and Mitigation in Large Language Models

Yijun Feng

机构 * Shihezi University(石河子大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01781 2025-08-05 cs.CL cs.AI 90%

A comprehensive taxonomy of hallucinations in Large Language Models

Manuel Cossio

机构 * Universitat de Barcelona(巴塞罗那大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments 55 pages, 16 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19156 2025-07-28 cs.CL cs.AI cs.CY cs.HC 90%

An Empirical Investigation of Gender Stereotype Representation in Large Language Models: The Italian Case

Gioele Giachino, Marco Rondina, Antonio Vetrò, Riccardo Coppola, Juan Carlos De Martin

机构 * Politecnico di Torino(都灵理工大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments 16 pages, European Conference on Machine Learning and Principles and Practice of Knowledge Discovery in Databases (ECML PKDD 2025) - 5th Workshop on Bias and Fairness in AI (BIAS25)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08199 2025-07-09 cs.CV cs.AI cs.LG 90%

A Cascading Cooperative Multi-agent Framework for On-ramp Merging Control Integrating Large Language Models

Miao Zhang, Zhenlong Fang, Tianyi Wang, Qian Zhang, Shuai Lu, Junfeng Jiao, Tianyu Shi

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Department of Computer Science & Engineering, University of Minnesota(明尼苏达大学计算机科学与工程系) Department of Mechanical Engineering & Materials Science, Yale University(耶鲁大学机械工程与材料科学系) Computer Vision, BYD COMPANY LIMITED(计算机视觉,比亚迪有限公司) School of Architecture, University of Texas at Austin(德克萨斯大学奥斯汀分校建筑学院) Faculty of Applied Science & Engineering, University of Toronto(多伦多大学应用科学与工程学院)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.15627 2025-07-01 cs.CL cs.LG 90%

Benchmarking Uncertainty Quantification Methods for Large Language Models with LM-Polygraph

Roman Vashurin, Ekaterina Fadeeva, Artem Vazhentsev, Lyudmila Rvanova, Akim Tsvigun, Daniil Vasilev, Rui Xing, Abdelrahman Boda Sadallah, Kirill Grishchenkov, Sergey Petrakov, Alexander Panchenko, Timothy Baldwin, Preslav Nakov, Maxim Panov, Artem Shelmanov

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

Comments Published at TACL 2025, presented at ACL 2025. Roman Vashurin, Ekaterina Fadeeva, Artem Vazhentsev contributed equally

Journal ref Transactions of the Association for Computational Linguistics, 13 (2025) 220-248

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21091 2025-06-24 cs.CY cs.AI cs.CL 90%

Position is Power: System Prompts as a Mechanism of Bias in Large Language Models (LLMs)

Anna Neumann, Elisabeth Kirsten, Muhammad Bilal Zafar, Jatinder Singh

机构 * Research Center Trust, UA Ruhr University of Duisburg-Essen(杜伊斯堡-埃森大学) Ruhr University Bochum(波恩鲁尔大学) University of Cambridge(剑桥大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments Published in Proceedings of ACM FAccT 2025 Update Comment: Fixed the error where user vs. system and implicit vs. explicit labels in the heatmaps were switched. The takeaways remain the same

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06657 2025-06-10 cs.CL cs.AI 90%

Quantile Regression with Large Language Models for Price Prediction

Nikhita Vedula, Dushyanta Dhyani, Laleh Jalali, Boris Oreshkin, Mohsen Bayati, Shervin Malmasi

机构 * Amazon.com, Inc.(亚马逊公司) Stanford University(斯坦福大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments Accepted to Findings of ACL, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06539 2025-06-10 cs.CL cs.AI 90%

Beyond Facts: Evaluating Intent Hallucination in Large Language Models

Yijie Hao, Haofei Yu, Jiaxuan You

机构 * Emory University(埃默里大学) UIUC(伊利诺伊大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments Accepted to ACL 2025 main conference

Journal ref Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (ACL 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05068 2025-06-09 cs.CL cs.AI 90%

Does It Make Sense to Speak of Introspection in Large Language Models?

Iulia M. Comsa, Murray Shanahan

机构 * Google DeepMind(谷歌DeepMind) Imperial College London(帝国学院伦敦)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04739 2025-06-06 cs.CL cs.AI 90%

Lifelong Evolution: Collaborative Learning between Large and Small Language Models for Continuous Emergent Fake News Detection

Ziyi Zhou, Xiaoming Zhang, Litian Zhang, Yibo Zhang, Zhenyu Guan, Chaozhuo Li, Philip S. Yu

机构 * School of Cyber Science and Technology, Beihang University(信息科学与技术学院,北京航空航天大学) School of Cyber Science and Technology, Beijing University of Posts and Telecommunications(信息科学与技术学院,北京邮电大学) Department of Computer Science, University of Illinois at Chicago(计算机科学系,伊利诺伊大学芝加哥分校)

专题命中 知识编辑与模型理解 :language model(title,abstract);small language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24445 2025-06-02 cs.LG cs.AI 90%

Learning Safety Constraints for Large Language Models

Xin Chen, Yarden As, Andreas Krause

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

Comments ICML 2025 (Spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07233 2025-05-19 cs.CL cs.AI 90%

DynamicRAG: Leveraging Outputs of Large Language Model as Feedback for Dynamic Reranking in Retrieval-Augmented Generation

Jiashuo Sun, Xianrui Zhong, Sizhe Zhou, Jiawei Han

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments 24 pages, 7 figures, 15 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07883 2025-05-14 cs.CL cs.AI 90%

Recovering Event Probabilities from Large Language Model Embeddings via Axiomatic Constraints

Jian-Qiao Zhu, Haijiang Yan, Thomas L. Griffiths

机构 * Department of Computer Science(计算机科学系) Princeton University(普林斯顿大学) Department of Psychology(心理学系) University of Warwick(沃里克大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02859 2025-05-07 cs.CL cs.AI 90%

Enhancing ML Model Interpretability: Leveraging Fine-Tuned Large Language Models for Better Understanding of AI

Jonas Bokstaller, Julia Altheimer, Julian Dormehl, Alina Buss, Jasper Wiltfang, Johannes Schneider, Maximilian Röglinger

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00557 2025-05-02 cs.CL cs.AI 90%

Triggering Hallucinations in LLMs: A Quantitative Study of Prompt-Induced Hallucination in Large Language Models

Makoto Sato

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);instruction tuning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.21012 2025-05-02 cs.CL cs.AI 90%

Waking Up an AI: A Quantitative Framework for Prompt-Induced Phase Transition in Large Language Models

Makoto Sato

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.19480 2025-04-29 cs.LG cs.AI 90%

An Automated Reinforcement Learning Reward Design Framework with Large Language Model for Cooperative Platoon Coordination

Dixiao Wei, Peng Yi, Jinlong Lei, Yiguang Hong, Yuchuan Du

机构 * Shanghai Research Institute for Intelligent Autonomous Systems, Tongji University(上海智能自主系统研究院,同济大学) Department of Control Science and Engineering, Tongji University(控制科学与工程系,同济大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13644 2025-04-21 cs.AI cs.CL 90%

Exploring the Potential for Large Language Models to Demonstrate Rational Probabilistic Beliefs

Gabriel Freedman, Francesca Toni

机构 * Department of Computing, Imperial College London, UK(计算系,帝国理工学院伦敦分校)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04222 2025-04-16 cs.LG cs.AI cs.CR 90%

TrafficLLM: Enhancing Large Language Models for Network Traffic Analysis with Generic Traffic Representation

Tianyu Cui, Xinjie Lin, Sijia Li, Miao Chen, Qilei Yin, Qi Li, Ke Xu

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07898 2025-04-11 cs.IR cs.CL cs.LG 90%

How do Large Language Models Understand Relevance? A Mechanistic Interpretability Perspective

Qi Liu, Jiaxin Mao, Ji-Rong Wen

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05324 2025-04-09 cs.IR cs.AI cs.CL 90%

Hybrid Retrieval for Hallucination Mitigation in Large Language Models: A Comparative Analysis

Chandana Sree Mala, Gizem Gezici, Fosca Giannotti

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13622 2025-04-09 cs.CL cs.AI 90%

REFIND at SemEval-2025 Task 3: Retrieval-Augmented Factuality Hallucination Detection in Large Language Models

DongGeon Lee, Hwanjo Yu

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments Accepted to SemEval@ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.00936 2025-04-09 cs.CL cs.AI 90%

Large Language Model Enhanced Knowledge Representation Learning: A Survey

Xin Wang, Zirui Chen, Haofen Wang, Leong Hou U, Zhao Li, Wenbin Guo

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏