arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7526 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7526 篇

2510.12181 2025-10-15 cs.CL cs.AI 88%

From Knowledge to Treatment: Large Language Model Assisted Biomedical Concept Representation for Drug Repurposing

Chengrui Xiang, Tengfei Ma, Xiangzheng Fu, Yiping Liu, Bosheng Song, Xiangxiang Zeng

机构 * College of Computer Science and Electronic Engineering, Hunan University(计算机科学与电子工程学院,湖南大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments 16 pages, 4 figures, 13 tables. Accepted by EMNLP 2025 (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12137 2025-10-15 cs.CL cs.AI 88%

Credal Transformer: A Principled Approach for Quantifying and Mitigating Hallucinations in Large Language Models

Shihao Ji, Zihui Song, Jiajie Huang

机构 * Zaozhuang No.28 Middle School(邹庄28号中学) Tengzhou No.1 High School(滕州1号高中) Xi’an Jiaotong University(西安交通大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10398 2025-10-14 cs.CL cs.AI 88%

STEAM: A Semantic-Level Knowledge Editing Framework for Large Language Models

Geunyeong Jeong, Juoh Sun, Seonghee Lee, Harksoo Kim

机构 * Konkuk University(韩国康康大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted to EMNLP 2025 (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15460 2025-10-08 cs.AI cs.CL math.SP 88%

Hallucination Detox: Sensitivity Dropout (SenD) for Large Language Model Training

Shahrad Mohammadzadeh, Juan David Guerra, Marco Bonizzato, Reihaneh Rabbany, Golnoosh Farnadi

机构 * McGill University(麦吉尔大学) Polytechnique Montréal(蒙特利尔理工学院) Université de Montréal(蒙特利尔大学) Mila - Quebec Artificial Intelligence Institute(魁北克人工智能研究所) CIFAR AI Chair(CIFAR人工智能主席)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted to ACL 2025, accepted to Safe Generative AI Workshop @ NeurIPS 2024. Camera-ready version for ACL 2025 (to appear). Submitted July 2025

Journal ref Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers), pages 5538-5554, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01274 2025-10-03 cs.CL cs.LG 88%

TraceDet: Hallucination Detection from the Decoding Trace of Diffusion Large Language Models

Shenxu Chang, Junchi Yu, Weixing Wang, Yongqiang Chen, Jialin Yu, Philip Torr, Jindong Gu

机构 * Department of Engineering Science, University of Oxford, UK(牛津大学工程科学系) Hasso Plattner Institute, University of Potsdam(波茨坦大学哈索普兰特纳研究所) Carnegie Mellon University(卡内基梅隆大学) Mohamed bin Zayed University of Artificial Intelligence(姆罕默德·本·拉希德智能大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01231 2025-10-03 cs.CL cs.AI stat.ML 88%

Trustworthy Summarization via Uncertainty Quantification and Risk Awareness in Large Language Models

Shuaidong Pan, Di Wu

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19375 2025-09-25 cs.LG cs.AI stat.ML 88%

Uncertainty Quantification of Large Language Models using Approximate Bayesian Computation

Mridul Sharma, Adeetya Patel, Zaneta D' Souza, Samira Abbasgholizadeh Rahimi, Siva Reddy, Sreenath Madathil

机构 * Faculty of Dental Medicine and Oral Health Sciences, McGill University(牙医学院与口腔健康科学学院,麦吉尔大学) McGill University(麦吉尔大学) Mila–Quebec Artificial Intelligence Institute(魁北克人工智能研究所) School of Computer Science, McGill University(计算机科学学院,麦吉尔大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18123 2025-09-24 cs.AI cs.LG 88%

SPADE: A Large Language Model Framework for Soil Moisture Pattern Recognition and Anomaly Detection in Precision Agriculture

Yeonju Lee, Rui Qi Chen, Joseph Oboamah, Po Nien Su, Wei-zhen Liang, Yeyin Shi, Lu Gan, Yongsheng Chen, Xin Qiao, Jing Li

机构 * organization= H. Milton Stewart School of Industrial Systems Engineering, Georgia Institute of Technology , city= Atlanta , state= GA , country= USA organization= Panhandle Research Extension Center, University of Nebraska-Lincoln , city= Scottsbluff , state= NE , country= USA organization= Department of Computer Science Engineering, University of Nebraska-Lincoln , city= Lincoln , state= NE , country= USA organization= Department of Biological Systems Engineering, University of Nebraska-Lincoln , city= Lincoln , state= NE , country= USA organization= Institute for Robotics Intelligent Machines, Georgia Institute of Technology , city= Atlanta , state= GA , country= USA organization= School of Civil \& Environmental Engineering, Georgia Institute of Technology, Georgia Institute of Technology , city= Atlanta , state= GA , country= USA

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17665 2025-09-23 cs.LG cs.AI cs.CY 88%

Mechanistic Interpretability with SAEs: Probing Religion, Violence, and Geography in Large Language Models

Katharina Simbeck, Mariam Mahran

机构 * HTW Berlin University of Applied Sciences(柏林应用科学大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

Comments Accepted at AEQUITAS 2025: Workshop on Fairness and Bias in AI | co-located with ECAI, October 26th, 2025, Bologna, Italy. 12 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16696 2025-09-23 cs.CL cs.LG 88%

Decoding Uncertainty: The Impact of Decoding Strategies for Uncertainty Estimation in Large Language Models

Wataru Hashimoto, Hidetaka Kamigaito, Taro Watanabe

机构 * Nara Institute of Science and Technology(奈良科学技术大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

Comments Accepted at EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15403 2025-09-22 cs.CL cs.LG 88%

Quantifying Uncertainty in Natural Language Explanations of Large Language Models for Question Answering

Yangyi Li, Mengdi Huai

机构 * Department of Computer Science, Iowa State University(计算机科学系,爱荷华州立大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20020 2025-09-19 cs.LG cs.AI 88%

Modular Machine Learning: An Indispensable Path towards New-Generation Large Language Models

Xin Wang, Haoyang Li, Haibo Chen, Zeyang Zhang, Wenwu Zhu

机构 * Department of Computer Science and Technology, BNRist, Tsinghua University(计算机科学与技术系,BNRist,清华大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

Comments 20 pages, 4 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11299 2025-09-09 cs.CL cs.AI 88%

BriLLM: Brain-inspired Large Language Model

Hai Zhao, Hongqiu Wu, Dongjie Yang, Anni Zou, Jiale Hong

机构 * AGI Institute(AGI研究院) Computer School(计算机学院) Shanghai Jiao Tong University(上海交通大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07992 2025-09-09 cs.CL cs.LG 88%

Concept Bottleneck Large Language Models

Chung-En Sun, Tuomas Oikarinen, Berk Ustun, Tsui-Wei Weng

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

Comments Accepted to ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.10722 2025-09-03 cs.CL cs.AI 88%

MEGen: Generative Backdoor into Large Language Models via Model Editing

Jiyang Qiu, Xinbei Ma, Zhuosheng Zhang, Hai Zhao, Yun Li, Qianren Wang

机构 * School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院) Key Laboratory of Shanghai Education Commission for Intelligent Interaction and Cognitive Engineering, Shanghai Jiao Tong University(上海交通大学智能交互与认知工程重点实验室) Shanghai Key Laboratory of Trusted Data Circulation and Governance in Web3(上海Web3可信数据流通与治理重点实验室) Cognitive AI Lab(认知人工智能实验室)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments ACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11308 2025-08-26 cs.AI cs.CL cs.CR 88%

Defending against Jailbreak through Early Exit Generation of Large Language Models

Chongwen Zhao, Zhihao Dou, Kaizhu Huang

机构 * Duke Kunshan University(杜克昆山大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments ICONIP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15847 2025-08-25 cs.CL cs.LG 88%

Mechanistic Exploration of Backdoored Large Language Model Attention Patterns

Mohammed Abu Baker, Lakshmi Babu-Saheer

机构 * Department of Computer Science, Anglia Ruskin University(计算机科学系,安格利亚 Ruskin 大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

Comments 13 pages. Mechanistic analysis of backdoored LLMs (Qwen2.5-3B). Code: https://github.com/mshahoyi/sa_attn_analysis. Base model: unsloth/Qwen2.5-3B-Instruct-unsloth-bnb-4bit. Finetuned models: https://huggingface.co/collections/mshahoyi/simple-sleeper-agents-68a1df3a7aaff310aa0e5336

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01832 2025-08-25 cs.CL cs.LG 88%

Rotary Offset Features in Large Language Models

André Jonasson

机构 * André Jonasson(独立研究者)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01196 2025-08-12 cs.CL cs.AI 88%

$μ$KE: Matryoshka Unstructured Knowledge Editing of Large Language Models

Zian Su, Ziyang Huang, Kaiyuan Zhang, Xiangyu Zhang

机构 * Purdue University(普渡大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments COLM 2025. The first two authors contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22915 2025-08-01 cs.CL cs.AI 88%

Theoretical Foundations and Mitigation of Hallucination in Large Language Models

Esmail Gumaan

机构 * Department of Computer Science, University of Sana'a(桑加大学计算机科学系)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04469 2025-07-21 cs.HC cs.AI cs.CL 88%

The role of large language models in UI/UX design: A systematic literature review

Ammar Ahmed, Ali Shariq Imran

机构 * Analytics (ISA) Research Group, Department of Computer Science (IDI), Norwegian University of Science \& Technology (NTNU) , city= Gj vik , postcode= 2815 , country= Norway

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01550 2025-07-16 cs.LG cs.CL cs.CR 88%

Representation Bending for Large Language Model Safety

Ashkan Yousefpour, Taeheon Kim, Ryan S. Kwon, Seungbeen Lee, Wonje Jeung, Seungju Han, Alvin Wan, Harrison Ngan, Youngjae Yu, Jonghyun Choi

机构 * Seoul National University(首尔国立大学) Yonsei University(延世大学) AIM Intelligence(AIM智能) University of Michigan(密歇根大学) Stanford University(斯坦福大学) Amazon AWS(亚马逊AWS)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

Comments Accepted to ACL 2025 (main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05448 2025-07-09 cs.CL cs.AI 88%

On the Semantics of Large Language Models

Martin Schuele

机构 * Institute of Computational Life Sciences, Zurich University of Applied Sciences(计算生命科学学院,应用科学大学) Institute of History and Philosophy of Science and Technology (IHPST), Université Paris 1 - Panthéon-Sorbonne(科学与技术历史与哲学研究所,巴黎第一大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Journal ref Intellectica, 81, (pp.15-36), 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05489 2025-07-01 cs.CL cs.AI 88%

Mechanistic Interpretability of Emotion Inference in Large Language Models

Ala N. Tak, Amin Banayeeanzade, Anahita Bolourani, Mina Kian, Robin Jia, Jonathan Gratch

机构 * Institute for Creative Technologies, University of Southern California (USC)(创意技术研究所,南加州大学) Information Sciences Institute, University of Southern California (USC)(信息科学研究所,南加州大学) Department of Computer Science, University of Southern California (USC)(计算机科学系,南加州大学) Department of Statistics and Data Science, University of California, Los Angeles (UCLA)(统计与数据科学系,加州大学洛杉矶分校)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments ACL 2025 camera-ready version. First two authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07184 2025-06-10 cs.AI cs.CL cs.CV 88%

Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images

Liangliang You, Junchi Yao, Shu Yang, Guimin Hu, Lijie Hu, Di Wang

机构 * Provable Responsible AI and Data Analytics (PRADA) Lab(可证明负责任的人工智能与数据分析实验室) King Abdullah University of Science and Technology(国王阿卜杜勒阿齐兹大学) University of Electronic Science and Technology of China(中国电子科学技术大学) University of Copenhagen(哥本哈根大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05393 2025-06-09 cs.CL cs.LG 88%

Are Large Language Models Good Temporal Graph Learners?

Shenyang Huang, Ali Parviz, Emma Kondrup, Zachary Yang, Zifeng Ding, Michael Bronstein, Reihaneh Rabbany, Guillaume Rabusseau

机构 * Mila - Quebec AI Institute(魁北克AI研究所) School of Computer Science, McGill University(麦吉尔大学计算机科学学院) University of Cambridge(剑桥大学) DIRO, Université de Montréal(蒙特利尔大学DIRO研究所) CIFAR AI Chair(CIFAR人工智能主席) New Jersey Institute of Technology(新泽西理工学院) University of Oxford(牛津大学) AITHYRA

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

Comments 9 pages, 9 tables, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00382 2025-06-06 cs.LG cs.CL 88%

Spectral Insights into Data-Oblivious Critical Layers in Large Language Models

Xuyuan Liu, Lei Hsiung, Yaoqing Yang, Yujun Yan

机构 * Dartmouth College(达特茅斯学院)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

Comments Accepted by Findings of ACL2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19631 2025-05-27 cs.CL cs.AI 88%

Segment First or Comprehend First? Explore the Limit of Unsupervised Word Segmentation with Large Language Models

Zihong Zhang, Liqi He, Zuchao Li, Lefei Zhang, Hai Zhao, Bo Du

机构 * School of Artificial Intelligence, Wuhan University(武汉大学人工智能学院) School of Computer Science, Wuhan University(武汉大学计算机学院) School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机学院)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19440 2025-05-27 cs.CL cs.LG 88%

The Birth of Knowledge: Emergent Features across Time, Space, and Scale in Large Language Models

Shashata Sawmya, Micah Adler, Nir Shavit

机构 * Massachusetts Institute of Technology(麻省理工学院) Red Hat, Inc.(红帽公司)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19663 2025-05-27 cs.CL cs.AI 88%

Identifying Knowledge Editing Types in Large Language Models

Xiaopeng Li, Shasha Li, Shangwen Wang, Shezheng Song, Bin Ji, Huijun Liu, Jun Ma, Jie Yu

机构 * National University of Denfense Technology(国防科技大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted by KDD 2025

详情

展开后加载摘要…

URL PDF HTML 收藏