arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7505 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7505 篇

2602.01875 2026-02-03 cs.CL 89%

PretrainRL: Alleviating Factuality Hallucination of Large Language Models at the Beginning

PretrainRL: 缓解大语言模型在开始阶段的事实性幻觉

Langming Liu, Kangtao Lv, Haibin Chen, Weidong Zhang, Yejing Wang, Shilei Liu, Xin Tong, Yujin Yuan, Yongwei Wang, Wenbo Su, Bo Zheng

机构 * Future Living Lab of Alibaba(阿里巴巴未来生活实验室) Zhejiang University(浙江大学) Alibaba Group(阿里巴巴集团) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);pretraining(abstract);分类 cs.CL

AI总结 PretrainRL通过在预训练阶段引入强化学习,缓解大语言模型在开始阶段的事实性幻觉问题,通过去偏见和学习机制提升事实准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19145 2026-02-03 stat.ME cs.LG stat.AP 89%

Do Large Language Models (Really) Need Statistical Foundations?

大型语言模型(真的需要统计基础吗?

Weijie Su

机构 * University of Pennsylvania(宾夕法尼亚大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

AI总结 本文探讨大型语言模型是否需要统计学基础,指出其统计本质和黑箱特性使统计方法成为必要,并强调统计学界在LLMs研究中的重要性。

Comments Accepted at The Annals of Applied Statistics; Added discussions on more topics

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04443 2026-01-30 cs.CR cs.LG eess.SP 89%

Large Language Models for Detecting Cyberattacks on Smart Grid Protective Relays

用于检测智能电网继电保护装置网络攻击的大型语言模型

Ahmad Mohammad Saber, Saeed Jafari, Zhengmao Ouyang, Paul Budnarain, Amr Youssef, Deepa Kundur

机构 * Department of Electrical and Computer Engineering, University of Toronto(电气与计算机工程系,多伦多大学) Concordia Institute for Information Systems Engineering (CIISE), Concordia University(信息系统工程研究所(CIISE),康科迪亚大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

AI总结 本文提出基于LLM的检测框架,用于检测智能电网继电保护装置的网络攻击,通过结构化自然语言提示实现高准确率的攻击检测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14310 2026-01-22 cs.CR cs.AI 89%

CORVUS: Red-Teaming Hallucination Detectors via Internal Signal Camouflage in Large Language Models

CORVUS:通过内部信号伪装在大语言模型中实现红色团队幻觉检测

Nay Myat Min, Long H. Pham, Hongyu Zhang, Jun Sun

机构 * Singapore Management University(新加坡管理大学) Chongqing University(重庆大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 CORVUS 通过内部信号伪装技术,有效检测大语言模型中的幻觉问题,并推动了对手意识的审计方法。

Comments 13 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10010 2026-01-16 cs.CV cs.AI 89%

VERHallu: Evaluating and Mitigating Event Relation Hallucination in Video Large Language Models

VERHallu: 评估和缓解视频大语言模型中的事件关系幻觉

Zefan Zhang, Kehua Zhu, Shijie Jiang, Hongyuan Lu, Shengkai Sun, Tian Bai

机构 * College of Computer Science and Technology, Key Laboratory of Symbolic Computation and Knowledge Engineering, Ministry of Education, Jilin University(吉林大学计算机科学与技术学院,符号计算与知识工程重点实验室,教育部,吉林大学) College of Software, Jilin University(吉林大学软件学院) Facemind Group(FaceMind集团) School of Computer Science and Information Engineering, Hefei University of Technology(合肥工业大学计算机科学与信息工程学院)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);pretraining(abstract);分类 cs.AI

AI总结 本文提出VERHallu基准,用于评估和缓解视频大语言模型中的事件关系幻觉,通过关键帧传播策略提升多事件理解能力。

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06437 2026-01-13 cs.CL 89%

Time Travel Engine: A Shared Latent Chronological Manifold Enables Historical Navigation in Large Language Models

时间旅行引擎:共享的潜在时间流形使大型语言模型能够进行历史导航

Jingmin An, Wei Liu, Qian Wang, Fang Fang

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

AI总结 时间旅行引擎通过共享的潜在时间流形,使大型语言模型能够导航历史,揭示语言模型中时间进程的连续几何结构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01156 2026-01-06 cs.CL 89%

DHI: Leveraging Diverse Hallucination Induction for Enhanced Contrastive Factuality Control in Large Language Models

DHI: 利用多样化幻觉诱导提升大语言模型对比事实性控制

Jiani Guo, Xiangke Zeng, Jie Wu, Zuchao Li

机构 * School of Computer Science, Wuhan University(武汉大学计算机学院) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) School of Artificial Intelligence, Wuhan University(武汉大学人工智能学院)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 DHI通过多样化幻觉诱导提升大语言模型对比事实性控制,有效减少幻觉生成。

Comments ICONIP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20162 2025-12-24 cs.AI 89%

Concept Generalization in Humans and Large Language Models: Insights from the Number Game

人类与大语言模型的概念泛化:来自数字游戏的洞察

Arghavan Bazigaran, Hansem Sohn

机构 * Department of Biomedical Engineering, Sungkyunkwan University, South Korea(生物医学工程系,全州大学,韩国)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 研究通过数字游戏对比人类与大语言模型在概念泛化上的差异,揭示人类灵活的推理策略与LLM依赖数学规则的本质区别。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19424 2025-12-23 cs.CL 89%

CodeSimpleQA: Scaling Factuality in Code Large Language Models

CodeSimpleQA: 在代码大语言模型中提升事实性

Jian Yang, Wei Zhang, Yizhi Li, Shawn Guo, Haowen Wang, Aishan Liu, Ge Zhang, Zili Wang, Zhoujun Li, Xianglong Liu, Weifeng Lv

机构 * Beihang University(北航大学) Manchester(曼彻斯特) M-A-P StepFun

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);post-training(abstract);分类 cs.CL

AI总结 CodeSimpleQA通过构建双语基准测试和后训练框架,提升代码大语言模型在编程知识事实准确性上的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06281 2025-12-09 cs.CV cs.AI 89%

Unleashing the Intrinsic Visual Representation Capability of Multimodal Large Language Models

释放多模态大语言模型的内在视觉表示能力

Hengzhuang Li, Xinsong Zhang, Qiming Peng, Bin Luo, Han Hu, Dengyang Jiang, Han-Jia Ye, Teng Zhang, Hai Jin

机构 * HUST(华中科技大学) Tencent Hunyuan Research(腾讯混元研究) HKUST(香港科技大学) NJU(南京大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出LaVer框架,通过掩码图像建模提升多模态大语言模型的视觉表示能力,实验表明其在需要密集视觉能力的场景中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04425 2025-12-05 cs.CV cs.AI 89%

Explainable Parkinsons Disease Gait Recognition Using Multimodal RGB-D Fusion and Large Language Models

可解释的帕金森病步态识别:基于多模态RGB-D融合与大语言模型

Manar Alnaasan, Md Selim Sarowar, Sungho Kim

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出基于多模态RGB-D融合与大语言模型的帕金森病步态识别框架,通过增强时空表示和语言解释提高识别准确性和临床可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02772 2025-12-03 cs.CL cs.IR 89%

Towards Unification of Hallucination Detection and Fact Verification for Large Language Models

迈向大型语言模型中幻觉检测与事实验证的统一

Weihang Su, Jianming Long, Changyue Wang, Shiyu Lin, Jingyan Xu, Ziyi Ye, Qingyao Ai, Yiqun Liu

机构 * DCST, Tsinghua University(清华大学数据科学研究院) Fudan University(复旦大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 本文提出UniFact框架,通过统一评估方法揭示幻觉检测与事实验证的互补性,并证明混合方法在LLM中的优越性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.00259 2025-12-01 cs.CL 89%

AutoHall: Automated Factuality Hallucination Dataset Generation for Large Language Models

AutoHall: 自动化生成大语言模型的事实性幻觉数据集

Zouying Cao, Yifei Yang, XiaoJing Li, Hai Zhao

机构 * AGI Institute, School of Computer Science, Shanghai Jiao Tong University(AGI研究院,计算机科学学院,上海交通大学) Shanghai Key Laboratory of Trusted Data Circulation and Governance in Web3(上海可信数据流通与治理Web3重点实验室) School of Media & Communication, Shanghai Jiao Tong University(媒体与传播学院,上海交通大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 AutoHall通过自动化生成模型特定的幻觉数据集,提升大语言模型的事实性内容检测能力。

Comments Accepted by IEEE Transactions on Audio, Speech, and Language Processing (TASLP)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03553 2025-11-14 cs.CL 89%

CCD-Bench: Probing Cultural Conflict in Large Language Model Decision-Making

Hasibur Rahman, Hanan Salam

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07694 2025-11-12 cs.LG 89%

Probabilities Are All You Need: A Probability-Only Approach to Uncertainty Estimation in Large Language Models

Manh Nguyen, Sunil Gupta, Hung Le

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07295 2025-11-12 cs.IR cs.AI 89%

Hard vs. Noise: Resolving Hard-Noisy Sample Confusion in Recommender Systems via Large Language Models

Tianrui Song, Wen-Shuo Chao, Hao Liu

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02431 2025-11-12 cs.CL 89%

From Anger to Joy: How Nationality Personas Shape Emotion Attribution in Large Language Models

Mahammed Kamruzzaman, Abdullah Al Monsur, Gene Louis Kim, Anshuman Chhabra

机构 * University of South Florida(佛罗里达州立大学) North South University(北南大学) Bellini College of AI, Cybersecurity and Computing(人工智能、网络安全与计算学院)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Accepted at AACL-2025 (main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04053 2025-11-11 cs.AI 89%

Interpreting Multi-Attribute Confounding through Numerical Attributes in Large Language Models

Hirohane Takagi, Gouki Minegishi, Shota Kizawa, Issey Sukeda, Hitomi Yanaka

机构 * The University of Tokyo(东京大学) RIKEN(日本研究机构) Tohoku University(东北大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments Accepted to IJCNLP-AACL 2025 (Main). Code available at https://github.com/htkg/num_attrs

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.08878 2025-11-11 cs.NI cs.IT cs.LG eess.SP math.IT 89%

Large Language Model Empowered Next-Generation MIMO Networks: Fundamentals, Challenges, and Visions

Zhe Wang, Jiayi Zhang, Hongyang Du, Ruichen Zhang, Dusit Niyato, Bo Ai, Khaled B. Letaief

机构 * State Key Laboratory of Advanced Rail Autonomous Operation(先进轨道交通自主运行状态关键实验室) Beijing Jiaotong University(北京交通大学) School of Electronics and Information Engineering(电子与信息工程学院) University of Hong Kong(香港大学) College of Computing & Data Science(计算与数据科学学院) Nanyang Technological University(南洋理工大学) Hong Kong University of Science and Technology(香港科技大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

Comments 9 pages, 4 figures, 1 table, to appear in Digital Communications and Networks

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07869 2025-11-10 cs.CL cs.HC 89%

Are Humans as Brittle as Large Language Models?

Jiahui Li, Sean Papay, Roman Klinger

机构 * University of Bamberg(巴姆伯格大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03699 2025-11-06 cs.CL cs.CY 89%

Do Androids Dream of Unseen Puppeteers? Probing for a Conspiracy Mindset in Large Language Models

Francesco Corso, Francesco Pierri, Gianmarco De Francisci Morales

机构 * Politecnico Di Milano(米兰理工学院) CENTAI

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08809 2025-11-04 cs.LG 89%

Decoupling Contrastive Decoding: Robust Hallucination Mitigation in Multimodal Large Language Models

Wei Chen, Xin Yan, Bin Wen, Fan Yang, Tingting Gao, Di Zhang, Long Chen

机构 * HKUST(香港科技大学) University of Waterloo(滑铁卢大学) Kuaishou Technology(快手科技)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);preference optimization(abstract);分类 cs.LG

Comments 17 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22586 2025-10-30 cs.CL 89%

Precise In-Parameter Concept Erasure in Large Language Models

Yoav Gur-Arieh, Clara Suslik, Yihuai Hong, Fazl Barez, Mor Geva

机构 * Blavatnik School of Computer Science and AI, Tel Aviv University(塔尔斯基大学计算机科学与人工智能学院) New York University(纽约大学) University of Oxford & WhiteBox(牛津大学及WhiteBox)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);pretraining(abstract);分类 cs.CL

Comments Accepted to EMNLP 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12040 2025-10-15 cs.CL 89%

Uncertainty Quantification for Hallucination Detection in Large Language Models: Foundations, Methodology, and Future Directions

Sungmin Kang, Yavuz Faruk Bakman, Duygu Nur Yaldiz, Baturalp Buyukates, Salman Avestimehr

机构 * University of Southern California(南加州大学) University of Birmingham(伯明翰大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments 24 pages, 3 figures, magazine

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01243 2025-10-03 cs.CL 89%

Detoxifying Large Language Models via Autoregressive Reward Guided Representation Editing

Yisong Xiao, Aishan Liu, Siyuan Liang, Zonghao Ying, Xianglong Liu, Dacheng Tao

机构 * SKLCCSE, Beihang University(北航智能计算与复杂系统研究院) National University of Singapore(新加坡国立大学) Zhongguancun Laboratory, Beijing(中关村实验室) Institute of Dataspace, Hefei(合肥数据空间研究院) Nanyang Technological University(南洋理工大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Accepted to NeurIPS 25

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05724 2025-10-02 cs.CY cs.AI 89%

Addressing Moral Uncertainty using Large Language Models for Ethical Decision-Making

Rohit K. Dubey, Damian Dailisan, Sachit Mahajan

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments 13 pages, 5 figures. All authors contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15229 2025-09-30 cs.CL cs.CY 89%

Multilingual Prompting for Improving LLM Generation Diversity

Qihan Wang, Shidong Pan, Tal Linzen, Emily Black

机构 * New York University(纽约大学) Columbia University(哥伦比亚大学)

专题命中 知识编辑与模型理解 :prompting(title,abstract);LLM(title);large language model(abstract);language model(abstract)

Comments Accepted by EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22121 2025-09-29 cs.LG 89%

Mind the Missing: Variable-Aware Representation Learning for Irregular EHR Time Series using Large Language Models

Jeong Eul Kwon, Joo Heung Yoon, Hyo Kyung Lee

机构 * School of Industrial Management Engineering, Korea University(韩国大学工业管理工程学院) Division of Pulmonary, Allergy, Critical Care, and Sleep Medicine, Department of Medicine, University of Pittsburgh(匹兹堡大学医学部呼吸科、过敏科、重症医学科及睡眠医学科)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19060 2025-09-26 cs.CL 89%

UNCERTAINTY-LINE: Length-Invariant Estimation of Uncertainty for Large Language Models

Roman Vashurin, Maiya Goloburda, Preslav Nakov, Maxim Panov

机构 * Mohamed bin Zayed University of Artificial Intelligence(莫莫德·本·扎耶德人工智能大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18076 2025-09-23 cs.AI 89%

Improving Large Language Models Function Calling and Interpretability via Guided-Structured Templates

Hy Dang, Tianyi Liu, Zhuofeng Wu, Jingfeng Yang, Haoming Jiang, Tao Yang, Pei Chen, Zhengyang Wang, Helen Wang, Huasheng Li, Bing Yin, Meng Jiang

机构 * University of Notre Dame(诺丁汉大学) Amazon(亚马逊)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.AI

Comments Accepted to EMNLP 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏