arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7539 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7539 篇

2602.07958 2026-02-10 eess.SY cs.AI cs.DC cs.SY 85%

Accuracy-Delay Trade-Off in LLM Offloading via Token-Level Uncertainty

在LLM卸载中通过令牌级不确定性实现精度-延迟权衡

Yumin Kim, Hyeonsu Lyu, Minjae Lee, Hyun Jong Yang

机构 * Dept. of Electrical and Computer Engineering, Seoul National University, Seoul, Korea(电子与计算机工程系,首尔国立大学,首尔,韩国) Institute of New Media and Communications, Seoul National University, Seoul, South Korea(新媒体与通讯研究所,首尔国立大学,首尔,韩国)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出了一种基于令牌级不确定性的卸载框架,通过贪心算法在保持准确性的同时减少延迟,实现了LLM在移动边缘计算中的精度-延迟权衡。

Comments This paper has been accepted at 2025 IEEE Globecom Workshop: WS02-GAIMC: Mutual Facilitation of Generative Artificial Intelligence and Mobile Communications

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11871 2026-02-10 cs.AI 85%

Generative AI voting: fair collective choice is resilient to LLM biases and inconsistencies

生成式AI投票:公平的集体选择对LLM偏见和不一致具有韧性

Srijoni Majumdar, Edith Elkind, Evangelos Pournaras

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 生成式AI投票通过比例选票聚合方法实现公平决策,缓解低参与度和选民疲劳问题。

Comments 24 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01919 2026-02-03 cs.CL 85%

From Code-Centric to Concept-Centric: Teaching NLP with LLM-Assisted "Vibe Coding"

从代码导向到概念导向:利用LLM辅助的“Vibe编码”教授NLP

Hend Al-Khalifa

机构 * College of Computer and Information Sciences(计算机与信息科学学院) King Saud University(沙特国王大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出利用LLM辅助的

Comments Accepted in The Seventh Workshop on Teaching Natural Language Processing (Teaching NLP @ EACL2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01909 2026-02-03 cs.CL 85%

Latent Debate: A Surrogate Framework for Interpreting LLM Thinking

潜在辩论:一种解释大语言模型思维的代理框架

Lihu Chen, Xiang Yin, Francesca Toni

机构 * Imperial College London, United Kingdom(伦敦帝国学院)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出潜在辩论框架,通过捕捉单个模型内部隐含的论点信号,解释LLM的思维过程并检测幻觉。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18215 2026-02-03 cs.CR cs.AI 85%

Information Security Based on LLM Approaches: A Review

基于大语言模型的信息安全:综述

Chang Gong, Zhongwen Li, Xiaoqi Li

机构 * School of Cyberspace Security, Hainan University(海南大学网络空间安全学院)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文综述了大语言模型在信息安全领域的应用,探讨其在恶意行为预测、网络威胁分析等任务中的优势及面临的挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22851 2026-02-02 cs.CL 85%

When Meanings Meet: Investigating the Emergence and Quality of Shared Concept Spaces during Multilingual Language Model Training

意义交汇:探究多语言语言模型训练中共享概念空间的产生与质量

Felicia Körner, Max Müller-Eberstein, Anna Korhonen, Barbara Plank

机构 * MaiNLP, Center for Information and Language Processing, LMU Munich(MaiNLP,信息与语言处理中心,慕尼黑大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心) University of Tokyo(东京大学) IT University of Copenhagen(哥本哈根IT大学) Language Technology Lab, University of Cambridge(语言技术实验室,剑桥大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);pretraining(abstract);分类 cs.CL

AI总结 研究通过因果可解释方法探讨多语言语言模型训练中共享概念空间的产生与质量,发现早期出现并随训练细化,但语言依赖性显著,且翻译质量提升可能反映行为变化而非能力提升。

Comments Accepted to EACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22027 2026-01-30 cs.AI 85%

CAR-bench: Evaluating the Consistency and Limit-Awareness of LLM Agents under Real-World Uncertainty

CAR-bench: 评估在现实世界不确定性下LLM代理的一致性和限意识

Johannes Kirmayr, Lukas Stappen, Elisabeth André

机构 * BMW Group Research and Technology(宝马集团研究与技术) Augsburg University(艾希施泰特大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 CAR-bench旨在评估LLM代理在现实世界不确定性下的一致性、不确定性处理和能力意识,通过多轮对话和工具使用测试其可靠性和自我意识。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09277 2026-01-30 cs.CL 85%

NeuroFaith: Evaluating LLM Self-Explanation Faithfulness via Internal Representation Alignment

NeuroFaith:通过内部表示对齐评估LLM自解释的忠实性

Milan Bhan, Jean-Noel Vittaut, Nicolas Chesneau, Sarath Chandar, Marie-Jeanne Lesot

机构 * Sorbonne Université, CNRS, LIP6(索邦大学、国家科学研究中心、LIP6实验室) Mila - Quebec AI Institute, Université de Montréal(魁北克人工智能研究院、蒙特利尔大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 NeuroFaith通过内部表示对齐评估LLM自解释的忠实性,提出了一种灵活的框架和线性探针以提高模型的解释可信度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08415 2026-01-15 cs.CY cs.AI 85%

Regulatory gray areas of LLM Terms

大型语言模型条款的监管灰色区域

Brittany I. Davidson, Kate Muir, Florian A. D. Burnat, Adam N. Joinson

机构 * University of Bath(巴斯大学) Bath Spa University(巴斯斯巴大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文分析了五家主要LLM提供商的条款,揭示了使用限制的差异及监管灰色区域,提供了公开资源以帮助用户和研究人员应对这一挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16674 2026-01-13 cs.CL 85%

Through the LLM Looking Glass: A Socratic Probing of Donkeys, Elephants, and Markets

通过语言模型的棱镜:对驴、大象和市场的苏格拉底探查

Molly Kennedy, Ayyoob Imani, Timo Spinde, Akiko Aizawa, Hinrich Schütze

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本研究通过苏格拉底方法分析LLM在意识形态框架下的偏见,发现GPT-4o在标注准确性上达到人类水平,但面对二元比较时仍存在偏好倾向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01015 2026-01-06 cs.CL cs.DB 85%

HyperJoin: LLM-augmented Hypergraph Link Prediction for Joinable Table Discovery

HyperJoin: 基于大语言模型的超图链接预测用于可连接表发现

Shiyuan Liu, Jianwei Wang, Xuemin Lin, Lu Qin, Wenjie Zhang, Ying Zhang

机构 * University of Technology Sydney(悉尼科技大学) University of New South Wales(新南威尔士大学) ACEM, Shanghai Jiao Tong University(ACEM,上海交通大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 HyperJoin通过构建超图并利用大语言模型增强的超图链接预测,提升可连接表发现的精度和召回率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23323 2026-01-06 cs.LG 85%

LLM Interpretability with Identifiable Temporal-Instantaneous Representation

基于可识别的时间-瞬时表示的LLM可解释性

Xiangchen Song, Jiaqi Sun, Zijian Li, Yujia Zheng, Kun Zhang

机构 * Carnegie Mellon University(卡内基梅隆大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出了一种针对LLM高维概念空间的可识别时间因果表示学习框架,通过结合SAE技术,提升了LLM的可解释性。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24560 2026-01-01 cs.SE cs.AI 85%

Localized Calibrated Uncertainty in Code Language Models

代码语言模型中的局部校准不确定性

David Gros, Prem Devanbu

机构 * University of California, Davis(加州大学戴维斯分校)

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.AI

AI总结 本研究提出了一种技术,用于在代码语言模型中局部校准不确定性,通过最小意图对齐补丁数据集评估不同探测方法的校准效果,并探讨了其在AI监督中的应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23518 2025-12-30 cs.CL 85%

Single LLM Debate, MoLaCE: Mixture of Latent Concept Experts Against Confirmation Bias

单个LLM辩论,MoLaCE:混合潜在概念专家对抗确认偏见

Hazel Kim, Philip Torr

机构 * Department of Computer Science University of Oxford(牛津大学计算机科学系)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 MoLaCE通过混合潜在概念专家减少LLM的确认偏见,提升鲁棒性并高效实现多智能体辩论效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18733 2025-12-23 cs.CR cs.AI cs.MA 85%

Explainable and Fine-Grained Safeguarding of LLM Multi-Agent Systems via Bi-Level Graph Anomaly Detection

通过双层图异常检测实现LLM多智能体系统的可解释性与细粒度防护

Junjun Pan, Yixin Liu, Rui Miao, Kaize Ding, Yu Zheng, Quoc Viet Hung Nguyen, Alan Wee-Chung Liew, Shirui Pan

机构 * School of Information and Communication Technology, Griffith University, Australia(格里菲斯大学信息与通信技术学院) School of Artificial Intelligence, Jilin University, China(吉林大学人工智能学院) Department of Statistics and Data Science, Northwestern University, USA(西北大学统计与数据科学系)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出XG-Guard框架,通过双层图异常检测实现对LLM多智能体系统中恶意智能体的可解释性与细粒度检测。

Comments 14 pages, 3 tables, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17172 2025-12-22 cs.HC cs.AI 85%

PILAR: Personalizing Augmented Reality Interactions with LLM-based Human-Centric and Trustworthy Explanations for Daily Use Cases

PILAR: 基于LLM的人本化和可信的增强现实交互个性化

Ripan Kumar Kundu, Istiak Ahmed, Khaza Anuarul Hoque

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 PILAR通过基于LLM的个性化解释提升AR交互的可信度和用户体验

Comments Published in the 2025 IEEE International Symposium on Mixed and Augmented Reality Adjunct (ISMAR-Adjunct)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12117 2025-12-16 cs.SE cs.LG 85%

Citation-Grounded Code Comprehension: Preventing LLM Hallucination Through Hybrid Retrieval and Graph-Augmented Context

基于引用的代码理解:通过混合检索和图增强上下文防止LLM幻觉

Jahidul Arafat

机构 * Department of Computer Science and Software Engineering, Auburn University, Alabama, USA(计算机科学与软件工程系,阿伯丁大学,阿拉巴马州,美国)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出混合检索与图增强上下文方法,通过系统评估实现92%引用准确率,有效防止LLM幻觉。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07122 2025-12-09 cs.SE cs.AI 85%

RisConFix: LLM-based Automated Repair of Risk-Prone Drone Configurations

RisConFix: 基于大语言模型的高风险无人机配置自动修复

Liping Han, Tingting Nie, Le Yu, Mingzhe Hu, Tao Yue

机构 * School of Computer Science Nanjing University of Posts and Telecommunications(南京邮电大学计算机科学学院) School of Computer Science and Engineering Beihang University(北京航空航天大学计算机科学与工程学院)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 RisConFix通过基于大语言模型的实时修复机制,有效提升无人机在高风险配置下的鲁棒性,实验显示其修复成功率高达97%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05461 2025-12-08 cs.CY cs.AI cs.HC 85%

Knowing Your Uncertainty -- On the application of LLM in social sciences

了解你的不确定性——关于LLM在社会科学中的应用

Bolun Zhang, Linzhuo Li, Yunqi Chen, Qinlin Zhao, Zihan Zhu, Xiaoyuan Yi, Xing Xie

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出一个统一框架,用于评估LLM在社会科学任务中的不确定性,通过任务类型和验证类型两个维度,为研究者提供方法学保障和实践指导。

Comments 49 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00030 2025-12-05 cs.CL cs.CV 85%

SignBind-LLM: Multi-Stage Modality Fusion for Sign Language Translation

SignBind-LLM:多阶段模态融合用于手语翻译

Marshall Thomas, Edward Fish, Richard Bowden

机构 * CVSSP, University of Surrey(计算机视觉与模式识别研究所,萨里大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 SignBind-LLM通过多阶段模态融合提升手语翻译的准确性和鲁棒性,实现高保真翻译效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07334 2025-11-25 cs.CL 85%

Frame Representation Hypothesis: Multi-Token LLM Interpretability and Concept-Guided Text Generation

框架表示假说:多词LLM可解释性与概念引导的文本生成

Pedro H. V. Valois, Lincon S. Souza, Erica K. Shimomoto, Kazuhiro Fukui

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出框架表示假说,通过多词建模提升LLM的可解释性,利用概念引导解码实现更安全透明的文本生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04108 2025-11-18 cs.LG cs.NA math.NA math.ST stat.TH 85%

Can Linear Probes Measure LLM Uncertainty?

Ramzi Dakhmouche, Adrien Letellier, Hossein Gorji

机构 * Institute of Mathematics, EPFL, Switzerland(瑞士联邦理工学院数学研究所) Computational Engineering Lab, Empa, Switzerland(瑞士Empa计算工程实验室) ENSAE, IP Paris, France(法国IP巴黎高等商学院)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12305 2025-11-18 cs.LG 85%

MMSense: Adapting Vision-based Foundation Model for Multi-task Multi-modal Wireless Sensing

Zhizhen Li, Xuanhao Luo, Xueren Ge, Longyu Zhou, Xingqin Lin, Yuchen Liu

机构 * North Carolina State University, USA(北卡罗来纳州立大学) University of Virginia, USA(弗吉尼亚大学) Singapore University of Technology(新加坡科技设计大学) NVIDIA Corporation, USA(英伟达公司)

专题命中 知识编辑与模型理解 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16851 2025-11-17 cs.CR cs.CL 85%

Interpretable LLM Guardrails via Sparse Representation Steering

Zeqing He, Zhibo Wang, Huiyu Xu, Hejun Lin, Wenhui Zhang, Zhixuan Chu

机构 * The State Key Laboratory of Blockchain and Data Security, Zhejiang University, China(区块链与数据安全国家重点实验室,浙江大学,中国) School of Cyber Science and Technology, Zhejiang University, China(网络安全与技术学院,浙江大学,中国) College of Computer and Information Sciences, Fujian Agriculture and Forestry University, China(计算机与信息科学学院,福建农林大学,中国)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07083 2025-11-11 cs.AI 85%

Increasing AI Explainability by LLM Driven Standard Processes

Marc Jansen, Marcel Pehlke

机构 * Computer Science Institute University of Applied Sciences Ruhr West Bottrop(应用科学鲁尔西贝特大学计算机科学研究所)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14496 2025-11-11 cs.AI 85%

LLM-Powered Swarms: A New Frontier or a Conceptual Stretch?

Muhammad Atta Ur Rahman, Melanie Schranz, Samira Hayat

机构 * Lakeside Labs GmbH(莱克西德实验室)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments This is the author's version of a paper submitted to IEEE Intelligent Systems. 2 Tables, 2 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01311 2025-11-04 cs.AI 85%

llmSHAP: A Principled Approach to LLM Explainability

Filip Naudot, Tobias Sundqvist, Timotheus Kampik

机构 * Umeå University(乌梅大学) Tietoevry(蒂奥埃弗里) SAP(SAP公司)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14077 2025-11-04 cs.CL 85%

ERGO: Entropy-guided Resetting for Generation Optimization in Multi-turn Language Models

Haziq Mohammad Khalid, Athikash Jeyaganthan, Timothy Do, Yicheng Fu, Sean O'Brien, Vasu Sharma, Kevin Zhu

机构 * Algoverse AI Research(Algoverse AI研究院)

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL

Comments 14 pages, 5 figures

Journal ref Proceedings of the 2nd Workshop on Uncertainty Aware NLP (UncertaiNLP 2025), Suzhou, China, Association for Computational Linguistics, pp. 273--286, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27355 2025-11-03 cs.CL 85%

ThoughtProbe: Classifier-Guided LLM Thought Space Exploration via Probing Representations

Zijian Wang, Chang Xu

机构 * School of Computer Science(计算机科学学院) The University of Sydney(悉尼大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments EMNLP2025 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24505 2025-10-29 cs.CL 85%

CritiCal: Can Critique Help LLM Uncertainty or Confidence Calibration?

Qing Zong, Jiayu Liu, Tianshi Zheng, Chunyang Li, Baixuan Xu, Haochen Shi, Weiqi Wang, Zhaowei Wang, Chunkit Chan, Yangqiu Song

机构 * Department of Computer Science and Engineering, HKUST(计算机科学与工程系,香港科技大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏