arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7550 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7550 篇

2601.22858 2026-04-21 cs.GR cs.AI 81%

Learning to Build Shapes by Extrusion

通过挤出学习构建形状

Thor Vestergaard Christiansen, Karran Pandey, Alba Reinders, Karan Singh, Morten Rieger Hannemose, J. Andreas Bærentzen

机构 * Technical University of Denmark(丹麦技术大学) University of Toronto(多伦多大学)

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出基于文本的挤出表示(TEE),通过学习面挤出序列生成3D网格,支持任意面数并生成流形网格,同时可应用于现有网格进行编辑。

Comments A preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20481 2026-04-16 q-bio.NC cs.CL 81%

Coherence in the brain unfolds across separable temporal regimes

大脑中的相干性在可分离的时间 regime 中展开

Davide Staub, Finn Rabe, Akhil Misra, Yves Pauli, Roya Hüppi, Ni Yang, Nils Lang, Lars Michels, Victoria Edkins, Sascha Frühholz, Iris Sommer, Wolfram Hinzen, Philipp Homan

机构 * Department of Adult Psychiatry and Psychotherapy, University of Zurich, Zurich, Switzerland(大学精神病学与心理学系,苏黎世大学,苏黎世,瑞士) Department of Translation and Language Sciences, University Pompeu Fabra, Barcelona, Spain(翻译与语言科学系,庞培法拉大学,巴塞罗那,西班牙) Department of Neuroradiology, Clinical Neuroscience Center, University Hospital Zurich, Zurich, Switzerland(神经放射学系,临床神经科学中心,苏黎世大学医院,苏黎世,瑞士) Department of Psychology, University of Oslo, Oslo, Norway(心理学系,奥斯陆大学,奥斯陆,挪威) Cognitive and Affective Neuroscience Unit, University of Zurich, Zurich, Switzerland(认知与情感神经科学单元,苏黎世大学,苏黎世,瑞士) Center for Clinical Neuroscience and Cognition, University of Groningen, Groningen, Netherlands(临床神经科学与认知中心,格罗宁根大学,格罗宁根,荷兰) Neuroscience Center Zurich, University of Zurich and ETH Zurich, Zurich, Switzerland(苏黎世神经科学中心,苏黎世大学和ETH苏黎世分校,苏黎世,瑞士)

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究通过无标注的漂移和移位信号揭示了语言理解中相干性的神经机制,发现默认模式网络枢纽和初级听觉皮层存在不同的神经偏好。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12460 2026-04-16 cs.CL 81%

Beyond Black-Box Interventions: Latent Probing for Faithful Retrieval-Augmented Generation

超越黑盒干预:用于忠实检索增强生成的潜在探测

Linfeng Gao, Qinggang Zhang, Baolong Bi, Bo Zeng, Zheng Yuan, Zerui Chen, Zhimin Wei, Shenghua Liu, Linlong Xu, Longyue Wang, Weihua Luo, Jinsong Su

机构 * School of Informatics, Xiamen University(厦门大学信息学院) The Hong Kong Polytechnic University(香港理工大学) University of Chinese Academy of Sciences(中国科学院大学) Alibaba Group(阿里巴巴集团) Key Laboratory of Digital Protection and Intelligent Processing of Intangible Cultural Heritage of Fujian and Taiwan (Xiamen University), Ministry of Culture and Tourism, China(福建省和台湾非物质文化遗产数字化保护与智能处理重点实验室(厦门大学),中华人民共和国文化和旅游部,中国)

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);preference optimization(abstract);prompting(abstract);分类 cs.CL

AI总结 本文提出ProbeRAG框架,通过潜在冲突探测和注意力调节提升检索增强生成的忠实度,解决传统方法在评估知识冲突时的不足。

Comments ACL 2026 Findings; Code is available at https://github.com/LinfengGao/ProbeRAG

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10398 2026-04-15 cs.AI 81%

LatentRefusal: Latent-Signal Refusal for Unanswerable Text-to-SQL Queries

LatentRefusal:用于无法回答的文本到SQL查询的潜在信号拒绝

Xuancheng Ren, Shijing Hu, Zhihui Lu, Jiangqi Huang, Qiang Duan

机构 * Fudan University(复旦大学) Pennsylvania State University(宾夕法尼亚州立大学) Abington College(阿宾顿学院)

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出LatentRefusal方法,通过分析大语言模型的中间隐藏激活来预测查询可回答性,从而在文本到SQL系统中实现安全拒绝,提升系统安全性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12046 2026-04-15 cs.CL 81%

Think Through Uncertainty: Improving Long-Form Generation Factuality via Reasoning Calibration

在不确定性中思考:通过推理校准提升长形式生成的真实性

Xin Liu, Lu Wang

机构 * Computer Science and Engineering University of Michigan(计算机科学与工程系密歇根大学)

专题命中 知识编辑与模型理解 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出CURE框架,通过在声明层面教授模型处理不确定性,提升长形式生成的真实性。该方法通过多阶段训练流程对齐模型置信度与声明正确性,并在推理时选择性预测,实验表明其在事实准确性上优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10189 2026-04-14 cs.CL 81%

FAITH: Factuality Alignment through Integrating Trustworthiness and Honestness

FAITH:通过整合可信度和诚实度实现事实一致性

Xiaoning Dong, Chengyan Wu, Yajie Wen, Yu Chen, Yun Xue, Jing Zhang, Wei Xu, Bolei Ma

机构 * Tsinghua University, Institute for Interdisciplinary Information Sciences(清华大学,交叉信息研究院) Shanghai Qi Zhi Institute(上海期智研究院) South China Normal University, School of Electronic Science and Engineering(华南师范大学,电子科学与工程学院) Guangzhou Richstone Data Technologies Co., Ltd.(广州瑞驰数据技术有限公司) LMU Munich & Munich Center for Machine Learning(慕尼黑大学 & 慕尼黑机器学习中心)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)

AI总结 FAITH通过整合可信度和诚实度信号,提升大语言模型的事实准确性。采用PPO算法优化奖励函数,并结合检索增强模块增强内外知识一致性。

Comments ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00778 2026-04-02 cs.CL 81%

From Early Encoding to Late Suppression: Interpreting LLMs on Character Counting Tasks

从早期编码到晚期抑制:解释LLM在字符计数任务上的表现

Ayan Datta, Mounika Marreddy, Alexander Mehler, Zhixue Zhao, Radhika Mamidi

机构 * IIIT Hyderabad(印度国际信息技术学院海德拉巴分校) Goethe University, Frankfurt am Main, Germany(德国法兰克福歌德大学) University of Sheffield, UK(英国谢菲尔德大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

AI总结 研究通过字符计数任务揭示LLM内部计算中的结构干扰问题,发现模型在早期层正确编码信息,但后期层通过负电路抑制了正确输出,导致符号推理失败。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00429 2026-03-03 cs.HC cs.AI 81%

Personalities at Play: Probing Alignment in AI Teammates

性格的博弈:探究AI队友的对齐

Mohammad Amin Samadi, Nia Nixon

机构 * School of Education University of California Irvine(教育学院 加州大学尔湾分校)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 研究探讨AI队友的性格对齐,通过多维度评估发现其性格表现受提示策略、供应商差异和记忆构建影响,强调需综合考虑记忆和系统设计以有效评估AI性格。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05905 2026-02-06 cs.CL 81%

Codified Finite-state Machines for Role-playing

编码有限状态机用于角色扮演

Letian Peng, Yupeng Hou, Kun Zhou, Jingbo Shang

机构 * University of California, San Diego(加州大学圣地亚哥分校)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文提出编码有限状态机(CFSMs)和编码概率有限状态机(CPFSMs)框架,通过自动编码文本角色档案生成可解释的状态机,提升角色扮演中的一致性和随机性探索能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09349 2025-12-24 cs.CL 81%

DrVoice: Parallel Speech-Text Voice Conversation Model via Dual-Resolution Speech Representations

DrVoice:通过双分辨率语音表示实现平行语音-文本语音对话模型

Chao-Hong Tan, Qian Chen, Wen Wang, Chong Deng, Qinglin Zhang, Luyao Cheng, Hai Yu, Xin Zhang, Xiang Lv, Tianyu Zhao, Chong Zhang, Yukun Ma, Yafeng Chen, Hui Wang, Jiaqing Liu, Xiangang Li, Jieping Ye

机构 * Alibaba Group(阿里巴巴集团)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

AI总结 DrVoice通过双分辨率语音表示实现语音与文本的平行生成,有效降低计算成本并提升语音基础模型性能。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04545 2025-12-05 cs.CL 81%

EvoEdit: Lifelong Free-Text Knowledge Editing through Latent Perturbation Augmentation and Knowledge-driven Parameter Fusion

EvoEdit: 通过潜在扰动增强和知识驱动参数融合实现终身自由文本知识编辑

Pengfei Cao, Zeao Ji, Daojian Zeng, Jun Zhao, Kang Liu

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

AI总结 EvoEdit通过潜在扰动增强和知识驱动参数融合,实现终身自由文本知识编辑,有效解决知识更新与遗忘问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02917 2025-10-06 cs.SE cs.LG 81%

Mechanistic Interpretability of Code Correctness in LLMs via Sparse Autoencoders

Kriz Tahimic, Charibeth Cheng

机构 * College of Computer Studies(计算机科学学院)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14086 2025-09-03 cs.LG 81%

EEGDM: EEG Representation Learning via Generative Diffusion Model

Jia Hong Puah, Sim Kuan Goh, Ziwei Zhang, Zixuan Ye, Chow Khuen Chan, Kheng Seang Lim, Si Lei Fong, Kok Sin Woon, Cuntai Guan

机构 * School of Artificial Intelligence and Robotics, Xiamen University Malaysia(厦门大学马来西亚分校人工智能与机器人学院) School of Energy and Chemical Engineering, Xiamen University Malaysia(厦门大学马来西亚分校能源与化学工程学院) Department of Biomedical Engineering, Universiti Malaya(马来亚大学生物医学工程系) Department of Medicine, Universiti Malaya(马来亚大学医学系) Thrust of Carbon Neutrality and Climate Change, Hong Kong University of Science and Technology (Guangzhou)(香港科学与艺术大学(广州)碳中和与气候变化研究方向) College of Computing & Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);foundation model(abstract);pretraining(abstract)

Comments EEGDM Preprint 10 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04080 2025-08-07 cs.AI stat.OT 81%

GeoSR: Cognitive-Agentic Framework for Probing Geospatial Knowledge Boundaries via Iterative Self-Refinement

Jinfan Tang, Kunming Wu, Ruifeng Gongxie, Yuya He, Yuankai Wu

机构 * School of Computer Science(计算机学院) Sichuan University(四川大学) National Key Laboratory of Fundamental Science on Synthetic Vision(合成视觉基础科学国家重点实验室)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments 16 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.17253 2025-07-17 cs.CL 81%

How Well Can Knowledge Edit Methods Edit Perplexing Knowledge?

Huaizhi Ge, Frank Rudzicz, Zining Zhu

机构 * Columbia University(哥伦比亚大学) Dalhousie University(达尔豪斯大学) Stevens Institute of Technology(斯蒂文斯理工学院)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)

Comments A previous version of this document contained a hidden prompt entered by Z Zhu without knowledge of -- or consent by -- his co-authors. This version does not contain the prompt

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19021 2025-07-15 cs.CV cs.AI 81%

Relation-aware Hierarchical Prompt for Open-vocabulary Scene Graph Generation

Tao Liu, Rongjie Li, Chongyu Wang, Xuming He

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted by AAAI-25

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04139 2025-06-12 cs.AI 81%

Monet: Mixture of Monosemantic Experts for Transformers

Jungwoo Park, Young Jin Ahn, Kee-Eung Kim, Jaewoo Kang

机构 * Korea University(韩国大学) KAIST(韩国科学技术院) AIGEN Sciences(AIGEN科学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20088 2025-05-30 cs.CL 81%

Multi-Domain Explainability of Preferences

Nitay Calderon, Liat Ein-Dor, Roi Reichart

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.06249 2025-04-04 cs.CL cs.SE 81%

CodeUpdateArena: Benchmarking Knowledge Editing on API Updates

Zeyu Leo Liu, Shrey Pandit, Xi Ye, Eunsol Choi, Greg Durrett

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15421 2025-03-20 math.DG cs.AI 81%

Probing the topology of the space of tokens with structured prompts

Michael Robinson, Sourya Dey, Taisa Kushner

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments 20 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12477 2025-02-25 cs.CL 81%

Savaal: Scalable Concept-Driven Question Generation to Enhance Human Learning

Kimia Noorbakhsh, Joseph Chandler, Pantea Karimi, Mohammad Alizadeh, Hari Balakrishnan

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Kimia Noorbakhsh, Joseph Chandler, and Pantea Karimi contributed equally to the work

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13966 2025-02-21 cs.SE cs.LG 81%

Where's the Bug? Attention Probing for Scalable Fault Localization

Adam Stein, Arthur Wayne, Aaditya Naik, Mayur Naik, Eric Wong

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments 14 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10950 2025-01-14 cs.CL 81%

Understanding Multimodal LLMs: the Mechanistic Interpretability of Llava in Visual Question Answering

Zeping Yu, Sophia Ananiadou

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.02699 2025-01-07 cs.CV cs.AI 81%

EAGLE: Enhanced Visual Grounding Minimizes Hallucinations in Instructional Multimodal Models

Andrés Villa, Juan León Alcázar, Motasem Alfarra, Vladimir Araujo, Alvaro Soto, Bernard Ghanem

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

Comments 12 pages, 4 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.11875 2024-09-24 cs.AI 81%

Concept Induction using LLMs: a user experiment for assessment

Adrita Barua, Cara Widmer, Pascal Hitzler

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Journal ref Neural-Symbolic Learning and Reasoning, NeSy 2024, Lecture Notes in Computer Science, vol. 14980, pp. 132-148, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.01509 2024-06-11 cs.CL 81%

Fantastic Semantics and Where to Find Them: Investigating Which Layers of Generative LLMs Reflect Lexical Semantics

Zhu Liu, Cunliang Kong, Ying Liu, Maosong Sun

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted to Findings of ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.11613 2024-05-22 cs.CL 81%

Decoding by Contrasting Knowledge: Enhancing LLMs' Confidence on Edited Facts

Baolong Bi, Shenghua Liu, Lingrui Mei, Yiwei Wang, Pengliang Ji, Xueqi Cheng

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.13594 2024-04-23 cs.CV cs.AI 81%

Lost in Space: Probing Fine-grained Spatial Understanding in Vision and Language Resamplers

Georgios Pantazopoulos, Alessandro Suglia, Oliver Lemon, Arash Eshghi

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

Comments NAACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.02014 2024-03-05 cs.CR cs.AI 81%

Unveiling Hidden Links Between Unseen Security Entities

Daniel Alfasi, Tal Shapira, Anat Bremler Barr

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.07704 2023-10-12 cs.CV cs.CL 81%

Ferret: Refer and Ground Anything Anywhere at Any Granularity

Haoxuan You, Haotian Zhang, Zhe Gan, Xianzhi Du, Bowen Zhang, Zirui Wang, Liangliang Cao, Shih-Fu Chang, Yinfei Yang

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

Comments 30 pages, 10 figures. Code/Project Website: https://github.com/apple/ml-ferret

详情

展开后加载摘要…

URL PDF HTML 收藏