arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7539 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7539 篇

2406.03505 2026-01-12 cs.LG cs.AI 84%

Dynamic and Adaptive Feature Generation with LLM

动态和自适应特征生成与大语言模型

Xinhao Zhang, Jinghan Zhang, Banafsheh Rekabdar, Yuanchun Zhou, Pengfei Wang, Kunpeng Liu

机构 * Portland State University(波特兰州立大学) Computer Network Information Center, Chinese Academy of Sciences(中国科学院计算机网络信息中心) University of Chinese Academy of Sciences, Chinese Academy of Sciences(中国科学院大学)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出利用大语言模型和特征生成提示,实现动态和自适应的特征生成方法,以提高特征生成的可解释性、适用性和灵活性。

Comments Accepted by IJCAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03671 2026-01-08 cs.CL cs.LG 84%

NeuronScope: A Multi-Agent Framework for Explaining Polysemantic Neurons in Language Models

NeuronScope:一种用于解释语言模型中多义神经元的多智能体框架

Weiqi Liu, Yongliang Miao, Haiyan Zhao, Yanguang Liu, Mengnan Du

机构 * Wuhan University(武汉大学) Hong Kong Baptist University(香港 Baptist大学) New Jersey Institute of Technology(新泽西理工学院) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.LG

AI总结 NeuronScope通过多智能体框架迭代优化神经元解释,揭示语言模型中隐藏的多义性并提升解释的激活相关性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04050 2026-01-06 cs.CL cs.AI 84%

Explainability-Based Token Replacement on LLM-Generated Text

基于可解释性的token替换在LLM生成文本中

Hadi Mohammadi, Anastasia Giachanou, Daniel L. Oberski, Ayoub Bagheri

机构 * Department of Methodology and Statistics, Utrecht University(方法论与统计学系,乌得勒支大学)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出基于可解释性的token替换方法,通过集成分类器和SHAP/LIME技术,降低AI生成文本的可检测性,同时强调多模型策略在对抗token操纵中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11881 2025-12-16 cond-mat.soft cs.AI cs.LG 84%

Understanding Structural Representation in Foundation Models for Polymers

理解聚合物基础模型中的结构表示

Nathaniel H. Park, Eduardo Soares, Victor Y. Shirasuna, Tiffany J. Callahan, Sara Capponi, Emilio Vital Brazil

机构 * IBM Research Almaden(IBM阿尔马登研究院) IBM Research Brazil(IBM巴西研究院)

专题命中 知识编辑与模型理解 :foundation model(title,abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出基于SMILES的聚合物图表示方法,展示了其在28个基准数据集上的高性能,并揭示了SMILES表示的强不变性及化学语言模型对序列空间的遍历性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06301 2025-12-09 cs.LG cs.AI 84%

Chemistry Integrated Language Model using Hierarchical Molecular Representation for Polymer Informatics

整合化学语言模型:用于聚合物信息学的分层分子表示

Jihun Ahn, Gabriella Pasya Irianti, Vikram Thapar, Su-Mi Hur

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

AI总结 CI-LLM通过分层分子表示提升聚合物信息学中的预测与反向设计能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02089 2025-11-05 cs.LG cs.CL 84%

LLM Probing with Contrastive Eigenproblems: Improving Understanding and Applicability of CCS

Stefan F. Schouten, Peter Bloem

机构 * Vrije Universiteit Amsterdam(阿姆斯特丹自由大学)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Accepted to the Mechanistic Interpretability Workshop at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00443 2025-11-04 cs.LG cs.AI cs.CV 84%

Region-Aware Reconstruction Strategy for Pre-training fMRI Foundation Model

Ruthwik Reddy Doodipala, Pankaj Pandey, Carolina Torres Rojas, Manob Jyoti Saikia, Ranganatha Sitaram

机构 * St. Jude Children’s Research Hospital(圣犹大儿童研究医院) The University of Memphis(密苏里大学梅尔斯分校)

专题命中 知识编辑与模型理解 :foundation model(title,abstract);pretraining(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13763 2025-10-27 cs.AI cs.CL q-bio.NC 84%

Language Models Are Capable of Metacognitive Monitoring and Control of Their Internal Activations

Li Ji-An, Hua-Dong Xiong, Robert C. Wilson, Marcelo G. Mattar, Marcus K. Benna

机构 * Neurosciences Graduate Program University of California San Diego(加州大学圣地亚哥分校神经科学研究生项目) School of Psychology Georgia Tech(佐治亚理工学院心理学系) Department of Psychology New York University(纽约大学心理学系) Department of Neurobiology University of California San Diego(加州大学圣地亚哥分校神经生物学系)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09008 2025-10-13 cs.CV cs.AI cs.CL 84%

On Epistemic Uncertainty of Visual Tokens for Object Hallucinations in Large Vision-Language Models

Hoigi Seo, Dong Un Kang, Hyunjin Cho, Joohoon Lee, Se Young Chun

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07513 2025-10-10 cs.LG cs.AI cs.CV cs.DB 84%

MLLM4TS: Leveraging Vision and Multimodal Language Models for General Time-Series Analysis

Qinghua Liu, Sam Heshmati, Zheda Mai, Zubin Abraham, John Paparrizos, Liu Ren

机构 * The Ohio State University(俄亥俄州立大学) Bosch Research North America(博世北美研究)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16724 2025-10-10 cs.CL cs.AI 84%

The Role of Model Confidence on Bias Effects in Measured Uncertainties for Vision-Language Models

Xinyi Liu, Weiguang Wang, Hangfeng He

机构 * University of Rochester(罗切斯特大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to EMNLP Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03799 2025-10-07 cs.CL cs.AI cs.CY 84%

Mechanistic Interpretability of Socio-Political Frames in Language Models

Hadi Asghari, Sami Nenno

机构 * Technische Universität Berlin, Berlin, Germany Humboldt Institute for Internet \& Society, Berlin, Germany

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments Peer-reviewed and presented at Advances in Interpretable Machine Learning and Artificial Intelligence (AIMLAI) Workshop at ECML/PKDD 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18562 2025-10-07 cs.CL cs.AI 84%

From Word to World: Evaluate and Mitigate Culture Bias in LLMs via Word Association Test

Xunlian Dai, Li Zhou, Benyou Wang, Haizhou Li

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Shenzhen Research Institute of Big Data(深圳大数据研究院)

专题命中 知识编辑与模型理解 :large language model(abstract,comments);language model(abstract,comments);LLM(abstract);prompting(abstract)

Comments Cultural Analysis, Cultural Alignment, Word Association Test, Large Language Models. Accepted by EMNLP 2025 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00476 2025-10-06 cs.SE cs.AI cs.LG 84%

Analyzing Latent Concepts in Code Language Models

Arushi Sharma, Vedant Pungliya, Christopher J. Quinn, Ali Jannesari

机构 * Iowa State University(爱荷华州立大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01288 2025-10-03 cs.LG cs.AI 84%

Microsaccade-Inspired Probing: Positional Encoding Perturbations Reveal LLM Misbehaviours

Rui Melo, Rui Abreu, Corina S. Pasareanu

机构 * Carnegie Mellon University(卡内基梅隆大学) FEUP(费拉尔大学) INESC-ID(葡萄牙里斯本信息技术与创新研究中心)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 9 main pages, 13 appendix pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11771 2025-09-26 cs.CL cs.AI 84%

The Validation Gap: A Mechanistic Analysis of How Language Models Compute Arithmetic but Fail to Validate It

Leonardo Bertolazzi, Philipp Mondorf, Barbara Plank, Raffaella Bernardi

机构 * DISI, University of Trento(特伦托大学DISI中心) MaiNLP, Center for Information and Language Processing, LMU Munich(慕尼黑大学信息与语言处理中心) Munich Center for Machine Learning (MCML), Munich, Germany(慕尼黑机器学习中心) Free University of Bozen-Bolzano, Italy(博兹纳自由大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2025 Main, 38 pages, 33 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07974 2025-09-15 cs.SE cs.AI cs.LG 84%

From Hazard Identification to Controller Design: Proactive and LLM-Supported Safety Engineering for ML-Powered Systems

Yining Hong, Christopher S. Timperley, Christian Kästner

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted for publication at the International Conference on AI Engineering (CAIN) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09265 2025-09-12 cs.LG cs.CL 84%

Harnessing Uncertainty: Entropy-Modulated Policy Gradients for Long-Horizon LLM Agents

Jiawei Wang, Jiacai Liu, Yuqian Fu, Yingru Li, Xintao Wang, Yuan Lin, Yu Yue, Lin Zhang, Yang Wang, Ke Wang

机构 * ByteDance Seed(字节跳动种子)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments ICLR 2026 Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00673 2025-09-03 cs.CL cs.AI cs.IR 84%

Confident, Calibrated, or Complicit: Probing the Trade-offs between Safety Alignment and Ideological Bias in Language Models in Detecting Hate Speech

Sanjeeevan Selvaganapathy, Mehwish Nasim

机构 * School of Physics, Mathematics and Computing(物理、数学与计算学系) Network Analysis and Social Influence Modelling (NASIM) Lab(网络分析与社会影响建模实验室) The University of Western Australia(西澳大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20805 2025-08-29 cs.CL cs.AI cs.SD 84%

Exploring Machine Learning and Language Models for Multimodal Depression Detection

Javier Si Zhao Hong, Timothy Zoe Delaya, Sherwyn Chan Yin Kit, Pai Chet Ng, Xiaoxiao Miao

机构 * Singapore Institute of Technology(新加坡理工学院) Duke Kunshan University(杜克-昆山大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments This paper has been accepted by APCIPA ASC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14799 2025-08-28 cs.HC cs.AI cs.LG 84%

Analyzing Character Representation in Media Content using Multimodal Foundation Model: Effectiveness and Trust

Evdoxia Taka, Debadyuti Bhattacharya, Joanne Garde-Hansen, Sanjay Sharma, Tanaya Guha

机构 * University of Glasgow(格拉斯哥大学) University of Leeds(利兹大学) University of Warwick(沃里克大学)

专题命中 知识编辑与模型理解 :foundation model(title,abstract);pretraining(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03678 2025-08-06 cs.CL cs.LG cs.PL 84%

More Than a Score: Probing the Impact of Prompt Specificity on LLM Code Generation

Yangtian Zi, Harshitha Menon, Arjun Guha

机构 * Northeastern University(东北大学) Lawrence Livermore National Laboratory(劳伦斯利弗莫尔国家实验室)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03032 2025-07-28 cs.LG cs.CL 84%

Analyze Feature Flow to Enhance Interpretation and Steering in Language Models

Daniil Laptev, Nikita Balagansky, Yaroslav Aksenov, Daniil Gavrilov

机构 * mipt(莫斯科物理技术学院)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08622 2025-07-22 cs.AI cs.CL cs.CV 84%

Visually Guided Decoding: Gradient-Free Hard Prompt Inversion with Language Models

Donghoon Kim, Minji Bae, Kyuhong Shim, Byonghyo Shim

机构 * Seoul National University(首尔国立大学) Sungkyunkwan University(庆熙大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments ICLR 2025 (Official Code: https://github.com/DonghoonKim-1938/VGD)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12379 2025-07-17 cs.CL cs.AI 84%

Probing for Arithmetic Errors in Language Models

Yucheng Sun, Alessandro Stolfo, Mrinmaya Sachan

机构 * ETH Zürich(苏黎世联邦理工学院)

专题命中 知识编辑与模型理解 :language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12240 2025-06-17 cs.LG cs.AI 84%

Mind the XAI Gap: A Human-Centered LLM Framework for Democratizing Explainable AI

Eva Paraschou, Ioannis Arapakis, Sofia Yfantidou, Sebastian Macaluso, Athena Vakali

机构 * Aristotle University of Thessaloniki, School of Informatics(塞萨洛尼基亚里士多德大学信息学院) Technical University of Denmark(丹麦技术大学) Telefonica Scientific Research(电信科学研究院)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted for publication at The 3rd World Conference on eXplainable Artificial Intelligence. This version corresponds to the camera-ready manuscript submitted to the conference proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11073 2025-06-16 cs.CL cs.AI cs.CV 84%

CLAIM: Mitigating Multilingual Object Hallucination in Large Vision-Language Models with Cross-Lingual Attention Intervention

Zekai Ye, Qiming Li, Xiaocheng Feng, Libo Qin, Yichong Huang, Baohang Li, Kui Jiang, Yang Xiang, Zhirui Zhang, Yunfei Lu, Duyu Tang, Dandan Tu, Bing Qin

机构 * Harbin Institute of Technology(哈尔滨工业大学) Peng Cheng Laboratory(鹏城实验室) Central South University(中南大学) Huawei Technologies Co., Ltd(华为技术有限公司)

专题命中 知识编辑与模型理解 :language model(title,abstract);pretraining(abstract);分类 cs.CL、cs.AI

Comments ACL2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.17626 2025-06-04 cs.LG cs.CL 84%

Tracking the Feature Dynamics in LLM Training: A Mechanistic Study

Yang Xu, Yi Wang, Hengguan Huang, Hao Wang

机构 * Department of Computer Science(计算机科学系) Rutgers University(罗格斯大学) Section for Health Data Science and AI(健康数据科学与人工智能部门) University of Copenhagen(哥本哈根大学)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01133 2025-06-03 cs.CL cs.AI cs.SD eess.AS 84%

From Words to Waves: Analyzing Concept Formation in Speech and Text-Based Foundation Models

Asım Ersoy, Basel Mousi, Shammur Chowdhury, Firoj Alam, Fahim Dalvi, Nadir Durrani

机构 * Qatar Computing Research Institute(卡塔尔计算研究所)

专题命中 知识编辑与模型理解 :foundation model(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted Interspeech 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00245 2025-06-03 cs.LG cs.CL 84%

Beyond Semantic Entropy: Boosting LLM Uncertainty Quantification with Pairwise Semantic Similarity

Dang Nguyen, Ali Payani, Baharan Mirzasoleiman

机构 * UCLA CS(UCLA计算机科学系) Cisco Systems Inc.(思科系统公司)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 11 pages, 4 figures, 6 tables, link: https://github.com/BigML-CS-UCLA/SNNE

详情

展开后加载摘要…

URL PDF HTML 收藏