arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7539 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7539 篇

2603.17624 2026-04-01 cs.CL 83%

Do Language Models Encode Semantic Relations? Probing and Sparse Feature Analysis

语言模型是否编码语义关系?探测与稀疏特征分析

Andor Diera, Ansgar Scherp

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

AI总结 本文研究了大型语言模型对语义关系(同义、反义、上位词、下位词)的表示,结合线性探测与稀疏特征分析,揭示了语义关系在模型中的编码特性及稳定性。

Comments accepted at LREC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19562 2026-03-30 cs.LG cs.IT math.IT physics.comp-ph 83%

Neural Uncertainty Principle: A Unified View of Adversarial Fragility and LLM Hallucination

神经不确定性原理:对抗脆弱性与大语言模型幻觉的统一视角

Dong-Xiao Zhang, Hu Lou, Jun-Jie Zhang, Jun Zhu, Deyu Meng

机构 * Northwest Institute of Nuclear Technology(西北核技术研究所) Tsinghua University(清华大学)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文揭示对抗脆弱性与大语言模型幻觉的共同几何起源,提出神经不确定性原理,通过输入与损失梯度的不确定性界限,提供统一的可靠性分析框架。

Comments 16 pages,3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13622 2026-03-30 cs.CV cs.AI 83%

CARPE: Context-Aware Image Representation Prioritization via Ensemble for Large Vision-Language Models

CARPE:通过集成实现上下文感知的图像表示优先级

Donghee Lee, Rui Cai, Zhe Zhao

机构 * University of California, Davis(加州大学戴维斯分校)

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 CARPE通过集成机制增强大视觉-语言模型对视觉和文本模态的自适应加权能力,提升图像分类和多模态任务表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08138 2026-03-24 cs.CV cs.AI cs.MM 83%

Understanding Temporal Logic Consistency in Video-Language Models through Cross-Modal Attention Discriminability

通过跨模态注意力可区分性理解视频-语言模型中的时间逻辑一致性

Chengzhi Li, Heyan Huang, Ping Jian, Zhen Yang, Yaning Tian, Zhongbin Guo

机构 * School of Computer Science and Technology, Beijing Institute of Technology, Beijing, China(北京理工大学计算机科学与技术学院,北京,中国) Beijing Engineering Research Center of High Volume Language Information Processing and Cloud Computing Applications, Beijing Institute of Technology, Beijing, China(高性能语言信息处理与云计算应用北京工程研究中心,北京理工大学,北京,中国)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.AI

AI总结 研究探讨视频-语言模型在时间逻辑一致性问题上的核心原因,提出TCAS方法提升跨模态注意力的时序分辨能力,实验验证了方法对时间逻辑一致性的提升效果。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10045 2026-03-20 cs.CL 83%

Do Language Models Associate Sound with Meaning? A Multimodal Study of Sound Symbolism

语言模型是否将声音与意义关联?一种多模态研究声音象征主义

Jinhong Jeong, Sunghyun Lee, Jaeyoung Lee, Seonah Han, Youngjae Yu

机构 * Yonsei University(延世大学) Seoul National University(首尔国立大学) Korea University(韩国大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

AI总结 研究语言模型在多模态输入中对声音象征性的处理,通过分析不同语义维度下的音节注意力分数,揭示模型对声音与意义关联的理解机制。

Comments 33 pages, 27 tables, 10 figures, accepted to AAAI 2026 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14724 2026-03-17 cs.AI 83%

GameUIAgent: An LLM-Powered Framework for Automated Game UI Design with Structured Intermediate Representation

GameUIAgent:一种基于大语言模型的自动化游戏UI设计框架,采用结构化中间表示

Wei Zeng, Fengwei An, Zhen Liu, Jian Zhao

专题命中 知识编辑与模型理解 :LLM(title,abstract);language model(abstract);分类 cs.AI

AI总结 本文提出GameUIAgent框架,通过结构化中间表示将自然语言描述转化为Figma设计,结合神经符号管道实现迭代自校正,发现质量天花板效应和渲染评估保真原则。

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11212 2026-03-13 cs.CR cs.LG 83%

Security-by-Design for LLM-Based Code Generation: Leveraging Internal Representations for Concept-Driven Steering Mechanisms

面向基于大语言模型的代码生成的Security-by-Design:利用内部表示进行概念驱动的引导机制

Maximilian Wendlinger, Daniel Kowatsch, Konstantin Böttinger, Philip Sperl

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出SCS-Code,通过引导大语言模型的内部表示生成安全且功能性的代码,解决现有方法在安全性和功能正确性上的不足。

Comments to be published in the IEEE European Symposium on Security and Privacy (EuroS&P)'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.18901 2026-03-10 cs.CV cs.AI cs.MM eess.IV 83%

Improving Visual Object Tracking through Visual Prompting

通过视觉提示提升视觉目标跟踪

Shih-Fang Chen, Jun-Cheng Chen, I-Hong Jhuo, Yen-Yu Lin

机构 * Department of Computer Science, National Yang Ming Chiao Tung University(国立阳明交通大学计算机科学系) Research Center for Information Technology Innovation, Academia Sinica, Taiwan(学术院资讯科技创新研究中心) Microsoft, Seattle, Washington, United States(微软公司)

专题命中 知识编辑与模型理解 :prompting(title,abstract);foundation model(abstract);分类 cs.AI

AI总结 PiVOT通过视觉提示机制提升目标跟踪性能,利用预训练模型生成和优化视觉提示以抑制干扰项。

Comments This article was accepted by IEEE Transactions on Multimedia (TMM) in 2024 and published in 2025

Journal ref IEEE Transactions on Multimedia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07202 2026-03-10 cs.CL 83%

Lying to Win: Assessing LLM Deception through Human-AI Games and Parallel-World Probing

谎言以赢:通过人机游戏和平行世界探测评估LLM欺骗

Arash Marioriyad, Ali Nouri, Mohammad Hossein Rohban, Mahdieh Soleymani Baghshah

机构 * Sharif University of Technology(谢里夫技术大学)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本研究通过人机游戏和平行世界探测评估LLM欺骗行为,发现存在性框架显著增加Qwen和Gemini的欺骗率,凸显需新的行为审计方法。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06459 2026-03-09 cs.CV cs.AI 83%

Do Foundation Models Know Geometry? Probing Frozen Features for Continuous Physical Measurement

基础模型知道几何吗?通过冻结特征进行连续物理测量

Yakov Pyotr Shkolnikov

专题命中 知识编辑与模型理解 :foundation model(title);LLM(abstract);language model(abstract);分类 cs.AI

AI总结 研究发现视觉-语言模型通过冻结特征可实现连续几何测量,LoRA微调和架构分析揭示了路径训练缺陷及中层注意力头对几何信号的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04724 2026-02-27 q-bio.QM cs.LG 83%

Understanding protein function with a multimodal retrieval-augmented foundation model

通过多模态检索增强基础模型理解蛋白质功能

Timothy Fei Truong, Tristan Bepler

专题命中 知识编辑与模型理解 :foundation model(title,abstract);language model(abstract);分类 cs.LG

AI总结 PoET-2通过多模态检索增强方法提升蛋白质功能理解与预测能力

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11706 2026-02-19 cs.CV cs.AI 83%

MC-LLaVA: Multi-Concept Personalized Vision-Language Model

MC-LLaVA:多概念个性化视觉-语言模型

Ruichuan An, Sihan Yang, Renrui Zhang, Ming Lu, Tianyi Jiang, Kai Zeng, Yulin Luo, Jiajun Cao, Hao Liang, Ying Chen, Qi She, Shanghang Zhang, Wentao Zhang

机构 * Peking University(北京大学) Intel Labs, China(英特尔实验室,中国)

专题命中 知识编辑与模型理解 :language model(title,abstract);instruction tuning(abstract);分类 cs.AI

AI总结 MC-LLaVA通过多概念指令微调和个性化提示提升视觉-语言模型的多概念个性化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16019 2026-02-19 cs.CV cs.AI 83%

MedProbCLIP: Probabilistic Adaptation of Vision-Language Foundation Model for Reliable Radiograph-Report Retrieval

MedProbCLIP: 基于概率适应的视觉-语言基础模型用于可靠放射影像-报告检索

Ahmad Elallaf, Yu Zhang, Yuktha Priya Masupalli, Jeong Yang, Young Lee, Zechun Cao, Gongbo Liang

机构 * Texas A&M University-San Antonio(德克萨斯A&M大学-圣安东尼奥分校) Boise State University(博伊州立大学)

专题命中 知识编辑与模型理解 :foundation model(title,abstract);language model(abstract);分类 cs.AI

AI总结 MedProbCLIP 通过概率适应提升放射影像与报告检索的可靠性,优于现有基线方法。

Comments Accepted to the 2026 Winter Conference on Applications of Computer Vision (WACV) Workshops

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08548 2026-02-10 cs.CL 83%

How Do Language Models Understand Tables? A Mechanistic Analysis of Cell Location

语言模型如何理解表格?对单元格定位的机制分析

Xuanliang Zhang, Dingzirui Wang, Keyan Xu, Qingfu Zhu, Wanxiang Che

机构 * Harbin Institute of Technology(哈尔滨工业大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

AI总结 本研究通过分析语言模型处理表格的机制,揭示了单元格定位的三阶段流程,包括语义绑定、坐标定位和信息提取,并展示了模型如何通过离散分隔符计数和线性子空间编码实现表格理解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21984 2026-02-04 cs.CV cs.CL 83%

Beyond the Vision Encoder: Identifying and Mitigating Spatial Bias in Large Vision-Language Models

超越视觉编码器:识别和缓解大视觉-语言模型中的空间偏差

Yingjie Zhu, Xuefeng Bai, Kehai Chen, Yang Xiang, Youcheng Pan, Yongshuai Hou, Weili Guan, Jun Yu, Min Zhang

机构 * Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学深圳学院) Peng Cheng Laboratory, Shenzhen, China(鹏城实验室)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

AI总结 本文提出AGCI机制,通过动态注入全局视觉上下文缓解大视觉-语言模型中的空间偏差问题,提升模型的空间鲁棒性和下游任务表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02315 2026-02-03 cs.CL 83%

The Shape of Beliefs: Geometry, Dynamics, and Interventions along Representation Manifolds of Language Models' Posteriors

信念的形状:语言模型后验表示的流形、动态和干预

Raphaël Sarfati, Eric Bigelow, Daniel Wurgaft, Jack Merullo, Atticus Geiger, Owen Lewis, Tom McGrath, Ekdeep Singh Lubana

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

AI总结 研究揭示了语言模型中信念的几何结构,通过干预展示了如何在流形上保持信念的一致性,表明LLMs中自然涌现出复杂结构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02043 2026-02-03 cs.CV cs.AI 83%

Auto-Comp: An Automated Pipeline for Scalable Compositional Probing of Contrastive Vision-Language Models

Auto-Comp: 一种用于可扩展组合探测对比视觉-语言模型的自动化流水线

Cristian Sbrolli, Matteo Matteucci, Toshihiko Yamasaki

机构 * Politecnico di Milano(米兰理工学院) The University of Tokyo(东京大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 Auto-Comp通过自动化生成可扩展基准,揭示了对比视觉-语言模型在组合推理中的普遍缺陷及视觉-语言上下文的权衡问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01605 2026-02-03 cs.LG stat.ML 83%

Universal Redundancies in Time Series Foundation Models

时间序列基础模型中的通用冗余性

Anthony Bao, Venkata Hasith Vattikuti, Jeffrey Lai, William Gilpin

机构 * ECE Department, UT Austin(UT奥斯汀电子工程系) Department of Physics, UT Austin(UT奥斯汀物理系) Oden Institute, UT Austin(UT奥斯汀奥登研究所)

专题命中 知识编辑与模型理解 :foundation model(title,abstract);pretraining(abstract);分类 cs.LG

AI总结 本研究揭示了时间序列基础模型中普遍存在的冗余特性,并通过理论框架和消融实验揭示了模型退化现象的根源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22757 2026-02-02 cs.LG q-bio.BM 83%

Unveiling Scaling Behaviors in Molecular Language Models: Effects of Model Size, Data, and Representation

揭示分子语言模型中的缩放行为:模型大小、数据和表示的影响

Dong Xu, Qihua Pan, Sisi Yuan, Jianqiang Li, Zexuan Zhu, Junkai Ji

机构 * School of Artificial Intelligence, Shenzhen University, Shenzhen 518060, China(人工智能学院,深圳大学,深圳518060,中国)

专题命中 知识编辑与模型理解 :language model(title,abstract);pretraining(abstract);分类 cs.LG

AI总结 本研究通过训练300个分子语言模型,系统探讨了模型大小、数据量和表示对分子生成模型缩放行为的影响,并公开了最大分子语言模型库。

Comments 34 pages, 51 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.17914 2026-01-23 cs.CL 83%

Vision-Language Models Align with Human Neural Representations in Concept Processing

视觉-语言模型在概念处理中与人类神经表征对齐

Anna Bavaresco, Marianne de Heer Kloots, Sandro Pezzelle, Raquel Fernández

机构 * Institute for Logic, Language and Computation University of Amsterdam(逻辑、语言与计算研究所 阿姆斯特丹大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);pretraining(abstract);分类 cs.CL

AI总结 本研究发现视觉-语言模型在概念处理中能与人类神经表征对齐,揭示了不同架构在脑部响应中的差异。

Comments Accepted to EACL 2026 main

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01631 2026-01-22 cs.AI 83%

Unraveling LLM Jailbreaks Through Safety Knowledge Neurons

通过安全知识神经元揭开大语言模型劫持的面纱

Chongwen Zhao, Yutong Ke, Kaizhu Huang

机构 * Duke Kunshan University(杜克昆山大学)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出SafeTuning方法,通过调整安全知识神经元激活来提升大语言模型对劫持攻击的防御能力,实验显示其在多个模型上均有效

Comments EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03300 2026-01-08 cs.CR cs.LG 83%

TRYLOCK: Defense-in-Depth Against LLM Jailbreaks via Layered Preference and Representation Engineering

TRYLOCK:通过分层偏好和表征工程实现对LLM劫持的纵深防御

Scott Thornton

机构 * AI/ML Security Researcher(人工智能与机器学习安全研究员)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 TRYLOCK通过分层偏好和表征工程实现对LLM劫持的纵深防御,结合DPO、RepE、自适应侧车和输入规范化,有效降低攻击成功率并提升安全性与易用性的平衡。

Comments 14 pages, 4 figures. Code and datasets at https://github.com/scthornton/trylock

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13979 2025-12-17 cs.AI 83%

ReflCtrl: Controlling LLM Reflection via Representation Engineering

ReflCtrl: 通过表征工程控制LLM的反思

Ge Yan, Chung-En Sun, Tsui-Wei, Weng

机构 * CSE, UCSD(计算机科学与工程系,加州大学圣塔克鲁兹分校) HDSI, UCSD(人类-数字系统研究所,加州大学圣塔克鲁兹分校)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 ReflCtrl通过表征工程控制LLM的反思行为,减少冗余推理并提升效率。

Comments Spotlight in NeurIPS 25 MI workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13676 2025-12-16 cs.CL 83%

Towards Effective Model Editing for LLM Personalization

迈向有效的LLM个性化模型编辑

Baixiang Huang, Limeng Cui, Jiapeng Liu, Haoran Wang, Jiawei Xu, Zhuiyue Tan, Yutong Chen, Chen Luo, Yi Liu, Kai Shu

机构 * Emory University(埃默里大学) Amazon(亚马逊)

专题命中 知识编辑与模型理解 :LLM(title,abstract);prompting(abstract);分类 cs.CL

AI总结 本文提出个性化编辑框架,通过聚类偏好表示实现高效LLM个性化,提升多轮交互和隐含查询的性能。

Comments 15 pages (including appendix), 7 figures. Code, data, results, and additional resources are available at: https://model-editing.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00696 2025-12-16 q-bio.MN cs.AI cs.ET 83%

Hierarchical Molecular Language Models (HMLMs)

分层分子语言模型(HMLMs)

Hasi Hays, Yue Yu, William J. Richardson

机构 * Department of Chemical Engineering, University of Arkansas(化学工程系,亚拉巴马大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.AI

AI总结 HMLMs通过构建分子语言模型,将细胞信号传递建模为分子语言,利用分层注意力机制和跨尺度操作符整合多模态数据,提升对复杂信号网络的时间动态预测能力,推动精准医学发展。

Comments The current version includes minor revisions to the preprint v2 (arXiv preprint arXiv:2512.00696), Added the Supplementary materials section

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10453 2025-12-12 cs.CL 83%

Grammaticality Judgments in Humans and Language Models: Revisiting Generative Grammar with LLMs

人类与语言模型的语法判断:用LLMs重新审视生成语法

Lars G. B. Johnsen

机构 * National Library of Norway(挪威国家图书馆)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

AI总结 本文通过测试LLMs在主谓倒装和寄生缺口许可任务中的表现,揭示了LLMs对句法结构的敏感性,表明其在无显式编码的情况下能通过预测训练捕捉到生成语法的结构特征。

Comments 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16188 2025-12-08 cs.CL 83%

SAE-SSV: Supervised Steering in Sparse Representation Spaces for Reliable Control of Language Models

SAE-SSV: 在稀疏表示空间中进行监督引导以可靠控制语言模型

Zirui He, Mingyu Jin, Bo Shen, Ali Payani, Yongfeng Zhang, Mengnan Du

机构 * NJIT(新 jersey 理工学院) Rutgers University(罗格斯大学) Cisco(思科公司)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

AI总结 SAE-SSV通过在稀疏表示空间中训练监督引导向量,实现对语言模型行为的可靠控制,提高了生成任务的成功率和可解释性。

Comments Accepted by EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14496 2025-12-02 cs.LG 83%

Semantic Energy: Detecting LLM Hallucination Beyond Entropy

语义能量:超越熵的LLM幻觉检测

Huan Ma, Jiadong Pan, Jing Liu, Yan Chen, Joey Tianyi Zhou, Guangyu Wang, Qinghua Hu, Hua Wu, Changqing Zhang, Haifeng Wang

机构 * Tianjin University(天津大学) Baidu Inc.(百度公司) A*STAR Centre for Frontier AI Research (CFAR)(A*STAR前沿人工智能研究中心) Beijing University of Posts and Telecommunications(北京邮电大学) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 语义能量通过直接操作LLM最后层logits,结合语义聚类和能量分布,提升幻觉检测和不确定性估计的可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23375 2025-12-01 cs.CL cs.CV 83%

Optimizing Multimodal Language Models through Attention-based Interpretability

通过基于注意力的可解释性优化多模态语言模型

Alexander Sergeev, Evgeny Kotelnikov

机构 * European University at Saint Petersburg(圣彼得堡欧洲大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

AI总结 通过基于注意力的可解释性方法优化多模态语言模型,识别关键对象相关的注意力头以提高效率和性能。

Comments Accepted for ICAI-2025 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19569 2025-11-26 cs.LG 83%

An Invariant Latent Space Perspective on Language Model Inversion

语言模型反向的不变潜在空间视角

Wentao Ye, Jiaqi Hu, Haobo Wang, Xinpeng Ti, Zhiqing Xiao, Hao Chen, Liyao Li, Lei Feng, Sai Wu, Junbo Zhao

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);分类 cs.LG

AI总结 本文提出Inv^2A方法,通过不变潜在空间假设提升语言模型反向性能,有效对抗隐私和安全威胁。

Comments The Fortieth AAAI Conference on Artificial Intelligence (AAAI-26)

详情

展开后加载摘要…

URL PDF HTML 收藏