arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-05-11 至 2026-05-11 共收录 415 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 21 篇

2505.11325 2026-05-11 stat.ME cs.AI cs.LG stat.CO stat.ML 62%

Uncertainty Quantification for Prior-Data Fitted Networks using Martingale Posteriors

利用鞅后验的先验-数据拟合网络不确定性量化

Thomas Nagler, David Rügamer

机构 * Department of Statistics, LMU Munich(统计系,慕尼黑大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心(MCML))

专题命中 知识编辑与模型理解 :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种高效无调参的采样方法,基于鞅后验构建贝叶斯后验,用于量化先验-数据拟合网络预测均值、分位数等的不确定性,通过模拟和实际数据验证了方法的有效性和校准性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07693 2026-05-11 cs.LG 57%

Toward Better Geometric Representations for Molecule Generative Models

迈向更优的分子生成模型几何表示

Shaoheng Yan, Zian Li, Cai Zhou, Qiaojing Huang, Kai Liu, Muhan Zhang

机构 * Institute for Artificial Intelligence, PKU(北京大学人工智能学院) ByteDance AI Drug Discovery(字节跳动AI药物发现) School of Intelligence Science and Technology, PKU(北京大学智能科学与技术学院) Anew Labs(Anew实验室) Department of Electrical Engineering and Computer Science, MIT(麻省理工学院电子工程与计算机科学系) State Key Laboratory of General Artificial Intelligence, PKU(北京大学通用人工智能国家重点实验室)

专题命中 知识编辑与模型理解 :pretraining(abstract);分类 cs.LG

AI总结 本文提出LENSEs框架,通过改进分子表示方法提升生成质量,实验显示其在GEOM-DRUG数据集上取得高有效性和稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07140 2026-05-11 cs.CV cs.AI 57%

Neurosymbolic Framework for Concept-Driven Logical Reasoning in Skeleton-Based Human Action Recognition

基于骨架的人体动作识别的概念驱动逻辑推理神经符号框架

Talha Ilyas, Deval Mehta, Zongyuan Ge

机构 * Department of ECSE, Faculty of Engineering, Monash University, Australia(莫纳什大学工程学院电子与计算机工程系,澳大利亚) AIM for Health Lab, Faculty of Information Technology, Monash University, Australia(莫纳什大学信息科技学院健康人工智能实验室,澳大利亚) Department of DSAI, Faculty of Information Technology, Monash University, Australia(莫纳什大学信息科技学院数据科学与人工智能系,澳大利亚)

专题命中 知识编辑与模型理解 :LLM(abstract);分类 cs.AI

AI总结 本文提出一种神经符号框架,将骨架动作识别转化为概念驱动的一阶逻辑推理,通过结合表征学习与符号推理,提升动作识别的可解释性。

Comments Accepted In Proceedings of the 35th International Joint Conference on Artificial Intelligence (IJCAI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07367 2026-05-11 cs.RO cs.CV 50%

Weather-Robust Scene Semantics with Vision-Aligned 4D Radar

具有视觉对齐4D雷达的抗天气场景语义

Kali Hamilton, Christoffer Heckman

机构 * Autonomous Robotics and Perception Group(自主机器人与感知组)

专题命中 知识编辑与模型理解 :language model(abstract)

AI总结 本文提出通过冻结视觉语言模型将雷达编码器对齐于SigLIP嵌入,以提升恶劣天气下的场景语义理解,实验表明雷达配置在雾、轻雪和重雪条件下优于相机基线。

Comments 5 pages + references, 2 appendix pages. ICRA 2026 Radar in Robotics Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 其他LLM 21 篇

2605.07481 2026-05-11 cs.CR cs.AI 90%

Vaporizer: Breaking Watermarking Schemes for Large Language Model Outputs

Vaporizer: 拆解大型语言模型输出的水印方案

Jonathan Hong Jin Ng, Anh Tu Ngo, Anupam Chattopadhyay

机构 * College of Computing and Data Science(计算与数据科学学院) Nanyang Technological University(南洋理工大学)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.AI

AI总结 本文研究了最新水印方案的有效性,通过多种攻击策略揭示现有水印系统的优劣,提出改进安全性的方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07472 2026-05-11 cs.CR cs.AI cs.MA 90%

HBEE: Human Behavioral Entropy Engine -- Pre-Registered Multi-Agent LLM Simulation of Peer-Suspicion-Based Detection Inversion

HBEE:人类行为熵引擎——预注册的多智能体LLM模拟中的基于同伴怀疑的检测反转

Vickson Ferrel

机构 * Faculty of Computer Science & Information Technology(计算机科学与信息科技学院) Universiti Malaysia Sarawak(马来西亚沙巴大学) Vixero Technology Enterprise(Vixero技术企业)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.AI

AI总结 本文通过预注册的多智能体LLM模拟,研究了基于同伴怀疑的检测反转问题,发现适应性对手在T_60时的怀疑度低于随机选择的无辜代理,且检测信号在适应性对手行为下解耦。

Comments 14 pages, 6 figures. Pre-registration document and full deviation log included in artifact

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01685 2026-05-11 cs.CL cs.AI 89%

How Do Language Models Compose Functions?

语言模型如何组合函数?

Apoorv Khandelwal, Ellie Pavlick

机构 * Department of Computer Science(计算机科学系)

专题命中 其他LLM :language model(title,abstract);LLM(summary_cn,abstract_cn);large language model(abstract);分类 cs.CL、cs.AI

AI总结 研究语言模型在解决两跳事实回忆任务时的组合机制,发现现代LLM存在组合性差距,通过分析残差流发现两种处理机制,并发现嵌入空间几何与所用机制密切相关。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07490 2026-05-11 cs.CR 88%

Cross-Modal Backdoors in Multimodal Large Language Models

多模态模型中的跨模态后门

Runhe Wang, Li Bai, Haibo Hu, Songze Li

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract)

AI总结 研究提出一种利用轻量级连接器漏洞的跨模态后门攻击,通过污染连接器实现跨模态后门激活,展示攻击的有效性和可迁移性,揭示多模态对齐中的基本漏洞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07925 2026-05-11 cs.CL 83%

How Value Induction Reshapes LLM Behaviour

价值观诱导如何重塑大语言模型行为

Arnav Arora, Natalie Schluter, Katherine Metcalf, Maartje ter Hoeve

机构 * University of Copenhagen(哥本哈根大学) Apple(苹果公司)

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究探讨价值观诱导对大语言模型行为的影响,发现诱导价值观会引发其他相关或对立价值观的表达,提升安全性,但增加拟人化语言使用,导致模型更易产生验证性和趋炎附势倾向。

Comments Accepted to Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12362 2026-05-11 cs.LG cs.AI 81%

HYPER: A Foundation Model for Inductive Link Prediction with Knowledge Hypergraphs

HYPER:一种用于知识超图归纳链接预测的基础模型

Xingyue Huang, Mikhail Galkin, Michael M. Bronstein, İsmail İlkan Ceylan

机构 * University of Oxford(牛津大学) Google Research(谷歌研究) AITHYRA TU Wien(维也纳技术大学)

专题命中 其他LLM :foundation model(title,abstract);分类 cs.AI、cs.LG

AI总结 HYPER是一种基础模型,能处理包含新实体和新关系的知识超图归纳链接预测,通过编码超边中的实体及其位置实现跨不同关系类型的迁移学习。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07881 2026-05-11 cs.AR 80%

AccelSync: Verifying Synchronization Coverage in Accelerator Pipeline Programs

AccelSync:验证加速器流水程序中的同步覆盖率

Hangcheng An, Rui Wang, Depei Qian

专题命中 其他LLM :LLM(summary_cn,abstract)

AI总结 本文提出AccelSync工具,通过形式化加速器流水程序为受限并发语言,定义参数化硬件事件语义,验证同步覆盖率,发现3个之前未知的同步隐患,并在LLM生成的120个内核中检测到19.2%的缺陷率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07296 2026-05-11 cs.IR 80%

PRISM: Refracting the Entangled User Behavior Space for E-Commerce Search

PRISM:折射电商搜索中的交织用户行为空间

Haoqian Zhang, Ziyuan Yang, Yi Zhang

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 PRISM通过建模用户偏好与物品相关性交互,解决电商搜索中行为信号交织导致的鲁棒性问题,提升搜索行为建模的语义一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08029 2026-05-11 cs.CV cs.LG 79%

STARFlow2: Bridging Language Models and Normalizing Flows for Unified Multimodal Generation

STARFlow2:连接语言模型与归一化流以实现统一的多模态生成

Ying Shen, Tianrong Chen, Yuan Gao, Yizhe Zhang, Yuyang Wang, Miguel Ángel Bautista, Shuangfei Zhai, Joshua M. Susskind, Jiatao Gu

机构 * Apple(苹果公司)

专题命中 其他LLM :language model(title,abstract);分类 cs.LG

AI总结 本文提出STARFlow2,通过归一化流与预训练视觉语言模型结合,实现高效的多模态生成,采用深度浅层流设计和统一FAE潜在空间,提升生成效率与性能。

Comments 19 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07933 2026-05-11 cs.CL 79%

How to Train Your Latent Diffusion Language Model Jointly With the Latent Space

如何与潜在空间联合训练潜在扩散语言模型

Viacheslav Meshchaninov, Alexander Shabalin, Egor Chimbulatov, Nikita Gushchin, Ilya Koziev, Alexander Korotin, Dmitry Vetrov

机构 * Constructor University(Constructor大学) HSE University(莫斯科国立高等经济大学) Applied AI Institute(应用人工智能研究所) AXXX Independent researcher(独立研究者)

专题命中 其他LLM :language model(title,abstract);分类 cs.CL

AI总结 本文提出联合训练潜在扩散语言模型,通过重塑预训练语言模型的表示构建潜在空间,提升生成性能并加快速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07994 2026-05-11 cs.IT math.IT 78%

Semantic Smoothing for Language Models via Distribution Estimation and Embeddings

通过分布估计和嵌入实现语言模型的语义平滑

Haricharan Balasundaram, Swathi Shree Narashiman, Pranay Mathur, Andrew Thangaraj

专题命中 其他LLM :language model(title,abstract)

AI总结 本文提出语义平滑方法,通过嵌入在语义相似上下文中共享统计信息,减少语言模型的测试困惑度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07608 2026-05-11 q-bio.QM q-bio.BM 78%

GoForth: Language Models for RNA Design under Structure, Sequence, and Coding Constraints

GoForth:在结构、序列和编码约束下的RNA设计语言模型

Michael Lindsey

专题命中 其他LLM :language model(title,abstract)

AI总结 本文提出GoForth模型,用于在结构、序列和编码约束下进行RNA设计,通过条件生成模型解决逆向序列设计问题,实现高效高质量的候选生成及设计任务的语义嵌入。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07512 2026-05-11 cs.CV 78%

Hierarchical Dual-Subspace Decoupling for Continual Learning in Vision-Language Models

层次双子空间解耦用于视觉-语言模型中的持续学习

Mengxin Qin, Xiang Zhang, Kun Wei, Xu Yang, Cheng Deng

机构 * School of Electronic Engineering, Xidian University(西电电子工程学院)

专题命中 其他LLM :language model(title,abstract)

AI总结 本文提出HDSD框架,通过分解参数空间和结构化参数分解,减少子空间干扰和参数漂移,提升视觉-语言模型持续学习性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08054 2026-05-11 cs.CV 67%

Towards Highly-Constrained Human Motion Generation with Retrieval-Guided Diffusion Noise Optimization

面向高约束人类动作生成的检索引导扩散噪声优化

Hanchao Liu, Fang-Lue Zhang, Shining Zhang, Tai-Jiang Mu, Shi-Min Hu

机构 * Tsinghua University(清华大学) University of New South Wales(新南威尔士大学)

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 本文提出基于无训练扩散噪声优化框架的检索引导方法,通过关系任务解析和奖励引导掩码优化,解决高约束下的动作生成问题,提升虚拟代理行为合成能力。

Comments Accepted to CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07815 2026-05-11 cs.LG cs.CL 62%

OrScale: Orthogonalised Optimization with Layer-Wise Trust-Ratio Scaling

OrScale:基于层间信任比缩放的正交化优化

Yuxuan Lou, Yang You

机构 * National University of Singapore(新加坡国立大学)

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.LG

AI总结 OrScale通过引入信任比缩放改进Muon算法,通过层间正交化优化提升训练稳定性,实现更高效的收敛与泛化性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06992 2026-05-11 cs.LG stat.ML 57%

Why Does Agentic Safety Fail to Generalize Across Tasks?

为何代理安全无法跨任务泛化?

Yonatan Slutzky, Yotam Alexander, Tomer Slor, Yoav Nagel, Nadav Cohen

机构 * Some Institute(某些研究所)

专题命中 其他LLM :LLM(abstract);分类 cs.LG

AI总结 本文探讨了代理安全在多任务场景中泛化失败的原因,指出安全要求使任务与安全执行的关系更为复杂,通过理论和实验表明需新的方法提升安全性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06898 2026-05-11 cs.AI 57%

Self-Programmed Execution for Language-Model Agents

语言模型代理的自编程执行

Luke J. O'Connor

机构 * Harvard Medical School(哈佛医学院)

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 本文提出自编程执行(SPE)架构,使语言模型自身成为调度器,无需固定策略。通过agentic machines概念,实现无固定轮次策略的状态转移,并引入Spell语言处理程序自我编辑与重评估,实验表明前沿模型可完成复杂代理任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07670 2026-05-11 cond-mat.mtrl-sci 50%

Harnessing Structural Disorder: Unraveling Hydrogen Evolution in Monolayer Amorphous Carbon via First-Principles Simulations and Machine-Learned Potentials

利用结构无序:通过第一性原理模拟和机器学习势能解析单层非晶碳的氢演进

Sreehari M S, Ashutosh Krishna Amaram, Raghavan Ranganathan

专题命中 其他LLM :foundation model(abstract)

AI总结 研究单层非晶碳在氢演进反应中的性能,通过第一性原理模拟和机器学习势能分析其催化活性及结构特征。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23501 2026-05-11 cond-mat.mtrl-sci 50%

Operando study of the evolution of peritectic structures in metal solidification by quasi-simultaneous synchrotron X-ray diffraction and tomography

原位研究金属固结过程中共晶结构的演变:通过准同时同步辐射X射线衍射和断层扫描技术

Kang Xiang, Yueyuan Wang, Shi Huang, Hongyuan Song, Alberto Leonardi, Peter Garland, Sharif Ahmed, Michał M. Kłosowski, Hongmei Yang, Mengnie Li, Jiawei Mi

专题命中 其他LLM :prompting(abstract)

AI总结 本研究通过同步辐射X射线衍射与断层扫描技术,实现实时观察Al-Mn合金固结过程中共晶结构的形核与共生长动力学,揭示相共生长动力学及空间、晶体学和组分关系,发现Al4Mn六方柱状结构具有高各向异性生长行为,并形成Mn富集扩散层,影响后续相变。

Comments 37 pages, 10 figurs, 1 supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07135 2026-05-11 cs.CR 50%

Demystifying and Detecting Agentic Workflow Injection Vulnerabilities in GitHub Actions

揭开GitHub Actions中代理工作流注入漏洞的面纱并检测其漏洞

Shenao Wang, Xinyi Hou, Zhao Liu, Yanjie Zhao, Xiao Cheng, Quanchen Zou, Xiangzheng Zhang, Haoyu Wang

专题命中 其他LLM :LLM(abstract)

AI总结 本文研究GitHub Actions中代理工作流注入漏洞,提出两种核心模式P2A和P2S,并设计TaintAWI工具,发现519个潜在漏洞,其中343个为零日漏洞,已优先披露并获得修复。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11954 2026-05-11 cs.HC 50%

VizCopilot: Fostering Appropriate Reliance on Enterprise Chatbots with Context Visualization

VizCopilot:通过上下文可视化促进对企业聊天机器人适当依赖

Sam Yu-Te Lee, Jingya Chen, Albert Calzaretto, Richard Lee, Samir Passi, Alice Ferng, Mihaela Vorvoreanu

专题命中 其他LLM :prompting(abstract)

AI总结 VizCopilot通过可视化技术帮助用户对齐上下文,减少无关回答,提升信息整合效率,同时揭示AI摘要可信度的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏