arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-05-11 至 2026-05-11 共收录 21 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 21 篇

2605.07481 2026-05-11 cs.CR cs.AI 90%

Vaporizer: Breaking Watermarking Schemes for Large Language Model Outputs

Vaporizer: 拆解大型语言模型输出的水印方案

Jonathan Hong Jin Ng, Anh Tu Ngo, Anupam Chattopadhyay

机构 * College of Computing and Data Science(计算与数据科学学院) Nanyang Technological University(南洋理工大学)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.AI

AI总结 本文研究了最新水印方案的有效性,通过多种攻击策略揭示现有水印系统的优劣,提出改进安全性的方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07472 2026-05-11 cs.CR cs.AI cs.MA 90%

HBEE: Human Behavioral Entropy Engine -- Pre-Registered Multi-Agent LLM Simulation of Peer-Suspicion-Based Detection Inversion

HBEE:人类行为熵引擎——预注册的多智能体LLM模拟中的基于同伴怀疑的检测反转

Vickson Ferrel

机构 * Faculty of Computer Science & Information Technology(计算机科学与信息科技学院) Universiti Malaysia Sarawak(马来西亚沙巴大学) Vixero Technology Enterprise(Vixero技术企业)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.AI

AI总结 本文通过预注册的多智能体LLM模拟,研究了基于同伴怀疑的检测反转问题,发现适应性对手在T_60时的怀疑度低于随机选择的无辜代理,且检测信号在适应性对手行为下解耦。

Comments 14 pages, 6 figures. Pre-registration document and full deviation log included in artifact

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01685 2026-05-11 cs.CL cs.AI 89%

How Do Language Models Compose Functions?

语言模型如何组合函数?

Apoorv Khandelwal, Ellie Pavlick

机构 * Department of Computer Science(计算机科学系)

专题命中 其他LLM :language model(title,abstract);LLM(summary_cn,abstract_cn);large language model(abstract);分类 cs.CL、cs.AI

AI总结 研究语言模型在解决两跳事实回忆任务时的组合机制,发现现代LLM存在组合性差距,通过分析残差流发现两种处理机制,并发现嵌入空间几何与所用机制密切相关。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07490 2026-05-11 cs.CR 88%

Cross-Modal Backdoors in Multimodal Large Language Models

多模态模型中的跨模态后门

Runhe Wang, Li Bai, Haibo Hu, Songze Li

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract)

AI总结 研究提出一种利用轻量级连接器漏洞的跨模态后门攻击,通过污染连接器实现跨模态后门激活,展示攻击的有效性和可迁移性,揭示多模态对齐中的基本漏洞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07925 2026-05-11 cs.CL 83%

How Value Induction Reshapes LLM Behaviour

价值观诱导如何重塑大语言模型行为

Arnav Arora, Natalie Schluter, Katherine Metcalf, Maartje ter Hoeve

机构 * University of Copenhagen(哥本哈根大学) Apple(苹果公司)

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究探讨价值观诱导对大语言模型行为的影响,发现诱导价值观会引发其他相关或对立价值观的表达,提升安全性,但增加拟人化语言使用,导致模型更易产生验证性和趋炎附势倾向。

Comments Accepted to Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12362 2026-05-11 cs.LG cs.AI 81%

HYPER: A Foundation Model for Inductive Link Prediction with Knowledge Hypergraphs

HYPER:一种用于知识超图归纳链接预测的基础模型

Xingyue Huang, Mikhail Galkin, Michael M. Bronstein, İsmail İlkan Ceylan

机构 * University of Oxford(牛津大学) Google Research(谷歌研究) AITHYRA TU Wien(维也纳技术大学)

专题命中 其他LLM :foundation model(title,abstract);分类 cs.AI、cs.LG

AI总结 HYPER是一种基础模型,能处理包含新实体和新关系的知识超图归纳链接预测,通过编码超边中的实体及其位置实现跨不同关系类型的迁移学习。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07881 2026-05-11 cs.AR 80%

AccelSync: Verifying Synchronization Coverage in Accelerator Pipeline Programs

AccelSync:验证加速器流水程序中的同步覆盖率

Hangcheng An, Rui Wang, Depei Qian

专题命中 其他LLM :LLM(summary_cn,abstract)

AI总结 本文提出AccelSync工具,通过形式化加速器流水程序为受限并发语言,定义参数化硬件事件语义,验证同步覆盖率,发现3个之前未知的同步隐患,并在LLM生成的120个内核中检测到19.2%的缺陷率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07296 2026-05-11 cs.IR 80%

PRISM: Refracting the Entangled User Behavior Space for E-Commerce Search

PRISM:折射电商搜索中的交织用户行为空间

Haoqian Zhang, Ziyuan Yang, Yi Zhang

专题命中 其他LLM :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 PRISM通过建模用户偏好与物品相关性交互,解决电商搜索中行为信号交织导致的鲁棒性问题,提升搜索行为建模的语义一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08029 2026-05-11 cs.CV cs.LG 79%

STARFlow2: Bridging Language Models and Normalizing Flows for Unified Multimodal Generation

STARFlow2:连接语言模型与归一化流以实现统一的多模态生成

Ying Shen, Tianrong Chen, Yuan Gao, Yizhe Zhang, Yuyang Wang, Miguel Ángel Bautista, Shuangfei Zhai, Joshua M. Susskind, Jiatao Gu

机构 * Apple(苹果公司)

专题命中 其他LLM :language model(title,abstract);分类 cs.LG

AI总结 本文提出STARFlow2,通过归一化流与预训练视觉语言模型结合,实现高效的多模态生成,采用深度浅层流设计和统一FAE潜在空间,提升生成效率与性能。

Comments 19 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07933 2026-05-11 cs.CL 79%

How to Train Your Latent Diffusion Language Model Jointly With the Latent Space

如何与潜在空间联合训练潜在扩散语言模型

Viacheslav Meshchaninov, Alexander Shabalin, Egor Chimbulatov, Nikita Gushchin, Ilya Koziev, Alexander Korotin, Dmitry Vetrov

机构 * Constructor University(Constructor大学) HSE University(莫斯科国立高等经济大学) Applied AI Institute(应用人工智能研究所) AXXX Independent researcher(独立研究者)

专题命中 其他LLM :language model(title,abstract);分类 cs.CL

AI总结 本文提出联合训练潜在扩散语言模型,通过重塑预训练语言模型的表示构建潜在空间,提升生成性能并加快速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07994 2026-05-11 cs.IT math.IT 78%

Semantic Smoothing for Language Models via Distribution Estimation and Embeddings

通过分布估计和嵌入实现语言模型的语义平滑

Haricharan Balasundaram, Swathi Shree Narashiman, Pranay Mathur, Andrew Thangaraj

专题命中 其他LLM :language model(title,abstract)

AI总结 本文提出语义平滑方法,通过嵌入在语义相似上下文中共享统计信息,减少语言模型的测试困惑度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07608 2026-05-11 q-bio.QM q-bio.BM 78%

GoForth: Language Models for RNA Design under Structure, Sequence, and Coding Constraints

GoForth:在结构、序列和编码约束下的RNA设计语言模型

Michael Lindsey

专题命中 其他LLM :language model(title,abstract)

AI总结 本文提出GoForth模型,用于在结构、序列和编码约束下进行RNA设计,通过条件生成模型解决逆向序列设计问题,实现高效高质量的候选生成及设计任务的语义嵌入。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07512 2026-05-11 cs.CV 78%

Hierarchical Dual-Subspace Decoupling for Continual Learning in Vision-Language Models

层次双子空间解耦用于视觉-语言模型中的持续学习

Mengxin Qin, Xiang Zhang, Kun Wei, Xu Yang, Cheng Deng

机构 * School of Electronic Engineering, Xidian University(西电电子工程学院)

专题命中 其他LLM :language model(title,abstract)

AI总结 本文提出HDSD框架,通过分解参数空间和结构化参数分解,减少子空间干扰和参数漂移,提升视觉-语言模型持续学习性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08054 2026-05-11 cs.CV 67%

Towards Highly-Constrained Human Motion Generation with Retrieval-Guided Diffusion Noise Optimization

面向高约束人类动作生成的检索引导扩散噪声优化

Hanchao Liu, Fang-Lue Zhang, Shining Zhang, Tai-Jiang Mu, Shi-Min Hu

机构 * Tsinghua University(清华大学) University of New South Wales(新南威尔士大学)

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 本文提出基于无训练扩散噪声优化框架的检索引导方法,通过关系任务解析和奖励引导掩码优化,解决高约束下的动作生成问题,提升虚拟代理行为合成能力。

Comments Accepted to CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07815 2026-05-11 cs.LG cs.CL 62%

OrScale: Orthogonalised Optimization with Layer-Wise Trust-Ratio Scaling

OrScale:基于层间信任比缩放的正交化优化

Yuxuan Lou, Yang You

机构 * National University of Singapore(新加坡国立大学)

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.LG

AI总结 OrScale通过引入信任比缩放改进Muon算法,通过层间正交化优化提升训练稳定性,实现更高效的收敛与泛化性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06992 2026-05-11 cs.LG stat.ML 57%

Why Does Agentic Safety Fail to Generalize Across Tasks?

为何代理安全无法跨任务泛化?

Yonatan Slutzky, Yotam Alexander, Tomer Slor, Yoav Nagel, Nadav Cohen

机构 * Some Institute(某些研究所)

专题命中 其他LLM :LLM(abstract);分类 cs.LG

AI总结 本文探讨了代理安全在多任务场景中泛化失败的原因,指出安全要求使任务与安全执行的关系更为复杂,通过理论和实验表明需新的方法提升安全性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06898 2026-05-11 cs.AI 57%

Self-Programmed Execution for Language-Model Agents

语言模型代理的自编程执行

Luke J. O'Connor

机构 * Harvard Medical School(哈佛医学院)

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 本文提出自编程执行(SPE)架构,使语言模型自身成为调度器,无需固定策略。通过agentic machines概念,实现无固定轮次策略的状态转移,并引入Spell语言处理程序自我编辑与重评估,实验表明前沿模型可完成复杂代理任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07670 2026-05-11 cond-mat.mtrl-sci 50%

Harnessing Structural Disorder: Unraveling Hydrogen Evolution in Monolayer Amorphous Carbon via First-Principles Simulations and Machine-Learned Potentials

利用结构无序:通过第一性原理模拟和机器学习势能解析单层非晶碳的氢演进

Sreehari M S, Ashutosh Krishna Amaram, Raghavan Ranganathan

专题命中 其他LLM :foundation model(abstract)

AI总结 研究单层非晶碳在氢演进反应中的性能,通过第一性原理模拟和机器学习势能分析其催化活性及结构特征。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23501 2026-05-11 cond-mat.mtrl-sci 50%

Operando study of the evolution of peritectic structures in metal solidification by quasi-simultaneous synchrotron X-ray diffraction and tomography

原位研究金属固结过程中共晶结构的演变:通过准同时同步辐射X射线衍射和断层扫描技术

Kang Xiang, Yueyuan Wang, Shi Huang, Hongyuan Song, Alberto Leonardi, Peter Garland, Sharif Ahmed, Michał M. Kłosowski, Hongmei Yang, Mengnie Li, Jiawei Mi

专题命中 其他LLM :prompting(abstract)

AI总结 本研究通过同步辐射X射线衍射与断层扫描技术,实现实时观察Al-Mn合金固结过程中共晶结构的形核与共生长动力学,揭示相共生长动力学及空间、晶体学和组分关系,发现Al4Mn六方柱状结构具有高各向异性生长行为,并形成Mn富集扩散层,影响后续相变。

Comments 37 pages, 10 figurs, 1 supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07135 2026-05-11 cs.CR 50%

Demystifying and Detecting Agentic Workflow Injection Vulnerabilities in GitHub Actions

揭开GitHub Actions中代理工作流注入漏洞的面纱并检测其漏洞

Shenao Wang, Xinyi Hou, Zhao Liu, Yanjie Zhao, Xiao Cheng, Quanchen Zou, Xiangzheng Zhang, Haoyu Wang

专题命中 其他LLM :LLM(abstract)

AI总结 本文研究GitHub Actions中代理工作流注入漏洞,提出两种核心模式P2A和P2S,并设计TaintAWI工具,发现519个潜在漏洞,其中343个为零日漏洞,已优先披露并获得修复。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11954 2026-05-11 cs.HC 50%

VizCopilot: Fostering Appropriate Reliance on Enterprise Chatbots with Context Visualization

VizCopilot:通过上下文可视化促进对企业聊天机器人适当依赖

Sam Yu-Te Lee, Jingya Chen, Albert Calzaretto, Richard Lee, Samir Passi, Alice Ferng, Mihaela Vorvoreanu

专题命中 其他LLM :prompting(abstract)

AI总结 VizCopilot通过可视化技术帮助用户对齐上下文,减少无关回答,提升信息整合效率,同时揭示AI摘要可信度的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏