arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-07-15 至 2026-07-15 共收录 11 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 11 篇

2607.12624 2026-07-15 cs.CR 新提交 89%

PVDetector: Detecting Prompt Injection Attacks on Purpose-Specific LLM Agents through Policy-Violation Concept Analysis

PVDetector:通过策略违规概念分析检测针对特定目的大语言模型代理的提示注入攻击

Junhui Wang, Hangtao Zhang, Zhirun Zheng, Li Zeng, Jiejun Xiao, Xi Luo, Lihua Yin, Saiqin Long

专题命中 知识编辑与模型理解 :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 研究针对特定目的LLM代理的提示注入攻击,提出PVDetector框架,通过测量与离线派生的PV概念的隐藏状态对齐来检测攻击,实验表明该方法误报率低、开销小,性能优于现有方法。

Comments Accepted to ACM MM 2026. Code: https://github.com/Claresigle/PVDetector

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12739 2026-07-15 cs.CL 新提交 88%

Epistemic Stance Flexibility Probing: Measuring Prompt-Conditioned Register Shift in Large Language Models

认知立场灵活性探测:测量大语言模型中提示条件下的语域转换

Binwen Liu, Yilin Ren

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(title);LLM(abstract);分类 cs.CL

AI总结 研究大语言模型在不同归因提示下的认知立场灵活性,引入ESFP基准,涵盖多类别多模板项目,从四个维度评估模型响应,发现认知灵活性与模型能力正交,立场内容密度信号最强。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12631 2026-07-15 cs.CL cs.AI 新提交 88%

Can Induced Emotion Bias LLM Behaviors in Sequential Decision Making?

诱导情绪会影响大语言模型在序列决策中的行为吗?

Minh Khoi Ho, Zihao Zhu, Runchuan Zhu, Levina Li, Zhiwen Fan, Zhangyang Wang, Junyuan Hong

机构 * MBZUAI(穆罕默德·本·扎耶德人工智能大学) Texas A&M University(德州农工大学) National University of Singapore(新加坡国立大学) UCLA(加州大学洛杉矶分校) University of Texas at Austin(德克萨斯大学奥斯汀分校) Mass General Hospital(麻省总医院) Harvard Medical School(哈佛医学院)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究探讨诱导情绪对大语言模型在序列决策中行为的影响,采用爱荷华赌博任务结合情绪诱导程序,发现诱导情绪平均不显著影响其决策动态,但愤怒有条件地影响决策,揭示了与人类行为的差异,为相关研究提供工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11920 2026-07-15 econ.EM cs.AI stat.ME 新提交 79%

Sensitivity to Subjective Expected Utility Maximization: A Methodological Study, with an Illustrative Application to LLM Decision-Making

对主观预期效用最大化的敏感性:一项方法学研究,并应用于大语言模型决策

Jeff Helzner

专题命中 知识编辑与模型理解 :LLM(title,abstract);分类 cs.AI

AI总结 研究在标记结果稀缺等情况下评估不确定性决策的难题,通过含敏感性参数α的softmax选择模型得出相关可识别性结果,应用于大语言模型决策,检测到结构化比较α效应。

Comments 64 pages, 5 figures. Code and data archived at Zenodo: https://doi.org/10.5281/zenodo.21250951

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12507 2026-07-15 cs.CR 新提交 78%

When Binaries Talk Back: Representation-Confusion Attacks on LLM-Assisted Reverse Engineering

当二进制文件进行反击:对大语言模型辅助逆向工程的表示混淆攻击

Igor Santos-Grueiro

专题命中 知识编辑与模型理解 :LLM(title,abstract)

AI总结 研究大语言模型辅助逆向工程中的表示混淆攻击,通过RARE-Bench衡量,测试RARE-Guard控制,发现无运行时控制时模型有不安全提议,工具授权、支持门和来源门在处理虚假声明上表现不同,二进制派生内容可指导分析且多工具视图不一定提供独立证据。

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11327 2026-07-15 cs.LG cs.AI 版本更新 73%

PRISM Edit: One Vector for All Temporal Answers

PRISM Edit:适用于所有时间答案的单一向量

Chen Huang, Qi Zheng, Ruiqin Zheng, Long Zeng, Yuantong Xu

机构 * Tsinghua University(清华大学) ByteDance(字节跳动)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究针对大语言模型时间事实更新问题,基于因果追踪发现其内部计算支持新旧答案区分,进而引入PRISM Edit,通过优化单一多义词表示及利用固有调制路径,在新基准上评估,相比基线提升了时间一致性等指标且速度更快。

Comments Chen Huang and Qi Zheng contributed equally. Corresponding authors: Long Zeng, Yuantong Xu

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.01333 2026-07-15 cs.LG math.NT 70%

Classification of integers based on residue classes via modern deep learning algorithms

基于小素数除余类的整数分类:现代深度学习算法的应用

Da Wu, Jingye Yang, Mian Umair Ahsan, Kai Wang

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文研究了利用现代深度学习算法对整数基于小素数除余类进行分类,发现特征工程对模型性能至关重要,展示了线性回归在傅里叶级数基向量上的应用,并指出AutoML和LLM在未适当工程化特征时的不足。

Comments Accepted at Patterns

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06592 2026-07-15 cs.CL cs.LG 版本更新 62%

Hierarchical Latent Structures in Data Generation Process Unify Mechanistic Phenomena across Scale

数据生成过程中层次化潜在结构在跨尺度的机理现象中统一

Jonas Rohweder, Subhabrata Dutta, Iryna Gurevych

机构 * Ubiquitous Knowledge Processing Lab (UKP Lab) Department of Computer Science, Technical University of Darmstadt and National Research Center for Applied Cybersecurity ATHENE, Germany(通用知识处理实验室(UKP Lab)计算机科学系,达姆施塔特技术大学和应用网络安全国家研究中心ATHENE,德国)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.LG

AI总结 本文通过生成合成语料库研究数据生成过程中层次结构对语言模型中归纳头、功能向量和海德拉效应等现象的统一解释。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05686 2026-07-15 cs.AI 版本更新 57%

Attractor Geometry of Transformer Memory: From Conflict Arbitration to Confident Hallucination

Transformer记忆的吸引子几何:从冲突仲裁到自信 hallucination

Qiyao Liang, Risto Miikkulainen, Ila Fiete

机构 * Massachusetts Institute of Technology(麻省理工学院) University of Texas Austin(德克萨斯大学奥斯汀分校) Cognizant(Cognizant公司)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.AI

AI总结 研究Transformer记忆中冲突与hallucination的几何机制,揭示吸引子基底在隐藏状态空间中的作用,通过合成任务验证几何边界在区分正确回忆与hallucination中的有效性。

Comments Inadvertent premature posting before full approval of all listed co-authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12098 2026-07-15 cs.IR 新提交 50%

Explaining When PRF Fails: Participatory Auditing for Selective Query Expansion

解释伪相关反馈何时失败:用于选择性查询扩展的参与式审计

Zeyan Liang, Graham McDonald, Iadh Ounis

专题命中 知识编辑与模型理解 :LLM(abstract)

AI总结 研究PRF失败问题,提出两阶段审计然后自动化框架,第一阶段通过对用户审计揭示PRF利弊,第二阶段利用基于语言模型的重排器作预测器,解释PRF危害及决策过程,使检索组件可审计且以用户为基础。

Comments Accepted at WExIR @ SIGIR 2026, the 2nd Workshop on Explainability in Information Retrieval, Melbourne (Naarm), Australia, 24 July 2026. 3 pages, 1 figure. Extended abstract building on the SIGIR 2026 short paper "Auditing Query Drift: Do Users Actually Benefit from Pseudo-Relevance Feedback?" (doi:10.1145/3805712.3809916)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12050 2026-07-15 cs.RO 新提交 50%

EFLUX: Elastic Multi-Robot Formation Navigation and Adaptation with Agentic LLMs

EFLUX:基于智能语言模型的弹性多机器人编队导航与自适应

Jinyuan Zhang, Yuwei Wu, Guangyao Shi, Jonathan Diller, Gaurav S. Sukhatme, Vijay Kumar

机构 * GRASP Lab, University of Pennsylvania(宾夕法尼亚大学GRASP实验室) Department of Computer Science, University of Southern California(南加州大学计算机科学系)

专题命中 知识编辑与模型理解 :LLM(abstract)

AI总结 针对多机器人在受限环境中编队导航问题,提出EFLUX框架,基于几何和大语言模型,对变形与重新配置动作联合推理,经闭环管道转化为航点,实验证明其能实现安全弹性导航,减少死锁与导航失败。

详情

展开后加载摘要…

URL PDF HTML 收藏