arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12096 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 12096 篇

2608.14216 2026-08-17 cs.CR 新提交 89%

MazeRunner: Nonlinear Task and Clue Orchestration for LLM-driven Black-Box Automated Penetration Testing

MazeRunner:面向大语言模型驱动的黑盒自动化渗透测试的非线性任务与线索编排

Zhenyuan Li, Yi Jiang, Junjie Cheng, Yaokun Li, Jing Qiu, Shouling Ji

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 针对现有LLM驱动渗透测试智能体在非线性黑盒场景中的缺陷,提出三智能体框架的MazeRunner,在HTB目标上完成更多子任务、获取更高权限,探索攻击分支更高效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10281 2026-08-12 cs.CR 新提交 89%

From Prompt Injection to Web Exploitation: Revisiting Classic Vulnerabilities in LLM-Integrated Applications

从提示注入到Web漏洞利用:重新审视集成大语言模型的应用中的经典漏洞

Spiros Tsigkopoulos, Christoforos Ntantogian

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 本文研究集成大语言模型的Web应用的新型攻击LLM介导的Web攻击,提出LLM2X系列攻击类型,通过实现TicketOracle实验发现模型易感性差异,给出多层缓解策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18795 2026-08-12 cs.SI 版本更新 89%

Opinion Polarization in LLM-Based Social Networks: Manipulation and Mitigation

基于LLM的社交网络中的意见极化:操纵与缓解

Ali Safarpoor Dehkordi, Mohammad Shirzadi, Ahad N. Zehmakan

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 研究在基于大语言模型模拟的社交网络中,对手如何通过有限预算操纵意见极化,并评估两种防御机制(反应性和主动性)的效果,发现两者均无法完全恢复基线极化状态。

Comments 16 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08320 2026-08-11 cs.RO 新提交 89%

Diminishing Returns of Intelligence: The Non-Linear Relationship Between LLM Scale and User Perception in Short-Duration Open-Ended Social Human-Robot Interactions

智能收益递减:短时长开放式社交人机交互中,大语言模型规模与用户感知的非线性关系

Amanda Rasille Røn Volf, Morten Roed Frederiksen

机构 * The IT-University of Copenhagen(哥本哈根信息技术大学)

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 该研究探讨短时长开放式社交人机交互中LLM规模与用户感知的关系,发现30B参数模型相比更小模型无显著优势,提示具身社交HRI中模型缩放收益递减,对话流畅性等与参数规模同等重要。

Comments 4 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06830 2026-08-10 cs.RO cs.CR 新提交 89%

When Coordination Becomes a Threat: Communication Attacks in LLM-Controlled Multi-Robot Systems

当协调成为威胁:大语言模型控制的多机器人系统中的通信攻击

Zhen Huang, Zhihuang Liu, Weijia Shi, Yifan Yang, Weishang Wu, Zhiping Cai

机构 * College of Computer Science and Technology, National University of Defense Technology(国防科技大学计算机科学与技术学院) School of Informatics, Xiamen University(厦门大学信息学院)

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 该研究针对LLM控制的多机器人系统,提出两种通信攻击并在三种架构下验证其风险,引入CPV门可降低违规率,为相关安全问题提供了应对方案。

Comments 17 pages, 8 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06641 2026-08-10 cs.CR cs.SE 新提交 89%

From Documentation to Zero-day Vulnerabilities: LLM-Driven Fuzzing of JavaScript Engines in PDF Readers

从文档到零日漏洞:基于大语言模型的PDF阅读器JavaScript引擎模糊测试

Suyue Guo, Stijn Pletinckx, Tianle Yu, Yigitcan Kaya, Saad Ullah, Wenbo Guo, Christopher Kruegel, Giovanni Vigna

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 针对现有PDF阅读器模糊测试工具的局限,提出基于LLM的PDFuzzer,生成复杂API调用序列,在三款主流阅读器上覆盖率提升48%,识别31个零日漏洞并获厂商漏洞赏金。

Comments 16 pages, 2 figures, accepted by ACM CCS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04507 2026-08-06 cs.MA cs.NE 新提交 89%

Emergence of Reputation-Based Cooperation in LLM Agents

大语言模型智能体中基于声誉的合作的涌现

Kazuya Horibe, Kenji Itao, Wataru Toyokawa

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 研究发现LLM智能体的合作鲁棒性由对手禀赋敏感性(图像评分机制)和叛逃者排除严格程度决定,其无法发展更鲁棒的Leading-Eight规范,凸显文化进化的LLM合作的漏洞并提出自下而上规范构建的需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02012 2026-08-06 cs.SE cs.DB 版本更新 89%

Automated Database Testing via LLM-Synthesized SQL Features

基于大语言模型合成SQL特征的自动化数据库测试

Suyang Zhong, Manuel Rigger

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 该研究提出ShQveL方法,通过LLM合成SQL特征增强SQL生成器,在5个DBMS上发现55个新漏洞,其中50个已被修复,提升了自动化数据库测试的漏洞发现能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02178 2026-08-04 physics.soc-ph cond-mat.stat-mech cs.MA nlin.AO 新提交 89%

Microscopic dynamics of consensus formation in multi-agent LLM Naming Games

多智能体大语言模型命名博弈中共识形成的微观动力学

Cristiano De Nobili, Vijayasri Iyer, Alessandro Codello, Raffaella Burioni

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 该研究揭示了多智能体LLM命名博弈中,解码温度作为架构依赖控制参数,通过不同听者机制调控共识形成的微观动力学,得出了双速率动力学的解析有序条件。

Comments 8 pages, 8 figures, 1 table, 1 appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14061 2026-08-04 cs.SE 版本更新 89%

LLM Agents Can See Code Repositories

LLM智能体能够查看代码仓库

Dongjian Ma, Silin Chen, Yufei Yang, Yuling Shi, Yanfu Yan, Xiaodong Gu

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 研究多模态大语言模型在仓库级问题解决中利用视觉表示的效果,发现纯视觉方案降低精度,而结合视觉结构图可减少26%输入token并保持或提升精度。

Comments Accepted by ASE 2026. Our code and data are available at https://github.com/cslsolow/SeeRepo

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29519 2026-08-03 cs.SE 新提交 89%

Students' Practices and Skills in the LLM-Era: "You Can't Outsource the Struggle and Still Get the Skill"

LLM时代的学生实践与技能:“你不能把奋斗过程外包出去,却仍想获得技能”

Enne Rebeca Silva de Freitas, Gustavo Pinto, Danilo Monteiro

专题命中 其他LLM :LLM(title,title_cn)

AI总结 研究针对软件工程研究生在LLM时代的AI使用技能缺口,分析1383条子reddit帖子后发现学生外包研究技能培养的认知努力,提出需开发课程引导学生与LLM协同工作。

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26390 2026-08-03 cs.SE 版本更新 89%

Impossible to hide secret ...: Uncovering Security and Privacy Issues in LLM-native IDEs

无法隐藏的秘密:揭示原生大语言模型集成开发环境(LLM-native IDEs,简称LIDEs)的安全与隐私问题

Mostafijur Rahman Akhond, Md Afif Al Mamun, Gias Uddin, Song Wang

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 本文针对原生大语言模型集成开发环境(LIDEs),通过分析110万条相关帖子及6000余条评论,构建其安全隐私问题分类体系,发现问题多源于系统设计,开发者依赖外部防护,为后续安全LIDEs设计提供经验。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10383 2026-07-31 cs.CV 版本更新 89%

Authoring for Living Worlds: Tool-Constrained LLM Agents for Executable Multi-Actor Scenarios

代理视频生成:通过工具约束的LLM规划从文本到可执行事件图

Nicolae Cudlenco, Mihai Masala, Marius Leordeanu

机构 * Institute of Mathematics of the Romanian Academy(罗马尼亚科学院数学研究所) National University of Science and Technology Politehnica Bucharest(布加勒斯特理工大学) Büchi Labortechnik AG(布奇实验室技术股份公司)

专题命中 其他LLM :LLM(title,title_cn)

AI总结 本文提出了一种代理系统,通过LLM生成结构化的事件图规范,并在3D引擎中确定性执行,解决了传统视频生成的语义可靠性问题,展示了在物理真实性和语义对齐上的优越表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13767 2026-07-29 cs.AR 版本更新 89%

Retrieve, Schedule, Reflect: LLM Agents for Chip QoR Optimization

检索、调度、反思:用于芯片QoR优化的LLM代理

Yikang Ouyang, Yang Luo, Dongsheng Zuo, Yuzhe Ma

专题命中 其他LLM :LLM(title,title_cn)

AI总结 本文提出基于LLM的代理框架,通过与EDA工具交互实现芯片优化调度,利用检索增强生成和帕累托驱动反馈提升QoR,实验显示其在时序改进、能耗和面积上优于强化学习等黑盒方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23213 2026-07-28 cs.HC 新提交 89%

A Taxonomy of Confabulations and the Perception-Reality Gap in LLM-Assisted Immersive Scene Editing

大语言模型辅助沉浸式场景编辑中的虚构分类与感知-现实差距

Junlong Chen, Per Ola Kristensson

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 研究LLM辅助沉浸式3D场景编辑中的虚构,通过对24名非专业用户的探索性研究构建分类法,报告其普遍性与破坏性,定义感知-现实差距结构,强调负载下虚构意识饱和度,得出对未来系统减轻虚构的设计启示。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19315 2026-07-23 cs.SE 89%

Improving LLM-Driven Test Generation by Learning from Mocking Information

通过学习模拟信息改进LLM驱动的测试生成

Jamie Lee, Flynn Teh, Hengcheng Zhu, Mengzhen Li, Mattia Fazzini, Valerio Terragni

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 本文提出MOCKMILL方法,利用开发者编写测试中的模拟信息自动生成测试用例,通过迭代生成与修复过程提升测试覆盖率和有效性。

Comments Accepted for publication in ICST 2026 (AIST workshop). This arXiv version is the authors' accepted manuscript

Journal ref IEEE Conference on Software Testing, Verification and Validation Workshop 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18250 2026-07-22 cs.HC 新提交 89%

Anthropomorphism in Children's Interactions with LLM Chatbots: A Systematic Review of Drivers and Outcomes

儿童与基于大语言模型的聊天机器人互动中的拟人化:驱动因素和结果的系统综述

Hansinie Madushika Jayathilake, Renkai Ma

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 本研究通过分析35项实证研究,系统综述儿童与LLM聊天机器人互动中拟人化的驱动因素及结果,发现类人角色构建等驱动互动,出现五种拟人化结果,可为相关聊天机器人设计开发提供参考。

Comments Accepted by ACM IDC '26

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17022 2026-07-21 cs.SE cs.HC 新提交 89%

Can LLM Code Explanations Adapt to Diverse Problem-Solvers' Needs?

大语言模型代码解释能否适应不同问题解决者的需求?

Andrew Anderson, David Piorkowski, Justin Weisz, Margaret Burnett, Kush Varshney

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 研究LLM代码解释能否适应不同问题解决者需求,基于包容性设计方法开发提示,用自然语言处理技术从六个LLM生成代码解释,发现13种语言适应分类法,贡献两种问题解决适应方法。

Comments To be published in AAAI/ACM conference on AI, Ethics, and Society (AIES 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15977 2026-07-20 cs.CR 新提交 89%

Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization

拒绝并非安全!评估大语言模型驱动的内容幽默化中的潜在安全风险

Yu Cui, Ruiqing Yue, Tingyu Li, Sicheng Pan, Zhuoyu Sun, Xufeng Zhang, Baohan Huang, Haibin Zhang, Cong Zuo

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 研究基于LLM的内容幽默化潜在安全风险,提出HumorSafe框架评估风险传播,发现LLMs幽默化时会引入刻板印象和毒性,还提出HumorPIA攻击,揭示现有LLM安全评估在幽默化设置下的差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04915 2026-07-20 cs.HC 89%

Exploring Expert Perspectives on Wearable-Triggered LLM Conversational Support for Daily Stress Management

探索专家对可穿戴触发LLM对话支持日常压力管理的视角

Poorvesh Dongre, Sameer Neupane, Priyanka Jadhav, Nikitha Donekal Chandrashekar, Christian Webb, Denis Gračanin

专题命中 其他LLM :LLM(title,title_cn)

AI总结 本文提出EmBot应用,结合可穿戴设备压力检测与LLM对话支持,通过专家访谈揭示设计中的早期紧张点和考虑因素,为日常压力管理和心理健康支持系统设计提供指导。

Journal ref IH '26: Proceedings of the 2026 ACM Interactive Health Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31762 2026-07-01 cs.HC 新提交 89%

Investigating LLM-Powered Dissenting Minority Support in Power-Imbalanced Group Decision-Making: Counterargument and Mediation as Intervention Strategies

探究LLM赋能的异议少数群体在权力不平衡群体决策中的支持:反驳与调解作为干预策略

Soohwan Lee, Seoyeong Hwang, Mingyu Kim, Dajung Kim, Kyungho Lee

专题命中 其他LLM :LLM(title,title_cn)

AI总结 本研究开发了LLM赋能的异议少数支持系统,通过AI生成的反驳或AI调解消息来关注少数观点,实验发现反驳增强满意度但调解增加参与却降低心理安全感,揭示了参与与心理安全之间的支持悖论。

Comments Accepted at CSCW 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15031 2026-06-25 econ.EM 新提交 89%

Partial Identification from LLM Prompts

从LLM提示中的部分识别

Xiaohong Chen, Ashesh Rambachan, Elie Tamer

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 研究利用大语言模型作为二元分类器时,在真实标签未知且报告误差可能任意相关的情况下,通过外部校准分数和事件来部分识别真实流行度θ,并刻画识别边界。

Comments 31 PAGES TOTAL. NO FIGURES

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23791 2026-06-24 hep-ph 新提交 89%

One Generator, Any Process: LLM-Conditioning for the LHC

一个生成器,任意过程:LHC的LLM条件生成

Henning Bahl, Tilman Plehn, Daniel Schiller, Thanush Sivagnanalingam

专题命中 其他LLM :LLM(title,title_cn);foundation model(abstract)

AI总结 提出利用预训练LLM为自回归变压器提供描述性嵌入,通过连续参数、过程标签和费曼图的条件化方案,实现LHC事件生成网络的快速收敛、更优结果及对未见过程的泛化。

Comments 33 pages, 23 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19904 2026-06-19 cs.SI 新提交 89%

Toward Temporal Realism in City-Scale Crisis Response Simulation using LLM Agents

面向城市级危机响应模拟中时间真实性的LLM智能体方法

Anping Zhang, Yang Tan, Yuanbo Tang, Huaze Tang, Qiuhua Ye, Marta C. Gonzalez, Yang Li

专题命中 其他LLM :LLM(title,title_cn)

AI总结 针对LLM社会模拟缺乏时间真实性的问题,基于深圳疫情志愿活动数据,提出数据校准的自激与危机激活机制,实现爆发性时间模式,使智能体时间分布接近真实。

Comments 11pages,7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14796 2026-06-16 cs.SE 新提交 89%

Faster Code, Deeper Debt? A Multivocal Literature Review on Technical Debt and Its Early Signs in LLM-Assisted Software Development

更快的代码,更深的债务?关于LLM辅助软件开发中技术债务及其早期迹象的多声部文献综述

Ramtin Ehsani, Shriya Rawal, Yuanfang Cai, Preetha Chatterjee

专题命中 其他LLM :LLM(title,title_cn)

AI总结 通过104篇文献的多声部综述,发现LLM辅助开发放大传统技术债务(代码、设计、文档债务)并引入新债务(快速集成、提示、伦理、数据、来源债务),提出人机协同、提示工程等缓解策略,但缺乏标准化基准。

Comments Accepted for publication in ACM Transactions on Software Engineering and Methodology (TOSEM), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11877 2026-06-11 cs.NI 新提交 89%

LLM-Enabled NWDAF: A Step Toward AI-Native 6G Network Intelligence

LLM赋能的NWDAF:迈向AI原生的6G网络智能

Henok Daniel, Omar Alhussein, Cheng Li, Jie Liang, Ernesto Damiani

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 开发了一个与Free5GC兼容的开源NWDAF,集成大语言模型接口,通过意图识别实现自然语言交互,简化网络分析管理,为AI原生6G网络奠定基础。

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10749 2026-06-11 cs.CR 版本更新 89%

AttriGuard: Defeating Indirect Prompt Injection in LLM Agents via Causal Attribution of Tool Invocations

AttriGuard: 通过工具调用的因果归因击败LLM代理中的间接提示注入

Yu He, Haozhe Zhu, Yiming Li, Shuo Shao, Hongwei Yao, Zhihao Liu, Zhan Qin

专题命中 其他LLM :LLM(title,title_cn)

AI总结 针对LLM代理易受间接提示注入攻击的问题,提出基于并行反事实测试的运行时防御AttriGuard,通过因果归因区分用户意图驱动与不可信观察驱动的工具调用,在多个基准上实现0%攻击成功率。

Comments Accepted by USENIX Security 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10434 2026-06-10 cs.HC cs.ET 新提交 89%

Profiling cognitive offloading in LLM-mediated synthesis writing: Volume vs. content

LLM中介的合成写作中认知卸载的剖析:数量与内容

Oleksandra Poquet, Mani Shankar Nanduri, Maria Ximena Salinas Loyer, Matthias Stadler, Michael Sailer, Jelena Jovanovic

专题命中 其他LLM :LLM(title,title_cn)

AI总结 本研究通过聚类分析比较了两种认知卸载剖析方法(基于使用量和基于内容),发现内容剖析能揭示更丰富的认知模式,为理解LLM如何重新分配认知活动提供新视角。

Comments Accepted to the Proceedings of the European Conference for Tecnology-Enhanced Learning' 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10311 2026-06-10 cs.SE 新提交 89%

From Awareness to Action: How Developers Engage with Accessibility Innovation in LLM-Assisted Development

从意识到行动:开发者如何在LLM辅助开发中参与无障碍创新

Thayssa Águila da Rocha, Luciane Silva, Ana Duarte, Marcelle Pereira Mota, Gustavo Pinto

专题命中 其他LLM :LLM(title,title_cn)

AI总结 通过分析14个基于LLM的无障碍项目提案和9名参与者的焦点小组讨论,发现由残障人士主导的倡议能促进包容性创新,推动无障碍从合规要求转变为技术卓越和文化变革的驱动力。

Comments WASHES 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04397 2026-06-10 cs.SE cs.IR 版本更新 89%

Context-as-AI-Service: Surfacing Cross-File Dependency Chains for LLM-Generated Developer Documentation

上下文即服务:为LLM生成的开发者文档揭示跨文件依赖链

Ameya Gawde, Vyzantinos Repantis, Harshvardhan Singh, Lucy Moys

专题命中 其他LLM :LLM(title,title_cn)

AI总结 提出Context-as-a-Service (CaaS)检索层,通过索引代码库并支持关键词与语义搜索,帮助LLM代理在生成或审查文档时追踪跨文件依赖链,实验表明CaaS能发现基线遗漏的错误并减少时间和输入令牌消耗。

Comments 8 pages, 2 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏