arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-10 至 2026-07-10 共收录 119 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 20 篇

2504.02128 2026-07-10 cs.MA cs.AI cs.CL cs.ET 85%

Achieving Unanimous Consensus Through Multi-Agent Deliberation

通过多智能体辩论实现一致共识

Apurba Pokharel, Ram Dantu, Shakila Zaman, Vinh Quach, Sirisha Talapuru

机构 * University of North Texas(北卡罗来纳州立大学)

专题命中 多智能体 :agent(title);multi-agent(title);分类 cs.AI、cs.CL

AI总结 本文提出了一种基于多智能体辩论的区块链共识机制,利用大型语言模型进行结构化讨论以实现一致共识,同时保持区块链属性并处理对手行为和共识信心。

Comments 6 pages, 4 figure, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08652 2026-07-10 cs.AI 新提交 83%

Formal Mechanisms for Market Stability in Self-Interested Agent Societies: A Marketplace Simulation Study

自利代理社会中市场稳定性的形式机制:市场模拟研究

Eugene Ng Yi Sheng, Bingquan Shen

机构 * DSO National Laboratories(国防科技研究院) National University of Singapore(新加坡国立大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(abstract);分类 cs.AI

AI总结 研究自利代理社会中市场稳定性的形式机制,通过多智能体市场模拟实验,比较八种机制,发现调解机制最佳,对其进行对抗性红队测试,结果表明该机制具有对抗鲁棒性,能在攻击下维持市场稳定。

Comments 23 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07729 2026-07-10 cs.MA cs.AI cs.CL 新提交 73%

Collective Intelligence with Foundation Models

基于基础模型的集体智能

J. de Curtò, I. de Zarzà

机构 * Department of Computer Applications in Science \& Engineering, BARCELONA Supercomputing Center, 08034 Barcelona, Spain Escuela Técnica Superior de Ingeniería (ICAI), Universidad Pontificia Comillas, 28015 Madrid, Spain Human Centered AI, Data \& Software, LUXEMBOURG Institute of Science

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 研究如何将多个基础模型协调成合作推理系统,提出多智能体框架,含求解器、批评和聚合智能体及评分模块。通过消融研究比较四种配置,发现模型异质性是性能提升关键,能提高逐步准确率、降低方差,还讨论了相关原则、方法及对应用人工智能的影响。

Comments Accepted as a book chapter in "Advances in Global Applied Artificial Intelligence" (G. A. Tsihrintzis, M. Virvou, N. G. Bourbakis, L. C. Jain, Eds.), authenticated version will be published in Springer series: Learning and Analytics in Intelligent Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08375 2026-07-10 cs.CV cs.AI 新提交 70%

WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving

WCog-VLA:用于端到端自动驾驶的双级世界认知视觉-语言-行动模型

Xuerun Yan, Zhexi Lian, Nuoheng Zhang, Shiyu Fang, Haoran Wang, Chen Lv, Jia Hu, Binyang Song

机构 * Tongji University(同济大学) Nanyang Technological University(南洋理工大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 针对现有视觉-语言-行动模型在自动驾驶中存在的局限,提出双级世界认知的WCog-VLA框架,语义层统一认知推理,生成层引入新模型加速推理,构建数据集,实验证明该模型在NAVSIM基准测试中达到最优分数。

Comments 20 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26883 2026-07-10 cs.LO 版本更新 67%

A Dynamic Deontic Simplicial Logic for Joint Commitments

联合承诺的动态道义单纯逻辑

Giorgio Cignarale, Hugo Rincon Galeana

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 提出基于单纯复形的道义逻辑DSL及其动态扩展DDSL,用于建模群体义务和联合承诺,并证明了可靠性和完全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21074 2026-07-10 cs.NI 版本更新 67%

RepLLM: Toward Automatically Reproducing Network Research Results

RepLLM:迈向自动重现网络研究结果

Yining Jiang, Yunxin Xu, Wenyun Xu, Yufan Zhu, Rui Liu, Tangtang He, Haiying Huang, Letian Zhu, Qingyu Song, Qiang Su, Lizhao You, Lu Tang, Wanjian Feng, Yuchao Zhang, Linghe Kong, Qiao Xiang, Jiwu Shu

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 针对计算机网络研究结果重现难题,RepLLM提出端到端多智能体框架,通过四个智能体协作及共享内存机制确保一致性,借助特定推理和调试方法解决问题,相比现有框架表现更优,能高效重现基准且减少令牌消耗。

Comments SIGCOMM'26(19 pages, 6 figures, 6 tables)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 工作流自动化 14 篇

2607.08740 2026-07-10 cs.AI cs.PL cs.SE 新提交 84%

Workflow as Knowledge: Semantic Persistence for LLM-Mediated Workflows

作为知识的工作流:大语言模型介导的工作流的语义持久性

Emanuele Quinto, Carlo Andrea Rozzi, Francesco Zanitti

机构 * UNHCR København(联合国难民署哥本哈根办事处) CNR—Istituto Nanoscienze Modena(意大利国家研究委员会-纳米科学研究所摩德纳分所) ZeLe & F ApS København(泽勒与F有限公司哥本哈根分公司)

专题命中 工作流自动化 :workflow(title,abstract);tool use(abstract);分类 cs.AI、cs.SE

AI总结 研究大语言模型介导的工作流,提出受Lisp启发的概念模型,用符号形式等作解释视角,将工作流相关元素表示为持久知识对象,区分派生和推理,初步阐述了工作流的语义持久性。

Comments 39 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08288 2026-07-10 cs.CR cs.AI 新提交 83%

From Legacy Documentation to OSCAL: An MCP-Based Agent Pipeline for Threat-Informed Continuous Compliance in Critical Infrastructure

从遗留文档到OSCAL:基于MCP的代理管道,用于关键基础设施中的威胁情报驱动的持续合规性

Lea Roxanne Muth, Marian Margraf

机构 * Department of Mathematics and Computer Science(数学与计算机科学系)

专题命中 工作流自动化 :agent(title,abstract);multi-agent(abstract);分类 cs.AI

AI总结 研究针对关键基础设施运营技术环境无法主动扫描但需主动系统反馈的问题,提出基于MCP的多代理管道,将自然语言描述转换为知识图谱和OSCAL工件,架构解耦推理与检索,降低风险,在场景中取得一定召回率并生成报告,虽有错误但可人工审查。

Comments Accepted for publication at the 2026 IEEE International Conference on Cyber Security and Resilience (IEEE CSR), Lisbon, Portugal, August 3-5, 2026. 8 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08180 2026-07-10 cs.CR cs.AI 新提交 83%

Out of Sight: Compression-Aware Content Protection against Agentic Crawlers

视线之外:针对智能爬虫的压缩感知内容保护

Xuefei Wang

机构 * Beihang University(北航大学)

专题命中 工作流自动化 :agentic(title);agent(abstract);workflow(abstract);分类 cs.AI

AI总结 研究基于LLM的智能体给在线内容带来的新威胁,提出CAPE框架,通过注入不可见扰动保护文本内容,在低查询预算下有效提升信息损失,实验证明其有效性与通用性,推动智能体时代内容保护研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08257 2026-07-10 cs.AI 新提交 70%

MentalHospital: A Virtual Environment for Evaluating Psychiatric Clinical Encounters

精神病院:一个用于评估精神科临床问诊的虚拟环境

Yuming Yang, Xiao Sun, Yuanwei Zou, Zhengxiao Wu, Yun Chen, Jiang Zhong, Haoyang Zeng, Jingwang Huang, Kaiwen Wei

机构 * School of Computer Science, Chongqing University(重庆大学计算机科学学院) School of Computer Science, Hunan University(湖南大学计算机科学学院)

专题命中 工作流自动化 :planning(abstract);workflow(abstract);分类 cs.AI

AI总结 研究针对大语言模型在精神科临床问诊评估不足的问题,引入MentalHospital虚拟环境,实例化S.O.A.P.工作流程,用双轨协议评估,开发MentalEval,经测试其具有临床保真度且与专家高度一致,指出大语言模型在精神状态评估上落后临床医生。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07974 2026-07-10 cs.CL cs.AI 新提交 62%

A Multi-cluster Boundary Learning Method for Out-of-Scope Intent Detection via MiniLM Embedding

一种基于MiniLM嵌入的多簇边界学习方法用于检测超出范围的意图

Yihong Xu, Mingyu Kang, Linyuan Lü

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI、cs.CL

AI总结 针对意图检测中超出范围意图检测的挑战,提出基于MiniLM嵌入的多簇边界学习方法,在单类分类工作流程中检测超出范围意图,实验表明该方法性能最优,所用MiniLM能更好适应相关要求。

Comments To submit

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10062 2026-07-10 cs.AI cs.MA 新提交 57%

Deployment-Time Memorization in Foundation-Model Agents

基础模型智能体中的部署时记忆

Lei, Chen, Guilin Zhang, Kai Zhao, Dalmo Cirne, Andy Olsen, Xu Chu, Zeke Miller, Alet Blanken, Amine Anoun, Jerry Ting

机构 * Lei (Rachel) Chen Guilin Zhang Kai Zhao Dalmo Cirne Andy Olsen Zeke Miller Xu Chu Alet Blanken Amine Anoun Jerry Ting

专题命中 工作流自动化 :agent(abstract);分类 cs.AI

AI总结 研究基础模型智能体在部署时记忆的设计选择如何影响个性化效用、提取风险和删除保真度,提出遗忘残差分数并揭示压缩与删除的权衡。

Comments 4 pages, ICML MemFM 2026 Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05969 2026-07-10 cs.CR cs.SE 版本更新 57%

Heimdallr: Characterizing and Detecting LLM-Induced Security Risks in GitHub CI Workflows

Heimdallr:在GitHub CI工作流中识别和检测LLM引发的安全风险

Bonan Ruan, Yeqi Fu, Chuqi Zhang, Jiahao Liu, Jun Zeng, Zhenkai Liang

专题命中 工作流自动化 :workflow(abstract);分类 cs.SE

AI总结 本文研究GitHub CI工作流中LLM引发的安全风险,提出Heimdallr框架,通过流程图规范化和威胁向量检测,实现高精度识别LLM节点和威胁向量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04920 2026-07-10 cs.AI 版本更新 57%

Conversational AI for Rapid Scientific Prototyping: A Case Study on ESA's ELOPE Competition

用于快速科学原型设计的对话式人工智能:以欧空局的ELOPE竞赛为例

Nils Einecke

机构 * Honda Research Institute Europe GmbH(本田欧洲研究机构)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 以欧空局ELOPE竞赛为例,探讨用ChatGPT进行快速科学原型设计。介绍其在竞赛中的表现,包括提供代码、推理等,虽有局限但凸显人机协作潜力,分析优缺点,提出将大语言模型集成到科学工作流程可增强快速原型设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08529 2026-07-10 cs.IR 新提交 50%

Log-Insight: Automating Microservice Incident Diagnosis via Neuro-Symbolic Log Analysis

Log-Insight:通过神经符号日志分析实现微服务事件诊断自动化

Carlos Garcia-Hernandez, Aymane Abdali, Guangyu Wu, Mingxue Wang, Fei Shen, Zhaoyu Pang, Yanbin Zhang

专题命中 工作流自动化 :workflow(abstract)

AI总结 研究针对大规模微服务系统生产事件诊断难题,提出Log-Insight系统,通过自动化SRE手动分类工作流程,经符号阶段处理后为LLM提供证据合成假设报告,六阶段管道减少大量原始事件,评估显示该系统能高效准确诊断根本原因,还报告了相关故障模式等内容。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02358 2026-07-10 cond-mat.stat-mech physics.soc-ph 新提交 50%

Contrarian Majority Dynamics: Violation of Detailed Balance and Nonequilibrium Steady States

逆反多数动力学:细致平衡的违反与非平衡稳态

Serge Galam

专题命中 工作流自动化 :agent(abstract)

AI总结 从统计力学角度重新审视含逆反者的Galam多数模型,揭示了其微观动力学、与平均场近似的区别以及非平衡稳态特性。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15612 2026-07-10 cs.CE cs.CR q-fin.TR 版本更新 50%

SoK: Market Microstructure for Decentralized Prediction Markets (DePMs)

SoK:去中心化预测市场(DePMs)的市场微观结构

Nahid Rahman, Joseph Al-Chami, Jeremy Clark

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文通过回顾去中心化预测市场(DePMs)的历史和设计,分析了其模块化工作流程及各模块的设计变体,探讨了去中心化、表达性和抗操纵之间的权衡,并指出了研究中的开放问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10746 2026-07-10 cs.LO 版本更新 50%

Weakest Precondition Rules for Programs with Linear Temporal Specifications

具有线性时态规范的程序的最弱前置条件规则

Gidon Ernst

专题命中 工作流自动化 :workflow(abstract)

AI总结 研究如何将软件模块集成中时态逻辑需求考虑进去,针对现有工具不足,提出一种简单通用能集成到现有验证条件生成器的解决方案来处理结构化程序与时态逻辑集成问题。

Comments Accepted at ISoLA 2026 - SpecifyThis

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22109 2026-07-10 q-fin.CP math.OC q-fin.PM stat.AP stat.CO 版本更新 50%

Low-Turnover Rebalancing for Sparse Index Tracking

用于稀疏指数跟踪的低换手率再平衡

Dimitrios Roxanas

专题命中 工作流自动化 :workflow(abstract)

AI总结 研究针对稀疏指数跟踪中滚动重建存在的高换手率问题,提出将构建与维护分开的新工作流程,采用混合框架及自融资变量$\Delta w$,在标准普尔500风格案例中实现低换手率跟踪,且维护层可用于外部跟踪器改进。

Comments Rewritten in the language of generalised Bayesian inference and with the main focus on rebalancing and turnover. New case study and protocol

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12497 2026-07-10 cs.CR 版本更新 50%

Demystifying LLM Supply Chain Vulnerabilities in the Wild: Distribution, Root Cause, and Real-World Impact

揭开大语言模型供应链在实际应用中的漏洞:分布、根源及现实世界影响

Shenao Wang, Yanjie Zhao, Zhao Liu, Quanchen Zou, Haoyu Wang

专题命中 工作流自动化 :workflow(abstract)

AI总结 该研究首次系统大规模实证分析大语言模型供应链漏洞,分析529个实际漏洞,发现漏洞集中在应用层等,特定漏洞源于独特特征,还研究了现实影响,提炼5条见解,为保障供应链安全提供数据基础与研究方向。

Comments Accepted by Internetware 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 软件智能体 8 篇

2607.08043 2026-07-10 cs.SE cs.AI 新提交 84%

Aleena: Alignment Agent for Research Software Engineering Collaborations

Aleena:用于研究软件工程协作的对齐代理

Kshitij Dani, Cordero Core, Landung Setiawan, Carlos Garcia Jurado Suarez, Anshul Tambay, Vani Mandava, Anant Mittal

机构 * eScience Institute(eScience研究院) University of Washington(华盛顿大学)

专题命中 软件智能体 :agent(title,abstract);agentic(abstract,comments);分类 cs.AI、cs.SE

AI总结 研究软件协作中决策易失依据致相关人员心智模型不同,提出智能AI可支持对齐与跟踪。介绍开源的Aleena,以GitHub为协作平台,转化交互为结构化记录,揭示风险等,还阐述其动机、设计、原型及场景。

Comments 8 pages, 5 figures. AgenticSE @ KDD '26: Agentic Software Engineering (SE 3.0): The Rise of AI Teammates, KDD 2026 Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08691 2026-07-10 cs.SE cs.AI cs.IR 新提交 73%

ProjAgent: Procedural Similarity Retrieval for Repository-Level Code Generation

ProjAgent:用于仓库级代码生成的过程相似性检索

QiHong Chen, Aaron Imani, Iftekhar Ahmed

机构 * University of California, Irvine(加州大学伊文斯分校)

专题命中 软件智能体 :workflow(abstract);agentic(abstract);分类 cs.AI、cs.SE

AI总结 研究仓库级代码生成问题,提出ProjAgent系统,将目标函数分解为中间推理步骤,通过代理工作流程检索相似过程行为的函数,结合语义检索构建丰富上下文,并利用静态分析反馈循环修复代码,实验表明该方法有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07744 2026-07-10 cs.SE 新提交 70%

PERFOPT-Bench: Evaluating Coding Agents on Software Performance Optimization

PERFOPT-Bench:评估软件性能优化中的编码代理

Yingyun Cui, Yi Xie, Piaohong Wang, Jiawei Ma, Bo Liu, Liangliang Cao

专题命中 软件智能体 :agent(abstract);agentic(abstract);分类 cs.SE

AI总结 该研究介绍PERFOPT-Bench基准,用于评估软件性能优化中编码代理的完整性能工程循环。通过7个长期任务评估7个不同的代理堆栈,发现优化性能取决于工作负载,原始加速作基准分数不安全,还提出中继试验可恢复额外空间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08028 2026-07-10 cs.AI cs.CL cs.SE 新提交 69%

From Prompts to Contracts: Harness Engineering for Auditable Enterprise LLM Agents

从提示到契约:用于可审计企业大语言模型代理的 harness 工程

Joongho Ahn, Moonsoo Kim

机构 * AI Leadership Research Center(人工智能领导力研究中心)

专题命中 软件智能体 :agent(abstract,comments);分类 cs.AI、cs.CL、cs.SE

AI总结 研究针对企业大语言模型应用从原型到产品化的需求,提出 harness 工程方法,在韩国企业数据切片上实例化并评估三个问题,包括契约保留、模型替换检查及代码执行效果,形成可将原型转为可审计应用的工程模式。

Comments 32 pages, 6 figures, 16 tables. Reference implementation and evaluation artifacts: https://github.com/hammerbaki/enterprise-llm-agent-harness (archived at https://doi.org/10.5281/zenodo.21269426)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07980 2026-07-10 cs.SE cs.AI 新提交 62%

3100 Opinions on Code Review in an AI World: Building Causal Theory from Practitioner Discourse

人工智能时代关于代码审查的3100种观点:从从业者话语中构建因果理论

Shyam Agarwal, Courtney Miller, Christian Kästner, Bogdan Vasilescu

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.SE

AI总结 研究人工智能对代码审查的影响,通过收集从业者话语构建因果模型,明确审查是控制点,团队决定编码代理对软件影响,转化相关命题,还提供LLM辅助灰色文献理论构建方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07946 2026-07-10 cs.SE cs.LG 新提交 62%

DeepSWE: Measuring Frontier Coding Agents on Original, Long-Horizon Engineering Tasks

DeepSWE:在原始的、长周期工程任务上评估前沿编码智能体

Wenqi Huang, Charley Lee, Leonard Tng, Serena Ge

机构 * Datacurve

专题命中 软件智能体 :agentic(abstract);分类 cs.LG、cs.SE

AI总结 研究针对编码智能体评估,指出多数基准测试存在的问题。提出DeepSWE基准测试,其任务从零编写,用手写验证器评分,能避免相关问题,在区分智能体等方面表现出色,还发布了基准测试等相关内容。

Comments 32 pages, 10 figures. Code and data: https://github.com/datacurve-ai/deep-swe ; https://deepswe.datacurve.ai/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08182 2026-07-10 cs.CV cs.AI 新提交 57%

LEEVLA: Seeing What Matters in Latent Environment Evolution for Vision-Language-Action

LEEVLA:在视觉-语言-动作的潜在环境演化中洞察关键要素

Qi Lyu, Baicheng Liu, Xudong Wang, Jiahua Dong, Lianqing Liu, Zhi Han

专题命中 软件智能体 :agent(abstract);分类 cs.AI

AI总结 研究针对视觉-语言-动作模型难以应对复杂动态场景的问题,提出LEEVLA架构,引入漂移引导动态优先级和结构化特征流生成,构成“何处-如何”训练框架,实验表明该方法优于现有方法,强调了关键要素引导和结构化推理的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07882 2026-07-10 cs.SE 新提交 57%

Bug Report Specification Refinement with Trajectory Guidance for Automated Program Repair

基于轨迹引导的自动程序修复的错误报告规范细化

S M Farah Al Fahim, Md Nakhla Rafi, Md Ahasanuzzaman, Zeyang Ma, Dong Jae Kim, Shaowei Wang, Tse-Hsun, Chen

专题命中 软件智能体 :agent(abstract);分类 cs.SE

AI总结 研究针对自动程序修复中错误报告规范不完善的问题,提出TrajSpec方法,通过轨迹引导收集证据并组织成三级表示,经审查生成细化报告,实验表明该方法能有效提高修复性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. GUI与网页智能体 2 篇

2602.13723 2026-07-10 cs.SE 版本更新 89%

Compiling Large Multi-Modal Requirement Documents into Runnable Software Systems: From an Agentic Test-Driven Perspective

ARC:将大型多模态需求文档编译为可运行软件系统

Weiyu Kong, Yun Lin, Xiwen Teoh, Duc-Minh Nguyen, Ruofei Ren, Jiaxin Chang, Haoxu Hu, Haoyu Chen

专题命中 GUI与网页智能体 :agentic(title,summary_cn);workflow(abstract);分类 cs.SE

AI总结 提出Agentic需求编译(ARC)技术,通过双向测试驱动智能体循环,将多模态DSL文档直接编译为可运行Web系统,在GUI测试通过率上平均提升50.6%。

Comments This work is accepted at issta'26 (SIGSOFT International Symposium on Software Testing and Analysis)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08147 2026-07-10 cs.CR cs.AI 新提交 57%

Prismata: Confining Cross-Site Prompt Injection in Web Agents

Prismata:限制Web代理中的跨站提示注入

Corban Villa, Alp Eren Ozdarendeli, Sijun Tan, Raluca Ada Popa

机构 * UC Berkeley(加州大学伯克利分校)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 研究针对Web代理跨站提示注入问题,提出Prismata防御机制,通过动态信任推导生成权限标签,结合机械限制执行标签,无需开发者注释,能有效降低攻击成功率并保留良性任务效用。

详情

展开后加载摘要…

URL PDF HTML 收藏