arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-05-28 至 2026-05-28 共收录 234 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 23 篇

2605.27401 2026-05-28 cs.CY cs.AI 57%

Using Zero-Shot LLM-Generated Survey Data for Geographically Explicit Population Synthesis

使用零样本大语言模型生成的调查数据进行地理显式人口合成

Taylor Anderson, Sara Von Hoene, Orhan Yagizer Cinar, Emma Von Hoene, Amira Roess, Andrew Crooks, Hamdi Kavak

机构 * Dept. of Geography and Geoinformation Science, George Mason University, Fairfax, VA, USA(地理与地理信息科学系,乔治·马歇尔大学,弗吉尼亚州 Fairfax) Dept. of Computer Science, George Mason University, Fairfax, VA, USA(计算机科学系,乔治·马歇尔大学,弗吉尼亚州 Fairfax) College of Public Health, George Mason University, Fairfax, VA, USA(公共卫生学院,乔治·马歇尔大学,弗吉尼亚州 Fairfax) Dept. of Geography, University at Buffalo, Buffalo, NY, USA(地理系,布法罗大学,纽约州 Buffalo) Dept. of Computational and Data Sciences, George Mason University, Fairfax, VA, USA(计算与数据科学系,乔治·马歇尔大学,弗吉尼亚州 Fairfax)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 本文评估零样本大语言模型生成的健康调查数据能否作为传统迭代比例拟合工作流的输入,用于地理显式人口合成,并发现其可作为补充输入但尚不能替代真实调查数据。

Comments 15 pages, 5 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27155 2026-05-28 cs.CV cs.AI 57%

Semantic Robustness Probing via Inpainting: An Interactive Tool for Safety-Critical Object Detection

通过修复进行语义鲁棒性探测:面向安全关键目标检测的交互工具

Nico Steckhan, Krutarth Prajapati, Weija Shao, Silvia Vock

机构 * Federal Institute for Occupational Safety and Health (BAuA)(联邦职业安全与健康研究所) Fraunhofer Institute for Manufacturing Engineering and Automation IPA(弗劳恩霍夫研究所(制造工程与自动化IPA))

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 提出SemProbe工具,通过扩散模型可控修复生成语义探针,支持用户自定义掩码和因素,自动评估并记录目标检测模型的鲁棒性变化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02398 2026-05-28 cs.LG 57%

A Spatially Informed Gaussian Process UCB Method for Decentralized Coverage Control

一种用于分散覆盖控制的空间信息高斯过程UCB方法

Gennaro Guidone, Luca Monegaglia, Elia Raimondi, Han Wang, Mattia Bianchi, Florian Dörfler

机构 * Automatic Control Laboratory (IfA)(自动控制实验室)

专题命中 工作流自动化 :agent(abstract);分类 cs.LG

AI总结 提出一种基于高斯过程上置信界(GP-UCB)的分散算法,通过结合期望位置成本与方差探索项,使智能体自主平衡探索与利用,实现未知空间覆盖控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28352 2026-05-28 cs.RO 50%

Magnet-Based Soft Robotic Skin Using a 3D-Printed Multi-Lattice Structure and CNN-Based Tactile Super-Resolution

基于磁体的软体机器人皮肤:使用3D打印多格点结构和CNN触觉超分辨率

Yunseong Bang, Joowon Park, Suan Sim, Youngjun Ryu, Sukho Park, Kyungseo Park

专题命中 工作流自动化 :workflow(abstract)

AI总结 提出一种集成多层软格点、霍尔效应传感器阵列和CNN触觉超分辨率模型的磁基机器人皮肤,通过格点参数调节实现机械柔顺性与传感特性的联合优化,并利用3D打印快速制造,实现接触位置和法向力的实时估计。

Comments 6 pages, 9 figures. Accepted to IEEE International Conference on Robotics and Automation (ICRA) 2026. Y. Bang and J. Park contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28206 2026-05-28 quant-ph 50%

Digital Quantum Simulation of the quantum $β$-FPUT Lattice: Formulation and Resource Estimation

量子$\beta$-FPUT晶格的数字量子模拟:公式化与资源估计

Kiratholly Nandakumar Madhav Sharma, Juan Manuel Aguiar Hualde, Julian van Velzen, Phalgun Lolur

专题命中 工作流自动化 :workflow(abstract)

AI总结 针对量子$\beta$-FPUT晶格,提出第一量子化的数字量子模拟框架,通过离散晶格位移直接处理非简谐相互作用,并设计浅层量子电路计算模分辨位移关联函数,给出了容错量子计算机上的资源估计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27925 2026-05-28 cond-mat.stat-mech math.PR physics.data-an stat.CO stat.ME 50%

Finite-size occupancy scaling of apparent fractal dimensions in stochastic trajectories

随机轨迹中表观分形维数的有限尺寸占据标度

Bon A. Koo, Edward Ju

专题命中 工作流自动化 :workflow(abstract)

AI总结 针对有限随机轨迹中分形维数估计的有限尺寸标度问题,提出基于球箱占据模型的偏差校正方法,通过归一化局部斜率坍塌实现跨模型类的误差降低。

Comments Main text: 30 pages, 5 figures; supplementary material included

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27791 2026-05-28 cs.DB 50%

Are Diffusion Language Models Good Database Analysts?

扩散语言模型是好的数据库分析师吗?

Peixian Ma, Xialie Zhuang, Jiantao Tan, Changlun Li, Ruirui Chen, Chengwei Qin

专题命中 工作流自动化 :agentic(abstract)

AI总结 本文提出统一评估框架和SQL-D1智能体框架,通过实验证明扩散语言模型在NL2SQL任务中具有结构鲁棒性和效率-精度灵活权衡的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27652 2026-05-28 cs.DC 50%

Carbon-Aware Mapping and Scheduling for Deadline-Constrained Workflows

面向截止时间约束工作流的碳感知映射与调度

Dominik Schweisgut, Anne Benoit, Yves Robert, Henning Meyerhenke

专题命中 工作流自动化 :workflow(abstract)

AI总结 针对异构数据中心中具有截止时间约束的工作流,提出结合动态规划与启发式策略的碳感知映射与调度算法CWM,在满足截止时间的前提下显著降低碳排放。

Comments 29 pages, 11 figures, Preprint, to appear at Euro-Par'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27634 2026-05-28 cs.HC 50%

Structuring Human-AI Productive Interdependence by Strategic Level of Automation Selection for Qualitative Inquiry

通过定性研究中的自动化水平战略选择构建人机生产性相互依赖

Feng Zhou, Jacqueline Meijer-Irons, Ambar Murillo

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文基于相互依赖理论,提出一个形式化框架,通过评估任务风险和验证成本来选择适当的自动化水平,以构建人机生产性相互依赖,从而解决定性分析中大规模语言模型自动化与解释性本质之间的冲突。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17354 2026-05-28 cs.CV cs.GR 50%

PocketGS: On-Device Training of 3D Gaussian Splatting for High Perceptual Modeling

PocketGS: 用于高感知建模的3D高斯泼溅设备端训练

Wenzhi Guo, Guangchi Fang, Shu Yang, Bing Wang

机构 * Hong Kong Polytechnic University(香港理工大学) Nanjing University(南京大学)

专题命中 工作流自动化 :workflow(abstract)

AI总结 提出PocketGS,通过三个协同设计的算子(G、I、T)在移动设备上实现3D高斯泼溅的高效训练,在严格资源约束下保持高保真重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12843 2026-05-28 cs.CV 50%

MMRad-22K: A Structured Multimodal Evidence Dataset for Chest X-ray Report Generation

MMRad-22K:用于胸部X光报告生成的结构化多模态证据数据集

Yichen Zhao, Zelin Peng, Fenghe Tang, Piao Yang, Yu Huang, Wei Shen

机构 * MoE Key Lab of Artificial Intelligence, AI Institute, School of Computer Science, Shanghai Jiao Tong University(人工智能MOE实验室、人工智能研究院、计算机科学学院、上海交通大学) School of Biomedical Engineering, Division of Life Sciences and Medicine, University of Science and Technology of China (USTC)(生物医学工程学院、生命科学与医学系、中国科学技术大学) Center for Medical Imaging, Robotics, Analytic Computing & Learning (MIRACLE), Suzhou Institute for Advanced Research, USTC(医学影像、机器人、分析计算与学习中心(MIRACLE)、苏州市先进研究院、中国科学技术大学) Department of Radiology, The First Affiliated Hospital, Zhejiang University School of Medicine(放射科、浙江大学医学院第一附属医院)

专题命中 工作流自动化 :workflow(abstract)

AI总结 针对胸部X光报告生成中现有资源监督信号碎片化的问题,提出结构化多模态证据数据集MMRad-22K,并基于统一LVLM骨干进行适配,证明结构化多模态证据优于纯文本或边界框证据,在语言和临床指标上表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 14 篇

2605.27531 2026-05-28 cs.PL cs.CL cs.SE 89%

Agentic Separation Logic Specification Synthesis

智能体分离逻辑规范合成

Tarun Suresh, David Korczynski, Julien Vanegue

机构 * Bloomberg(贝莱德)

专题命中 软件智能体 :agent(summary_cn,abstract);agentic(title,abstract);分类 cs.CL、cs.SE

AI总结 提出 Spec-Agent 智能体系统,通过静态分析、运行时堆追踪和反例引导迭代,为大型 C++ 代码库合成分离逻辑规范,在百万行级代码上达到 85% 有效规范合成率且无假阳性。

Comments 9 pages, 3 appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28588 2026-05-28 cs.CR cs.AI 83%

Technical Report: Exploring the Emerging Threats of the Agent Skill Ecosystem

技术报告:探索智能体技能生态系统的新兴威胁

Luca Beurer-Kellner, Aleksei Kudrinskii, Marco Milanta, Kristian Bonde Nielsen, Hemang Sarkar, Liran Tal

机构 * Snyk

专题命中 软件智能体 :agent(title,abstract);AI agent(abstract);分类 cs.AI

AI总结 本研究通过分析3984个AI智能体技能,发现76个恶意载荷,揭示了技能生态系统中的安全威胁,并提出了威胁分类和攻击模式。

Comments 10 pages, technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08311 2026-05-28 cs.SE cs.AI 79%

Understanding Automated Program Repair Agents Through the Lens of Traceability: An Empirical Study

通过可追溯性视角理解自动化程序修复智能体:一项实证研究

Ira Ceka, Hailie Mitchell, Saurabh Pujar, Luca Buratti, Shyam Ramji, Junfeng Yang, Gail Kaiser, Baishakhi Ray

机构 * Columbia University(哥伦比亚大学) IBM Research(IBM研究院)

专题命中 软件智能体 :tool use(abstract);planning(abstract);agentic(abstract);分类 cs.AI、cs.SE

AI总结 本文通过追踪五个最先进的自动化程序修复智能体在500个真实世界修复任务中的决策流程,揭示了它们在逻辑密集型错误修复、测试生成和回归测试选择方面的关键局限性,并提出了改进方向。

Comments Accepted for publication (ISSTA '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27547 2026-05-28 cs.MA 78%

From Task Allocation to Risk Clearing: A Unifying Interface for Mixed Human-Agent Societies

从任务分配到风险清算:混合人机社会的统一接口

Vassilis Vassiliades

专题命中 软件智能体 :agent(title,abstract)

AI总结 提出风险感知选项清算(ROC)机制,通过将风险摘要与选项结合并由中央清算所优化风险调整任务效用,实现混合人机社会中异构代理的可扩展透明协调。

Comments Presented at EMAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28617 2026-05-28 cs.AI cs.PL 77%

LACUNA: Safe Agents as Recursive Program Holes

LACUNA: 作为递归程序空洞的安全智能体

Yaoyu Zhao, Yichen Xu, Oliver Bračevac, Cao Nguyen Pham, Frank Zhengqing Wu, Martin Odersky

机构 * EPFL(苏黎世联邦理工学院)

专题命中 软件智能体 :agent(abstract,abstract_cn);planning(abstract);分类 cs.AI

AI总结 提出LACUNA编程模型,通过类型化调用和编译时检查,让LLM智能体以递归程序空洞的方式安全地编写代码,实现表达性与安全性的统一。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28751 2026-05-28 cs.LG cs.AI cs.CL 75%

Extrapolative Weight Averaging Reveals Correctness-Efficiency Frontiers in Code RL

外推权重平均揭示代码强化学习中的正确性-效率前沿

Kunhao Zheng, Pierre Chambon, Juliette Decugis, Jonas Gehring, Taco Cohen, Benjamin Negrevergne, Gabriel Synnaeve

机构 * Meta Superintelligence Labs - FAIR(Meta超智能实验室 - FAIR)

专题命中 软件智能体 :tool use(abstract);agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 通过外推权重平均,无需额外RL训练即可扩展微调检查点间的帕累托前沿,在竞争性编程中实现正确性与效率的权衡,并提升推理时性能。

Comments 54 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24631 2026-05-28 cs.SE cs.AI 73%

Coherence Collapse: Diagnosing Why Code Agents Fail After Reaching the Right Code

一致性崩溃:诊断代码智能体在到达正确代码后失败的原因

Myeongsoo Kim, Dingmin Wang, Siwei Cui, Farima Farmahinifarahani, Terry Yue Zhuo, Shweta Garg, Baishakhi Ray, Rajdeep Mukherjee, Varun Kumar

机构 * AWS AI Labs(AWS AI实验室) Monash University(墨尔本大学)

专题命中 软件智能体 :agent(abstract,abstract_cn);分类 cs.AI、cs.SE

AI总结 通过轨迹分解分析,发现代码智能体在定位正确后仍因编辑质量缺陷(尤其是“一致性崩溃”)而失败,并提出了无需参考的共识驱动改进方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26186 2026-05-28 cs.SE cs.AI cs.CL cs.LG 70%

SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?

SetupX:LLM代理能否从过去的功能正确代码仓库设置失败中学习?

Zihang Zhou, Ziqian Ren, Yukai Wu, Yingjie Xiong, Wei Zhou, Chao Peng, Dong Zhang, Bingheng Yan, Xuanhe Zhou, Fan Wu

机构 * Shanghai Jiao Tong University(上海交通大学) Beijing University of Posts and Telecommunications(北京邮电大学) Independent Researcher(独立研究者) Jinan Inspur Data Technology Co., Ltd.(济南 Inspur 数据技术有限公司)

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 提出SetupX框架,通过经验学习、推测执行和验证协议解决代码仓库设置中的跨仓库经验迁移、多步试错和鲁棒验证问题,在基准测试中达到92%通过率。

Comments 21 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28515 2026-05-28 cs.SE cs.AI 62%

Do LLMs Favor Their Providers? Measuring Vertical Integration Bias in Code Generation

LLM 是否偏袒其提供商?测量代码生成中的垂直整合偏差

Melih Catal, Alex Wolf, Tiago Ferreiro Matos, Pooja Rani, Harald Gall

机构 * University of Zurich(苏黎世大学) University of Mannheim(曼海姆大学)

专题命中 软件智能体 :agentic(abstract);分类 cs.AI、cs.SE

AI总结 本文提出 VIBench 基准,通过 20 个提供商可选的软件集成场景,测量前沿 LLM 在直接和代理代码生成中的垂直整合偏差,发现六成关联模型存在显著偏差,代理工作流加剧偏差至 +39.2 个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28122 2026-05-28 cs.CR cs.AI cs.CL 62%

SNARE: Adaptive Scenario Synthesis for Eliciting Overeager Behavior in Coding Agents

SNARE: 自适应场景合成以诱发编码代理中的过度行为

Yubin Qu, Yi Liu, Gelei Deng, Yanjun Zhang, Yuekang Li, Ying Zhang, Leo Yu Zhang

机构 * Griffith University(格里菲斯大学) Quantstamp Nanyang Technological University(南洋理工大学) UNSW Sydney(悉尼大学) Wake Forest University(卫斯理大学)

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.CL

AI总结 提出SNARE流水线,通过组合良性场景片段并使用无评判器预言机评分与汤普森采样,自适应地诱发编码代理的过度行为,并在4×5代理-模型矩阵上评估,发现19.51%的良性运行触发过度行为,且代理框架比模型影响更大。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27908 2026-05-28 cs.CL cs.AI 62%

ESC-Skills: Discovering and Self-Evolving Skills for Emotional Support Conversations

ESC-Skills: 发现并自我进化情感支持对话技能

Jie Zhu, Huaixia Dou, Shuo Jiang, Junhui Li, Lifan Guo, Feng Chen, Chi Zhang, Fang Kong

机构 * School of Computer Science and Technology, Soochow University(苏州大学计算机科学与技术学院) Qwen DianJin Team, Alibaba Cloud Computing(阿里云Qwen团队)

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.CL

AI总结 提出ESC-Skills框架,通过干预单元建模支持交互并构建技能库,结合多轮廓自我进化机制,提升情感支持对话的可解释性、可控性和效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27785 2026-05-28 cs.AI cs.DB 57%

A Query Engine for the Agents

面向智能体的查询引擎

Kenny Daniel

机构 * Hyperparam(Hyperparam公司)

专题命中 软件智能体 :agent(abstract);分类 cs.AI

AI总结 提出一个轻量级、JS原生、支持异步SQL和LLM UDF的查询引擎Hyperparam,用于在AI应用中分析非结构化文本,性能优于DuckDB-WASM。

Comments 4 pages, 1 figure, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27499 2026-05-28 cs.LG astro-ph.CO astro-ph.IM physics.comp-ph stat.ML 57%

GenSBI: Generative Methods for Simulation-Based Inference in JAX

GenSBI: 基于JAX的模拟推断生成方法

Aurelio Amerio

机构 * Instituto de Física Corpuscular (IFIC) Universitat de València & CSIC(粒子物理研究所(IFIC)瓦伦西亚大学 & 西班牙国家科研委员会)

专题命中 软件智能体 :workflow(abstract);分类 cs.LG

AI总结 提出GenSBI库,在JAX中实现流匹配、分数匹配和去噪扩散等生成模型,用于模拟推断,提供统一接口和多种Transformer架构,并在标准基准上达到接近理想的C2ST分数。

Comments 48 pages + 1 appendix, 33 figures, 18 tables. For the associated Python code, see https://github.com/aurelio-amerio/GenSBI

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17448 2026-05-28 cs.GR cs.CL 57%

Self-Improving CAD Generation Agents with Finite Element Analysis as Feedback

基于有限元分析反馈的自改进CAD生成智能体

Guijin Son, Jehyun Park, Seyeon Park, Sunghee Ahn, Youngjae Yu

机构 * Seoul National University(首尔国立大学) OneLineAI Sungkyunkwan University(成均馆大学) Ewha Womans University(成乙女子大学)

专题命中 软件智能体 :agent(abstract);分类 cs.CL

AI总结 提出一种以有限元分析为反馈的CAD生成框架,通过蓝图和渲染图监督信号提升多部件装配质量,使生成结果满足工程需求。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏

3. GUI与网页智能体 9 篇

2605.28534 2026-05-28 cs.CL 77%

GUI-CIDER: Mid-training GUI Agents via Causal Internalization and Density-aware Exemplar Reselection

GUI-CIDER:通过因果内化和密度感知示例重选进行GUI代理的中期训练

Zheng Wu, Chengcheng Han, Zhengxi Lu, Tianjie Ju, Yanyu Chen, Qi Gu, Xunliang Cai, Zhuosheng Zhang

机构 * School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院) Meituan(美团) Zhejiang University(浙江大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 GUI与网页智能体 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.CL

AI总结 提出GUI-CIDER中期训练方法,通过因果内化和密度感知示例重选显式内化GUI世界知识,提升代理对GUI操作的理解和任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26114 2026-05-28 cs.AI cs.CL 76%

MobileGym: A Verifiable and Highly Parallel Simulation Platform for Mobile GUI Agent Research

MobileGym: 一个可验证且高度并行的移动GUI智能体研究仿真平台

Dingbang Wu, Rui Hao, Haiyang Wang, Shuzhe Wu, Han Xiao, Zhenghong Li, Bojiang Zhou, Zheng Ju, Zichen Liu, Lue Fan, Zhaoxiang Zhang

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Peking University(北京大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 GUI与网页智能体 :agent(title);分类 cs.AI、cs.CL

AI总结 提出MobileGym,一个基于浏览器的轻量级、完全可控的移动环境,通过结构化JSON状态实现可验证结果信号和低成本并行强化学习,并附带包含416个参数化任务模板的基准测试集。

Comments Project page: https://mobilegym.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28258 2026-05-28 cs.SE cs.AI cs.CV cs.HC 73%

GUI Agents for Continual Game Generation

面向持续游戏生成的GUI智能体

Yixu Huang, Bo Li, Na Li, Zhe Wang, Kaijie Chen, Haonan Ge, Qingyi Si, Yuanzhe Shen, Ruihan Yang, Guangjing Wang, Hongcheng Guo

机构 * Fudan University(复旦大学) Xiaohongshu Inc.(小红书公司) Tongji University(同济大学) University of California, Santa Barbara(加州大学圣芭芭拉分校)

专题命中 GUI与网页智能体 :agent(abstract);agentic(abstract);分类 cs.AI、cs.SE

AI总结 提出利用GUI智能体作为客观评估者和主观测试者,通过PlaytestArena和Play2Code框架实现持续游戏生成,显著提升可玩性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28116 2026-05-28 cs.CR cs.AI cs.CL 62%

MIRAGE: Context-Aware Prompt Injection against Mobile GUI Agents via User-Generated Content

MIRAGE:通过用户生成内容对移动GUI代理的上下文感知提示注入

Ruoqi Guo, Yi Liu, Gelei Deng, Yiheng Xiong, Yuekang Li, Ying Zhang, Leo Yu Zhang, Lida Zhao, Ji Jie, Yuxiao Lu

机构 * Griffith University(格里菲斯大学) Quantstamp Nanyang Technological University(南洋理工大学) Singapore Management University(新加坡管理学院) University of New South Wales(新南威尔士大学) Wake Forest University(威克森林大学) Independent Researcher(独立研究者)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI、cs.CL

AI总结 提出MIRAGE管道,通过将攻击者控制的文本嵌入用户生成内容区域,在不修改代理、应用或操作系统的情况下,对视觉语言模型驱动的移动GUI代理实现高成功率的提示注入攻击。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28629 2026-05-28 cs.CL 57%

Mobile-Aptus: Confidence-Driven Proactive and Robust Interaction in MLLM-based Mobile-Using Agents

Mobile-Aptus: 基于MLLM的手机使用代理中的置信度驱动的主动与鲁棒交互

Zheng Wu, Pengzhou Cheng, Zongru Wu, Yuan Guo, Tianjie Ju, Aston Zhang, Gongshen Liu, Zhuosheng Zhang

机构 * School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院) GenAI, Meta(Meta的GenAI)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.CL

AI总结 针对手机使用代理中的过度执行和过度请求问题,提出一种置信度驱动的主动与鲁棒交互框架,通过监督微调和置信度偏差校正实现最优性能。

Comments Accepted by TASLP

详情

展开后加载摘要…

URL PDF HTML 收藏