arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-05-18 至 2026-05-18 共收录 167 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 18 篇

2604.18145 2026-05-18 cs.CV cs.AI 57%

Region-Grounded Report Generation for 3D Medical Imaging: A Fine-Grained Dataset and Graph-Enhanced Framework

基于3D医学影像的区域 grounded 报告生成:一个细粒度数据集和图增强框架

Cong Huy Nguyen, Son Dinh Nguyen, Guanlin Li, Tuan Dung Nguyen, Aditya Narayan Sankaran, Mai Huy Thong, Thanh Trung Nguyen, Mai Hong Son, Reza Farahbakhsh, Phi Le Nguyen, Noel Crespi

机构 * AI4LIFE, Hanoi University of Science and Technology, Vietnam(AI4LIFE,河内科学技术大学,越南) SAMOVAR, Télécom SudParis, Institut Polytechnique de Paris, France(SAMOVAR,Telecom SudParis,巴黎理工学院,法国) Military Central Hospital, Vietnam(108军区中央医院,越南)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 本文提出VietPET-RoI数据集和HiRRA框架,通过图增强模块捕捉RoI属性依赖,提升3D PET/CT报告生成的临床可靠性,实验表明其在BLEU、ROUGE-L和临床指标上均优于现有方法。

Comments 16 pages; Accepted to appear in ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.22440 2026-05-18 cs.CY cs.LG cs.MA econ.GN q-fin.EC 57%

From Model Design to Organizational Design: Complexity Redistribution and Trade-Offs in Generative AI

从模型设计到组织设计:生成AI中的复杂性再分配与权衡

Sharique Hasan, Alexander Oettl, Sampsa Samila

机构 * Duke University(杜克大学) Georgia Institute of Technology(佐治亚理工学院) IESE Business School(IESE商学院)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 本文提出GAS框架,分析大语言模型如何重塑组织与竞争策略,揭示生成AI中通用性、准确性与简洁性之间的权衡及复杂性再分配对管理挑战的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.20240 2026-05-18 cs.CY cs.AI 57%

Social and Ethical Risks Posed by General-Purpose LLMs for Settling Newcomers in Canada

通用大型语言模型对加拿大新移民融入社会的潜在风险

Isar Nejadgholi, Maryam Molamohammadi, Samir Bakhtawar

机构 * National Research Council Canada(加拿大国家研究委员会) Mila - Quebec Artificial Intelligence Institute(魁北克人工智能研究所)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 研究探讨通用大语言模型在移民安置领域可能带来的风险,强调需开发定制化AI工具以确保人类监督与责任。

Comments 26 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15362 2026-05-18 cs.CL cs.DL cs.IR 57%

Automatic Construction of a Legal Citation Graph from 100 Million Ukrainian Court Decisions: Large-Scale Extraction, Topological Analysis, and Ontology-Driven Clustering

从1亿份乌克兰法院判决中自动构建法律引文图:大规模提取、拓扑分析和本体驱动聚类

Volodymyr Ovcharov

机构 * LEX AI LLC, Kyiv, Ukraine(LEX AI LLC,基耶夫,乌克兰)

专题命中 工作流自动化 :workflow(abstract);分类 cs.CL

AI总结 研究通过大规模提取和拓扑分析,构建了首个大规模法律引文图,揭示了司法引文结构编码法律领域边界并预测立法重要性。

Comments 15 pages, 7 figures, 2 tables, 21 references

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15227 2026-05-18 cs.AI cond-mat.mtrl-sci cs.RO 57%

NIMO Controller: a self-driving laboratory orchestrator based on the Model Context Protocol

NIMO控制器:基于模型上下文协议的自动驾驶实验室协调器

Naruki Yoshikawa, Ryo Tamura

机构 * National Institute for Materials Science(国家材料科学研究所) Graduate School of Frontier Sciences, The University of Tokyo(东京大学前沿科学研究生院)

专题命中 工作流自动化 :AI agent(abstract);分类 cs.AI

AI总结 本文提出基于模型上下文协议的自动驾驶实验室架构,介绍NIMO控制器,通过MCP服务器暴露所有功能,提供可视化编程界面,支持人类和AI代理统一接口。

Comments 9 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12266 2026-05-18 q-bio.GN cs.LG 57%

Genome-Factory: A Library for Tuning, Deploying, and Interpreting Genomic Foundation Models

Genome-Factory:用于调优、部署和解释基因组基础模型的库

Weimin Wu, Xuefeng Song, Yibo Wen, Qinjie Lin, Zhihan Zhou, Jerry Yao-Chieh Hu, Zhong Wang, Han Liu

机构 * Center for Foundation Models Generative AI \& Department of Computer Science, Northwestern University, USA School of Natural Sciences, University of California at Merced, USA Department of Energy Joint Genome Institute, Lawrence Berkeley National Laboratory, USA Systems Biology Division, Lawrence Berkeley National Laboratory, USA Department of Statistics Data Science, Northwestern University, USA

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 Genome-Factory 提供了一种统一的流程简化方法,涵盖基因组模型开发的全流程,包括数据收集、模型调优、推理、基准测试和可解释性,适用于多种模型和调优方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16169 2026-05-18 cs.LO cs.MS physics.chem-ph 50%

LeanBET: Formally-verified surface area calculations in Lean

LeanBET:在Lean中形式验证的表面积计算

Ejike D. Ugwuanyi, Colin T. Jones, John Velkey, Tyler R. Josephson

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文在Lean4中实现并验证了BET方法的完整流程,包括窗口枚举、单调性检查、膝点选择和线性回归,证明了算法的正确性并验证了与BETSI参考方法的一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16062 2026-05-18 cond-mat.mes-hall physics.app-ph physics.ins-det 50%

In-situ correlative SEM/KPFM for semiconductor devices and 2D heterostructures

原位相关性SEM/KPFM用于半导体器件和二维异质结构

Prabhu Prasad Swain, Nahid Hosseini, Eveline. S Mayner, Aleksandra Radenovic, Marcos Penedo, Georg E. Fantner

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出了一种原位单次异步霍夫曼-凯尔文探针力显微镜技术,用于半导体器件和二维异质结构的表征,克服了传统压阻悬臂的电容交叉干扰问题,实现了高精度表面形貌和接触电势差的联合成像。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16008 2026-05-18 cs.CV 50%

End-to-end plaque counting and virus titration from laboratory plate images with deep learning

基于深度学习的实验室平板图像端到端斑块计数与病毒滴度测定

Eugenia Moris, Alicia Costábile, Sebastián Rey, Irene Ferreiro, Joaquín Hurtado, Lizandra Lissette Luciano, Matías Villagrán, Aisha Espino Vázquez, Jomari Ramos, Isadora Monteiro, María Victoria de Santiago, Pilar Moreno, Gonzalo Moratorio, José Ignacio Orlando

机构 * Arionkoder LLC Laboratory of Experimental Virus Evolution, Pasteur Institute of Montevideo(实验病毒进化实验室,蒙特维多巴斯德研究所) Laboratory of Molecular Virology, Faculty of Sciences, University of the Republic(分子病毒学实验室,科学学院,乌拉圭共和国大学) Center for Innovation in Epidemiological Surveillance, Pasteur Institute of Montevideo(流行病学监测创新中心,蒙特维多巴斯德研究所) Biochemistry Section, Faculty of Sciences, University of the Republic(生物化学部门,科学学院,乌拉圭共和国大学)

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出一种端到端的深度学习方法,通过分割模型对实验室平板图像中的斑块进行自动计数和滴度测定,提高了病毒感染性检测的效率和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15472 2026-05-18 cs.MA 50%

Estimated Dynamic Equilibrium Model: Supply and Demand as a Sample Path of a Stochastic Process

估计动态均衡模型:供给与需求作为随机过程的样本路径

Mikhail L. Arbuzov, Sisong Bei, Alexey Shvets

专题命中 工作流自动化 :agent(abstract)

AI总结 本文提出EDEM模型,将供需视为由异质噪声估值驱动的随机过程,揭示了持续失衡的生成机制,并通过实验发现六个不同的市场状态。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 13 篇

2605.15334 2026-05-18 cs.LG cs.AI cs.CL cs.SE 89%

From I/O to Code with Discovery Agent

从输入输出到代码:发现代理

Yihong Dong, Jiaru Qian, Haoran Zhang, Peixu Wang, Binhua Li, Zhi Jin, Yongbin Li, Ge Li, Xiaokang Yang, Xue Jiang

机构 * School of Computer Science, Peking University(北京大学计算机科学系) Tongyi Lab, Alibaba Group(阿里集团通义实验室) Wuhan University(武汉大学) Renmin University of China(中国人民大学) National University of Singapore(新加坡国立大学) Shanghai Jiaotong University(上海交通大学)

专题命中 软件智能体 :agent(title,summary_cn);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出DIO-Agent,通过将IO2Code视为离散程序空间的进化搜索,利用LLM作为突变算子,结合执行误差信号指导突变,解决从输入输出行为合成代码的难题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15815 2026-05-18 cs.SE cs.CL cs.MA 86%

BootstrapAgent: Distilling Repository Setup into Reusable Agent Knowledge

BootstrapAgent: 将仓库设置提炼为可重用的代理知识

Sihan Fu, Oucheng Liu, Shiyuan Wang, Jin Shi, Chengkun Wei

机构 * Zhejiang University(浙江大学) The Australian National University(澳大利亚国立大学) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)

专题命中 软件智能体 :agent(title,abstract);planning(abstract);multi-agent(abstract);分类 cs.CL、cs.SE

AI总结 BootstrapAgent通过提炼仓库初始化过程中的启发式知识,生成可验证的代理合同,提升代码代理在 unfamiliar repositories 的任务成功率和效率。

Comments 19 pages, 9 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15301 2026-05-18 cs.AI 85%

Solvita: Enhancing Large Language Models for Competitive Programming via Agentic Evolution

Solvita:通过代理进化增强大型语言模型以应对编程竞赛

Han Li, Jinyu Tian, Rili Feng, Yuqiao Du, Chong Zheng, Chenyu Wang, Chenchen Liu, Shihao Li, Xinping Lei, Yifan Yao, Weihao Xie, Letian Zhu, Jiaheng Liu

机构 * Nanjing University(南京大学) Tsinghua University(清华大学) Independent Researcher(独立研究者)

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 Solvita通过闭环系统和可训练知识网络,使代理动态学习,提升编程竞赛任务的准确性和经验积累。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15425 2026-05-18 cs.SE cs.AI 84%

Runtime-Structured Task Decomposition for Agentic Coding Systems

运行时结构化任务分解用于代理编码系统

Shubhi Asthana, Bing Zhang, Chad DeLuca, Hima Patel, Ruchi Mahindru

机构 * IBM Research(IBM研究院)

专题命中 软件智能体 :agentic(title,abstract);workflow(abstract);分类 cs.AI、cs.SE

AI总结 本文提出运行时结构化任务分解方法,通过可执行控制逻辑管理任务分解与执行流程,降低重试成本,提升代理编码系统的效率和可靠性。

Comments Paper presented at ACM Conference on AI and Agentic Systems 2026 at the Agentic Software Engineering workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15569 2026-05-18 cs.CR cs.AI cs.SE 84%

Detecting Privilege Escalation in Polyglot Microservices via Agentic Program Analysis

通过代理程序分析检测多语言微服务中的特权提升

Penghui Li, Hong Yau Chong, Yinzhi Cao, Junfeng Yang

机构 * Columbia University(哥伦比亚大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);分类 cs.AI、cs.SE

AI总结 本文提出Neo框架,结合LLM和经典程序分析,解决微服务中特权提升检测的复杂性问题,发现24个零日漏洞,精度和召回率均优于现有方法。

Comments In Proceedings of the 47th IEEE Symposium on Security and Privacy (S&P)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15585 2026-05-18 cs.AI cs.CV 81%

See Before You Code: Learning Visual Priors for Spatially Aware Educational Animation Generation

在编码前看到:学习视觉先验以生成空间感知的教育动画

Yuejia Li, Ke He, Junheng Li, Shutong Chen, Jingkang Xia, Zhiyue Su, Junchi Zhang, Mang Ye

机构 * Wuhan University(武汉大学) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 软件智能体 :agent(abstract,abstract_cn);planning(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出OmniManim框架,通过视觉规划和反馈机制提升教育动画生成质量,改进渲染效果和教学效果。

Comments 21 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15315 2026-05-18 cs.AI cs.CL 62%

Context Pruning for Coding Agents via Multi-Rubric Latent Reasoning

通过多标准潜在推理进行编码代理的上下文剪枝

Jingjing Wang, Xiwen Chen, Wenhui Zhu, Huayu Li, Zhengxiao He, Feiyang Cai, Ana S. Carreon-Rascon, Xuanzhao Dong, Feng Luo

机构 * Clemson University(克莱姆森大学) Morgan Stanley(摩根大通) Arizona State University(亚利桑那州立大学) University of Arizona(亚利桑那大学)

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出LaMR框架,通过分解代码相关性为语义证据和依赖支持两个维度,利用多任务CRF模型提升编码代理的上下文剪枝效果,实验表明其在多个基准测试中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.19128 2026-05-18 cs.LG cs.AI 62%

Shaping Sparse Rewards in Reinforcement Learning: A Semi-supervised Approach

在强化学习中塑造稀疏奖励:一种半监督方法

Wenyun Li, Wenjie Huang, Chen Sun

机构 * Department of Mathematics, The University of Hong Kong (HKU)(香港大学数学系) Department of Data and Systems Engineering, HKU(香港大学数据与系统工程系) Musketeers Foundation Institute of Data Science, HKU(穆斯克特基金会数据科学研究所)

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种半监督方法,通过利用非零奖励转移和数据增强学习轨迹空间表示,提升稀疏奖励下的奖励塑造效果,在Atari和机器人操控任务中优于监督方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22151 2026-05-18 cs.CV cs.CL 57%

MultiMat: Multimodal Program Synthesis for Procedural Materials using Large Multimodal Models

MultiMat: 多模态程序合成用于基于过程的材料生成

Jonas Belouadi, Tamy Boubekeur, Adrien Kaiser

机构 * University of Mannheim(曼海姆大学) Adobe Research(Adobe研究)

专题命中 软件智能体 :workflow(abstract);分类 cs.CL

AI总结 MultiMat利用大规模多模态模型实现多模态程序合成,提升生成过程材料图的效率与视觉质量,优于纯文本基线方法。

Comments Accepted at ICLR 2026 (poster)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15669 2026-05-18 cs.LG 57%

Rule2DRC: Benchmarking LLM Agents for DRC Script Synthesis with Execution-Guided Test Generation

Rule2DRC:用于DRC脚本合成的LLM代理基准测试

Jinuk Kim, Junsoo Byun, Donghwi Hwang, Seong-Jin Park, Hyun Oh Song

机构 * Department of Computer Science and Engineering, Seoul National University(首尔国立大学计算机科学与工程系) Neural Processing Research Center(神经处理研究所以) Samsung Electronics Co., Ltd(三星电子公司)

专题命中 软件智能体 :agent(abstract);分类 cs.LG

AI总结 Rule2DRC是一个大规模基准,用于评估DRC脚本生成代理,包含1000个规则到脚本任务和13921个用于执行评分的评估芯片布局。它提供了一种通过DRC执行结果衡量功能正确性的评估流程,并引入SplitTester生成区分性测试用例以提升Best-of-N选择性能。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15601 2026-05-18 cs.SE quant-ph 57%

Bayesian Sequential Verification for Budget-Aware Quantum Program Testing

基于预算的量子程序测试的贝叶斯顺序验证

Lei Zhang

专题命中 软件智能体 :workflow(abstract);分类 cs.SE

AI总结 本文提出一种基于预算的量子程序测试方法,通过贝叶斯假设检验流程减少测量成本,适用于高成功概率的量子程序。

Comments 7 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14859 2026-05-18 cs.CR cs.AI 57%

Do Coding Agents Understand Least-Privilege Authorization?

编码代理是否理解最小特权授权?

Zheng Yan, Jingxiang Weng, Charles Chen, Dengyun Peng, Ethan Qin, Jiannan Guan, Jinhao Liu, Qiming Yu, Yixin Yuan, Fanqing Meng, Carl Che, Mengkang Hu

机构 * Evolvent AI Research Team(Evolvent AI研究院)

专题命中 软件智能体 :agent(abstract);分类 cs.AI

AI总结 研究编码代理是否能自主推断最小特权授权边界,提出Sufficiency-Tightness Decomposition方法,提升敏感任务成功率并降低攻击成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01089 2026-05-18 cs.AI 57%

CodeDistiller: Automatically Generating Code Libraries for Scientific Coding Agents

CodeDistiller:自动为科学编码代理生成代码库

Peter Jansen, Samiah Hassan, Pragnya Narasimha

机构 * University of Arizona(亚利桑那大学) Allen Institute for Artificial Intelligence(人工智能研究所)

专题命中 软件智能体 :agent(abstract);分类 cs.AI

AI总结 CodeDistiller通过自动提炼科学GitHub仓库代码,生成经过验证的领域特定代码库,提升科学发现系统实验的准确性与完整性。

Comments 8 pages, 3 figures, 3 tables. Accepted to ACL 2026 (Demo Track)

详情

展开后加载摘要…

URL PDF HTML 收藏

3. GUI与网页智能体 6 篇

2605.15963 2026-05-18 cs.AI 70%

PAGER: Bridging the Semantic-Execution Gap in Point-Precise Geometric GUI Control

PAGER:弥合点精确几何GUI控制中的语义-执行鸿沟

Jingxuan Wei, Xi Bai, Shan Liu, Caijun Jia, Zheng Sun, Xinglong Xu, Siyuan Li, Linzhuang Sun, Bihui Yu, Conghui He, Cheng Tan

机构 * University of Chinese Academy of Sciences(中国科学院大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) China University of Petroleum-Beijing(中国石油大学(北京))

专题命中 GUI与网页智能体 :agent(abstract);planning(abstract);分类 cs.AI

AI总结 本文提出PAGER,通过依赖结构规划与像素级执行,解决对点精确几何GUI任务的需求,提升任务成功率至62%以上,填补语义-执行鸿沟。

Comments 27 pages, 11 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16116 2026-05-18 cs.AI 57%

ShopGym: An Integrated Framework for Realistic Simulation and Scalable Benchmarking of E-Commerce Web Agents

ShopGym: 一个集成框架,用于电子商务网络代理的现实模拟和可扩展基准测试

Chinmay Savadikar, Mingyu Zhao, Yuanzheng Zhu, Han Li, Shuang Xie, Alberto Castelo, Tianfu Wu, Lingyun Wang

机构 * North Carolina State University(北卡罗来纳州立大学) Shopify

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 本文提出ShopGym框架,通过模拟层ShopArena和基准层ShopGuru,实现电子商务网络代理的现实模拟与可扩展基准测试,验证了合成商店在结构属性和代理性能上的有效性。

Comments 32 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06223 2026-05-18 cs.AI cs.RO 57%

ProCompNav: Proactive Instance Navigation with Comparative Judgment for Ambiguous User Queries

ProCompNav:基于比较判断的主动实例导航

Junhyuk Kwon, Seungjoon Lee, Hyejin Park, Kyle Min, Jungseul Ok

机构 * GSAI, POSTECH(POSTECH人工智能研究所) CSE, POSTECH(POSTECH计算机科学与工程系) Oracle(Oracle公司)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 ProCompNav通过两阶段框架解决用户查询歧义问题,通过比较判断逐步缩小候选集,提升导航成功率并减少用户响应长度。

Comments Project page: https://tree-jhk.github.io/procompnav/ . Code: https://github.com/tree-jhk/procompnav/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15281 2026-05-18 cs.CR cs.AI 57%

Autonomous Intelligent Agents for Natural-Language-Driven Web Execution with Integrated Security Assurance

自然语言驱动的网页执行自主智能体与集成安全保障

Vinil Pasupuleti, Siva Rama Krishna Varma Bayyavarapu, Shrey Tyagi

机构 * International Business Machines (IBM)(国际商业机器公司(IBM)) Salesforce Inc(Salesforce公司)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 本文提出一种AI驱动的自动化测试框架,通过五个集成策略提升测试脚本生成成功率和导航可靠性,同时实现安全验证,检测认证绕过漏洞和输入验证缺陷。

Comments 6 pages, 4 figures, 5 tables, IEEE conference format

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15964 2026-05-18 cs.RO cs.CV 50%

WorldVLN: Autoregressive World Action Model for Aerial Vision-Language Navigation

WorldVLN: 用于空域视觉-语言导航的自回归世界动作模型

Baining Zhao, Jiacheng Xu, Weicheng Feng, Xin Zhang, Zhaolu Wang, Haoyang Wang, Shilong Ji, Ziyou Wang, Jianjie Fang, Zhiheng Zheng, Weichen Zhang, Yu Shang, Wei Wu, Chen Gao, Xinlei Chen, Yong Li

机构 * Tsinghua University(清华大学) Shandong University(山东大学) Manifold AI Beijing Institute of Technology(北京理工大学) Northeastern University(东北大学)

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 WorldVLN提出一种自回归世界动作模型,通过预测潜在世界演变并生成可执行的航点动作,提升空域视觉-语言导航性能,优于现有基线模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09869 2026-05-18 cs.RO cs.CV 50%

ConsistNav: Closing the Action Consistency Gap in Zero-Shot Object Navigation with Semantic Executive Control

ConsistNav:通过语义执行控制关闭零样本物体导航中的动作一致性差距

Haosen Wang, Zhenyang Li, Yinqiang Zhang, Zongqi He, Lutao Jiang, Kai Li, Yizhou Zhao, Liaoyuan Fan, Wenjian Hou, Tingbang Liang, Yibin Wen, Defeng Gu

机构 * Sun Yat-sen University(中山大学) The University of Hong Kong(香港大学) Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) City University of Hong Kong(香港城市大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 本文提出ConsistNav框架,通过语义执行控制模块解决零样本物体导航中动作一致性问题,提升导航精度与鲁棒性。

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 记忆与上下文管理 17 篇

2605.09033 2026-05-18 cs.CR cs.AI 90%

ShadowMerge: A Novel Poisoning Attack on Graph-Based Agent Memory via Relation-Channel Conflicts

ShadowMerge:一种通过关系通道冲突的图基agent内存新型污染攻击

Yang Luo, Zifeng Kang, Tiantian Ji, Xinran Liu, Yong Liu, Shuyu Li, Lingyun Peng

机构 * Key Laboratory of Trustworthy Distributed Computing and Service (MoE)(可信分布式计算与服务重点实验室) Beijing University of Posts and Telecommunications(北京邮电大学) Zhongguancun Laboratory(中关村实验室)

专题命中 记忆与上下文管理 :agent(title,title_cn);分类 cs.AI

AI总结 本文提出ShadowMerge攻击,通过关系通道冲突攻击图基agent内存,利用冲突值影响agent行为,改进现有攻击方法,实现93.8%的攻击成功率。

Comments Preprint. Corresponding authors: Zifeng Kang and Tiantian Ji. Code is available at https://anonymous.4open.science/status/ShadowMerge-033C

详情

展开后加载摘要…

URL PDF HTML 收藏