arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-21 至 2026-08-21 共收录 62 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 5 篇

2605.10555 2026-08-21 cs.AI 版本更新 92%

Agent-First Tool API: A Semantic Interface Paradigm for Enterprise AI Agent Systems

代理优先工具API:面向企业AI代理系统的语义接口范式

Kai Pan, Rong Hou

机构 * A2A Lab(A2A实验室)

专题命中 工具调用 :agent(title,summary_cn);AI agent(title,abstract);autonomous agent(abstract);分类 cs.AI

AI总结 本文提出Agent-First Tool API范式,通过六动词语义协议、标准化工具合同和双层治理管道,解决传统API与自主代理需求的五大匹配问题,实验证明其在任务成功率、人工干预和自主纠错方面显著优于传统CRUD方法。

Comments Metadata correction: Rong Hou was inadvertently omitted from the arXiv author metadata. The author list in the manuscript already included Rong Hou. The manuscript content is unchanged

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00156 2026-08-21 cs.RO 版本更新 67%

Dual-Informed Vertical Expansion for Multi-Objective Node Selection in Anytime Conflict-Based Search

双信息引导的垂直扩展用于任意时间冲突搜索中的多目标节点选择

Willem van Osselaer, Jiarui Li, Meshal Alharbi, Gioele Zardini

机构 * Massachusetts Institute of Technology(麻省理工学院)

专题命中 工具调用 :agent(abstract);multi-agent(abstract)

AI总结 提出DIVE策略,通过最佳边界搜索与深度优先搜索结合,在保持最优性的同时减少搜索中断、提供早期可行解并降低内存占用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01548 2026-08-21 cs.AI cs.LG 版本更新 62%

LLM Capability Limits: Static Emergence and Dynamic Boundary Control

涌现不变性:从符号化思维到结构控制

Yi Liu

专题命中 工具调用 :tool use(abstract);分类 cs.AI、cs.LG

AI总结 该研究形式化了语言为核心的智能的限制,提出动态边界控制框架,通过DeepSeek V4-Flash实验验证其可提升大语言模型的推理性能,组织了大语言模型的涌现限制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17546 2026-08-21 cs.SE 版本更新 57%

REST API Testing with Verified LLM-Inferred Dependencies and Response-Driven Refinement

基于经验证的LLM推断依赖关系与响应驱动优化的REST API测试

Tu Nguyen, Thanh Nguyen, Huy Nguyen, Viet Nguyen, Tien N. Nguyen, Vu Nguyen

专题命中 工具调用 :workflow(abstract);分类 cs.SE

AI总结 本文提出APIPilot框架,通过执行验证LLM推断的REST API依赖关系,结合响应驱动优化,在16个真实API上实现高覆盖率与成功率,优于现有基线。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16004 2026-08-21 math.FA math.CV 版本更新 50%

A proof of Esterle's conjecture on negative powers of Hilbert-space contractions

关于Hilbert空间收缩算子负幂的Esterle猜想的证明

Thomas Ransford

专题命中 工具调用 :tool use(abstract)

AI总结 本文证明了Esterle关于Hilbert空间收缩算子负幂的猜想,通过构造正序列验证了在特定条件下的算子为单位算子。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 24 篇

2506.05616 2026-08-21 cs.AI cond-mat.mtrl-sci physics.comp-ph 版本更新 89%

Toward Greater Autonomy in Materials Discovery Agents: Unifying Planning, Physics, and Scientists

迈向材料发现智能体的更高自主性:统一规划、物理与科学家

Lianhao Zhou, Hongyi Ling, Keqiang Yan, Kaiji Zhao, Xiaoning Qian, Raymundo Arróyave, Xiaofeng Qian, Shuiwang Ji

机构 * Department of Computer Science and Engineering, Texas A&M University(计算机科学与工程系,德克萨斯A&M大学) Department of Materials Science and Engineering, Texas A&M University(材料科学与工程系,德克萨斯A&M大学) Department of Electrical and Computer Engineering, Texas A&M University(电气与计算机工程系,德克萨斯A&M大学) Computing and Data Sciences, Brookhaven National Laboratory(布鲁赫斯国家实验室计算与数据科学部) Department of Physics and Astronomy, Texas A&M University(物理与天文学系,德克萨斯A&M大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract,abstract_cn);workflow(abstract);分类 cs.AI

AI总结 该研究提出MAPPS智能体框架,通过统一规划、物理与科学家实现更高自主性,在MP-20数据集上使材料发现相关指标提升5倍,是自主材料发现的潜力框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15242 2026-08-21 cs.AI cs.SE 版本更新 81%

LongRCA Bench: Diagnosing Responsible Roles and Root Causes in Long-Horizon Agent Failures

LongRCA Bench:诊断长 horizon 智能体失败中的责任角色与根本原因

Yunfei Zhang, Boyu Feng, Changhua Pei, Zexin Wang, Zhihuang Peng, Xinlong Liu, Hengyue Jiang, Difeng Ma, Jiayi Zhang, Yongzhou Yao, Yanan Zhao, Fei Sun, Yintong Huo, Zhaoyang Liu, Jingjing Li, Gaogang Xie, Dan Pei

机构 * Computer Network Information Center, Chinese Academy of Sciences(中国科学院计算机网络信息中心) Hangzhou Institute for Advanced Study, University of Chinese Academy of Sciences(中国科学院大学杭州高等研究院) Chongqing University(重庆大学) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) Singapore Management University(新加坡管理大学) Tongyi Lab, Alibaba Group(阿里巴巴集团通义实验室) Tsinghua University(清华大学)

专题命中 规划决策 :agent(title,abstract);分类 cs.AI、cs.SE

AI总结 LongRCA Bench 是含1140条失败轨迹的长 horizon 智能体失败诊断基准,本文提出无需训练的 RCTA 方法,在责任角色归因和根本步骤定位上优于现有基线,表明需将二者作为独立评估目标。

Comments 18 pages, 6 figures. Yunfei Zhang and Boyu Feng contributed equally. Changhua Pei is the corresponding author

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18637 2026-08-21 cs.IR 版本更新 80%

PILOT Technical Report

PILOT技术报告

Jiuning Lin, Ruiquan Lan, Xiaodong Zhu, Bin Zhang, Chengyu Lai, Chuxin Chen, Dimin Wang, Han Zhu, Hongtao Cheng, Jialin Zhu, Lingqing Zhang, Shuai Zhong, Tao Wang, Weipeng Huang, Yinjiang Cai, Yinnan Song, Yuan Liu, Zhibo Xiao, Zhixin Ma, Zihong Huang

专题命中 规划决策 :agent(abstract,abstract_cn);planning(abstract);agentic(abstract)

AI总结 该研究针对现有推荐系统优化智能体方法的反应式缺陷,提出PILOT框架,通过三类角色构建控制循环,在淘宝平台对比ROAM验证,实现多项指标提升且搜索效率显著提高,无需人工干预。

Comments Technical Report, 42 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15654 2026-08-21 cs.RO cs.AI 版本更新 79%

PO-PDDL: Learning Symbolic POMDPs from Visual Demonstrations for Robot Planning Under Uncertainty

PO-PDDL: 从视觉演示中学习符号化POMDP以实现不确定性下的机器人规划

Wenjing Tang, Xuanjin Jin, Yuan Liu, Renming Huang, Cewu Lu, Panpan Cai

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 提出PO-PDDL符号化POMDP框架,通过从机器人执行视频中重建潜在状态轨迹、识别部分可观测性并学习随机转移与观测模型,实现不确定性下的鲁棒任务规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21874 2026-08-21 cs.RO cs.AI 版本更新 79%

A Physics-Informed Neural Network Approach for UAV Path Planning in Dynamic Environments

动态环境下无人机路径规划的物理信息神经网络方法

Shuning Zhang

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 针对动态环境下无人机路径规划问题,提出PINN框架,将动力学等约束嵌入学习,仿真显示其在多指标上优于A*等传统方法,可统一模型与数据驱动规划。

Comments Withdrawn due to a substantive methodological error that affects the main conclusions of the paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16853 2026-08-21 cs.RO 版本更新 78%

FlexWorm: Primitive-augmented Hybrid Contact-motion Planning for Suction-based Multi-segment Deformable Robots

FlexWorm:用于基于吸盘的多段可变形机器人的基元增强混合接触-运动规划

Zili Tang, Tiecheng Guo, Qinyue Zhang, Meng Guo

机构 * School of Advanced Manufacturing and Robotics, Peking University(北京大学先进制造与机器人学院)

专题命中 规划决策 :planning(title,abstract)

AI总结 FlexWorm框架为基于吸盘的多段可变形机器人提出规划方法,含IKHS与PaHS,仿真和硬件实验表明其在复杂环境下规划性能更优且鲁棒性良好。

Comments 13 pages, 18 figures, accepted for publication in IEEE Robotics and Automation Letters (RA-L), 2026. Supplementary video: this https URL (https://youtu.be/OQR5Sx5Bwnc)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13854 2026-08-21 cs.CL 版本更新 77%

SPyCE: Skill-Policy Co-evolution for Multimodal Agents

SPyCE:多模态智能体的技能-策略协同进化

Ru Zhang, Weijie Qiu

机构 * Zhejiang University(浙江大学) Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 规划决策 :tool use(abstract);tool-use(abstract);workflow(abstract);分类 cs.CL

AI总结 研究多模态智能体,提出SPyCE框架,将推理轨迹提炼为分层技能库与策略协同进化,执行技能捕获局部操作,工作流技能编码高级先验,实验证明该框架优于基线,为构建多模态智能体提供新范式。

Comments Accepted by ACM MM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29078 2026-08-21 cs.LG 版本更新 70%

DASH-OPD: Discrepancy-Aware Switching with Hysteresis for On-Policy Distillation

DASH-OPD:面向在线策略蒸馏的带滞后性的差异感知切换算法

Yuchen Xia, Qianguo Sun, Chao Song, Junlong Wu, Yiyan Qi, Yunjian Xu

机构 * The Chinese University of Hong Kong(香港中文大学) IDEA Research(IDEA研究院) Emdoor Research Institute(亿道研究院)

专题命中 规划决策 :agent(abstract);agentic(abstract);分类 cs.LG

AI总结 本文针对在线策略蒸馏中执行器切换的问题,提出带滞后性的差异感知切换算法 DASH-OPD,经 ALFWorld 验证,其性能优于所有基线,训练与部署效率更优,相关代码等后续将发布。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17584 2026-08-21 cs.RO 版本更新 67%

HODAgent: Towards On-Demand, Responsive Humanoids for Physical World Human Interaction

HODAgent:面向物理世界人机交互的按需、响应式人形机器人

Wang Warren Chen, Jiahao Zhang, Zhenjiang Li, Mingxu Wang, Lei Yi, Yuchen Kang, Shuo Sun, Ziping Chen, Jie Chen

机构 * Xiaopeng(小鹏)

专题命中 规划决策 :agent(abstract);planning(abstract)

AI总结 HODAgent作为面向服务人形机器人的System-2具身智能体,通过半双工架构实现自适应服务,在仿真与实体机器人上均显著优于基准模型。

Comments we have received a formal directive from our company requiring all company assets to undergo a mandatory internal review process before any public release. We are now required to immediately withdraw the paper to comply with this policy

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11665 2026-08-21 cs.CV cs.RO 版本更新 67%

UAV-Based Infrastructure Inspections: A Literature Review and Proposed Framework for AEC+FM

基于无人机的基础设施检查:面向AEC+FM的文献综述与提出框架

Amir Farzin Nikkhah, Dong Chen, Bradford Campbell, Somayeh Asadi, Arsalan Heydarian

专题命中 规划决策 :planning(abstract);workflow(abstract)

AI总结 本文综述了无人机在基础设施检查中的应用,提出框架整合多模态数据与Transformer架构,以提高检测准确性和可靠性,未来研究方向包括轻量级AI模型和合成数据集。

Comments Accepted for publication in the Proceedings of the International Conference on Computing in Civil Engineering (i3CE 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09276 2026-08-21 cs.CL cs.LG 版本更新 62%

Verifiably grounded machine interpretation of lunar geology

月球地质学的可验证机器解释

Tom Sander, Kay Wohlfarth, Christian Wöhler

专题命中 规划决策 :workflow(abstract);分类 cs.CL、cs.LG

AI总结 本研究将地质知识推理方法嵌入多模态视觉-语言架构,构建可验证的月球地质学机器解释模型,结合开卷检索解决数值年龄定年依赖记忆先验的问题,明确自动地质推理的必要架构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.19085 2026-08-21 cs.RO cs.AI 版本更新 57%

DA-WAM: Decision-Aligned Future Latents for Driving World Models

DA-WAM:面向驾驶世界模型的决策对齐未来潜变量

Ruiguo Zhong, Benshan Ma, Xiaolong Chen, Lang Zhang, Mingyue Feng, Yaonong Wang, Pei Liu, Jun Ma

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Leapmotor(零跑汽车) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 DA-WAM 是统一预测表示学习等模块的驾驶世界模型框架,通过动作条件未来潜变量实现决策对齐,在 NAVSIM 数据集上达到最优性能,验证了关键组件的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10828 2026-08-21 cs.AI 版本更新 57%

The First Drop of Ink: Nonlinear Impact of Distracting Information in Long-Context Reasoning

第一滴墨水:误导信息在长上下文推理中的非线性影响

Muhan Gao, Zih-Ching Chen, Kuan-Hao Huang

机构 * Department of Computer Science Engineering, Texas A\&M University, College Station, TX, USA NVIDIA AI Technology Center, NVIDIA Corporation, Santa Clara, CA, USA

专题命中 规划决策 :agentic(abstract);分类 cs.AI

AI总结 研究探讨了误导信息在长上下文推理中的非线性影响,发现误导信息比例增加时,性能在初期急剧下降,后续变化较小。通过理论和实证分析,揭示了误导信息对注意力的 disproportionate 影响,并指出过滤收益主要来自减少上下文长度而非去除误导信息。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13731 2026-08-21 cs.CL 版本更新 57%

Doc-V*:Coarse-to-Fine Interactive Visual Reasoning for Multi-Page Document VQA

Doc-V*:多页文档视觉问答中的粗到细交互推理

Yuanlei Zheng, Pei Fu, Hang Li, Ziyang Wang, Yuyi Zhang, Wenyu Ruan, Xiaojin Zhang, Zhongyu Wei, Zhenbo Luo, Jian Luan, Wei Chen, Xiang Bai

机构 * School of Software Engineering, Huazhong University of Science and Technology(华中科技大学软件工程学院) MiLM Plus, Xiaomi Inc.(小米公司MiLM Plus团队) School of Computer Science and Technology, Huazhong University of Science and Technology(华中科技大学计算机科学与技术学院) School of Data Science, Fudan University(复旦大学数据科学学院)

专题命中 规划决策 :agentic(abstract);分类 cs.CL

AI总结 Doc-V*提出一种无OCR的智能框架,通过序列证据聚合解决多页文档VQA问题,结合语义检索和目标页面获取,提升回答准确性和证据收集效率,在五个基准测试中优于开源基线,提升领域外性能达47.9%。

Comments Accepted by Association for Computational Linguistics (ACL)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02794 2026-08-21 cs.AI 版本更新 57%

CharTool: Tool-Integrated Visual Reasoning for Chart Understanding

CharTool: 集成工具的视觉推理用于图表理解

Situo Zhang, Yifan Zhang, Zichen Zhu, Da Ma, Lei Pan, Danyang Zhang, Zihan Zhao, Lu Chen, Kai Yu

机构 * X-LANCE Lab, School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学与工程学院X-LANCE实验室) Jiangsu Key Lab of Language Computing(江苏省语言计算重点实验室) Suzhou Laboratory(苏州实验室) AISpeech Co., Ltd.(思必驰科技股份有限公司)

专题命中 规划决策 :agentic(abstract);分类 cs.AI

AI总结 本文提出CharTool,通过集成工具提升多模态大语言模型对图表的理解能力,通过双重数据管道和代理强化学习,在六个图表基准测试中取得显著提升。

Comments Accepted by ACMMM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18853 2026-08-21 eess.SY cs.LG 版本更新 57%

Learn for Variation: Efficient AAV Trajectory Learning through a Differentiable Wireless World Model

为变化学习:在可微环境中变分引导的AAV轨迹学习

Xiucheng Wang, Zhenye Chen, Nan Cheng, Zhisheng Yin, Xuemin Shen

机构 * State Key Laboratory of ISN and School of Telecommunications Engineering, Xidian University(信息与通信工程国家重点实验室和西安电子科技大学电信工程学院) School of Aerospace Science and Technology, Xidian University(航天学院) Department of Electrical and Computer Engineering, University of Waterloo(滑铁卢大学电气与计算机工程系)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出L4V框架,通过变分引导解决AAV轨迹规划中的奖励驱动强化学习问题,利用密集政策梯度提升任务完成效率和传输速率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08521 2026-08-21 cs.RO cs.AI eess.SY 版本更新 57%

FMT$^{\mathrm{X}}$: Lazy Wavefront Search for Dynamic Replanning

FMT$^{\mathrm{X}}$:用于动态重规划的惰性波前搜索

Soheil Espahbodi Nia

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文提出FMT$^{\mathrm{X}}$算法,通过代价改进测试和直接代价推送实现动态重规划,实验显示其在路径质量、修复工作量及碰撞检查效率上表现良好,明确了碰撞检测策略对规划性能的影响。

Comments 52 pages, 15 figures. Substantially revised version with strengthened asymptotic-optimality analysis, revised complexity analysis, expanded dynamic-replanning experiments, and updated presentation

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07388 2026-08-21 math.FA 版本更新 50%

The Banach lattice Lean library

巴拿赫格Lean库

David Muñoz-Lahoz

专题命中 规划决策 :planning(abstract)

AI总结 本文介绍用于巴拿赫格理论的Lean 4库,借助带人工监督的LLMs构建,可支持相关研究的形式化,已完成三项研究级形式化,有望成为集体成果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13148 2026-08-21 cs.CR 版本更新 50%

TrustMee: Self-Verifying Remote Attestation Evidence

TrustMee: 自验证远程证明证据

Parsa Sadri Sinaki, Zainab Ahmad, Wentao Xie, Merlijn Sebrechts, Jimmy Kjällman, Lachlan J. Gunn

专题命中 规划决策 :agent(abstract)

AI总结 TrustMee通过自验证远程证明证据机制,实现跨平台的证明验证,无需特定平台代码,利用WebAssembly组件实现验证逻辑的通用性。

Comments 16 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22700 2026-08-21 cs.CV 版本更新 50%

4DLoG: Generative Modeling of Neurodegenerative Brain Anatomy with 4D Longitudinal Diffusion Model

利用4D纵向扩散模型生成神经退行性脑解剖结构

Nivetha Jayakumar, Swakshar Deb, Bahram Jafrasteh, Qingyu Zhao, Miaomiao Zhang

机构 * Department of Electrical and Computer Engineering(电气与计算机工程系) Department of Radiology(放射学系) Department of Electrical and Computer Engineering, Department of Computer Science(电气与计算机工程系、计算机科学系)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出一种4D纵向扩散模型,用于生成神经退行性疾病的脑解剖结构,通过临床变量条件生成准确的脑部变化轨迹,验证了其在疾病分类和分割中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22531 2026-08-21 cs.CV 版本更新 50%

UrbanVGGT: Scalable Sidewalk Width Estimation from Street View Images

UrbanVGGT:从街景图像中可扩展的人行道宽度估计

Kaizhen Tan, Fan Zhang

机构 * Heinz College of Information Systems and Public Policy(信息系统与公共政策学院) Carnegie Mellon University(卡内基梅隆大学) Institute of Remote Sensing and Geographical Information System(遥感与地理信息系统研究所)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出UrbanVGGT方法,通过单张街景图像估算人行道宽度,结合语义分割、3D重建、地面平面拟合等技术,在华盛顿特区基准测试中达到0.252米的均方误差,展示了其在大规模城市中的可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09774 2026-08-21 cs.CR 版本更新 50%

QRS: A Rule-Synthesizing Neuro-Symbolic Triad for Autonomous Vulnerability Discovery

QRS:一种用于自主漏洞发现的神经符号三元组规则生成器

George Tsigkourakos, Constantinos Patsakis

专题命中 规划决策 :autonomous agent(abstract)

AI总结 QRS通过神经符号方法生成代码查询,发现超出预定义模式的漏洞,显著降低假阳性,并在低开销下发现高严重性漏洞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02088 2026-08-21 cs.CV 版本更新 50%

PhysSFI-Net: Physics-informed Geometric Learning of Skeletal and Facial Interactions for Orthognathic Surgical Outcome Prediction

PhysSFI-Net:基于物理的几何学习用于正颌手术结果预测的颅面和面部相互作用

Jiahao Bao, Huazhen Liu, Yu Zhuang, Leran Tao, Xinyu Xu, Yongtao Shi, Mengjia Cheng, Yiming Wang, Congshuang Ku, Ting Zeng, Yilang Du, Siyi Chen, Shunyao Shen, Suncheng Xiang, Hongbo Yu

专题命中 规划决策 :planning(abstract)

AI总结 PhysSFI-Net通过结合物理指导的几何深度学习,实现高精度的正颌手术术后面部形态预测,优于现有方法。

Comments 16 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18268 2026-08-21 cs.RO cs.CG 版本更新 50%

On Minimum Aerial Photographs for Planar Region Coverage: Hardness and Approximation

关于平面区域覆盖的最小航拍照片的计算复杂性

Si Wei Feng, Kartik Mohta, Kangli Wang

专题命中 规划决策 :planning(abstract)

AI总结 研究用正方形和圆形覆盖简单平面多边形的计算复杂性,证明了不可近似性间隙并开发了2.828-最优近似算法。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 多智能体 4 篇

2604.12616 2026-08-21 cs.AI cs.MM 版本更新 88%

Every Picture Tells a Dangerous Story: Memory-Augmented Multi-Agent Jailbreak Attacks on VLMs

每幅画都讲述一个危险的故事:基于内存增强的多智能体 jailbreak 攻击 VLMs

Jianhao Chen, Shiqin Wang, Haoyang Chen, Hanjie Zhao, Haozhe Liang, Zheng Wang, Tieyun Qian

机构 * Wuhan University(武汉大学) Zhongguancun Academy(中关村学院) Tianjin University(天津大学) University of the Chinese Academy of Sciences(中国科学院大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本文提出MemJack框架,通过视觉语义引导多智能体协作,利用迭代空域投影过滤器提升对VLMs的攻击成功率,实验表明其在COCO数据集上达到71.48%的攻击成功率。

Comments This work was accepted by WISE2026. 15 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏