arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 1830 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 1830 篇

2606.08300 2026-06-09 cs.LG 新提交 83%

QueryWeaver: Reliable Multi-Tool Query Execution Planning via LLM-Based Graph Generation

QueryWeaver: 基于LLM图生成的可靠多工具查询执行规划

Aishwarya Chakravarthy, Vidhi Kulkarni, Duen Horng Chau

机构 * School of Computational Science and Engineering, Georgia Institute of Technology, Atlanta, GA, USA(计算科学与工程学院,佐治亚理工学院,亚特兰大,GA,美国)

专题命中 规划决策 :planning(title,abstract);tool use(abstract);分类 cs.LG

AI总结 提出将自然语言查询转换为结构化图并通过确定性规划器执行的系统,利用深度优先搜索解决跨工具依赖,实现高可靠性查询。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04166 2026-08-06 cs.HC 新提交 83%

Enacting Constructive Conflicts with AI Agents to Enhance Reconsideration among Novice Interaction Designers

借助AI智能体构建建设性冲突以提升新手交互设计师的重新考量能力

Howard Ziyu Han, Nikolas Martelaro

专题命中 规划决策 :AI agent(title,abstract);agent(abstract,comments)

AI总结 该研究构建受对抗性设计理论启发的AI智能体,通过45名设计学生的实验发现,该智能体实施的建设性冲突可提升新手交互设计师的重新考量能力,推动设计改进与创意拓展。

Comments 8 pages, 4 figures, conditionally accepted to Human-Agent Interaction 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03502 2026-08-05 cs.AI cs.LG cs.MA 新提交 82%

Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks

用于复杂序列决策任务的混合大语言模型增强强化学习智能体

Christophe D. Hounwanou, John Emeka Eze, Yaé Ulrich Gaba

专题命中 规划决策 :agent(abstract);autonomous agent(abstract);tool-use(abstract);planning(abstract)

AI总结 本文提出混合LLM增强RL智能体,融合LLM规划与RL动作优化,经实验验证其在序列决策任务上优于仅RL、仅LLM的基线方法,为构建更强自主系统提供了新方向。

Comments 16 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18947 2026-06-18 cs.AI cs.CL cs.IR cs.MA 新提交 82%

Decoupling Search from Reasoning: A Vendor-Agnostic Grounding Architecture for LLM Agents

将搜索与推理解耦:面向LLM Agent的供应商无关的接地架构

Emmanuel Aboah Boateng, Kyle MacDonald, Amardeep Kumar, Siddharth Kodwani, Sudeep Das

机构 * DoorDash, Inc.(DoorDash公司)

专题命中 规划决策 :agent(title_cn,abstract_cn);agentic(abstract);分类 cs.AI、cs.CL

AI总结 提出解耦搜索接地(DSG)架构,将搜索接地从推理模型中分离,通过MCP兼容网关实现供应商路由、缓存等控制,在降低成本和延迟的同时保持或提升准确性。

Comments 15 pages, Figure 8

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07682 2026-06-09 cs.SE cs.AI 新提交 82%

SWE-Marathon: Can Agents Autonomously Complete Ultra-Long-Horizon Software Work?

SWE-Marathon: 智能体能否自主完成超长时程软件工作?

Rishi Desai, Jesse Hu, Joan Cabezas, Neel Harsola, Pratyush Shukla, Roey Ben Chaim, Adnan El Assadi, Omkaar Mukund Kamath, Fenil Faldu, Prannay Hebbar, Jiankai Sun, Yiyuan Li, Pramod Srinivasan, Ishan Gupta, Christopher Settles, Daniel Wang, Derek Chen, Pranav Raja, Albert Liu, Marek Šuppa, Nevasini Sasikumar, Luyang Kong, Erik Quintanilla, Xiangyi Li, Ivan Bercovich, Steven Dillmann

机构 * Abundant Zenity Harvard University(哈佛大学) University of Waterloo(滑铁卢大学) Gujarat Technological University(古吉拉特技术大学) Warping Stanford University(斯坦福大学) UNC-Chapel Hill(北卡罗来纳大学教堂山分校) Independent(独立) Refresh Soleda AI Near AI Georgia Tech(佐治亚理工学院) Comenius University in Bratislava(布拉迪斯拉发Comenius大学) UC San Diego(圣地亚哥大学) BenchFlow UC Santa Barbara(圣巴巴拉大学)

专题命中 规划决策 :agent(abstract);AI agent(abstract);planning(abstract);workflow(abstract)

AI总结 提出SWE-Marathon基准,包含20个超长时程任务,平均消耗2720万token,评估智能体在规划、长上下文理解和记忆方面的能力,当前前沿编码智能体解决率低于30%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12172 2026-08-13 cs.MA 新提交 82%

Rethinking Agent Security as a Networking Problem

将智能体安全重新思考为一个网络问题

Van Tran, Taveesh Sharma, Tajveer Singh Dhesi, Nick Feamster

专题命中 规划决策 :agent(title,abstract);AI agent(abstract)

AI总结 该研究针对现有以智能体为中心的安全防御无法可靠防范AI智能体风险的问题,借鉴网络领域原则,提出结合确定性执行与语义策略的AI智能体安全系统设计思路。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05757 2026-08-07 cs.CV 新提交 82%

Beyond Relevance: Bayesian Evidence Acquisition for Agentic Whole-Slide Image Reasoning

超越相关性:面向智能体的全切片图像推理的贝叶斯证据获取

Bryan Wong, Xun Xu, Huazhu Fu, Nancy F. Chen, Mun Yong Yi

机构 * A*STAR(新加坡科技研究局)

专题命中 规划决策 :agentic(title,abstract);agent(abstract)

AI总结 本研究提出BEACON框架,将WSI推理建模为贝叶斯证据获取问题,通过最大化预期信息增益减少诊断不确定性,在五个WSI-VQA基准的零样本实验中,其性能优于同类无训练智能体框架,提升了证据获取效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04420 2026-08-06 cs.RO 新提交 82%

SCOPE: Field-of-View-Aware Path Planning in Unknown 3D Environments via Safety-Volume Certification

SCOPE:通过安全体积认证在未知三维环境中感知视场的路径规划

Junbin Yuan, Muqing Cao, Yunwoo Lee, Brady Moon, Sebastian Scherer

机构 * Carnegie Mellon University(卡内基梅隆大学) Brigham Young University(杨百翰大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 SCOPE是一种在未知3D环境中规划路径的框架,通过安全体积认证实现视场感知,可到达所有目标、减少任务时间,真实机器人演示验证其有效性。

Comments Project website: https://yuanjunbin.github.io/scope-planner/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03924 2026-08-05 cs.RO 新提交 82%

ETA: A New Agentic Paradigm for Embodied Tasks

ETA:一种用于具身任务的新型智能体范式

Yitong Chen, Zezheng Huai, Sixian Li, Yubang Wang, Haozhe Zhang, Yifei Zhang, Hechang Chen, Jingjing Gong, Yu-Gang Jiang, Xipeng Qiu

专题命中 规划决策 :agentic(title);agent(abstract,abstract_cn)

AI总结 针对当前具身系统泛化依赖训练数据、长时执行难控的问题,提出新型具身任务智能体范式ETA,发布开源实现OpenETA,为Codex提供轻量级插件以支持具身任务处理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03223 2026-08-05 cs.LG cs.AI cs.CL 新提交 82%

Agentic Reinforcement Learning with Self-Distilled Reward Shaping

具有自提炼奖励塑造的智能体强化学习

Ranxu Zhang, Guinan Chen, Chenshaodong, Jinghao Lin, Xiaozhou Xu, Sunzhe, Yanyong Zhang, Chao Wang

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 针对智能体强化学习中稀疏奖励无法分配中间决策信用的问题,提出ADRS框架,通过校准教师分数等提升多轮语言智能体在长时域任务的性能,且增益稳定。

Comments 17 pages,10 figures,11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02302 2026-08-04 cs.AI cs.LG cs.SE 新提交 82%

Trajectories That Segment Themselves: Agent-Declared Boundaries as a Training Unit

自分割轨迹:智能体声明边界作为训练单元

Jingxi Wei

专题命中 规划决策 :agent(title,abstract);分类 cs.AI、cs.LG、cs.SE

AI总结 该研究提出智能体声明边界的采集时语义自分割方法,将其作为训练单元,实验表明该分段具有一致性,下游DPO在特定任务中表现优于对照组。

Comments 20 pages, 6 figures, 11 tables. Includes appendices with full controls and ablations

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00113 2026-08-04 cs.RO 新提交 82%

Track-Guided Hierarchical Reinforcement Learning for Autonomous Vehicle Drifting with Minimum-Lap-Time Planning

赛道引导分层强化学习用于最小圈速规划的自动驾驶车辆漂移控制

Sheng Zhao, Bolin Zhao, Xiaodong Wu, Chen Lv

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 该研究针对自动驾驶车辆漂移控制的双目标难题,提出TgRL分层强化学习框架,结合最优轨迹规划训练智能体,实现了兼顾控制性能与圈速缩短的漂移竞赛策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25405 2026-07-29 cs.HC 新提交 82%

Agentic AI Autonomy Assessment: A Decision-Support Framework Towards Governed Supply Chain Systems

智能体人工智能自主性评估:面向受治理供应链系统的决策支持框架

Lennart Trumpler, Rodrigo Furlan de Assis, Elias Ribeiro da Silva, Luis Antonio de Santa-Eulalia, Christian Hendriksen

专题命中 规划决策 :agentic(title,abstract);agent(abstract)

AI总结 本文针对智能体人工智能在供应链决策中应用但治理不足的问题,提出AAAA框架,基于用户委托等三维度衡量任务自主性,经模拟游戏测试结构效度,揭示自主性与层级成本关系,为供应链智能体风险评估等提供基础。

Comments 28 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23718 2026-07-28 cs.IR 新提交 82%

Melo: A Production LLM-Powered Music Recommendation Agent

Melo:一个由大语言模型驱动的音乐推荐代理

Shijia Wang, Da Guo, Qiang Xiao, Fanghui Bi, Weisheng Li, Dongjing Wang, Chuanjiang Luo

专题命中 规划决策 :agent(title,abstract);planning(abstract)

AI总结 研究基于网易云音乐部署的大语言模型驱动音乐推荐代理Melo,针对实体幻觉和长尾退化故障模式,采用推理时实体基础和反思性重试机制,经测试在播放列表留存和参与度指标上有提升,强调运行时机制对推荐进展的重要性。

Journal ref Proceedings of the 20th ACM Conference on Recommender Systems (RecSys '26), September 27-October 02, 2026, Minneapolis, MN, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22242 2026-07-27 cs.DC 新提交 82%

Agentic CPU-GPU Scheduling for Heterogeneous AI Workloads

用于异构人工智能工作负载的智能CPU-GPU调度

Tianxi Lu, Sherief Reda

专题命中 规划决策 :agentic(title,abstract);agent(abstract)

AI总结 研究异构人工智能工作负载的调度问题,提出将设备调度制定为三种选项,识别影响延迟的因素,构建智能调度器,该调度器在多种场景下达到最优映射,精度与经典基线匹配且无需离线训练,性能优于其他策略。

Comments 15 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21993 2026-07-27 cs.GT 新提交 82%

Three-Body Alignment: Aligning Chess Agent with Human Reasoning through Reranked Rationale

三体对齐:通过重新排序的理由将国际象棋智能体与人类推理对齐

Jaymari Chua, Chen Wang, Liming Zhu, Lina Yao

专题命中 规划决策 :agent(title,abstract);agentic(abstract)

AI总结 研究如何通过国际象棋中的“三体对齐”,分析人类专家、引擎辅助评论员和大语言模型产生的理由间语义差异,构建多源理由数据集,进行实证分析与实验,开发数据集结构并开源,以改善智能体与人类对齐及决策的可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19650 2026-07-23 cs.RO cs.MA 新提交 82%

Remote ID Spoofing-Aware Trajectory Planning for Small Unmanned Aerial Systems

小型无人机系统的远程ID欺骗感知轨迹规划

Jeremiah Webb, Bryce Bjorkman, Abel Diaz Gonzalez, Austin Coursey, Noah Dahle, Kailani Lemieux Mack, Filippos Fotiadis, Gautam Biswas, Bryan C. Ward, Abenezer Taye

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 针对小型无人机在RID位置欺骗攻击下的轨迹规划问题,提出分散式欺骗感知框架,利用物理层观测评估广播可信度,检测定位欺骗代理,集成到规划器中,仿真显示可减少近空中碰撞事件且保持计算效率。

Comments 9 pages, 3 figures, to be published in IEEE DASC 2026 Conference proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18062 2026-07-21 cs.RO cs.CV 新提交 82%

UniETP: Unifying Environments for Generalizable Embodied Task Planning

UniETP:统一用于通用具身任务规划的环境

Peiran Xu, Jiaqi Zheng, Ziyou Wang, Yadong Mu

机构 * Peking University(北京大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 针对具身任务规划中模拟器和数据集孤立的问题,提出UniETP统一接口,整合四个常用模拟器,兼具标准化与多样性,构建新数据集,通过实验评估模型具身规划能力并分析瓶颈。

Comments We are actively working on releasing the codes and data

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14544 2026-07-17 cs.CV 新提交 82%

3D Geometric Tooth Alignment Planning via Deep Reinforcement Learning

通过深度强化学习进行3D几何牙齿对齐规划

Yong Li, Jianwen Lou, Jiayue Ma, Yao-Xiang Ding, Youyi Zheng, Haihua Zhu

机构 * School of Software Technology, Zhejiang University(浙江大学软件学院) State Key Laboratory of CAD&CG, Zhejiang University(浙江大学CAD&CG国家重点实验室) Stomatology Hospital, Zhejiang University School of Medicine(浙江大学医学院附属口腔医院)

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 研究针对3D几何牙齿对齐规划问题,提出基于深度强化学习的框架。利用马尔可夫决策过程,结合三项创新:基于Transformer的智能体、动态掩码方案和两阶段课程学习策略,在数据集上评估,该方法在路径安全和效率上优于基线,提供自动化正畸对齐规划方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13034 2026-07-15 cs.AI cs.CL cs.SE cs.SY eess.SY 新提交 82%

Do AI Agents Know When a Task Is Simple? Toward Complexity-Aware Reasoning and Execution

人工智能代理知道任务何时简单吗?迈向复杂性感知推理与执行

Junjie Yin, Xinyu Feng

专题命中 规划决策 :AI agent(title);agent(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 研究探讨LLM代理缺乏任务感知执行范围估计能力,提出E3方法,在MSE-Bench基准测试及真实模型工具中验证,该方法能在保证成功率时大幅降低成本,推动迈向工程基础人工智能,还发布了框架和基准。

Comments 27 pages, 8 figures, 8 tables. Code and benchmark: https://github.com/eejyin/Do-AI-Agents-Know-When-a-Task-Is-Simple-Toward-Complexity-Aware-Reasoning-and-Execution

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10438 2026-07-14 cs.RO cs.NI 新提交 82%

Large Language Model Enhanced Differentiable Trajectory Planning for IoT-Enabled Autonomous Driving

用于物联网支持的自动驾驶的大语言模型增强可微轨迹规划

Shihao Zhang, Jing Yang, Ziyu Song, Zheng Lin, Sunil Prajapat, Zhaochen Xia, Hemant Ghayvat, Haitao Ding, Lip Yee Por, Ashok Kumar Das

机构 * State Key Laboratory of Automotive Simulation and Control, Jilin University(吉林大学汽车仿真与控制国家重点实验室) Center of Research for Cyber Security and Network (CSNET), Faculty of Computer Science and Information Technology, Universiti Malaya(马来西亚大学计算机科学与信息技术学院网络安全与网络研究中心) Interdisciplinary Centre for Security, Reliability and Trust (SnT), University of Luxembourg(卢森堡大学安全、可靠性与信任跨学科中心) IMT, Department of Humanities and Technology, Roskilde University(罗斯基勒大学人文与技术系IMT) Center for Security, Theory and Algorithmic Research, International Institute of Information Technology(国际信息技术研究所安全、理论与算法研究中心) Department of Computer Science and Engineering, College of Informatics, Korea University(韩国大学信息学院计算机科学与工程系)

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 针对物联网支持的自动驾驶规划问题,提出大语言模型增强可微轨迹规划框架。通过以周围智能体为中心的数据增强、复杂度感知的语义增强模块及可微优化模块,提升规划效果,在相关基准测试中取得高分,验证了在线部署和实时闭环执行能力。

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10336 2026-07-14 cs.RO cs.CV 新提交 82%

PrismAD: Decoupled Planning via Semantic Mixture-of-Planners for End-to-End Autonomous Driving

PrismAD:通过语义规划器混合实现端到端自动驾驶的解耦规划

Kang Ding, Zhigui Lin, Hongsong Wang, Jie Gui, Qi Liu, Zhe Wang, Luqi Tang, Lei He

机构 * School of Vehicle and Mobility, Tsinghua University(清华大学车辆与运载学院) State Key Laboratory of Intelligent Green Vehicle and Mobility, Tsinghua University(清华大学智能绿色车辆与出行国家重点实验室) School of Cyberspace Security, Southeast University(东南大学网络空间安全学院) School of Computer Science and Engineering, Southeast University(东南大学计算机科学与工程学院) School of Automotive Engineering, Wuhan University of Technology(武汉理工大学汽车工程学院) SAIC GM Wuling Automobile Co., Ltd.(上汽通用五菱汽车股份有限公司)

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 研究针对自动驾驶规划器耦合问题,提出PrismAD框架,将场景令牌分组,用独立规划专家学习专门表示,语义感知路由器聚合预测,引入稀疏top-$K$激活,实验证明该框架性能具竞争力。

Comments 8 pages,5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09756 2026-07-14 cs.RO 新提交 82%

LLM-Centric Agentic AI for UAV Swarms: Architecture, Enabling Technologies, and Open Problems

用于无人机群的以大语言模型为中心的智能体人工智能:架构、使能技术及开放问题

Yousef Emami, Rahim Taheri, Mohammadhossein Homaei, Muhammad Atif Ur Rehman, Mohammad Shojafar

专题命中 规划决策 :agentic(title,abstract);planning(abstract)

AI总结 研究针对无人机群实际部署受限问题,提出以大语言模型为中心的智能体人工智能LAUS,回顾相关使能技术,分析威胁,确定包括抗幻觉推理等在内的开放研究挑战。

Comments 8 pages, 4 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01120 2026-07-03 cs.DC 新提交 82%

Next-Generation Agentic Reinforcement Learning Systems Enable Self-Evolving Agents

下一代智能体强化学习系统实现自进化智能体

Ran Yan, Wei Fu, Jiale Li, Shusheng Xu, Zhiyu Mei, Jiaxuan Gao, Jiarui Zhang, Wentai Zhang, Hao Dai, Xujie Shen, Chuyi He, Zhen Pu, Jun Mei, Zhiyao Lin, Haitao Wang, Zhiqiang Ding, Jiawei Zhang, Huaijie Wang, Ruida Xu, Honghua Dong, Youhe Jiang, Yi Wu, Tongkai Yang, Binhang Yuan

专题命中 规划决策 :agentic(title,abstract);agent(abstract)

AI总结 针对企业级大规模智能体服务中自进化部署的瓶颈,提出智能体在线强化学习系统需在轨迹数据协议、数据代理和进化控制平面三方面进行协同设计,并通过AReaL2.0实例化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00422 2026-07-02 cs.CR 新提交 82%

KidnapRAG: A Black-Box Attack for Hijacking Reasoning in Agentic Retrieval-Augmented Generation Systems

KidnapRAG:针对代理式检索增强生成系统中推理劫持的黑盒攻击

Chanwoo Choi, Euntae Kim, Kyuho Lee, Youngsam Chun, Jinhee Jeong, Eunmi Kim, Myunggyo Oh, Junseo Jang, Buru Chang

专题命中 规划决策 :agentic(title,abstract);agent(abstract)

AI总结 提出KidnapRAG,一种针对代理式RAG系统的黑盒顺序投毒攻击,通过三种角色文档(诱饵、链环、恶意指令)劫持多步推理链,实验表明在多种框架和基准上优于现有方法。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25189 2026-07-02 cs.OS 新提交 82%

ActPlane: Programmable OS-Level Policy Enforcement for Agent Harnesses

ActPlane:面向代理框架的可编程操作系统级策略执行

Yusheng Zheng, Tianyuan Wu, Quanzhi Fu, Tong Yu, Wenan Mao, Tao Ma, Dan Williams, Wei Wang, Andi Quinn

专题命中 规划决策 :agent(title,abstract);AI agent(abstract)

AI总结 提出ActPlane,一种在操作系统内核中执行代理策略的引擎,通过eBPF实现信息流控制,弥补语义鸿沟,覆盖工具层无法观察的间接执行路径,开销1.9%-8.4%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09620 2026-06-30 cs.RO cs.SY eess.SY 新提交 82%

Motion planning for hundreds of floating robots

数百个浮动机器人的运动规划

Jan Kamm, Antonio Terpin, Raffaello D'Andrea, Aswin Ramachandran

机构 * Institute for Dynamic Systems and Control, ETH Zürich(苏黎世联邦理工学院动态系统与控制研究所)

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 针对大型浮动机器人编队的无碰撞运动规划问题,提出一种可扩展的流水线方法,通过碰撞图分解为独立子问题并行求解,在500个机器人仿真和实际演示中验证了有效性。

Comments Accepted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22955 2026-06-23 cs.CV 新提交 82%

Evo-RAD: Navigating Rare Retinal Disease Diagnosis via Self-Evolving Agentic Retrieval

Evo-RAD:通过自进化代理检索导航罕见视网膜疾病诊断

Wangding Xia, Ye Du, Jiashi Lin, Meng Wang, Danli Shi, Shujun Wang

机构 * The Hong Kong Polytechnic University(香港理工大学) Northwestern Polytechnical University(西北工业大学) National University of Singapore(新加坡国立大学)

专题命中 规划决策 :agentic(title,abstract);agent(abstract)

AI总结 提出Evo-RAD框架,将检索增强诊断建模为马尔可夫决策过程,通过图代理动态删除不相关证据、插入病理一致样本或终止进化,利用同质性感知奖励优化,显著提升罕见视网膜疾病诊断性能。

Comments Accepted by MICCAI 2026. 10 pages, 2 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22151 2026-06-23 cs.IR 新提交 82%

Novelty-Aware Agentic Retrieval: Comparing Research Contributions Through Structured Multi-Step Reasoning

新颖性感知的智能检索:通过结构化多步推理比较研究贡献

Shou-Tzu Han

专题命中 规划决策 :agentic(title,abstract);agent(abstract)

AI总结 提出新颖性感知研究智能体,通过结构化多步推理增强RAG,实现论文间重叠、差异及问题-方法缺失的对比分析,在100篇论文语料上支持五种结构化比较能力。

Comments 9 pages, 1 figure, 14 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20922 2026-06-23 cs.CR 新提交 82%

Think Twice Before You Act: Protecting LLM Agents Against Tool Description Poisoning via Isolated Planning

三思而后行:通过隔离规划保护LLM代理免受工具描述投毒攻击

Shanghao Shi, Xiao Wang, Chaoyu Zhang, Hao Li, Wenjing Lou, Thomas Hou, Yevgeniy Vorobeychik, Chongjie Zhang, Ning Zhang

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 提出Tool-Guard系统级防御,通过隔离规划机制将可疑工具调用隔离到受感染列表,阻断投毒描述持续影响,在AgentDojo和ASB基准上显著降低攻击成功率并保持任务效用。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏