arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 1830 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 1830 篇

2607.22724 2026-07-28 cs.LG cs.AI 新提交 81%

Progress-conditioned Group Policy Optimization for Long-Horizon Agentic Tasks

用于长期代理任务的进度条件分组策略优化

Kaibing Yang, Guangfeng Cai, Shengtian Yang, Shuo He, Yu Li, Mengyi Liu, Pengwei Chen, Jun Xu, Lei Feng

机构 * Southeast University(东南大学) Kuaishou Technology(快手科技) Meituan(美团)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.LG

AI总结 研究长期代理任务中基于分组策略优化的采样不平衡问题,提出进度条件分组策略优化(ProGPO),通过特定条件下利用首次访问观察覆盖率,为访问更多新状态的轨迹或步骤赋予优势,实验证明该方法优于基线,尤其在困难任务上效果显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20743 2026-07-24 cs.RO cs.AI cs.LG 新提交 81%

Self-Supervised Bio-Inspired Robotic Trajectory Planning with Obstacle Avoidance

具有避障功能的自监督生物启发式机器人轨迹规划

Miroslav Krupa, Miroslav Cibula, Kristína Malinovská

机构 * Faculty of Mathematics, Physics and Informatics, Comenius University Bratislava(布拉迪斯拉发夸美纽斯大学数学、物理与信息学院)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 研究机器人轨迹规划问题,提出基于自监督学习框架,利用正反模型作监督机制,在含障碍物环境下规划轨迹,实验证明方法可行,针对规划器问题提出并评估了额外训练机制和缓解策略。

Comments 12 pages, 3 figures. To be published in 2026 International Conference on Artificial Neural Networks (ICANN) proceedings. This research was supported by the Slovak Research and Development Agency, project APVV-21-0105

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20582 2026-07-24 cs.LG cs.AI cs.MA 新提交 81%

Bayesian uncertainty estimation improves clinical decision making in medical AI agents

贝叶斯不确定性估计改善医学人工智能代理中的临床决策

Frederik Hauke, Patrick Wienholt, Christiane Kuhl, Dyke Ferber, Jakob Nikolas Kather, Sven Nebelung, Daniel Truhn

机构 * University Hospital RWTH Aachen(亚琛工业大学附属医院) Heidelberg University Hospital(海德堡大学医院) TU Dresden(德累斯顿工业大学) TUD Dresden University of Technology(德累斯顿工业大学)

专题命中 规划决策 :AI agent(title);agent(abstract);分类 cs.AI、cs.LG

AI总结 研究针对医学图像分析机器学习模型缺乏置信度度量问题,采用蒙特卡洛随机失活获取认知不确定性信号,添加到点预测提高错误检测AUROC,在临床决策支持代理实验中,以特定形式传达该信号可降低误诊率,凸显其对决策的价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18530 2026-07-22 cs.LG cs.AI 新提交 81%

Censoring-Aware In-Context Learning for Generalized Supplier Lead Time Estimation in Supply Chain Planning

供应链规划中广义供应商提前期估计的审查感知上下文学习

Christopher Wang, Sebastien Ouellet, Behrouz Haji Soleimani, Ali Etemad

机构 * Queen’s University(女王大学) Kinaxis Inc.(Kinaxis公司)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 研究供应链规划中供应商提前期预测问题,提出审查感知上下文学习模型LeadTime-ICL,结合Transformer与条件归一化流头,经预训练可适应新数据集,在多数据集上评估表现优异,为工业规划提供准确低成本预测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14171 2026-07-17 cs.LG cs.CL 新提交 81%

Branching Policy Optimization: Sandbox-Native Language Agent Reinforcement Learning

分支策略优化:沙盒原生语言智能体强化学习

Bowei He, Yankai Chen, Xiaokun Zhang, Xue Liu

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) McGill Univeristy(麦吉尔大学) City University of Hong Kong(香港城市大学)

专题命中 规划决策 :agent(title,abstract);分类 cs.CL、cs.LG

AI总结 研究基于可执行沙盒的大语言模型智能体强化学习,提出分支策略优化(BPO)算法,利用沙盒特性构建新展开拓扑,通过自适应快照、分叉动作等方式计算优势,实验验证该算法能提升成功率、降低方差并减少策略更新。

Comments Accepted by WAIC Academic 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10582 2026-07-14 cs.LG cs.AI 新提交 81%

MemDecay: Region-Aware KV Cache Eviction for Efficient LLM Agent Inference

MemDecay:用于高效大语言模型智能体推理的区域感知键值缓存逐出策略

Venkatesha Matam, Keon Kim

机构 * Independent Researcher(独立研究者)

专题命中 规划决策 :agent(title,abstract);分类 cs.AI、cs.LG

AI总结 研究大语言模型智能体KV缓存内存瓶颈问题,提出无需训练的区域感知逐出策略MemDecay,为令牌分配特定区域优先级和衰减率,经实验验证该策略能有效管理缓存,确立语义提示结构对KV缓存管理的作用并明确其与关注重要性的结合方式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10275 2026-07-14 cs.AI cs.CL 新提交 81%

Information-seeking failures of large language models in agentic clinical reasoning

大语言模型在代理临床推理中的信息获取失败

Krischan Braitsch, Laura K. Schmalbrock, Theresa Weltermann, Andrew F. Berdel, Isabella Miller, Kai Tran, Michael Heider, Sabrina Kraus, Florian Bassermann, Jacqueline Lammert, Sebastian Ziegelmayer, Marcus Makowski, Lisa C. Adams, Keno K. Bressem

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.CL

AI总结 研究大语言模型在临床推理中信息获取失败问题,开发血液肿瘤学代理评估框架,发现信息利用率是诊断准确性关键指标,推理痕迹与准确性不相关,主要失败模式为搜索满足等,指出模型主要限制是不确定性下信息获取失败。

Comments 66 pages, 9 figures; includes supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11493 2026-07-14 cs.LG cs.AI math.CT 新提交 81%

Agentic Skill Optimization over Lie Algebroids

李代数胚上的智能体技能优化

Sridhar Mahadevan

机构 * Adobe Research(Adobe研究院) University of Massachusetts, Amherst(马萨诸塞大学阿默斯特分校)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.LG

AI总结 研究智能体技能优化问题,提出LASKO框架,将技能建模为李代数胚截面,利用李括号筛选测试替代昂贵验证,在自然语言任务因果提取中实现近15倍加速,提升技能优化速度。

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09336 2026-07-13 cs.LG cs.AI cs.RO 新提交 81%

Shortcut Trajectory Planning for Efficient Offline Reinforcement Learning

用于高效离线强化学习的捷径轨迹规划

Guanquan Wang, Yoshimasa Tsuruoka

机构 * The University of Tokyo(东京大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 研究针对离线强化学习中轨迹规划器的问题,提出捷径轨迹规划(STP)框架,将捷径模型作为轨迹生成器,单阶段训练条件捷径轨迹模型,支持可调推理,用增强可行性感知校正的评论家选候选计划,在多任务基准测试中性能强且简化训练管道。

Comments 16 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08400 2026-07-10 cs.CR cs.AI cs.LG 新提交 81%

TRACE: A Two-Channel Robust Attribution Watermark via Complementary Embeddings for LLM-Agent Trajectories

TRACE:一种通过互补嵌入实现的用于大语言模型智能体轨迹的双通道鲁棒归属水印

Zheng Gao, Xiaoyu Li, Xiaoyan Feng, Jiaojiao Jiang, Yang Song, Yulei Sui, Zhenchang Xing, Liming Zhu

机构 * University of New South Wales(新南威尔士大学) Griffith University(格里菲斯大学) CSIRO’s Data61(澳大利亚联邦科学与工业研究组织(CSIRO)的数据61)

专题命中 规划决策 :agent(title,abstract);分类 cs.AI、cs.LG

AI总结 研究针对大语言模型智能体轨迹归属水印易被经销商攻击的问题,提出TRACE方法,通过互补嵌入构建双通道水印,包括基于局部内容的选择通道和基于日志框架的计数通道,实验表明该方法能保证水印鲁棒性,保持智能体成功率且检测分数高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08024 2026-07-10 cs.CV cs.AI cs.LG cs.RO 新提交 81%

APIVOT: Adaptive Planning with Interleaved Vision-Language Thoughts

APIVOT:具有交错视觉语言思维的自适应规划

Emily Jin, Joy Hsu, Yiqing Xu, Weiyu Liu, Nick Haber, Jiajun Wu

机构 * Stanford University(斯坦福大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 研究长期机器人规划问题,提出基于VLM的APIVOT规划器,通过自适应交错语言和视觉思维,利用语言语义推理、视觉思维验证几何可行性,在长期厨房任务中表现出色,提升了规划成功率和推理效率。

Comments Project Page: https://emilyzjin.github.io/projects/apivot.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07844 2026-07-10 cs.RO cs.AI cs.LG 新提交 81%

Shift & Drift: A Zero-Shot Benchmark for Generalizable and Robust Autonomous Driving Motion Planning

Shift & Drift:用于可泛化且稳健的自动驾驶运动规划的零样本基准测试

Alessandro Canevaro, Hang Yu, Julian Schmidt, Peizheng Li, Silvan Lindner, Wilhelm Stork, Georg Martius, Julian Jordan

机构 * Mercedes-Benz AG, Research & Development(梅赛德斯-奔驰股份公司,研发部) University of Tübingen(图宾根大学) Karlsruhe Institute of Technology, ITIV(卡尔斯鲁厄理工学院,ITIV)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 研究自动驾驶运动规划器在新城市拓扑泛化及执行扰动恢复方面的不足,提出Shift & Drift双轨基准测试,通过语义转移和状态分布漂移测试不同规划范式,发现模仿学习与强化学习在性能上的差异,为评估可靠部署提供基准。

Comments Accepted at 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07508 2026-07-09 cs.LG cs.AI 新提交 81%

Single-Rollout Asynchronous Optimization for Agentic Reinforcement Learning

用于智能强化学习的单步异步优化

Zhenyu Hou, Yujiang Li, Jie Tang, Yuxiao Dong

机构 * Tsinghua University(清华大学)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.LG

AI总结 研究针对异步强化学习中训练稳定性和离策略挑战,提出单步异步优化(SAO)。核心方法是用单步采样取代分组采样,改进单步策略并引入裁剪策略。主要贡献是SAO训练稳定,性能优于GRPO及其变体,在模拟在线学习中有效且成功部署于模型训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01421 2026-07-03 cs.SE cs.AI 新提交 81%

Risk Architecture for AI-Native Engineering Teams: An Organizational Framework for Agentic System Governance

AI原生工程团队的风险架构:智能体系统治理的组织框架

Laxmipriya Ganesh Iyer

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.SE

AI总结 针对AI原生团队违反传统软件工程假设的问题,提出七维团队画像、六类故障模式(含依赖边界确定性失配)和框架充分性评估方法,发现风险覆盖随AI原生程度单调下降,最严重故障出现在组织边界。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31106 2026-07-01 cs.RO cs.AI cs.LG 新提交 81%

What Probing Reveals about Autonomous Driving: Linking Internal Prediction Errors to Ego Planning

探测揭示自动驾驶:内部预测误差与自我规划的关联

Hyeonchang Jeon, Kyungbeom Kim, Eugene Vinitsky, Kyung-Joong Kim

机构 * Gwangju Institute of Science and Technology (GIST)(光州科学技术院) New York University(纽约大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 通过线性探测和因果干预,研究自动驾驶策略在碰撞事件中缺乏及时预测能力,导致规划缺陷,并证明纠正预测可提升安全性。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27766 2026-06-29 cs.LG cs.AI cs.RO 新提交 81%

RS-Diffuser: Risk-Sensitive Diffusion Planning with Distributional Value Guidance

RS-Diffuser: 基于分布价值引导的风险敏感扩散规划

Shiqiang Gong

机构 * Northwestern Polytechnical University(西北工业大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 提出RS-Diffuser,一种结合扩散轨迹生成与分布价值评论家的风险敏感离线规划框架,通过尾部感知目标引导去噪过程,实现灵活的风险偏好行为,在风险敏感D4RL和机器人导航基准上达到最优性能。

Comments ICIC 2026 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07512 2026-06-25 cs.CV cs.AI cs.CL 新提交 81%

MemDreamer: Decoupling Perception and Reasoning for Long Video Understanding via Hierarchical Graph Memory and Agentic Retrieval Mechanism

MemDreamer: 通过分层图记忆和智能体检索机制解耦感知与推理以实现长视频理解

Cong Chen, Guo Gan, Kaixiang Ji, ZhaoYang Zhang, Zhen Yang, Guangming Yao, Hao Chen, Jingdong Chen, Yi Yuan, Chunhua Shen

机构 * Ant Group(蚂蚁集团) Zhejiang University(浙江大学) Central South University(中南大学) HKUST(GZ)(香港科技大学(广州))

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.CL

AI总结 提出MemDreamer框架,通过分层图记忆和智能体检索机制解耦感知与推理,将长视频理解转化为智能体探索过程,在四个基准上达到SOTA,推理上下文窗口仅占全量2%且准确率提升12.5点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22681 2026-06-23 cs.CL cs.AI 新提交 81%

Only Ask What You Don't Know: Grounded Delta Planning for Efficient Multi-step RAG

只问你不知道的:基于接地增量规划的高效多步RAG

Wei-Chieh Chou, Xuanjun Chen, Jian-Ren Lin, Claire Lin, Hung-yi Lee, Jyh-Shing Roger Jang

机构 * Dept. of Computer Science and Information Engineering, National Taiwan University(国立台湾大学资讯工程学系) Graduate Institute of Communication Engineering, National Taiwan University(国立台湾大学电信工程学研究所) Department of Economics, National Taiwan University(国立台湾大学经济学系) Department of Information Management, National Taiwan University(国立台湾大学资讯管理学系) NTU Artificial Intelligence Center of Research Excellence (NTU AI-CoRE)(国立台湾大学人工智能卓越研究中心)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.CL

AI总结 提出GDP-RAG框架,通过初步检索、缺口条件规划和骨架轨迹,仅针对信息增量进行推理,在HotpotQA等数据集上以最低成本实现最高准确率。

Comments Submitted to COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21775 2026-06-23 cs.LG cs.AI 新提交 81%

Beyond the Next Step: Variable-Length Latent World Models for Long-Horizon Planning

超越下一步:用于长时程规划的变长潜世界模型

Tianqi Du, Qi Zhang, Yifei Wang, Yisen Wang

机构 * State Key Lab of General Artificial Intelligence, School of Intelligence Science and Technology, Peking University(北京大学智能科学与技术学院通用人工智能国家重点实验室) Amazon AGI SF Lab(亚马逊AGI旧金山实验室) Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 提出变长潜世界模型(VLWM),通过学习变长动作序列的条件潜状态预测,解决递归一步预测在长时程规划中的累积误差问题,结合课程训练策略,在长时程控制任务上平均提升13%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20658 2026-06-23 cs.AI cs.LG 新提交 81%

Expected Free Energy-based Planning as Variational Inference

基于期望自由能的规划作为变分推理

Wouter W. L. Nuijten, Thijs van de Laar, Bert de Vries

机构 * Eindhoven University of Technology(埃因霍温理工大学) Lazy Dynamics B.V.

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 将基于期望自由能的规划重新表述为变分自由能最小化,通过引入认知先验实现信息寻求行为,并在三个复杂递增的环境中验证了方法的有效性和可扩展性。

Journal ref Transactions on Machine Learning Research, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19328 2026-06-23 cs.LG cs.AI cs.RO 新提交 81%

UBP2: Uncertainty-Balanced Preference Planning for Efficient Preference-based Reinforcement Learning

UBP2: 不确定性平衡的偏好规划用于高效基于偏好的强化学习

Mohamed Nabail, Leo Kaixuan Cheng, Jingmin Wang, Nicholas Rhinehart

机构 * Learning, Embodied Autonomy, and Forecasting (LEAF) Lab, University of Toronto(学习、具身自主与预测(LEAF)实验室,多伦多大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 提出UBP2方法,通过联合推理奖励、动力学和值函数的不确定性来主动引导探索,在Meta-World基准上显著提高了样本效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14418 2026-06-15 cs.AI cs.LG cs.RO 新提交 81%

Causal Object-Centric Models for Planning with Monte Carlo Tree Search

用于蒙特卡洛树搜索规划的因果对象中心模型

Rodion Vakhitov, Leonid Ugadiarov, Alexey Skrynnik, Aleksandr Panov

机构 * MIRAI CogAILab

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 提出COMET算法,结合无监督对象中心编码器和Transformer世界模型,通过动作-槽融合机制和对象因果注意力实现高效规划,在多个基准上优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13683 2026-06-15 cs.AI cs.CL 新提交 81%

UP-NRPA: User Portrait based Nested Rollout Policy Adaptation for Planning with Large Language Models in Goal-oriented Dialogue Systems

UP-NRPA:基于用户画像的嵌套 rollout 策略自适应,用于目标导向对话系统中与大语言模型的规划

Hui Wang, Fafa Zhang, Meng Liu, Xiangyu Chen, Chaoxu Mu

机构 * School of Artificial Intelligence, Anhui University(安徽大学人工智能学院) Anhui Provincial Key Laboratory of Security Artificial Intelligence, Anhui University(安徽大学安徽省安全人工智能重点实验室) Pengcheng Laboratory(鹏城实验室)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.CL

AI总结 提出 UP-NRPA 在线框架,利用大语言模型和用户画像实时自适应调整对话策略,无需离线强化学习,在协作与非协作对话基准中实现 100% 任务成功率,谈判任务销售列表比提升 56.41%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08919 2026-06-09 cs.AI cs.CR cs.LG 新提交 81%

Oversight Has a Capacity: Calibrating Agent Guards to a Subjective, Fatiguing Human

监督具有容量:将智能体守卫校准到主观且易疲劳的人类

Emre Turan

专题命中 规划决策 :agent(title,abstract);分类 cs.AI、cs.LG

AI总结 针对LLM智能体动作审批中人类评审者主观且易疲劳的问题,提出将守卫建模为成本敏感的选择性分类,并引入负载感知策略,发现过度监督反而降低安全性,形成倒U型曲线。

Comments 12 pages, 4 figures. Code and interactive demo: https://github.com/turangenesis/headroom

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08360 2026-06-09 cs.LG cs.AI 新提交 81%

Generative Frontier Planning for Adaptive Peer-Referral Recruitment under Covariate-Dependent Arrivals

协变量依赖到达下的自适应同伴推荐招募的生成前沿规划

Lingkai Kong, Hezi Jiang, Andrew Ma, Keyu Wang, Akseli Kangaslahti, Milind Tambe

机构 * Harvard University(哈佛大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 针对同伴推荐招募中协变量依赖到达的现实问题,提出生成前沿规划(GFP),通过确定性备份和边际贪心分配实现高效规划,在模拟实验中优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07603 2026-06-09 cs.LG cs.AI 新提交 81%

MetaEvo: A Meta-Optimization Framework for Experience-Driven Agent Evolution

MetaEvo:一种基于经验驱动的智能体进化的元优化框架

Bowen Ren, Heyan Huang, Yinghao Li, Yang Gao

机构 * School of Computer Science and Technology, Beijing Institute of Technology(北京理工大学计算机科学与技术学院) Beijing Institute of Technology Southeast Academy of Information Technology(北京理工大学东南信息技术研究院)

专题命中 规划决策 :agent(title,abstract);分类 cs.AI、cs.LG

AI总结 提出MetaEvo两阶段框架,通过偏好优化增强模型从任务经验中抽象原则的能力,并在模块化架构中积累复用,持续提升推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06823 2026-06-08 cs.LG cs.AI q-fin.ST 新提交 81%

PandaAI: A Practical Agent CQ2 for Neuro-symbolic Data Analysis And Integrated Decision-Making in Quantitative Finance

PandaAI: 一种用于量化金融中神经符号数据分析与集成决策的实用智能体CQ2

Yuqi Li, Siyuan Liu, Bingjun Liu

机构 * Panda AI

专题命中 规划决策 :agent(title,abstract);分类 cs.AI、cs.LG

AI总结 针对金融数据低信噪比和非平稳性,提出PandaAI,一种结合市场状态建模与约束alpha生成的闭环神经符号LLM智能体,通过领域微调和模块化架构实现风险感知决策,在沪深300数据上Rank IC提升18.2%,最大回撤降低25.7%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06618 2026-06-08 cs.RO cs.AI cs.LG 新提交 81%

ChronoForest: Closed-Loop Multi-Tree Diffusion Planning for Efficient Bridge Search and Route Composition

ChronoForest: 用于高效桥接搜索和路线组合的闭环多树扩散规划

Jungmin Seo, Jaesik Park

机构 * Seoul National University(首尔国立大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 针对仅依赖短程离线轨迹进行长程路线规划的问题,提出ChronoForest系统,通过锚链树扩散规划器和在线多树协调器实现局部桥接搜索与全局路线重解,在OGBench和哈密顿路线组合基准上显著提升成功率和效率。

Comments 40 pages, 4 figures, 7 tables, 3 algorithms

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06381 2026-08-10 cs.HC cs.AI cs.MA 新提交 80%

Evaluating XAI Support From A Hierarchical Reinforcement Learning Policy in Human-Agent Collaboration

评估人机协作中分层强化学习策略的可解释人工智能(XAI)支持

Mateus Levi Simões Fernandes, Alberto Sardinha

专题命中 规划决策 :agent(title,abstract);分类 cs.AI;autonomous agent(journal_ref)

AI总结 本文首次在Overcooked-AI基准中,对分层特设智能体(HA²)架构生成的文本/音频实时解释开展被试间实验,分析XAI对人机协作的影响,为评估可解释强化学习架构建立基线方法。

Comments 13 pages, 6 figures, accepted as an Extended Abstract at AAMAS 2026

Journal ref Proc. of the 25th International Conference on Autonomous Agents and Multiagent Systems. 2026. p. 3259-3261

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11197 2026-07-14 cs.AI 新提交 80%

What We Talk About When We Talk About LLM Planning: Evidence for Two Distinct Planning Abilities

当我们谈论大语言模型规划时我们在谈论什么:两种不同规划能力的证据

Sukai Huang, Chenyuan Zhang, Fucai Ke, Zhixi Cai, Naim Rastgoo, Gholamreza Haffari, Hamid Rezatofighi

机构 * Faculty of Information Technology, Monash University(莫纳什大学信息技术学院)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 研究大语言模型规划任务性能差异原因,通过在ACPBench-Hard上评估多个模型家族,应用多维项目反应理论模型,发现操作推理和结构枚举两个塑造规划性能的维度,推动大语言模型规划的能力层面评估。

Comments 19 pages. Keywords: Reasoning, Automated Planning, Item Responses Theory, LLMs as Planner Research Area: NLP and Symbolic Reasoning Research Area Keywords: neurosymbolic, planning in agents, symbolic reasoning Contribution Types: Model analysis & interpretability

详情

展开后加载摘要…

URL PDF HTML 收藏