arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-04 至 2026-08-04 共收录 388 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 112 篇

2608.00320 2026-08-04 cs.LG cs.MA cs.SY eess.SY 新提交 79%

Neural operator learning for collision-aware trajectory planning of spacecraft swarms

面向航天器集群碰撞感知轨迹规划的神经算子学习

Sidhdharth D. Sikka, Suyi Gao, Zehui Lu, Rongjie Lai, Shaoshuai Mou

机构 * Purdue University(普渡大学) Manifold Research Group(流形研究组)

专题命中 规划决策 :planning(title);agent(abstract);分类 cs.LG

AI总结 该研究提出排列等变神经算子,结合自监督物理目标与对抗威胁训练,实现航天器集群轨迹规划,可零样本泛化到大规模集群,精度接近最优控制求解器,性能优于无碎片感知基线。

Comments 27 pages, 6 figures, 6 tables. Submitted to Nature Machine Intelligence. Video abstract included as ancillary file

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00003 2026-08-04 cs.AI 新提交 79%

AutoFOAM: The Self-Refining Autonomous OpenFOAM Agent

AutoFOAM:自优化自主OpenFOAM智能体

Arun Govind Neelan, A Seshaditya

机构 * SimuNetics Onnes Cryogenics Quasi AI

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 AutoFOAM是基于Qwen-coder 2.5-14B微调的自主LLM智能体,通过7阶段迭代循环及三种抗退化机制,可基于自然语言指令完成OpenFOAM模拟,助力CFD工作流程普及与快速原型开发。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03270 2026-08-04 cs.RO cs.AI 版本更新 79%

Grounded Vision-Language Interpreter for Long-Horizon Bimanual Task and Motion Planning

用于长 horizon 双臂任务与运动规划的接地视觉语言解释器

Jeremy Siburian, Keisuke Shirai, Cristian C. Beltran-Hernandez, Masashi Hamaya, Michael Görner, Atsushi Hashimoto

机构 * OMRON SINIC X Corporation(OMRON SINIC X公司) The University of Tokyo(东京大学) University of Hamburg(汉堡大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 针对现有视觉语言机器人规划框架的黑箱缺陷与双臂任务探索不足问题,提出混合规划框架 ViLaIn-TAMP,经烹饪领域任务及实际双臂机器人系统验证,其性能优于基准方法。

Comments IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01201 2026-08-04 cs.RO cs.CV 新提交 78%

PRISM: Privileged Probabilistic Latent Supervision for End-to-End Autonomous Driving Motion Planning

PRISM:面向端到端自动驾驶运动规划的特权概率潜在监督

Volodymyr Havrylov, Faris Janjoš, Andreas Look, Jürgen Mathes, Andreas Geiger

机构 * University of Tübingen(蒂宾根大学) Bosch Center for Artificial Intelligence(博世人工智能中心) Coburg University(科堡大学) Tübingen AI Center(蒂宾根人工智能中心)

专题命中 规划决策 :planning(title,abstract)

AI总结 该研究针对端到端自动驾驶模型梯度微弱问题,提出基于真实值的概率潜在监督框架,在 nuScenes 数据集上实现规划 L2 误差降 8%、碰撞率降 3%,且计算开销可忽略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01172 2026-08-04 cs.RO 新提交 78%

Complete Motion Planning using Workspace-Fibered Decomposition for nR-Planar Manipulator

面向nR平面机械手的基于工作空间纤维分解的完整运动规划

Aayush Rath, Antony Thomas

机构 * Robotics Research Center, IIIT Hyderabad(IIIT海得拉巴机器人研究中心)

专题命中 规划决策 :planning(title,abstract)

AI总结 针对杂乱环境中nR平面冗余机械手的运动规划问题,提出工作空间纤维分解框架,通过递归提升低维子链可达工作空间简化规划,实验显示其可保留无碰撞连通性并降低碰撞检测复杂度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00822 2026-08-04 cs.RO 新提交 78%

RIT*: Riemannian Informed Trees for Cost-Adaptive Optimal Motion Planning

RIT*:适用于成本自适应最优运动规划的黎曼知情树

Muhayy Ud Din, Ahmed Nadar, Jan Rosell, Irfan Hussain

机构 * Center for Autonomous Robotic Systems, Khalifa University(哈利法大学自主机器人系统中心) Institute of Industrial and Control Engineering, Universitat Politècnica de Catalunya(加泰罗尼亚理工大学工业与控制工程研究所)

专题命中 规划决策 :planning(title,abstract)

AI总结 该研究提出RIT*规划框架,以黎曼原语替代批量知情搜索的欧几里得原语,结合CARM优化度量,在高维各向异性运动规划中显著降低成本,性能优于BIT*等基准方法。

Comments Accepted in Robotics and Automation Letters

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00613 2026-08-04 cs.RO 新提交 78%

From Failures to Supervision: DynamicEnvPlan for Robust Long-Horizon Embodied Planning

从失败到监督:用于鲁棒长视距具身规划的DynamicEnvPlan

Hao Yuan, Yuxin Wang, Lei Ji, Zhiwei Yu

机构 * University of Chinese Academy of Sciences(中国科学院大学) Beijing Academy of Artificial Intelligence (BAAI)(北京人工智能研究院)

专题命中 规划决策 :planning(title,abstract)

AI总结 该研究提出DynamicEnvPlan闭环框架,通过规划、扰动与防护校正模块生成恢复轨迹并分阶段微调,在104个任务-场景组合上使具身规划成功率从33.3%升至76.2%,提升了物理世界交互的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00455 2026-08-04 cs.DC 新提交 78%

AReaL-DTE: Sparse Policy-Weight Transfer for Online Agentic Reinforcement Learning

AReaL-DTE:面向在线智能体强化学习的稀疏权重迁移技术

Yingqi Peng, Jiawei Zhang, Wenhao Zhou, Ruida Xu, Ran Yan, Wei Dong, Yi Gao, Zhiqiang Ding, Tongkai Yang, Binhang Yuan

专题命中 规划决策 :agentic(title,abstract)

AI总结 本研究提出面向在线智能体强化学习的 AReaL-DTE,通过无快照增量传输引擎实现稀疏权重迁移,在跨集群及集群内场景下大幅提升速度并降低内存占用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00206 2026-08-04 cs.RO cs.SY eess.SY 新提交 78%

Motion Planning for Mobile Manipulators Navigating Doorways via Model Predictive Control

基于模型预测控制的移动机械臂 doorway 运动规划

Kasra Sinaei, Kasun Weerakoon, Christopher Bradley, Seyed Abolfazl Fakoorian, Donald Ebeigbe

机构 * The Pennsylvania State University(宾夕法尼亚州立大学) AlphaZ Inc.(AlphaZ公司)

专题命中 规划决策 :planning(title,abstract)

AI总结 针对移动机械臂在人类环境中穿越 doorway 的需求,提出基于非线性 MPC 的耦合系统运动规划框架,经仿真与硬件实验验证可生成无碰撞的 door 穿越轨迹。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10795 2026-08-04 eess.SY cs.SY 版本更新 78%

Optimization Under Uncertainty for Energy Infrastructure Planning: A Synthesis of Methods, Tools, and Open Challenges

在不确定性下优化能源基础设施规划:方法、工具和开放挑战的综合研究

Rahman Khorramfar, Aron Brenner, Lara Booth, Ana Rivera, Ruaridh Macdonald, Priya Donti, Saurabh Amin

专题命中 规划决策 :planning(title,abstract)

AI总结 本文综述了生成与传输扩展及不确定性优化的最新进展,探讨了不确定性建模需求,并分析了优化与机器学习的新兴方向,揭示了能源基础设施规划中的研究空白。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12244 2026-08-04 cs.RO 版本更新 78%

Any House Any Task: Scalable Long-Horizon Planning for Abstract Human Tasks

任何房屋任何任务:为抽象人类任务的可扩展长周期规划

Zhihong Liu, Yang Li, Rengming Huang, Cewu Lu, Panpan Cai

专题命中 规划决策 :planning(title,abstract)

AI总结 AHAT是一种优化长周期规划的家庭任务规划器,通过结合LLM和TGPO算法,在复杂家庭任务中实现高效规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03011 2026-08-04 cs.RO 版本更新 78%

3D-CovDiffusion: 3D-Aware Diffusion Policy for Coverage Path Planning

3D-CovDiffusion:面向覆盖路径规划的三维感知扩散策略

Chenyuan Chen, Haoran Ding, Ran Ding, Tianyu Liu, Zewen He, Anqing Duan, Yoshihiko Nakamura

机构 * IEEE

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出 3D-CovDiffusion,将覆盖路径规划转化为条件序列生成问题,采用几何条件扩散框架从三维点云合成轨迹,相比基线方法在轨迹平滑度、覆盖率等指标上实现显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07376 2026-08-04 eess.SY cs.SY 78%

A Multi-Model Probabilistic Framework for Seismic Risk Assessment and Retrofit Planning of Electric Power Networks

Huangbin Liang, Beatriz Moya, Francisco Chinesta, Eleni Chatzi

专题命中 规划决策 :planning(title,abstract)

Comments 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08876 2026-08-04 cs.LG 版本更新 77%

OTora: A Unified Red Teaming Framework for Reasoning-Level Denial-of-Service in LLM Agents

OTora:一种用于LLM代理推理层面拒绝服务攻击的统一红队框架

Xinyu Li, Ronghui Mu, Lin Li, Tianjin Huang, Gaojie Jin

机构 * Department of Computer Science, University of Exeter(埃克塞特大学计算机科学系) Department of Computer Science, University of Oxford(牛津大学计算机科学系) Department of Mathematics and Computer Science, Eindhoven University of Technology(埃因霍温理工大学数学与计算机科学系)

专题命中 规划决策 :agent(abstract);autonomous agent(abstract);tool-use(abstract);分类 cs.LG

AI总结 OTora是首个统一的两阶段红队框架,用于实现推理层面拒绝服务攻击,通过优化对抗触发器和生成代理感知的推理负载,提升推理token数量和延迟,同时保持任务准确性。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01837 2026-08-04 cs.AI 新提交 74%

PCSD: Persistent Consistency for Self-Distillation in Agentic Reinforcement Learning

PCSD:智能体强化学习中自蒸馏的持久一致性

Chunji Lv, Yangguang Wei, Junlin Liu, Yang Gao, Ming Liu, Xinming Wang, Jinyang Wu, Guoren Wang, Changsheng Li

专题命中 规划决策 :agentic(title);分类 cs.AI

AI总结 该研究针对智能体强化学习中奖励稀疏问题,提出PCSD方法,通过持久一致性推导蒸馏权重,结合GRPO优化,在ALFWorld等基准上取得优于GRPO、SDAR的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24341 2026-08-04 cs.AI 版本更新 74%

Simulating Tenant Responses to Energy Policy Interventions with Transaction-Cost-Aware LLM Agent

使用具有交易成本意识的大语言模型模拟租户对能源政策干预的反应

Weijie Xia, Stefanie Horian, Hanyue Huang, Queena K. Qian, Jie Yang, Pedro P. Vergara

机构 * Mistral AI(米斯特拉尔人工智能公司) Ollama(奥拉马)

专题命中 规划决策 :agent(title);分类 cs.AI

AI总结 研究利用感知交易成本,开发摩擦感知角色建模方法,以模拟租户对能源政策干预的反应。通过荷兰公民调查数据,比较不同模型和设置,发现纳入该方法能提升模型性能,为政策理论与LLM政策模拟搭建桥梁。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27814 2026-08-04 cs.AI 版本更新 74%

ATOD: Annealed Turn-Aware On-Policy Distillation for Multi-Turn Agentic Tasks

ATOD: 面向多轮自主智能体的退火轮次感知在线策略蒸馏

Qitai Tan, Zefang Zong, Mo Li, Yipeng Shi, Yang Li, Peng Chen

机构 * Tencent Inc.(腾讯公司) Tsinghua University(清华大学)

专题命中 规划决策 :agentic(title);分类 cs.AI

AI总结 提出ATOD混合在线蒸馏算法,通过退火式OPD-RL调度和轮次级重加权,解决长程交互任务中OPD性能天花板和RL早期低效问题,在三个基准上超越教师模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02402 2026-08-04 cs.LG cs.AI 新提交 73%

From fragmented data to actionable design: Physics-calibrated learning for plastic upcycling

从碎片化数据到可操作的设计:用于塑料升级再造的物理校准学习

Jingyang Bai, Zijia Wang, Xiangyi Long, Marcos Millan, Binjian Nie, Mingyue Ding

专题命中 规划决策 :planning(abstract);workflow(abstract);分类 cs.AI、cs.LG

AI总结 本研究开发PC-MG-MoE框架,将塑料升级再造的碎片化实验数据转化为可操作指导,在严格验证下误差最低,可支持跨实验室异质性下的工程筛选与实验规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.13084 2026-08-04 cs.LG cs.AI 版本更新 73%

Belief-Contraction-Driven Active Inverse Source Localization and Characterization

基于信念收缩的主动逆源定位与表征

Yiwei Shi, Mengyue Yang, Qi Zhang, Cunjia Liu, Weinan Zhang, Weiru Liu

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.AI、cs.LG

AI总结 该研究针对动态场主动逆源定位与表征问题,提出信念收缩驱动的ATT-PFRL方法,统一推断、停止与控制,在多场景下较基线方法实现更高完成度、更快收敛与更准定位。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00792 2026-08-04 cs.RO 新提交 71%

StochSIPP: Safe Interval Path Planning in Stochastic Dynamic Environments

StochSIPP:随机动态环境下的安全区间路径规划

Ajith Kemisetti, Shahaf S. Shperberg, Yoonchang Sung

专题命中 规划决策 :planning(title)

AI总结 StochSIPP是针对带不确定边/顶点状态的时间路网的精确条件规划器,通过SIPP与有界AND/OR搜索实现安全导航,可缩短到达时间并解决保守规划器无法处理的门控场景。

Comments 16 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01937 2026-08-04 cs.AI cs.CY 新提交 70%

A Contractualist Argumentation Framework for Moral Decision-Making

用于道德决策的契约论论证框架

Luis Marcos-Vidal, Giulio Antonio Abbo, Tony Belpaeme

机构 * Hospital del Mar Research Institute(德尔马医院研究所) Ghent University(根特大学) imec(imec研究院)

专题命中 规划决策 :agent(abstract);autonomous agent(abstract);分类 cs.AI

AI总结 该研究针对自主智能体在共享环境中需处理冲突利益的道德决策问题,提出基于Scanlon契约论的、扩展了价值过滤的ASPIC+契约论论证框架,经实例验证其有效性并探讨了与现有方法的关联。

Comments 9 pages; to appear in the proceedings of the Fourth International Workshop on Value Engineering in AI (VALE 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01456 2026-08-04 cs.CV cs.CL 新提交 70%

Long-Horizon Embodied Decision-Making via Multimodal Memory Compression

基于多模态记忆压缩的长视野具身决策

Bingxuan Li, Rui Yang, Cheng Qian, Jiateng Liu, Jeonghwan Kim, Zhenhailong Wang, Manling Li, Tong Zhang, Heng Ji

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Northwestern University(西北大学)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.CL

AI总结 该研究提出DunphyBench基准用于评估长视野具身决策,发现当前智能体与人类表现存在差距,设计了MeMento记忆压缩器,使VLM驱动智能体准确率提升7.18%且内存使用降低85.38%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00215 2026-08-04 cs.AI 新提交 70%

Personalizing Large Language Model Agents with Small Policy Models

用小型策略模型个性化大型语言模型智能体

Dian Jin, Zhi Zhang, Huichao Li, Yihe Pan, Rundong Huang, Doudou Zhou

专题命中 规划决策 :agent(abstract);tool-use(abstract);分类 cs.AI

AI总结 本研究提出轻量级策略层FABLE,通过在线学习用户执行策略实现LLM智能体个性化,在多类评估中改进偏好敏感行为且保持端到端任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18183 2026-08-04 cs.LG cs.GT 版本更新 70%

NashPG: A Policy Gradient Method with Iteratively Refined Regularization for Finding Nash Equilibria

NashPG: 一种通过迭代细化正则化寻找纳什均衡的策略梯度方法

Eason Yu, Tzu Hao Liu, Clément L. Canonne, Yunke Wang, Chang Xu, Nguyen H. Tran, Stefano V. Albrecht

机构 * University of Sydney(悉尼大学) Nanyang Technological University(南洋理工大学)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 本文提出NashPG算法,通过在策略优化目标中直接引入正则化,解决了多智能体强化学习中两玩家零和不完全信息游戏寻找纳什均衡的挑战,实现了在经典基准游戏和大型领域中的高效收敛与高收益。

Comments Transactions on Machine Learning Research (TMLR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01964 2026-08-04 cs.CV 新提交 67%

LongHorizon-Harness: Advancing Long-Horizon Agents for Real-World Tasks

LongHorizon-Harness:推进面向真实世界任务的长时程智能体

Ziyu Ma, Hailang Huang, Shun Zou, Yong Wang, Shidong Yang, Yiming Hu, Fei Wei, XiangXiang Chu

机构 * Alibaba Group(阿里巴巴集团)

专题命中 规划决策 :agent(abstract);tool use(abstract)

AI总结 本研究提出LongHorizon-Harness框架,通过MEA循环等设计解决长时程智能体的状态追踪与错误传播问题,在多个基准测试中显著提升了Qwen、Claude等模型的表现。

Comments 29 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00779 2026-08-04 cs.RO 新提交 67%

SIPTraj: Map-Free End-to-End Trajectory Prediction via Physics-Guided Scene Interaction

SIPTraj:无高精地图的物理引导场景交互端到端轨迹预测

Feifei Liu, Zejun Wei, Haozhe Wang, Yazhi Ye, Yuying Zhang, Jintao Cheng, Chi Man Vong, Xieyuanli Chen, Xiaoyu Tang

机构 * School of Data Science and Engineering, Xingzhi College, South China Normal University(华南师范大学行知学院数据科学与工程学院) Hong Kong University of Science and Technology(香港科技大学) University of Macau(澳门大学) College of Intelligence Science and Technology, National University of Defense Technology(国防科技大学智能科学学院) School of Electronic Science and Engineering, South China Normal University(华南师范大学电子科学与工程学院)

专题命中 规划决策 :agent(abstract);planning(abstract)

AI总结 SIPTraj是一种无高精地图的端到端轨迹预测框架,通过分层智能体-场景编码器和物理引导迭代解码器解决场景锚定与物理可行性问题,在两个数据集上性能优于现有方法,推理无需高精地图。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00583 2026-08-04 cs.CR cs.AI cs.CL cs.LG 新提交 67%

A False Average: Chain-of-Thought Monitors Collapse Where They Are the Only Defense

虚假的平均值:思维链监控在其作为唯一防御的地方失效

Shikhar Shiromani, Leo Richter

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 该研究指出思维链监控在作为唯一防御时会失效,攻击者通过重写智能体推理可大幅降低监控捕获率,攻击可跨模型迁移,仅轨迹防御难恢复,需外部信息辅助。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00533 2026-08-04 cs.CL cs.AI cs.LG 新提交 67%

Native Multilingual Chain-of-Thought Reasoning in Low-Resource Southeast Asian Languages

低资源东南亚语言中的原生多语言思维链推理

Sean Gip Lim, William Chandra Tjhi, Hai Leong Chieu

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 针对低资源东南亚语言大模型推理的跨语言崩溃与微调瓶颈,提出OSCD算法,结合翻译智能体循环与联合嵌入语义对齐,在AIME25等基准上实现数学推理的显著提升。

Comments 22 pages, 16 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00133 2026-08-04 eess.SY cs.SY 新提交 67%

Deep Reinforcement Learning: From First Principles to Reasoning Models

深度强化学习:从第一性原理到推理模型

Ghoshana Bista

专题命中 规划决策 :agent(abstract);multi-agent(abstract)

AI总结 本书介绍深度强化学习从经典方法到各类算法及多领域应用的演进,融合基础与研究视角,面向具备相关基础的学生、研究者和工程师。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00181 2026-08-04 cs.SE cs.AI 新提交 66%

Cross-Benchmark Generalization in Long-Horizon Agents

长视野智能体的跨基准泛化

Sushant Mehta, Logan Ritchie, Liudas Panavas, Edwin Chen

专题命中 规划决策 :agent(abstract,comments);分类 cs.AI、cs.SE

AI总结 本研究针对长视野智能体,通过两阶段SFT-再-RL流程后训练Qwen3.5-122B-A10B模型,在5项外部基准实现性能提升,证明长视野多工具后训练的工作方式可跨领域迁移。

Comments Accepted at the COLM 2026 Workshop on Agent Behavior. 11 pages, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏