arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-02 至 2026-07-02 共收录 162 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 14 篇

2607.00245 2026-07-02 q-fin.GN 新提交 89%

Agent-to-Agent Finance: Blockchain Payments and Trust Infrastructure for Autonomous AI Agents

代理间金融:面向自主AI代理的区块链支付与信任基础设施

Hui Gong

专题命中 工具调用 :agent(title,abstract);AI agent(title,abstract);autonomous agent(abstract)

AI总结 本文提出代理间金融概念,利用区块链可编程结算、智能钱包、去中心化注册表和可验证计算解决自主AI代理在身份、授权、支付、验证、声誉和问责方面的协调摩擦,强调有限自主权设计。

Comments 22 pages, 3 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17406 2026-07-02 cs.AI 版本更新 88%

EvoMaster: A Foundational Evolving Agent Framework for Agentic Science at Scale

EvoMaster:一种用于大规模代理科学的基础进化代理框架

Xinyu Zhu, Yuzhu Cai, Zexi Liu, Cheng Wang, Fengyang Li, Wenkai Jin, Wanxu Liu, Zehao Bing, Bingyang Zheng, Jingyi Chai, Shuo Tang, Rui Ye, Yuwen Du, Xianghe Pang, Yaxin Du, Tingjia Miao, Yuzhi Zhang, Ruoxue Liao, Zhaohan Ding, Linfeng Zhang, Yanfeng Wang, Weinan E, Siheng Chen

机构 * School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院) SciLand DP Technology(DP技术)

专题命中 工具调用 :agent(title,abstract);agentic(title,abstract);分类 cs.AI

AI总结 EvoMaster通过持续自我进化机制,使代理能迭代优化假设并积累知识,实现跨学科的高效科学发现,其易用性与性能在多个基准测试中均表现优异。

Comments 44 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01084 2026-07-02 cs.AI 新提交 83%

Can Agents Generalize to the Open World? Unveiling the Fragility of Static Training in Tool Use

智能体能否泛化到开放世界?揭示工具使用中静态训练的脆弱性

Song-Lin Lv, Weiming Wu, Rui Zhu, Zi-Jian Cheng, Lan-Zhe Guo

专题命中 工具调用 :tool use(title);agent(abstract);tool-use(abstract);分类 cs.AI

AI总结 针对LLM智能体在真实场景中因查询、工具集和交互动态变化而性能下降的问题,形式化定义了开放世界工具使用问题,构建了四层层次的环境偏移框架,并通过实验揭示了监督微调和强化学习训练智能体在面对开放环境偏移时的脆弱性,提出了扰动增强微调策略以提升鲁棒性。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00297 2026-07-02 cs.LG cs.CL 新提交 81%

EPC: A Standardized Protocol for Measuring Evaluator Preference Dynamics in LLM Agent Systems

EPC:一种用于测量LLM智能体系统中评估者偏好动态的标准协议

Zewen Liu

专题命中 工具调用 :agent(title,abstract);分类 cs.CL、cs.LG

AI总结 提出EPC协议,通过四阶段隔离范式标准化测量LLM智能体系统中评估者偏好耦合现象,并提供参考快照和版本约定以支持复现、比较和衰减检测。

Comments 10 pages, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11430 2026-07-02 cs.CR cs.AI cs.CY 版本更新 79%

Hardening x402: PII-Safe Agentic Payments via Pre-Execution Metadata Filtering

x402协议的强化:通过预执行元数据过滤实现隐私信息安全的代理支付

Vladimir Stantchev

机构 * SRH University Heidelberg(SRH海德堡大学) PRESIDIO Group(PRESIDIO集团)

专题命中 工具调用 :agentic(title);AI agent(abstract);分类 cs.AI

AI总结 本文提出presidio-hardened-x402,通过拦截x402支付请求检测并屏蔽个人身份信息,同时执行支出政策和阻止重复支付。实验表明其在精度和召回率上表现优异,且延迟符合预算要求。

Comments 2: corrected NLP-mode precision/recall after a recogniser fix that lifts the US_SSN and PHONE detection v1 understated, and revised the recommended threshold to min_score=0.5 (the curve is flat, not peaked). Section 5 tables, the threshold analysis, and Figures 1-2 are updated; headline micro-F1 = 0.898

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13148 2026-07-02 cs.AI 新提交 77%

TerraBench: Can Agents Reason Over Heterogeneous Earth-System Data?

TerraBench: 智能体能否对异构地球系统数据进行推理?

Dat Tien Nguyen, Thao Nguyen, Fadillah Adamsyah Maani, Huy M. Le, Muhammad Umer Sheikh, Numan Saeed, Muhammad Haris Khan, Salman Khan

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 工具调用 :tool-use(abstract);planning(abstract);agentic(abstract);分类 cs.AI

AI总结 提出TerraBench基准,基于TerraAgent框架,通过结合大语言模型规划与科学工具,实现跨网格数据、卫星图像、地理空间和模拟器的交互式推理,包含403个任务和24,500个执行步骤。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24636 2026-07-02 cs.CL 版本更新 74%

OpenReward: Learning to Reward Long-form Agentic Tasks via Reinforcement Learning

OpenReward: 通过强化学习学习奖励长形式智能体任务

Ziyou Hu, Zhengliang Shi, Minghang Zhu, Haitao Li, Teng Sun, Pengjie Ren, Suzan Verberne, Zhaochun Ren

机构 * Leiden University(莱顿大学) Shandong University(山东大学) Tsinghua University(清华大学)

专题命中 工具调用 :agentic(title);分类 cs.CL

AI总结 提出OpenRM,一种工具增强的长形式奖励模型,通过GRPO训练联合监督工具使用和结果准确性,在长形式任务中显著优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01063 2026-07-02 cs.SE 新提交 70%

AutoRestTest at the SBFT 2026 Tool Competition

AutoRestTest 在 SBFT 2026 工具竞赛中

Tyler Stennett, Myeongsoo Kim, Saurabh Sinha, Alessandro Orso

专题命中 工具调用 :agent(abstract);multi-agent(abstract);分类 cs.SE

AI总结 提出结合语义属性依赖图、多智能体强化学习和大型语言模型的AutoRestTest方法,在SBFT 2026 REST联赛中11个API上三项评估均获第一。

Comments 2 pages, 1 figure. Published in the 19th Search-Based and Fuzz Testing Workshop (SBFT '26), co-located with ICSE 2026

Journal ref Proceedings of the 19th Search-Based and Fuzz Testing Workshop (SBFT '26), April 12-18, 2026, Rio de Janeiro, Brazil. ACM, New York, NY, USA, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12887 2026-07-02 cs.IR cs.AI 版本更新 70%

EcoGEO: Trajectory-Aware Evidence Ecosystems for Web-Enabled LLM Search Agents

EcoGEO:基于轨迹的证据生态系统用于网络增强的大语言模型搜索代理

Hengwei Ye, Jiasheng Mao, Zhenhan Guan, Zheng Tian

机构 * ShanghaiTech University(上海科技大学)

专题命中 工具调用 :agent(abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出EcoGEO,一种基于轨迹的证据生态系统,用于研究网络增强的大语言模型搜索代理在多步骤浏览中的证据获取过程,通过协调导航页面与支持页面提升产品推荐性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00156 2026-07-02 cs.RO 新提交 67%

Dual-Informed Vertical Expansion for Multi-Objective Node Selection in Anytime Conflict-Based Search

双信息引导的垂直扩展用于任意时间冲突搜索中的多目标节点选择

Willem van Osselaer, Jiarui Li, Meshal Alharbi, Gioele Zardini

机构 * Massachusetts Institute of Technology(麻省理工学院)

专题命中 工具调用 :agent(abstract);multi-agent(abstract)

AI总结 提出DIVE策略,通过最佳边界搜索与深度优先搜索结合,在保持最优性的同时减少搜索中断、提供早期可行解并降低内存占用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13059 2026-07-02 cs.LG cs.AI 版本更新 62%

Competition-Aware CPC Forecasting with Near-Market Coverage

竞争感知的CPC预测与近市场覆盖

Sebastian Frey, Edoardo Beccari, Maximilian Kranz, Nicolò Alberto Pellizzari, Ali Mete Karaman, Qiwei Han, Maximilian Kaiser

机构 * Nova School of Business and Economics(新里斯本大学商业与经济学院) University of Hamburg(汉堡大学)

专题命中 工具调用 :planning(abstract);分类 cs.AI、cs.LG

AI总结 针对付费搜索中部分可观测的竞争环境,提出结合语义邻域、行为邻域和地理意向协变量的竞争感知CPC预测方法,在短期(1周)图模型降低sMAPE 15.1%,长期(6-12周)协变量增强基础模型降低sMAPE 22.5%-27.6%。

Comments 17 pages, 2 figures, 6 tables, European Conference on Machine Learning and Principles and Practice of Knowledge Discovery in Databases (ECML/PKDD), the code is availale at https://github.com/Sebastian-Frey/Competition-Aware-GNNs-for-TimeSeriesForecasting

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26542 2026-07-02 cs.CR cs.AI 版本更新 57%

ChainCaps: Composition-Safe Tool-Using Agents via Monotonic Capability Attenuation

ChainCaps: 通过单调能力衰减实现组合安全的工具使用智能体

Xiaochong Jiang, Shiqi Yang, Ziwei Li, Lifei Liu, Haoran Yu, Yichen Liu

机构 * Independent Researcher, Seattle, WA, USA(华盛顿州塞勒姆独立研究员) Independent Researcher, New York City, NY, USA(纽约市纽约独立研究员) King Abdullah University of Science and Technology(国王阿卜杜勒阿齐兹科学技术大学)

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 针对工具组合中的权限洗钱漏洞,提出ChainCaps机制,通过运行时能力预算交集传播规则,在不修改智能体或工具服务器的情况下,将攻击成功率从25-68%降至0-4.8%,同时保持96-100%的良性任务完成率。

Comments Published at the Second Workshop on Agents in the Wild: Safety, Security, and Beyond (AIWILD) at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07397 2026-07-02 cs.CL 版本更新 57%

Thinking While Speaking: Inference-Time Knowledge Transfer for Responsive and Intelligent Conversational Voice Agents

边说话边思考:面向响应式与智能对话语音代理的推理时知识迁移

Vidya Srinivas, Zachary Englhardt, Vikram Iyer, Shwetak Patel

机构 * Paul G. Allen School of Computer Science & Engineering(保罗·G·阿伦计算机科学与工程学院)

专题命中 工具调用 :tool use(abstract);分类 cs.CL

AI总结 提出对话填充方法,通过小型说话者模型即时生成上下文响应以隐藏推理模型延迟,并在推理中无缝整合流式知识,在保持毫秒级响应速度的同时将准确度差距缩小至前沿推理模型的6.3%以内。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01029 2026-07-02 cs.RO 新提交 50%

AMBUSH: Collaborative Capture in Complex Environments with Neural Acceleration

AMBUSH:复杂环境下的协作捕获与神经加速

Junfeng Chen, YinHang Luo, Xinyi Wang, Junrui Li, Meng Guo

机构 * School of Advanced Manufacturing and Robotics, Peking University(北京大学先进制造与机器人学院) Distributed Autonomous Systems and Control Lab, University of Michigan(密歇根大学分布式自主系统与控制实验室)

专题命中 工具调用 :planning(abstract)

AI总结 提出基于“伏击”策略的参数化方法,结合混合蒙特卡洛树搜索与神经加速,实现多个慢速追捕者在复杂环境中高效捕获快速逃逸者。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 55 篇

2607.00151 2026-07-02 cs.DC 新提交 89%

SmoothAgent: Efficient Long-Horizon LLM-Based Agent Serving with Lookahead Context Engineering

SmoothAgent: 基于前瞻上下文工程的高效长程LLM Agent服务

Zaifeng Pan, Qianxu Wang, Zhengding Hu, Chang Chen, Yue Guan, Yanbo Zhou, Steven Swanson, Yufei Ding

专题命中 规划决策 :agent(title,title_cn)

AI总结 针对LLM Agent中上下文变换导致KV缓存失效和TTFT增加的问题,提出前瞻编程模型和调度器,实现异步上下文预处理,降低TTFT达11.9倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00255 2026-07-02 cs.IT math.IT 新提交 89%

SLM, LLM or Agentic AI? Toward Intelligent UAV-Enabled WPT Systems in Low-Altitude Economy Networks

SLM、LLM 还是 Agentic AI?面向低空经济网络中智能无人机赋能WPT系统

Feibo Jiang, Li Dong, Lei Mao, Kezhi Wang, Xianbin Wang, Abbas Jamalipour

专题命中 规划决策 :agentic(title,title_cn)

AI总结 研究在资源受限动态环境下,利用小语言模型(SLM)和基于大语言模型(LLM)的Agentic AI框架优化无人机无线充电(WPT)路径与能量,实现低复杂度、低延迟和高能效。

Journal ref IEEE Journal on Selected Areas in Communications, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23405 2026-07-02 cs.MA cs.AI cs.RO 版本更新 89%

Planning over MAPF Agent Dependencies via Multi-Dependency PIBT

通过多依赖PIBT规划MAPF智能体依赖关系

Zixiang Jiang, Yulun Zhang, Rishi Veerapaneni, Jiaoyang Li

机构 * University Of Melbourne(墨尔本大学) Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)

专题命中 规划决策 :agent(title,abstract);planning(title,abstract);multi-agent(abstract);分类 cs.AI

AI总结 提出多依赖PIBT(MD-PIBT)框架,通过搜索智能体依赖关系来规划多智能体路径,在拥挤环境中高效处理多达10000个智能体,支持多种运动学约束。

Comments Accepted to IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00828 2026-07-02 cs.DB cs.AI 新提交 85%

Exploring the Semantic Gap in Agentic Data Systems: A Formative Study of Operationalization Failures in Analytical Workflows

探索智能体数据系统中的语义鸿沟:分析工作流中操作化失败的形成性研究

Jalal Mahmud, Eser Kandogan

机构 * Megagon Labs(Megagon实验室)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);workflow(abstract);分类 cs.AI

AI总结 本研究通过跨领域分析236个分析意图,识别出153种反复出现的操作化失败,归纳为五类语义鸿沟,揭示用户分析概念与系统可用信息之间的差距,并提出未来智能体数据系统需要更丰富的语义表示。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04988 2026-07-02 cs.MA cs.AI 版本更新 85%

When AI Agents Compete for Jobs: Strategic Capabilities and Economic Dynamics of AI Labour Markets

当AI代理竞争工作岗位:AI劳动力市场的战略能力与经济动态

Christopher Chiu, Simpson Zhang, Mihaela van der Schaar

机构 * DAMTP, University of Cambridge(剑桥大学应用数学与理论物理系)

专题命中 规划决策 :AI agent(title,abstract);planning(abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出AI-Work模拟平台,研究AI代理在劳动力市场中的竞争行为,发现元认知、竞争意识和长期战略规划能力使代理获得更高利润和市场份额。

Comments Accepted at ICML 2026, Code available at https://github.com/chy-chiu/ai-work

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00972 2026-07-02 cs.AI 新提交 83%

Bayesian Uncertainty Propagation for Agentic RAG Pipelines: A Proof-of-Concept Study on Multi-Hop Question Answering

面向智能体RAG管道的贝叶斯不确定性传播:多跳问答的概念验证研究

Louis Donaldson, Connor Walker, Koorosh Aslansefat, Yiannis Papadopoulos

机构 * University of Hull(赫尔大学)

专题命中 规划决策 :agentic(title,abstract);workflow(abstract);分类 cs.AI

AI总结 提出一种不确定性感知的智能体RAG框架,通过贝叶斯网络传播各阶段的不确定性信号,以估计系统级不确定性并定位潜在故障点,在HotpotQA上表现有效,但在StrategyQA上受限于校准问题。

Comments Submitted for 7th International Conference on Maintenance and Intelligent Asset Management (ICMIAM 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00820 2026-07-02 cs.SE 新提交 83%

Knowledge-Enhanced Agentic Vulnerability Repair

知识增强的智能体漏洞修复

Sicong Cao, Hao Ma, Le Yu, Kangyi Ding, Xiaolei Liu, Terry Yue Zhuo, Bo Wang, Xingwei Lin, Xiaobing Sun, Linzhang Wang, David Lo

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.SE

AI总结 提出KeaRepair,一种基于智能体的自动化漏洞修复方法,通过提取历史漏洞知识并利用工具增强的智能体进行诊断,生成并迭代优化补丁,在55个C/C++漏洞上修复率达83.64%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00422 2026-07-02 cs.CR 新提交 82%

KidnapRAG: A Black-Box Attack for Hijacking Reasoning in Agentic Retrieval-Augmented Generation Systems

KidnapRAG:针对代理式检索增强生成系统中推理劫持的黑盒攻击

Chanwoo Choi, Euntae Kim, Kyuho Lee, Youngsam Chun, Jinhee Jeong, Eunmi Kim, Myunggyo Oh, Junseo Jang, Buru Chang

专题命中 规划决策 :agentic(title,abstract);agent(abstract)

AI总结 提出KidnapRAG,一种针对代理式RAG系统的黑盒顺序投毒攻击,通过三种角色文档(诱饵、链环、恶意指令)劫持多步推理链,实验表明在多种框架和基准上优于现有方法。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25189 2026-07-02 cs.OS 新提交 82%

ActPlane: Programmable OS-Level Policy Enforcement for Agent Harnesses

ActPlane:面向代理框架的可编程操作系统级策略执行

Yusheng Zheng, Tianyuan Wu, Quanzhi Fu, Tong Yu, Wenan Mao, Tao Ma, Dan Williams, Wei Wang, Andi Quinn

专题命中 规划决策 :agent(title,abstract);AI agent(abstract)

AI总结 提出ActPlane,一种在操作系统内核中执行代理策略的引擎,通过eBPF实现信息流控制,弥补语义鸿沟,覆盖工具层无法观察的间接执行路径,开销1.9%-8.4%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00444 2026-07-02 cs.RO cs.AI 新提交 79%

Search-Based Spatiotemporal and Multi-Robot Motion Planning on Graphs of Space-Time Convex Sets

基于时空凸集图的搜索式时空与多机器人运动规划

Jingtao Tang, Zining Mao, Lufan Yang, Hang Ma

机构 * Simon Fraser University(西蒙弗雷泽大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 提出基于时空凸集图(ST-GCS)的算法框架,通过图搜索与连续轨迹优化结合,实现单/多机器人时间最优运动规划,在狭窄瞬态可行区域中显著加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00283 2026-07-02 cs.RO cs.AI cs.CV 新提交 79%

What's Hidden Matters: Identifying Planning-Critical Occluded Agents using Vision-Language Models

隐藏之物至关重要:使用视觉语言模型识别规划关键性的被遮挡智能体

Amirhosein Chahe, Tyler Naes, Jovin D'sa, Faizan M. Tariq, Sangjae Bae, Lifeng Zhou, David Isele

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 提出利用视觉语言模型(VLM)识别对自车轨迹影响最大的被遮挡智能体,通过规划KL散度(PKL)度量进行排序,并微调VLM以提升性能,实验表明该方法比随机采样提升约30%。

Comments Accepted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026). 9 pages, 5 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00272 2026-07-02 cs.RO cs.AI cs.MA 新提交 79%

ASPIRE: Agentic /Skills Discovery for Robotics

ASPIRE: 面向机器人的智能体技能发现

Runyu Lu, Yubo Wu, Ethan Kou, Letian Fu, Wenli Xiao, Ajay Mandlekar, Yinzhen Xu, Guanya Shi, Ken Goldberg, Ang Chen, Mosharaf Chowdhury, Yuke Zhu, Linxi "Jim" Fan, Guanzhi Wang

机构 * NVIDIA(英伟达) UMich(密歇根大学) UIUC(伊利诺伊大学厄巴纳-香槟分校) UC Berkeley(加州大学伯克利分校) CMU(卡内基梅隆大学)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 提出ASPIRE系统,通过闭环执行、技能库积累和进化搜索,自主编写和优化机器人控制程序,在扰动、多机器人协作和长时域任务上显著超越现有方法,并实现零样本泛化与仿真到现实的技能迁移。

Comments 43 pages, 12 figures, 9 tables. Project page: https://research.nvidia.com/labs/gear/aspire/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00065 2026-07-02 cs.RO cs.AI 新提交 79%

Optimal any-angle path planning in static and dynamic environments

静态与动态环境中的最优任意角度路径规划

Yiyuan Zou, Clark Borst

机构 * Faculty of Aerospace Engineering, Delft University of Technology(航空航天工程学院,代尔夫特理工大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 提出椭圆前向扩展和视野技术加速最优任意角度路径规划,开发Zeta*和Zeta*-SIPP算法,在静态和动态环境中保持最优性,速度提升20倍以上。

Comments 33 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31329 2026-07-02 cs.RO cs.AI 新提交 79%

3D HAMSTER: Bridging Planning and Control in Hierarchical Vision Language Action Models through 3D Trajectory Guidance

3D HAMSTER:通过3D轨迹引导在分层视觉语言动作模型中桥接规划与控制

Dongyoon Hwang, Byungkun Lee, Dongjin Kim, Hyojin Jang, Hoiyeong Jin, Jueun Mun, Minho Park, Hojoon Lee, Hyunseung Kim, Jaegul Choo

机构 * Kim Jaechul Graduate School of AI, KAIST(韩国科学技术院金载哲人工智能研究生院) Graduate School of Artificial Intelligence, POSTECH(浦项工业大学人工智能研究生院) KRAFTON AI

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 提出3D HAMSTER框架,通过让规划器直接输出度量可靠的3D轨迹,弥合2D引导与3D低层策略之间的差距,在3D轨迹预测、仿真和真实操作中优于现有方法。

Comments Published in IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2026. Code: https://github.com/DAVIAN-Robotics/3D_HAMSTER. Project page: https://davian-robotics.github.io/3D_HAMSTER/

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12756 2026-07-02 cs.LG math.OC 79%

Navigating Demand Uncertainty in Container Shipping: Deep Reinforcement Learning for Enabling Adaptive and Feasible Master Stowage Planning

在集装箱航运中应对需求不确定性:通过深度强化学习实现适应性与可行性的主装货计划

Jaike van Twiller, Yossiri Adulyasak, Erick Delage, Djordje Grbic, Rune Møller Jensen

机构 * IT University of Copenhagen, Denmark(丹麦哥本哈根IT大学) HEC Montréal, Qc, Canada(加拿大魁北克省蒙特利尔高等商学院) GERAD, Qc, Canada(加拿大魁北克省GERAD) Mila - Quebec AI Institute, Qc, Canada(加拿大魁北克省Mila-魁北克人工智能研究所)

专题命中 规划决策 :planning(title,abstract);分类 cs.LG

AI总结 本文通过深度强化学习框架解决主装货计划中的状态依赖约束问题,提升在需求不确定性和操作约束下的适应性和可行性。

Comments This paper is accepted at ECML-PKDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02635 2026-07-02 physics.soc-ph 79%

Planning for Rhythmized Urban Parks: Temporal Park Classification and Modes of Action

为节奏化城市公园规划:时间公园分类与行动模式

Xiyuan Ren, ChengHe Guan, Shengze Chen, Meizi You, Ying Li, Kangning Huang

专题命中 规划决策 :planning(title,abstract)

AI总结 本文研究城市公园的节奏化规划,通过分析东京254个公园的访问模式,揭示季节性和日常活动对公园使用的影响,提出四种提升时空公平性的实践方法。

Journal ref Journal of the American Planning Association, 92-1(2026), 105-124

详情

展开后加载摘要…

URL PDF HTML 收藏