arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-05-18 至 2026-05-18 共收录 167 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 10 篇

2605.16178 2026-05-18 physics.ao-ph 87%

Probabilistic Seasonal Streamflow Forecasting Across California's Sierra Nevada Watersheds with Agentic AI

基于代理AI的加州Sierra Nevada流域概率季节性径流预测

Ignacio Lopez-Gomez, Michael P. Brenner, Tapio Schneider

专题命中 工具调用 :agentic(title,abstract);agent(abstract);AI agent(abstract);workflow(abstract)

AI总结 本文提出利用代理AI与自动代码突变系统结合的方法,提升Sierra Nevada流域季节性径流预测的准确性,通过适应性集成三个XGBoost分模型,减少预测误差达29%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15206 2026-05-18 cs.LG cs.AI cs.DC 86%

AgentStop: Terminating Local AI Agents Early to Save Energy in Consumer Devices

AgentStop: 早期终止本地AI代理以在消费设备中节省能源

Dzung Pham, Kleomenis Katevas, Ali Shahin Shamsabadi, Hamed Haddadi

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) Brave Software, Imperial College London(Brave软件公司,伦敦帝国学院)

专题命中 工具调用 :AI agent(title);autonomous agent(abstract);tool use(abstract);agentic(abstract)

AI总结 研究提出AgentStop方法,通过预测并提前终止可能失败的代理任务,减少能源消耗,提升本地AI代理的能效与隐私保护。

Comments ACM CAIS '26

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15565 2026-05-18 cs.LG cs.AI 84%

AstraFlow: Dataflow-Oriented Reinforcement Learning for Agentic LLMs

AstraFlow:面向代理大语言模型的数据流强化学习

Haizhong Zheng, Yizhuo Di, Jiahui Wang, Shuowei Jin, Xueshen Liu, Yongji Wu, Z. Morley Mao, Ion Stoica, Jiawei Zhao, Beidi Chen

机构 * Carnegie Mellon University(卡内基梅隆大学) University of Michigan(密歇根大学) UC Berkeley(加州大学伯克利分校) Meta

专题命中 工具调用 :agentic(title,abstract);tool-use(abstract);分类 cs.AI、cs.LG

AI总结 AstraFlow通过数据流导向的强化学习系统,实现复杂多策略协作训练和高效利用异构计算资源,提升代理LLM的推理与工具使用能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02268 2026-05-18 cs.LG 83%

SKILL0: In-Context Agentic Reinforcement Learning for Skill Internalization

SKILL0:基于上下文的代理强化学习用于技能内化

Zhengxi Lu, Zhiyuan Yao, Jinyang Wu, Chengcheng Han, Qi Gu, Xunliang Cai, Weiming Lu, Jun Xiao, Yueting Zhuang, Yongliang Shen

机构 * Zhejiang University(浙江大学) Meituan(美团) Tsinghua University(清华大学)

专题命中 工具调用 :agentic(title,abstract);agent(abstract);分类 cs.LG

AI总结 SKILL0通过在训练时逐步减少技能上下文,使模型在无任务检索情况下实现自主行为,实验显示在多个任务中性能提升显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16079 2026-05-18 cs.CV cs.AI cs.HC 79%

VideoSeeker: Incentivizing Instance-level Video Understanding via Native Agentic Tool Invocation

VideoSeeker:通过原生代理工具调用激励实例级视频理解

Yiming Zhao, Yu Zeng, Wenxuan Huang, Zhen Fang, Qing Miao, Qisheng Su, Jiawei Zhao, Jiayin Cai, Lin Chen, Zehui Chen, Yukun Qi, Yao Hu, Xiaolong Jiang, Feng Zhao

机构 * University of Science and Technology of China(中国科学技术大学) Xiaohongshu Inc.(小红书公司) East China Normal University(华东师范大学) Xi’an Jiaotong University(西安交通大学)

专题命中 工具调用 :agentic(title,abstract);分类 cs.AI

AI总结 VideoSeeker通过整合代理推理与实例级视频理解任务,提升视频理解精度,实验表明其在实例级任务中比基线模型提升13.7%,超越GPT-4o和Gemini-2.5-Pro。

Comments Project Page: https://gaotiexinqu.github.io/VideoSeeker/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16191 2026-05-18 cs.CL cond-mat.other physics.comp-ph 70%

Optimized Three-Dimensional Photovoltaic Structures with LLM guided Tree Search

优化的三维光伏结构与LLM引导的树搜索

Michael P. Brenner, Lizzie Dorfman, John C. Platt

机构 * Google Research School of Engineering and Applied Sciences, Harvard University(谷歌研究工程与应用科学学院,哈佛大学) Google Research(谷歌研究)

专题命中 工具调用 :agent(abstract);workflow(abstract);分类 cs.CL

AI总结 本文利用AI编码系统生成新型科学假设,通过LLM驱动的树搜索算法优化三维光伏结构,解决中纬度地区传统光伏板的效率瓶颈问题。

Comments 10 pages 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12581 2026-05-18 cs.LO cs.AI cs.FL math.OC 70%

Ensuring Logic in the Fog: Sound POMDP Synthesis with LTL Objectives

确保雾中的逻辑:带有LTL目标的可靠POMDP综合

Can Zhou, Yulong Gao, Pian Yu

机构 * Imperial College London(伦敦帝国理工学院) University College London(伦敦大学学院)

专题命中 工具调用 :autonomous agent(abstract);planning(abstract);分类 cs.AI

AI总结 本文提出一种新的可靠奖励塑造机制,用于在部分可观测马尔可夫决策过程中实现LTL目标的合成,通过增强的蒙特卡洛规划框架提升在部分可观测环境中的导航能力。

Comments Accepted by IJCAI-ECAI 2026, the 35th International Joint Conference on Artificial Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15938 2026-05-18 physics.bio-ph cs.LG 57%

Clock-state olfactory search in turbulent flows using Q-learning: The geometry of plume recovery

湍流中利用Q学习进行钟态嗅觉搜索:烟雾恢复的几何学

Marco Rando, Robin A. Heinonen, Yujia Qi, Agnese Seminara

机构 * Universit\'e C\ ote d'Azur, Inria, CNRS, Laboratoire J.A. Dieudonn\'e, 28 avenue Valrose, 06108, Nice, France Machine Learning Genoa Center \& Department of Civil, Chemical Environmental Engineering, University of Genova Via Montallegro 1, 16145 Genoa, Italy Environmental Engineering, University of Genova, Via Montallegro 1, 16145 Genoa, Italy, now at University of California, Dept Mechanical Engineering, Engineering II, Santa Barbara, CA 93106-5070, USA Environmental Engineering, University of Genova, Via Montallegro 1, 16145 Genoa, Italy

专题命中 工具调用 :agent(abstract);分类 cs.LG

AI总结 本文通过Q学习训练嗅觉搜索代理,利用时间钟表恢复烟雾,结合昆虫行为提升导航策略,但需改进策略适应局部间歇性水平以增强鲁棒性。

Comments 15 pages, 13 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15519 2026-05-18 cs.CV cs.AI 57%

DiffVAS: Diffusion-Guided Visual Active Search in Partially Observable Environments

DiffVAS: 在部分可观测环境中基于扩散的视觉主动搜索

Anindya Sarkar, Srikumar Sastry, Aleksis Pirinen, Nathan Jacobs, Yevgeniy Vorobeychik

机构 * Washington University in St. Louis(华盛顿大学圣路易斯分校) RISE Research Institutes of Sweden(瑞典RISE研究机构) Climate AI Nordics(北欧气候AI)

专题命中 工具调用 :planning(abstract);分类 cs.AI

AI总结 DiffVAS提出了一种目标条件化的策略,能够在部分可观测环境中同时搜索多种目标,提升了视觉主动搜索在现实应用中的部署能力。

Comments 26 Pages, 12 figures, Accepted to AAMAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16004 2026-05-18 math.FA math.CV 50%

A proof of Esterle's conjecture on negative powers of Hilbert-space contractions

关于Hilbert空间收缩算子负幂的Esterle猜想的证明

Thomas Ransford

专题命中 工具调用 :tool use(abstract)

AI总结 本文证明了Esterle关于Hilbert空间收缩算子负幂的猜想,通过构造正序列验证了在特定条件下的算子为单位算子。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 46 篇

2605.02651 2026-05-18 cs.DL cs.LG 85%

ARA: Agentic Reproducibility Assessment For Scalable Support Of Scientific Peer-Review

ARA:面向大规模科学同行评审的代理可重复性评估

Kevin Riehl, Andres L. Marin, Nikofors Zacharof, Fan Wu, Patrick Langer, Robert Jakob, Anastasios Kouvelas, Georgios Fontaras, Michail A. Makridis

机构 * ETH Zürich, IVT & Agentic Systems Lab (ASL)(苏黎世联邦理工学院,信息与通信技术研究所及代理系统实验室) European Commission, Joint Research Centre(欧洲委员会,联合研究中心) University of Konstanz(康斯坦茨大学) Ideas Forward

专题命中 规划决策 :agentic(title,abstract);workflow(abstract);分类 cs.LG

AI总结 ARA通过构建实验依赖图并评估可重复性得分,有效提升大规模科研成果的可重复性评估能力,实验表明其在不同领域和模型参数下均表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27859 2026-05-18 cs.AI cs.ET 85%

Rethinking Agentic Reinforcement Learning In Large Language Models

重新思考大型语言模型中的代理强化学习

Fangming Cui, Ruixiao Zhu, Cheng Fang, Sunan Li, Jiahong Li

机构 * Beijing Beijing China(北京北京中国) Shanghai Beijing China(上海北京中国)

专题命中 规划决策 :agentic(title,abstract);autonomous agent(abstract);planning(abstract);分类 cs.AI

AI总结 本文探讨了在大型语言模型中引入代理强化学习的新方法,强调自主代理的目标设定、长期规划和动态策略适应能力,提出新的方法论和设计,并指出未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15556 2026-05-18 cs.HC 85%

TopoClaw: A Human-Centric and Topology-Aware Agent Operating System

TopoClaw:一种以人为本且拓扑感知的代理操作系统

Heyuan Huang, Yeyi Guan, Jihong Wang, Mingzhi Wang, Jiamu Zhou, Xiangmou Qu, Jiaxin Yin, Xin Liao, Xingyu Lou, Jun Wang

专题命中 规划决策 :agent(title,abstract);tool use(abstract)

AI总结 TopoClaw提出一种以人为本的拓扑感知代理操作系统,通过物理设备拓扑与社会关系拓扑的耦合结构,实现跨设备动作放置、跨用户身份归属和跨上下文权限治理,提升分布式协作与安全管控能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15237 2026-05-18 cs.AR cs.AI 83%

A3D: Agentic AI flow for autonomous Accelerator Design

A3D: 基于代理AI的自主加速器设计流程

Abinand Nallathambi, Christopher Knight, Shantanu Ganguly, Wilfried Haensch, Anand Raghunathan

机构 * Purdue University(普渡大学) Argonne National Laboratory(阿贡国家实验室) University of Chicago(芝加哥大学)

专题命中 规划决策 :agentic(title,abstract);planning(abstract);分类 cs.AI

AI总结 A3D通过代理AI实现端到端的硬件加速器设计自动化,自动分析工作负载、识别性能瓶颈、生成微架构并探索速度-面积权衡空间,利用LLM和EDA工具提升复杂应用的加速器设计效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16205 2026-05-18 cs.AI cs.CL cs.LG cs.MA cs.SY eess.SY 82%

Context, Reasoning, and Hierarchy: A Cost-Performance Study of Compound LLM Agent Design in an Adversarial POMDP

上下文、推理与层次:在对抗性POMDP中的复合LLM代理设计成本-性能研究

Igor Bogdanov, Chung-Horng Lung, Thomas Kunz, Jie Gao, Adrian Taylor, Marzia Zaman

机构 * Carleton University(卡尔顿大学)

专题命中 规划决策 :agent(title,abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 研究探讨了在对抗性部分可观测序贯环境中,复合LLM代理设计的上下文、推理和层次分解对性能与成本的影响,发现程序化状态抽象在成本效率上表现最佳,而分层分解无需推理可获得最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00424 2026-05-18 cs.CR cs.AI cs.MA cs.SE 81%

Skills as Verifiable Artifacts: A Trust Schema and a Biconditional Correctness Criterion for Human-in-the-Loop Agent Runtimes

技能作为可验证的成果:为有人参与的代理运行时的可信架构和双向正确性标准

Alfredo Metere

机构 * Enclawed, LLC(Enclawed公司)

专题命中 规划决策 :agent(title,abstract);分类 cs.AI、cs.SE

AI总结 本文提出了一种可信架构和双向正确性标准,用于人类参与的代理运行时,强调技能验证的重要性,以确保运行时的可信性和可持续性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15120 2026-05-18 cs.RO cs.AI cs.CV 79%

CLOVER: Closed-Loop Value Estimation and Ranking for End-to-End Autonomous Driving Planning

CLOVER:端到端自动驾驶规划的闭环价值估计与排序

Sining Ang, Yuguang Yang, Canyu Chen, Yan Wang

机构 * Department of Automation, University of Science and Technology of China(中国科学技术大学自动化系) Institute for AI Industry Research, Tsinghua University(清华大学人工智能产业研究院) School of Electronic Information Engineering, Beihang University(北航电子信息技术学院) National College for Excellent Engineers, Beihang University(北航卓越工程师学院)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 CLOVER通过闭环价值估计与排序框架,解决端到端自动驾驶规划中训练与评估不匹配的问题,通过生成器和评分器的轻量级架构提升规划器性能,实现更准确的候选轨迹排序。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08964 2026-05-18 cs.LG 79%

T2T-LA: A Topology-to-Topology LLM Agent for Graph Learning with Neither Feature Access nor Task Knowledge

T2T-LA:一种用于图学习的拓扑到拓扑LLM代理,无需特征访问或任务知识

Yongyu Wang

机构 * MTU(MTU大学)

专题命中 规划决策 :agent(title,abstract);分类 cs.LG

AI总结 本文提出T2T-LA,一种无需特征访问或任务知识的拓扑到拓扑LLM代理,通过学习失败拓扑与评分之间的关系,实现图学习中的拓扑推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15203 2026-05-18 cs.IR cs.AI cs.MA 79%

Agent4POI: Agentic Context-Conditioned Affordance Reasoning for Multimodal Point-of-Interest Recommendation

Agent4POI: 基于代理的上下文条件化 affordance 推理用于多模态兴趣点推荐

Jinze Wang, Yangchen Zeng, Tiehua Zhang, Lu Zhang, Yuze Liu, Yongchao Liu, Xingjun Ma, Zhu Sun

机构 * Tongji University(同济大学) Swinburne University of Technology(斯威本理工大学) Southeast University(东南大学) Chengdu University of Information Technology(成都信息工程大学) Fudan University(复旦大学) Singapore University of Technology and Design(新加坡科技设计大学)

专题命中 规划决策 :agentic(title);agent(abstract);分类 cs.AI

AI总结 Agent4POI 提出一种新的兴趣点推荐框架,通过在推荐时生成上下文条件化的多模态表示,而非依赖静态兴趣点嵌入。该方法通过代理生成动态 affordance 查询并执行跨模态推理,提升推荐效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16009 2026-05-18 cs.RO 78%

Fast Expanding Safe Circular Regions for Efficient Local Path Planning

快速扩展的安全圆形区域用于高效的局部路径规划

Scott Fredriksson, Akshit Saradagi, George Nikolakopoulos

机构 * Robotics and Artificial Intelligence Team(机器人与人工智能团队) Luleå University of Technology(卢勒奥理工大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出一种几何算法,通过局部LiDAR扫描生成扩展的圆形区域,实现更快的计算和更长的规划时间,用于局部导航。

Comments Accepted by the IFAC World Congress 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15999 2026-05-18 cs.RO cs.SY eess.SY 78%

Constrained MPC-Based Motion Planning for Morphing Quadrotors in Ultra-Narrow Passages under Limited Perception

基于约束MPC的形态四旋翼运动规划在超狭窄通道中的应用

Harsh Modi, Xiao Liang, Minghui Zheng

机构 * Department of Civil & Environmental Engineering, Texas A&M University(土木与环境工程系,德克萨斯农工大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出一种运动规划框架,用于在极端受限环境中为变形四旋翼规划形态和轨迹。通过开发一种新颖的障碍物避障成本函数,使四旋翼能够在有限的2D激光雷达感知下导航通过极狭窄的缝隙。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15619 2026-05-18 cs.RO 78%

Wind-Aware Optimal Trajectory Planning for Efficient Gliding of Fixed-Wing Aerial Systems

考虑风的高效滑翔轨迹规划

Luca Morando, Nishanth Bobbili, Giuseppe Loianno

机构 * New York University(纽约大学) University of California Berkeley(加州大学伯克利分校)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出非线性多目标轨迹规划器,通过伯恩斯坦多项式生成三次连续轨迹,结合风速估算优化滑翔性能,实验证明在风扰和障碍物情况下具有稳定性和可靠性。

Comments Accepted for publication at IEEE International Conference on Robotics and Automation (ICRA 2026) held in Vienna

Journal ref IEEE International Conference on Robotics and Automation (ICRA 2026) held in Vienna

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02342 2026-05-18 cs.RO 78%

Whole-body motion planning and safety-critical control for aerial manipulation

全身运动规划与安全关键控制用于空中操作

Lin Yang, Jinwoo Lee, Domenico Campolo, H. Jin Kim, Jeonghyun Byun

机构 * School of Mechanical and Aerospace Engineering, Nanyang Technological University, Singapore(机械与航空航天工程学院,南洋理工大学,新加坡) Department of Aerospace Engineering, Seoul National University, South Korea(航空航天工程系,首尔国立大学,韩国)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出基于超级二次曲面的空中操作器全身运动规划与安全关键控制框架,通过融合Voronoi图与平衡流形生成平滑轨迹,并设计高阶控制屏障函数实现碰撞避让,实验验证其在复杂环境中的高效性和鲁棒性。

Comments Will be presented in 23rd IFAC World Congress 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10813 2026-05-18 cs.AI 77%

NanoResearch: Co-Evolving Skills, Memory, and Policy for Personalized Research Automation

NanoResearch: 为个性化研究自动化共进化技能、记忆与政策

Jinhang Xu, Qiyuan Zhu, Yujun Wu, Zirui Wang, Dongxu Zhang, Marcia Tian, Yiling Duan, Siyuan Li, Jingxuan Wei, Sirui Han, Yike Guo, Odin Zhang, Conghui He, Cheng Tan

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) The Hong Kong University of Science and Technology(香港科技大学) Peking University(北京大学) Zhejiang University(浙江大学) Xi'an Jiaotong University(西安交通大学) East China University of Science and Technology(东华大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 规划决策 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出NanoResearch框架,通过三重共进化解决研究自动化中的个性化需求,提升研究效率与用户体验。

Comments 40 pages, 14 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19572 2026-05-18 cs.CL 77%

A Self-Evolving Framework for Efficient Terminal Agents via Observational Context Compression

通过观察上下文压缩实现高效终端智能体的自进化框架

Jincheng Ren, Siwei Wu, Yizhi Li, Kang Zhu, Shu Xu, Boyu Feng, Ruibin Yuan, Wei Zhang, Riza Batista-Navarro, Jian Yang, Chenghua Lin

机构 * University of Manchester(曼彻斯特大学) MAP 4 HKUST(GZ)(香港科技大学(广州)MAP 4) HKUST(香港科技大学) Beihang University(北京航空航天大学)

专题命中 规划决策 :agent(abstract);workflow(abstract);agentic(abstract);分类 cs.CL

AI总结 本文提出TACO框架,通过自进化压缩规则提升终端智能体的效率与性能,实验表明在多个基准测试中均取得显著提升。

Comments 27 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16250 2026-05-18 cs.CL cs.AI cs.DB cs.LG 75%

A Generative AI Framework for Intelligent Utility Billing CO 2 Analytics and Sustainable Resource Optimisation

一种生成式AI框架用于智能用电量分析和可持续资源优化

Pavan Manjunath, Thomas Pruefer

机构 * Independent Research, India(印度独立研究) Independent Research, Germany(德国独立研究)

专题命中 规划决策 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出一个生成式AI框架,整合四个生产级能力,实现自然语言账单生成、消费预测及碳排放优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.22604 2026-05-18 cs.AI cs.HC cs.RO 74%

Bootstrapping Human-Like Planning via LLMs

通过大语言模型实现人类样式的规划

David Porfirio, Vincent Hsiao, Morgan Fine-Morris, Leslie Smith, Laura M. Hiatt

机构 * Navy Center for Applied Research in AI, US Naval Research Laboratory(美国海军人工智能应用研究中心)

专题命中 规划决策 :planning(title);分类 cs.AI

AI总结 本文研究如何结合自然语言接口与拖放界面,利用大语言模型生成人类风格的动作序列,并与手工指定的动作序列进行比较。

Comments Accepted by the 2025 34th IEEE International Conference on Robot and Human Interactive Communication (RO-MAN)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16054 2026-05-18 cs.LG cs.AI 73%

Ada-Diffuser: Latent-Aware Adaptive Diffusion for Decision-Making

Ada-Diffuser: 面向决策制定的潜在意识自适应扩散模型

Fan Feng, Selena Ge, Minghao Fu, Zijian Li, Yujia Zheng, Zeyu Tang, Yingyao Hu, Biwei Huang, Kun Zhang

机构 * University of California San Diego(加州大学圣地亚哥分校) Carnegie Mellon University(卡内基梅隆大学) MBZUAI Stanford University(斯坦福大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出Ada-Diffuser,通过显式建模潜在动态过程,提升决策制定的精度与适应性,实验验证其在模拟控制与机器人基准中的有效性。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26733 2026-05-18 cs.AI cs.LG 73%

FutureWorld: A Live Reinforcement Learning Environment for Predictive Agents with Real-World Outcome Rewards

FutureWorld: 一个用于预测代理的实时强化学习环境,具有现实世界结果奖励

Zhixin Han, Yanzhi Zhang, Chuyang Wei, Maohang Gao, Xiawei Yue, Kefei Chen, Yu Zhuang, Haoxiang Guan, Jiyan He, Jian Li, Yitong Duan, Yu Shi, Mengting Hu, Shuxin Zheng

机构 * College of Software, Nankai University(南开大学软件学院) Academy of Mathematics and Systems Science, Chinese Academy of Sciences(中国科学院数学与系统科学研究院) School of Computer Science and Technology, University of Science and Technology of China(中国科学技术大学计算机科学与技术学院) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) IIIS, Tsinghua University(清华大学智能系统与信息工程研究院) Zhongguancun Academy, Beijing, China(北京中关村学院)

专题命中 规划决策 :agent(abstract);agentic(abstract);分类 cs.AI、cs.LG

AI总结 本文提出FutureWorld,一个实时强化学习环境,通过闭环预测、结果实现与参数更新,提升预测准确性与校准能力。

Comments The code will be released in the near future. The experiments are currently ongoing

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14665 2026-05-18 cs.AI cs.CL cs.IR 73%

Falkor-IRAC: Graph-Constrained Generation for Verified Legal Reasoning in Indian Judicial AI

Falkor-IRAC:用于印度司法AI的图约束生成:在验证法律推理中的应用

Joy Bose

机构 * Independent Researcher(独立研究者)

专题命中 规划决策 :agent(abstract);agentic(abstract);分类 cs.AI、cs.CL

AI总结 本文提出Falkor-IRAC框架,通过图约束生成解决印度法律AI中的验证法律推理问题,利用IRAC知识图谱进行结构化推理,并通过验证代理检查生成路径的正确性。

Comments 20 pages, 8 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏