arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-15 至 2026-07-15 共收录 152 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 12 篇

2603.01311 2026-07-15 cs.CL 版本更新 90%

Catalyst-Agent: Autonomous heterogeneous catalyst screening with an LLM Agent

Catalyst-Agent:基于LLM Agent的自主异质催化剂筛选

Achuth Chandrasekhar, Janghoon Ock, Amir Barati Farimani

机构 * Mechanical Engineering, Carnegie Mellon University, Pittsburgh, PA 15213, USA(卡内基梅隆大学机械工程系,匹兹堡,PA 15213,USA) Department of Chemical and Biomolecular Engineering, University of Nebraska--Lincoln, Lincoln, NE 68588, USA(内布拉斯加大学林肯分校化学与生物分子工程系,林肯,NE 68588,USA)

专题命中 工具调用 :agent(title,title_cn);分类 cs.CL

AI总结 提出Catalyst-Agent,一种基于MCP服务器和LLM的AI代理,通过OPTIMADE API探索材料数据库、利用UMA模型计算吸附能,实现闭环自主催化剂筛选,在ORR、NRR和CO2RR反应中成功率达33-41%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11520 2026-07-15 cs.CL cs.AI cs.LG 版本更新 85%

ISE: An Execution-Grounded Recipe for Multi-Turn OS-Agent Trajectories

ISE:一种基于执行的多轮操作系统代理轨迹合成方法

Siyuan Luo, Nairong Zheng, Lin Zhou, Tiankuo Yao, Shengyou Yuan, Haojia Yu, Cong Pang, Jiapeng Luo, Lewei Lu

机构 * University of Electronic Science and Technology of China(电子科技大学) SenseTime Research(商汤科技研究院)

专题命中 工具调用 :agent(title,abstract);tool-use(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 提出ISE三阶段范式,通过结构化意图构建、角色锁定用户模拟和真实执行环境,生成多轮代理轨迹,微调后显著提升代理工具使用性能。

Comments 13 pages, 6 figures. Dataset and code: https://github.com/Valiere01/ISE-Trace

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12650 2026-07-15 cs.LG cs.AI cs.CY cs.SE 新提交 82%

Evidence-Grounded Verified Agentic Reasoning: A Path Toward Eliminating LLM Hallucination in Empirical Inference via Tool-Attested Kernel Proofs

基于证据的可验证智能推理:通过工具验证内核证明消除经验推理中语言模型幻觉的途径

Junyu Ren

专题命中 工具调用 :agentic(title,abstract);分类 cs.AI、cs.LG、cs.SE

AI总结 研究旨在消除语言模型经验推理中的幻觉,提出基于Lean 4的EG-VAR工具调用架构,通过工具验证公理等生成可验证声明,经实验在数值推理等测试中表现良好,定位为高风险经验声明的技术治理接口,可审计相关条件并转化错误为审计目标。

Comments Accepted at the ICML 2026 TAIGR workshop. System name: EG-VAR

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18939 2026-07-15 cs.CL 版本更新 79%

Lost in the Maze: Overcoming Context Limitations in Long-Horizon Agentic Search

迷失在迷宫中:克服长期智能体搜索中的上下文限制

Howard Yen, Yoonsang Lee, Ashwin Paranjape, Mengzhou Xia, Thejas Venkatesh, Jack Hessel, Danqi Chen, Yuhao Zhang

专题命中 工具调用 :agentic(title,abstract);分类 cs.CL

AI总结 研究长期智能体搜索中因上下文限制难以扩展的问题,提出SLIM框架,该框架分离检索工具并定期总结轨迹,在多任务中以低成本和少调用实现可比性能,还减少幻觉,为未来长期智能体提供参考。

Comments COLM 2026; Code and data are available here: https://github.com/howard-yen/SLIM

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12412 2026-07-15 econ.TH 新提交 78%

Choice at Finite Capacity: The Bounded Agent as an Information Channel and the Recovery of Walrasian Demand

有限容量下的选择:作为信息通道的有限理性主体与瓦尔拉斯需求的恢复

Avishek Bhandari

专题命中 工具调用 :agent(title,abstract)

AI总结 研究将购物者建模为有限信息通道,其选择是概率分布。核心方法是分析购物者需求对价格变化的反应模式,主要贡献是揭示其反应模式的对称性及需求受预算和压缩影响,而非理性,还涵盖了有限容量策略的人工主体并给出两商品二次型消费者的封闭形式解。

Comments 27 pages, Keywords: bounded rationality, rational inattention, rate distortion, discrete choice, demand theory, Slutsky equation, information theory

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12575 2026-07-15 cs.CR cs.CY cs.SI 新提交 78%

How Agentic Is Agentic Commerce? A Population-Scale Measurement of x402 Adoption and Authenticity

代理式商业的代理程度如何?x402采用情况与真实性的大规模测量

Shengchen Ling, Yajin Zhou, Lei Wu, Cong Wang

专题命中 工具调用 :agentic(title);AI agent(abstract)

AI总结 研究x402协议在商业中的代理程度,通过链上事件识别结算并确定真正付款人,对Base上的x402进行大规模测量,发现诸多问题,指出结算数量衡量的是可制造性而非采用情况。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13021 2026-07-15 cs.SE 新提交 70%

Software Supply Chains are Dead: Use-Case-Oriented Regeneration

软件供应链已死:面向用例的再生

Tanmay Singla, James C. Davis

专题命中 工具调用 :workflow(abstract);agentic(abstract);分类 cs.SE

AI总结 研究现代软件开发中构建与复用权衡因软件供应链攻击及生成式人工智能而改变,提出面向用例的再生范式,评估智能工作流程,通过对180个存储库-依赖对测量,证明该方法可行,推动软件采购向可验证的特定于存储库的代码合成发展。

Comments [ESEM'26-ERVR] Proceedings of the 20th International Symposium on Empirical Software Engineering and Measurement (ESEM 2026 Emerging Results, Vision, and Reflection Papers)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12257 2026-07-15 cs.AI cs.CL cs.IR cs.LG 新提交 67%

On-Device Deep Research at 4B: Exposure Bounds Faithfulness, Retrieval Bounds Coverage

4B 设备上的深度研究:曝光界限忠实度、检索界限覆盖率

Vinay Kumar Chaganti

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 该研究聚焦 4B 设备上深度研究,区分引用主张忠实度与可信覆盖率两个量,通过交叉对比来源字符数和质量,发现曝光决定忠实度,检索决定覆盖率,提出先提高曝光再调控检索召回率的实际方法。

Comments 13 pages, 2 figures, appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10001 2026-07-15 cs.SI cs.HC 版本更新 67%

Human-AI Synergy Supports Collective Creative Search

人类-人工智能协同支持集体创造性搜索

Chenyi Li, Raja Marjieh, Haoyu Hu, Mark Steyvers, Katherine M. Collins, Ilia Sucholutsky, Nori Jacoby

专题命中 工具调用 :agent(abstract);AI agent(abstract)

AI总结 本研究探讨了人类与人工智能协同在集体创造性搜索中的作用,发现混合团队在保持多样性的同时表现最佳,凸显了两者互补的协作优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11913 2026-07-15 cs.NE cs.AI 新提交 57%

Towards Self-Evolving Agents: A Human-Inspired Adaptive Exploration-Exploitation Framework for Genetic Network Programming

迈向自我进化智能体:一种受人类启发的遗传网络编程自适应探索-利用框架

Ali Kohan, Mohamad Roshanzamir, Roohallah Alizadehsani, Seyedali Mirjalili

专题命中 工具调用 :agentic(abstract);分类 cs.AI

AI总结 该研究受人类发育模式启发,提出人类启发的遗传网络编程(HGNP)框架,通过新型自适应交叉、变异算子及循环消除机制,动态调节遗传网络编程中探索与利用的平衡,提升了智能体策略性能,且可应用于多种GNP变体。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14539 2026-07-15 cs.CR cs.HC cs.SE 57%

When Security Meets Usability: An Empirical Investigation of Post-Quantum Cryptography APIs

当安全性遇见可用性:后量子密码学API的实证研究

Marthin Toruan, R. D. N. Shakya, Samuel Tseitkin, Raymond K. Zhao, Nalin Arachchilage

专题命中 工具调用 :workflow(abstract);分类 cs.SE

AI总结 通过实证评估开发者与后量子密码学API的交互,识别影响可用性的认知因素,并提出改进建议以促进PQC的采用。

Comments Accepted at the NDSS Symposium on Usable Security and Privacy (USEC) 2026

Journal ref Symposium on Usable Security and Privacy (USEC) 2026, San Diego, CA, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12117 2026-07-15 cs.DL 新提交 50%

Measuring the Re-executability of Published Molecular Docking Claims

测量已发表分子对接声明的可重新执行性

Vincent Giap, Eric Wang, Cris Nguyen

专题命中 工具调用 :agent(abstract)

AI总结 研究探讨已发表分子对接声明的可重新执行性,引入MERS-Dock及可执行性阶梯,通过对236篇相关论文审核发现可执行性低,验证审核并分析结果,表明再现差距是几何效应,将E类作可执行性门,发布测量层助数字系统核查计算声明。

Comments 19 pages, 6 figures. Data, code, and the MERS-Dock reporting standard: https://github.com/giapha/mpro-dockexec

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 40 篇

2509.21842 2026-07-15 cs.AI 版本更新 90%

DeepTravel: An End-to-End Agentic Reinforcement Learning Framework for Autonomous Travel Planning Agents

深度旅行:用于自主旅行规划智能体的端到端智能强化学习框架

Yansong Ning, Rui Liu, Jun Wang, Kai Chen, Wei Li, Jun Fang, Kan Zheng, Naiqiang Tan, Hao Liu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Didichuxing Co. Ltd(滴滴出行有限公司)

专题命中 规划决策 :planning(title,abstract);agentic(title,abstract);agent(abstract);workflow(abstract)

AI总结 研究针对旅行规划智能体灵活性和自主性不足问题,提出深度旅行框架,通过构建旅行沙盒、开发分层奖励建模系统及回复增强强化学习方法,使训练后的智能体在行程生成准确率和性能上表现出色。

Comments KDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19186 2026-07-15 cs.RO cs.AI cs.FL 版本更新 85%

Real-Time Model Checking for Closed-Loop Robot Reactive Planning

闭环机器人反应式规划的实时模型检查

Christopher Chandler, Bernd Porr, Giulia Lafratta, Alice Miller

机构 * School of Computing Science University of Glasgow Glasgow Scotland UK(计算科学学院格拉斯哥大学格拉斯哥苏格兰英国) School of Biomedical Engineering University of Glasgow Glasgow Scotland UK(生物医学工程学院格拉斯哥大学格拉斯哥苏格兰英国) University of Glasgow(格拉斯哥大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract);autonomous agent(abstract);分类 cs.AI

AI总结 研究利用模型检查让自主机器人实现反应式多步规划与避障,特制算法基于生物知识实时原位生成规划,通过链式系统和临时快照减轻状态空间爆炸,实验证明方法有效且性能提升,为自动驾驶导航发展提供案例,适用于关键任务移动机器人。

Comments 41 pages excluding references, 21 figures, submitted to Formal Aspects of Computing

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12634 2026-07-15 cs.LG cs.AI cs.CL 版本更新 85%

Keep Policy Gradient in Charge: Sibling-Guided Credit Distillation for Long-Horizon Tool-Use Agents

保持策略梯度主导:面向长程工具使用智能体的兄弟引导信用蒸馏

Tianyu Ding, Jianhong Xin, Juan Pablo De la Cruz Weinstein

机构 * Amazon Web Services(亚马逊云服务)

专题命中 规划决策 :tool-use(title,abstract);tool use(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 针对长程工具使用强化学习中轨迹级优势信号稀疏的问题,提出兄弟引导信用蒸馏(SGCD),通过动态采样成功与失败轨迹、外部LLM对比生成逐步信用参考,实现密集信用分配,在AppWorld和τ³-airline任务上显著提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13034 2026-07-15 cs.AI cs.CL cs.SE cs.SY eess.SY 新提交 82%

Do AI Agents Know When a Task Is Simple? Toward Complexity-Aware Reasoning and Execution

人工智能代理知道任务何时简单吗?迈向复杂性感知推理与执行

Junjie Yin, Xinyu Feng

专题命中 规划决策 :AI agent(title);agent(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 研究探讨LLM代理缺乏任务感知执行范围估计能力,提出E3方法,在MSE-Bench基准测试及真实模型工具中验证,该方法能在保证成功率时大幅降低成本,推动迈向工程基础人工智能,还发布了框架和基准。

Comments 27 pages, 8 figures, 8 tables. Code and benchmark: https://github.com/eejyin/Do-AI-Agents-Know-When-a-Task-Is-Simple-Toward-Complexity-Aware-Reasoning-and-Execution

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09224 2026-07-15 cs.SE cs.AI cs.CL 版本更新 82%

Git-Assistant: Planning-Based Support for Updating Git Repositories

Git辅助工具:基于规划的Git仓库更新支持

Alfredo Garrachón Ruiz, Tomás de la Rosa, Daniel Borrajo

机构 * AI Research, JPMorganChase(人工智能研究,摩根大通)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 研究针对git工具对开发者有挑战的问题,提出结合大语言模型与自动规划的Git-Assistant,经合成和随机git环境评估,证明该方法能提升仓库管理可靠性、减少错误,展现混合人工智能方法在开发者辅助上的潜力。

Comments Pending permissions from the private company

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12177 2026-07-15 cs.AI cs.CV 新提交 79%

The Emerging Paradigm of Geospatial Foundation Models: From Pre-Training to Agentic Reasoning

地理空间基础模型的新兴范式:从预训练到智能推理

Shelley Cazares

机构 * Google Public Sector(谷歌公共部门)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 研究地理空间基础模型的新兴范式,通过职责分离实现预训练与特定任务微调,探讨不同类型模型能力及实现考虑因素,提出模型适应策略分类法和框架,展望智能地理空间推理推动领域从感知到认知的发展。

Comments 18 pages, 4 figures. To appear in Lecture Notes in Computer Science (LNCS)

Journal ref Lecture Notes in Computer Science, Vol. 16446 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12122 2026-07-15 cs.LG 新提交 79%

An Agentic AI Scientific Community for Automated Neural Operator Discovery

用于自动神经算子发现的智能体人工智能科学社区

Luis Loo, Ulisses Braga-Neto

机构 * Texas A&M University(德克萨斯农工大学)

专题命中 规划决策 :agentic(title,abstract);分类 cs.LG

AI总结 该研究基于人工智能科学社区提出智能体方法用于自动神经算子发现,通过虚拟实验室中三个智能体协作,共享通用词汇表,在五个问题上评估,能发现高精度低参数架构,揭示语言模型智能体对保持多样性的作用及神经算子无免费午餐定理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28583 2026-07-15 cs.CV cs.AI cs.MM 版本更新 79%

Navigating the Mirage: A Dual-Path Agentic Framework for Robust Misleading Chart Question Answering

穿越幻象:一种双路径代理框架用于鲁棒的误导图表问答

Yanjie Zhang, Yafei Li, Rui Sheng, Zixin Chen, Yanna Lin, Huamin Qu, Lei Chen, Yushi Sun

机构 * The Hong Kong University of Science and Technology(香港科技大学)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 本文提出ChartCynics双路径框架,通过分离感知与验证,利用诊断视觉路径和OCR驱动数据路径解决图表误导问题,提升模型鲁棒性。

Comments 10pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12764 2026-07-15 cs.CV 新提交 78%

EvoGraph-R1: Self-Evolving Multimodal Knowledge Hypergraphs for Agentic Retrieval

EvoGraph-R1:用于智能检索的自进化多模态知识超图

Jiashi Lin, Changhong Jiang, Xiangru Lin, Ruifei Zhang, Xinyi Zhu, Jiyao Liu, Cheng Tang, Ye Du, Shujian Gao, Junzhi Ning, Lihao Liu, Ziyan Huang, Tianbin Li, Jin Ye, Junjun He

机构 * Northwestern Polytechnical University(西北工业大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) The University of Hong Kong(香港大学) Monash University(莫纳什大学) The Chinese University of Hong Kong (Shenzhen)(香港中文大学(深圳))

专题命中 规划决策 :agentic(title);agent(abstract)

AI总结 研究针对现有GraphRAG方法将知识图视为静态数据结构的局限,提出EvoGraph-R1自进化框架,把检索建模为MDP,智能体通过多种操作使超图结构进化以支持多跳推理,实验证明该方法在多模态问答基准测试中大幅优于现有基线。

Comments 10 pages main paper, 6 figures. CVPR 2026 accepted paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12732 2026-07-15 cs.RO 新提交 78%

Globalized Constrained Stein Variational Inference for Diverse Feasible Robot Motion Planning

用于多样化可行机器人运动规划的全局约束斯坦变分推理

Jiayun Li, Georgia Chalvatzaki

机构 * PEARL Lab, Dept. of Computer Science, TU Darmstadt(珍珠实验室,达姆施塔特工业大学计算机科学系) Robotics Institute Germany (RIG)(德国机器人研究所)

专题命中 规划决策 :planning(title,abstract)

AI总结 研究机器人运动规划多模态问题,提出SteinSQP方法,通过约束斯坦变分推理演化粒子集合,用无矩阵原始对偶算法解决子问题,引入优点函数全局化方法,在多任务中表现良好,收敛快且可行性高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12423 2026-07-15 cs.RO 新提交 78%

Model-Based Diffusion Optimal Control for Multi-Robot Motion Planning

基于模型的扩散最优控制用于多机器人运动规划

Zhilin He, Yorai Shaoul, Jiaoyang Li

专题命中 规划决策 :planning(title,abstract)

AI总结 针对多机器人运动规划难题,介绍基于模型的扩散最优控制(MDOC),它不依赖数据,通过结合动力学模型与控制障碍函数约束投影,利用基于冲突搜索的安全机制,在模拟实验中展现出优于基线规划器的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12480 2026-07-15 cs.AI 新提交 74%

TRACE: An Operational Reasoning Schema for Auditable Agentic Commitments

TRACE:可审计的智能体承诺的操作推理模式

Edward Y. Chang, Emily J. Chang

机构 * Stanford University(斯坦福大学) Quadrivium AI(四元数人工智能)

专题命中 规划决策 :agentic(title);分类 cs.AI

AI总结 本文提出TRACE模式用于记录推理轨迹,通过字段和测试应对推理不在语言模型中的问题,给出参考程序和操作规范,借助记录-消费者契约形成操作接口,通过示例展示应用,贡献了模式及其契约。

Comments 46 pages, 18 tables, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12178 2026-07-15 eess.SY cs.SY 新提交 71%

Dynamically Feasible Planning and Control in Complex Environments: a Scalable Systematic Approach

复杂环境下的动态可行规划与控制:一种可扩展的系统方法

Miguel Castroviejo-Fernandez, Ilya Kolmanovsky

专题命中 规划决策 :planning(title)

AI总结 针对受非凸约束的线性离散时间系统,提出生成安全集的方法及参考调节器,能保证系统安全与参考命令收敛,在线计算开销低,特定情况下安全集计算高效,通过仿真验证了方法的适用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12130 2026-07-15 cs.RO 新提交 71%

More than a Manipulator: Planning Propellant-Free Attitude Maneuvers for Free-Floating Spacecraft

不仅仅是一个操纵器:为自由漂浮航天器规划无推进剂姿态机动

Harsh G. Bhundiya, Avi Soval, Keenan Albee

机构 * University of Southern California(南加州大学)

专题命中 规划决策 :planning(title)

AI总结 研究利用机器人操纵器运动进行自由漂浮航天器无推进剂姿态控制,通过制定带约束的轨迹优化问题求解,展示多种系统轨迹,经与反作用轮阵列比较,证明其可作冗余或主要姿态控制系统,为空间应用提供框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12113 2026-07-15 cs.DC cs.AI 新提交 70%

Toward Trustworthy Autonomous Science: A Two-Year Community Roadmap

迈向可信自主科学:两年社区路线图

Rafael Ferreira da Silva, Milad Abolhasani, Peter Beaucage, Laura Biven, Michael Bussmann, Kyle Chard, Ryan Coffee, Stephen DeWitt, Sagar Dolas, Carrie Eckert, David Elbert, Ian Foster, Tirthankar Ghosal, Anna Giannakou, Tom Gibbs, Leslie Hamilton, Glenn Lockwood, Theresa Mayer, Ben Mintz, Raffi Nazikian, Sal Nimer, Amanda Randles, Woong Shin, Sreenivas Rangan Sukumar, Frédéric Suter, Mitra Taheri, Michela Taufer, Draguna Vrabie

机构 * U.S. Department of Energy, Office of Science, Office of Advanced Scientific Computing Research(美国能源部科学办公室高级科学计算研究办公室)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 该研究针对自主科学领域发展现状及问题,更新路线图围绕七个维度,评估原有里程碑并新增四个,规划两年发展路径,第一年聚焦接口等搭建验证框架,第二年针对联盟等,强调基层网络的互操作性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23276 2026-07-15 cs.LG cs.MA 版本更新 70%

Auditable Context-Aware HFMD Forecasting with Structured LLM Agents

基于结构化大语言模型代理的可审计上下文感知手足口病预测

Joongwon Chae, Runming Wang, Chen Xiong, Gong Yunhan, Lian Zhang, Ji Jiansong, Dongmei Yu, Peiwu Qin

机构 * Institute of Biomedicine and Health Engineering, Tsinghua Shenzhen International Graduate School (SIGS), Tsinghua University, Shenzhen, China(清华大学深圳国际研究生院生物医学与健康工程学院) The Fifth Affiliated Hospital of Wenzhou Medical University, Lishui 323000, China(温州医科大学第五附属医院) Hengqin Laboratory, Zhuhai, China(横琴实验室) The First Hospital of Hebei Medical University, Shijiazhuang, China(河北医科大学第一医院)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.LG

AI总结 研究针对手足口病预测,提出双代理神经符号框架,由基于大语言模型的事件解释器和预测生成器组成,通过摄取异构信号并结合历史病例数进行预测,在两个数据集评估中实现有竞争力的点准确性、可靠区间及可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12497 2026-07-15 cs.CV 新提交 69%

TerraLogic: A Benchmark for Hierarchical Geospatial Reasoning in Earth Observation

TerraLogic:地球观测中分层地理空间推理的基准

Yuhang Yan, Linchao Mou, Bokang Yang, Qingyu Li

机构 * The Chinese University of Hong Kong (Shenzhen)(香港中文大学(深圳)) Technical University of Munich(慕尼黑工业大学)

专题命中 规划决策 :agent(abstract,comments);planning(abstract)

AI总结 针对遥感中认知地理空间推理研究不足的问题,引入TerraLogic基准及HieraPlan工具增强智能体,通过545个任务推动评估向认知级发展,实验显示HieraPlan在分层地理空间推理上表现出色,为相关研究提供强大基线。

Comments 8 pages, 3 figures, and 7 tables. Dataset and agent code are available at https://github.com/Ireliya/TerraLogic

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12680 2026-07-15 cs.CV 新提交 67%

ReflectVLN: Training Vision-Language Navigation Agents with Reflective Reasoning

ReflectVLN:通过反思推理训练视觉语言导航智能体

Jiahang Wang, Yirong Yang, Yanqing Zhu, Minghua Luo, Shichao Xie, Fei Liu, Mu Xu

机构 * Amap, Alibaba Group(高德软件有限公司,阿里巴巴集团) Beihang University(北京航空航天大学)

专题命中 规划决策 :agent(abstract);agentic(abstract)

AI总结 研究针对现有视觉语言导航方法缺乏闭环机制问题,提出ReflectVLN框架,通过双向交互智能体决策,引入行动思维链训练方案,实验证明该框架在有限数据下提升成功率和路径效率,且具良好训练成本与可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏