arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-01 至 2026-07-01 共收录 144 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 10 篇

2606.31229 2026-07-01 cs.AI 新提交 92%

Agentic-Ideation: Sample Efficient Agentic Trajectories Synthesis for Scientific Ideation Agents

Agentic-Ideation: 面向科学构思智能体的样本高效智能体轨迹合成

Keyu Zhao, Lingyan Kong, Fengli Xu, Yong Li

机构 * Department of Electronic Engineering, Tsinghua University(清华大学电子工程系)

专题命中 工具调用 :agentic(title,title_cn);agent(abstract);workflow(abstract);multi-agent(abstract)

AI总结 提出Agentic-Ideation框架,通过Oracle引导的数据合成策略和掩码训练,高效生成高质量智能体轨迹,在科学构思任务上整体质量提升11.91%,数据合成效率提高10倍以上。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31935 2026-07-01 econ.EM 新提交 82%

Delegation Rights: Property, Agency, and Investment Incentives in the Age of AI Agents

委托权:AI代理时代中的财产、代理与投资激励

Yukun Zhang, Kemu Xu

专题命中 工具调用 :AI agent(title,abstract);agent(abstract)

AI总结 本文定义委托权为账户持有人授权代理执行的可撤销、身份保留、范围受限且模式特定的权限,通过三方不完全契约模型分析平台控制、用户控制与认证委托三种机制对投资激励和风险分配的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31665 2026-07-01 cs.MA 新提交 82%

ForecastAgentSearch: Towards a Multi-Expert Agent Search System for Geopolitical Event Forecasting

ForecastAgentSearch:面向地缘政治事件预测的多专家智能体搜索系统

Miaomiao Cai, He Chang, Yunshan Ma, See-kiong Ng

专题命中 工具调用 :agent(title,abstract);multi-agent(abstract)

AI总结 提出ForecastAgentSearch框架,将地缘政治事件预测建模为多专家智能体搜索问题,通过检索、排序和协调专业智能体生成预测,并讨论关键设计挑战与评估方案。

Journal ref SIGIR 2026 AgentSearch Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31504 2026-07-01 cs.CV 新提交 82%

SimpleSearch-VL: A Simple Recipe for Multimodal Agentic Deep Search

SimpleSearch-VL:多模态智能深度搜索的简单配方

Ming Dai, Zhihong Lu, Jinjie Gu, Jiedong Zhuang, Yefeng Liu, Wankou Yang, Jian Wang, Chunhua Shen

机构 * Southeast University(东南大学) Ant Group(蚂蚁集团)

专题命中 工具调用 :agentic(title,abstract);agent(abstract)

AI总结 提出SimpleSearch-VL框架,通过因子化自适应展开和证据验证推理提升多模态智能搜索的效率与可靠性,仅用少量数据即显著超越基线。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31648 2026-07-01 cs.AI cs.LG 新提交 79%

Think in English, Answer in Korean: Efficient Adaptation of Multilingual Tool-Using Agents

用英语思考,用韩语回答:多语言工具使用智能体的高效适配

Utsav Garg, Sungjin Hong, Jason Jung, Justin Lee, Shaan Desai, Joon Hee Kim, Anirudh Shrinivason, Edmond Wen, Susie Park

机构 * Cohere LG CNS

专题命中 工具调用 :tool-use(abstract);function calling(abstract);agentic(abstract);分类 cs.AI、cs.LG

AI总结 提出LuckyStar 111B混合推理模型,通过多语言监督微调、可验证奖励强化学习、语言一致性奖励和4-bit量化,高效适配多语言工具使用智能体,提升数学推理、函数调用和NL2SQL性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30749 2026-07-01 cs.RO 新提交 67%

From Grasps to Dexterity: Large-Scale Grasp Pretraining for Dexterous Manipulation

从抓取到灵巧:大规模抓取预训练用于灵巧操作

Ying Yuan, Xinyu Liu, Sriram Krishna, David Held

机构 * Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)

专题命中 工具调用 :tool use(abstract);tool-use(abstract)

AI总结 本文提出一种层次化模仿学习框架,利用大规模灵巧抓取数据集预训练低级控制器,再微调于下游工具使用任务,在仿真和真实实验中显著提升成功率。

Comments Project page: https://yingyuan0414.github.io/grasp2dexterity/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13239 2026-07-01 cs.SE cs.AI cs.CL cs.CV 新提交 67%

ComAct: Reframing Professional Software Manipulation via COM-as-Action Paradigm

ComAct: 通过COM即行动范式重构专业软件操作

Jiaxin Ai, Tao Hu, Xuemeng Yang, Shu Zou, Hairong Zhang, Daocheng Fu, Yu Yang, Hongbin Zhou, Nianchen Deng, Pinlong Cai, Zhongyuan Wang, Botian Shi, Kaipeng Zhang, Licheng Wen

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 工具调用 :agent(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 提出COM即行动范式,将专业软件交互转化为确定性程序合成,解决GUI代理的脆弱性和API代理的异构性问题;构建ComCADBench基准和ComActor自校正代理,在工业CAD软件上实现SOTA性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31372 2026-07-01 cs.SE 新提交 57%

Failure-Based Testing for Deep Reinforcement Learning Agents

基于失败的深度强化学习智能体测试方法

Weibin Lin, Jiangtao Meng, Zheng Zheng

专题命中 工具调用 :agent(abstract);分类 cs.SE

AI总结 针对深度强化学习智能体测试中奖励信号失效的问题,提出一种基于任务失败洞察的黑盒测试方法PRT,通过优先测试高难度任务来提升故障检测效率,在四个基准上测试成本降低超50%。

Comments 22 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30678 2026-07-01 physics.chem-ph physics.bio-ph physics.ed-ph 新提交 50%

NanoVer: An open-source framework for interactive molecular dynamics in extended reality (iMD-XR) on commodity hardware

NanoVer: 一个用于在消费级硬件上进行扩展现实交互式分子动力学(iMD-XR)的开源框架

Mark D. Wonnacott, Luis Ernesto Toledo Castro, Harry J. Stroud, Ludovica Aisa, Mohamed Dhouioui, Rhoslyn Roebuck Williams, Denis Protopopov, Sila Sobrado, David R. Glowacki

专题命中 工具调用 :AI agent(abstract)

AI总结 本文介绍NanoVer,一个开源框架,允许多人共处同一虚拟空间,以原子级精度实时操控柔性3D分子结构的分子动力学模拟,支持消费级独立XR硬件,并实现多客户端通信与多种任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30870 2026-07-01 cond-mat.mtrl-sci 新提交 50%

Adaptive fine-tuning of foundation models for crystal structure prediction: Discovery of high-pressure phases in the CaFeNi system

基础模型的自适应微调用于晶体结构预测:CaFeNi体系中高压相的发现

N. M. Chtchelkatchev, M. V. Magnitskaya, R. E. Ryltsev

专题命中 工具调用 :workflow(abstract)

AI总结 提出一种结合进化搜索与自适应数据选择及微调的自洽基础模型辅助晶体结构预测工作流,通过迭代选择代表性结构进行DFT标记,高效探索Ca-Fe-Ni三元体系,预测了高压下稳定的新化合物Ca6FeNi。

Comments 10 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 42 篇

2606.31200 2026-07-01 cs.AI 新提交 92%

Agentic RAG-VLM: Affordance-Aware Retrieval-Augmented Generation with Self-Reflective Planning for Robotic Grasping

Agentic RAG-VLM:基于自反规划与可操作性感知的检索增强生成在机器人抓取中的应用

Tao Chen, Lizheng Liu, Jiaxu Wang, Ziyue Jiang, Ruiqi Tian, JiGuang Huo, Zhongxue Gan

机构 * Fudan University(复旦大学) Kean University(肯恩大学)

专题命中 规划决策 :agentic(title,title_cn);planning(title,abstract);分类 cs.AI

AI总结 提出Agentic RAG-VLM框架,通过可操作性感知检索、场景图推理和自反规划,在杂乱环境中实现鲁棒抓取,成功率78.3%,比纯VLM基线提升53.3个百分点。

Comments 8 pages,5 figures,5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30940 2026-07-01 cs.RO cs.AI cs.LG 新提交 86%

Motion Planning in Compressed Representation Spaces

压缩表示空间中的运动规划

Lukas Lao Beyer, Sertac Karaman

机构 * MIT LIDS(麻省理工学院信息与决策系统实验室)

专题命中 规划决策 :planning(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 提出一种生成式框架,通过高压缩率自编码器学习离散层级化潜在空间,并在其中直接搜索进行运动规划,兼顾灵活性与效率,无需任务特定训练。

Comments To appear in the Proceedings of the 43rd International Conference on Machine Learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31916 2026-07-01 cs.CL 新提交 85%

Theory of Mind and Persuasion Beyond Conversation: Assessing the Capacity of LLMs to Induce Belief States via Planning and Action

超越对话的心智理论与说服:通过规划与行动评估LLMs诱导信念状态的能力

Ben Slater, Matteo G. Mecattaf, Lucy G. Cheke, John Burden, Winnie Street

机构 * Leverhulme Centre for the Future of Intelligence(勒沃霍姆未来智能中心) Prolific Google, Paradigms of Intelligence Team(谷歌智能范式团队)

专题命中 规划决策 :planning(title,abstract);agent(abstract);agentic(abstract);分类 cs.CL

AI总结 提出非对话式规划心智理论(NCP-ToM)框架,评估LLMs通过行动而非对话诱导他人信念状态的能力,发现GPT-5在80%任务中优于人类,但鲁棒性不足。

Comments 29 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30801 2026-07-01 cs.CL cs.CY cs.LG cs.SI 新提交 84%

Using AI Agents to Automate Black-Box Audits of Personalization Algorithms at Scale

使用AI代理自动化大规模黑盒审计个性化算法

Alessandro Morosini, Sarah H. Cen, Andrew Ilyas, Hedi Driss, Aleksander Mądry, Chara Podimata

机构 * Massachusetts Institute of Technology(麻省理工学院) Carnegie Mellon University(卡内基梅隆大学)

专题命中 规划决策 :AI agent(title,abstract);agent(abstract);分类 cs.CL、cs.LG

AI总结 提出用生成式AI代理作为行为引擎进行黑盒审计,通过固定人设和反事实扰动解耦用户属性与行为,在X平台部署1120个代理发现算法推荐放大有毒、极化内容且效果因用户意识形态而异。

Comments 43 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14027 2026-07-01 cs.CR cs.AI cs.CL cs.SY eess.SY 新提交 84%

Same-Origin Policy for Agentic Browsers

代理浏览器的同源策略

Xilong Wang, Xiaoxing Chen, Patrick Li, Dawn Song, Neil Gong

机构 * Duke University(杜克大学) Stanford University(斯坦福大学) UC Berkeley(加州大学伯克利分校)

专题命中 规划决策 :agentic(title,abstract);AI agent(abstract);分类 cs.AI、cs.CL

AI总结 研究代理浏览器中同源策略的有效性,构建SOPBench评估基准,发现现有代理浏览器频繁违反SOP,并提出SOPGuard机制来强制执行SOP,同时保持效用和低开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31073 2026-07-01 cs.AI cs.MA cs.RO 新提交 83%

MultiUAV-Plat: An LLM-Oriented Platform, Benchmark and Framework for Multi-UAV Collaborative Task Planning

MultiUAV-Plat:面向多无人机协同任务规划的LLM平台、基准测试与框架

Sheng Zhang, Qinglin Li, Yuechao Zang, Xueqin Huang, Yijia Fu, Cheng Zhu

机构 * National Key Laboratory of Information Systems Engineering, National University of Defense Technology(国防科技大学信息系统工程国家重点实验室)

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI

AI总结 提出MultiUAV-Plat平台与基准测试,以及Agent4Drone框架,通过LLM驱动的工具交互实现多无人机协同任务规划,在任务通过率等指标上显著优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30658 2026-07-01 cs.CY cs.AI 新提交 83%

Agentic AI Enhances Physician Trust in Clinical Decision Making

智能体AI增强医生在临床决策中的信任

Zhiling Yan, Zhe Fang, David J King, Ann Pongsakul, Eashan Adhikarla, Hui Ren, Sunyang Fu, Quanzheng Li, Lifang He, Xiang Li, Hongfang Liu, Yonghui Wu, Lichao Sun

机构 * Department of Computer Science and Engineering, Lehigh University(里海大学计算机科学与工程系) Department of Epidemiology, Harvard T.H. Chan School of Public Health(哈佛大学陈曾熙公共卫生学院流行病学系) Department of Medicine, Division of Cardiology, University of Florida(佛罗里达大学医学院心脏病学系) McGovern Medical School, University of Texas Health Science Center at Houston(德克萨斯大学休斯顿健康科学中心麦戈文医学院) Department of Radiology, Massachusetts General Hospital and Harvard Medical School(麻省总医院和哈佛医学院放射学系) McWilliams School of Biomedical Informatics, University of Texas Health Science Center at Houston(德克萨斯大学休斯顿健康科学中心麦克威廉姆斯生物医学信息学院) Department of Health Outcomes & Biomedical Informatics, College of Medicine, University of Florida(佛罗里达大学医学院健康结果与生物医学信息学系)

专题命中 规划决策 :agentic(title,abstract);planning(abstract);分类 cs.AI

AI总结 研究通过医生评估多模态临床病例,发现智能体AI相比非智能体基线显著提升医生的认知和行为信任,尤其在治疗规划任务中,但存在对错误输出的过度依赖。

Comments Accepted by AMIA 2026 Annual Symposium

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31106 2026-07-01 cs.RO cs.AI cs.LG 新提交 81%

What Probing Reveals about Autonomous Driving: Linking Internal Prediction Errors to Ego Planning

探测揭示自动驾驶:内部预测误差与自我规划的关联

Hyeonchang Jeon, Kyungbeom Kim, Eugene Vinitsky, Kyung-Joong Kim

机构 * Gwangju Institute of Science and Technology (GIST)(光州科学技术院) New York University(纽约大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 通过线性探测和因果干预,研究自动驾驶策略在碰撞事件中缺乏及时预测能力,导致规划缺陷,并证明纠正预测可提升安全性。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31941 2026-07-01 cs.RO cs.AI 新提交 79%

LeCropFollow: Latent Space Planning for Navigation in Unstructured Crop Fields

LeCropFollow:非结构化农田中导航的潜在空间规划

Felipe Tommaselli, Francisco Affonso, Arthur Pompeu, Gianluca Capezzuto, Arun Narenthiran Sivakumar, Girish Chowdhary, Marcelo Becker

机构 * University of São Paulo(圣保罗大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 提出LeCropFollow框架,利用自监督语义热图和基于模型的强化学习规划器在潜在流形中优化轨迹,无需几何建模,实现从简化模拟到真实世界的零样本迁移,在玉米田间隙中语义故障减少2.4倍。

Comments 8 pages, 7 figures, 3 tables. Github Repo: https://github.com/Felipe-Tommaselli/lecropfollow

Journal ref IEEE Robotics and Automation Letters, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31023 2026-07-01 cs.CR cs.LG 新提交 79%

Certified Speculative Execution for Untrusted AI Agents

不可信AI代理的认证推测执行

Chenyu Zhou, Qiliang Jiang, Shuning Wu, Xu Zhou

机构 * School of Engineering, Institute of Science Tokyo, Japan(东京科学大学工学院) College of Control Science and Engineering, Zhejiang University, China(浙江大学控制科学与工程学院) Department of Electrical and Computer Engineering, National University of Singapore, Singapore(新加坡国立大学电气与计算机工程系)

专题命中 规划决策 :AI agent(title,abstract);分类 cs.LG

AI总结 提出证书门控前缀接受(CGPA)方法,通过可信验证器、保形校准值边界和求解器延迟机制,实现安全、遗憾和速度的解耦,将不可信AI代理的违规率降至零。

Comments 15 pages, 2 figures, 24 tables. Includes a technical appendix (full proofs and all supplementary tables)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30650 2026-07-01 cs.CY cs.AI 新提交 79%

Qualified Educational Capacity Planning under Heterogeneous Student Support Needs: A Synthetic Benchmark and Decision-Support Framework

异构学生支持需求下的合格教育能力规划:一个合成基准与决策支持框架

Carlos Eduardo Sanoja, Oscar Enrique Moreno Mayz

机构 * Quanta Labs, LLC(Quanta Labs有限责任公司) Universidad Monteávila(蒙特阿维拉大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 针对教育支持服务中资格衰减、训练与需求冲突的合格能力问题,提出一个合成基准与决策支持框架,通过多控制器比较揭示新资格获取可达性决定最优策略的机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31948 2026-07-01 cs.RO 新提交 78%

RRT-Rope: A deterministic shortening approach for fast near-optimal path planning in large-scale uncluttered 3D environments

RRT-Rope:一种用于大规模无杂波3D环境中快速近最优路径规划的确定性缩短方法

Louis Petit, Alexis Lussier Desbiens

机构 * University of Sherbrooke(舍布鲁克大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 提出RRT-Rope算法,通过改进RRT-Connect快速生成可行路径,并利用确定性缩短技术后处理,在大型无杂波3D环境中实现比现有RRT变体快70%的近最优路径规划。

Comments 8 pages, accepted at the 2021 IEEE International Conference on Systems, Man, and Cybernetics (SMC), Melbourne, Australia

Journal ref 2021 IEEE International Conference on Systems, Man, and Cybernetics (SMC), Melbourne, Australia, 2021, pp. 1111-1118

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31071 2026-07-01 cs.CV cs.RO 新提交 78%

Hierarchical 3D Scene Graph Construction and Belief-based Planning for Semantic Navigation

层次化3D场景图构建与基于信念的语义导航规划

Bing Wu, Zuyao Chen, Changwen Chen

机构 * The Hong Kong Polytechnic University(香港理工大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 提出零样本语义导航框架,通过在线维护层次化3D场景图(HSG)实现多粒度语义拓扑,并基于信念规划进行有限视野推演,在长距离导航中显著提升成功率与路径效率。

Comments Camera-ready version accepted at ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30817 2026-07-01 cs.RO 新提交 78%

TAPE: Tether-Aware Path Planning for Autonomous Exploration of Unknown 3D Cavities Using a Tangle-Compatible Tethered Aerial Robot

TAPE:面向自主探索未知三维空腔的系绳感知路径规划,采用防缠绕系绳空中机器人

Louis Petit, Alexis Lussier Desbiens

机构 * Createk Design Lab, University of Sherbrooke(谢布克大学Createk设计实验室)

专题命中 规划决策 :planning(title,abstract)

AI总结 提出一种两级分层路径规划方法,通过全局TSP最小化距离和局部可调决策函数平衡路径成本与系绳长度,实现未知三维空腔的自主探索,仿真和实地测试验证了有效性。

Comments 8 pages

Journal ref IEEE Robotics and Automation Letters, vol. 7, no. 4, pp. 10550-10557, 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31222 2026-07-01 cs.AI 新提交 74%

Thinking Before Retrieving: Robust Zero-Shot Composed Image Retrieval via Strategic Planning and Self-Criticism

先思考再检索:通过战略规划与自我批评实现鲁棒的零样本组合图像检索

Gunho Jung, Jeong-Woo Park, Seon Bin Kim, Seong-Whan Lee

机构 * Department of Artificial Intelligence, Korea University(高丽大学人工智能系)

专题命中 规划决策 :planning(title);分类 cs.AI

AI总结 提出PEC-CIR框架,通过规划器-执行器-批评家多阶段推理流水线构建查询,在零样本组合图像检索中减少生成错误,提升检索精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25519 2026-07-01 cs.AI cs.LG 新提交 73%

Quantization Inflates Reasoning: Token Inflation as a Hidden Cost of Low-Bit Reasoning Models

量化膨胀推理:低比特推理模型的隐藏成本——令牌膨胀

Xinyu Lian, Walid Krichene, Beichen Huang, Masahiro Tanaka, Olatunji Ruwase, Li Zhang, Minjia Zhang

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Microsoft(微软) Anyscale Snowflake

专题命中 规划决策 :tool-use(abstract);agentic(abstract);分类 cs.AI、cs.LG

AI总结 研究发现低比特后训练量化虽保持推理准确性,但会显著增加推理令牌使用量,导致端到端服务性能下降,并提出了CoT令牌膨胀比来量化该效应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31425 2026-07-01 math.OC 新提交 71%

Joint Planning and Scheduling of Modular Vehicles for Passenger-Freight Integration

客货一体化模块化车辆的联合规划与调度

Wanru Chen, Jiaming Wu, Balázs Kulcsár

专题命中 规划决策 :planning(title)

AI总结 针对双向公交走廊,提出模块化车辆系统,通过联合优化服务路线、时刻表、车辆组成等,最小化成本并处理乘客需求不确定性,使用Benders分解算法求解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31252 2026-07-01 cs.AI 新提交 70%

Embodied CAD: Solver-Grounded LLM Agents for Parametric B-Rep Assembly Modeling

具身CAD:基于求解器的LLM代理用于参数化B-Rep装配建模

Fumin Liu, Haoyu Zhou, Fei Hao, Lin Yang

机构 * Nanjing University(南京大学)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.AI

AI总结 提出Embodied CAD框架,通过分层技能库和求解器反馈,让LLM代理迭代生成并修复参数化B-Rep装配模型,实现高可执行率和任务完成率。

Comments This paper contains 12 pages, 7 figures. This is an original unpublished manuscript submitted to the arXiv preprint server, with no prior publication or conference presentation

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31866 2026-07-01 cs.LO cs.MA 新提交 67%

Inquisitive Action Logic

探究性行动逻辑

Ivano Ciardelli

专题命中 规划决策 :agent(abstract);multi-agent(abstract)

AI总结 提出探究性行动逻辑InqAL,一种用于推理行动的多主体模态逻辑,通过问题模态分析主体对结果的确定作用,并证明其完备性和可判定性。

Comments In Proceedings AiML 2026, arXiv:2606.29444

Journal ref EPTCS 447, 2026, pp. 222-241

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31260 2026-07-01 cs.RO 新提交 67%

Plan Right, Then Plan Tight: Symbolic RL for Efficient Embodied Reasoning

先规划正确,再规划紧凑:面向高效具身推理的符号强化学习

Xiangli Shi, Xiaomeng Zhu, Ye Tian, Yuchun Guo, Ziyang Sun, Lujie Yin, Yuxuan Zhou, Yufei Huang

机构 * Tsinghua University(清华大学) The Hong Kong University of Science and Technology(香港科技大学) Tencent(腾讯) University of London(伦敦大学)

专题命中 规划决策 :agent(abstract);planning(abstract)

AI总结 针对具身任务规划中缺乏低成本确定性验证的问题,提出基于BDDL规范的符号强化学习框架,通过视频解析、LLM验证和轻量符号引擎提供毫秒级密集反馈,并引入难度感知长度调度GroupAdapt,在BEHAVIOR-1000上实现97.3的严格通过率,相对Qwen3-8B提升25.9%。

Comments 18 pages, 10 figures, 14 tables; includes appendix

详情

展开后加载摘要…

URL PDF HTML 收藏