A General Equilibrium Theory of Orchestrated AI Agent Systems
一个 orchestrated AI agent 系统的一般均衡理论
专题命中 规划决策 :agent(title,title_cn);AI agent(title,title_cn);分类 cs.AI
AI总结 本文提出了一种基于一般均衡理论的AI代理系统模型,通过集中编排实现系统福利最大化,并证明了均衡存在性和收敛性。
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
一个 orchestrated AI agent 系统的一般均衡理论
专题命中 规划决策 :agent(title,title_cn);AI agent(title,title_cn);分类 cs.AI
AI总结 本文提出了一种基于一般均衡理论的AI代理系统模型,通过集中编排实现系统福利最大化,并证明了均衡存在性和收敛性。
Agentic-DPO:从专家轨迹上的模仿到智能体策略优化
机构 * Johns Hopkins University(约翰·霍普金斯大学)
专题命中 规划决策 :agentic(title,title_cn);agent(abstract);分类 cs.AI
AI总结 研究针对大语言模型智能体基于专家轨迹训练只学动作序列、难应对错误的问题,提出Agentic-DPO方法,通过转化专家轨迹为状态条件偏好监督,结合策略保持增强,实现低成本智能体策略优化,实验验证其有效性。
论文路由器-智能体:用于个性化分层论文路由的基于内容的语言模型智能体
机构 * University of Sydney(悉尼大学)
专题命中 规划决策 :agent(title,summary_cn);分类 cs.CL
AI总结 研究个性化分层论文路由问题,提出无需训练基于文件夹成员决策的PaperRouter-Agent智能体,在真实个人图书馆和公共基准测试中,该智能体有效提升论文路由召回率和准确率,且成本低。
Mako:用于自主网络攻击的自进化智能操作系统(SE-AOS)
专题命中 规划决策 :agentic(title,abstract);agent(abstract);AI agent(abstract);分类 cs.AI
AI总结 介绍用于自主网络攻击的自进化智能操作系统SE-AOS,以Mako为首个实例,在XBOW验证基准上实现全套件覆盖,提出自主攻击定律,运行自进化循环,因研究有双重用途,公布科学成果但保留操作细节等。
Comments 13 pages, 10 figures, 8 tables
VIA:用于机器人控制的视觉接口代理
机构 * Stanford University(斯坦福大学)
专题命中 规划决策 :agent(title,abstract);planning(abstract);agentic(abstract);分类 cs.AI
AI总结 研究探索能否用基础模型通过视觉接口控制机器人,提出 VIA 框架,将机器人控制转为代理任务,该框架无需特定微调及特权信息,能零样本解决多种桌面操作任务,凭借基础模型能力提升取得高成功率,证明前沿代理技能可借合适接口用于机器人控制。
GRASP:用于智能检索增强生成的粒度感知搜索策略
机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) ; Adobe Research(Adobe 研究院)
专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI
AI总结 研究智能体检索增强生成中模型决策难题,提出GRASP强化学习框架,训练智能体协调互补检索工具,实验表明其提升检索召回率和问答性能,还展现出可解释行为,凸显协调检索信号和上下文粒度对智能体推理的关键作用。
探索用于生成高质量数学视觉辅助工具的智能工作流程
机构 * Stanford Graduate School of Education(斯坦福大学教育研究生院) ; Department of Computer Science(计算机科学系)
专题命中 规划决策 :agentic(title,abstract);workflow(abstract);分类 cs.AI
AI总结 研究针对中学数学图表可靠生成难的问题,引入智能工作流程,让 LLM 智能体评估并迭代改进生成的视觉效果,通过探索性评估确定改进关键领域,初步证明可提高 AI 生成数学图表的可靠性和教育价值。
Comments 13 pages, 9 figures. Exploratory course project on agentic workflows for generating and evaluating K 12 mathematical diagrams
策略驱动的CT智能体:为临床一致的CT推理建模阶段感知诊断控制
机构 * University of Science and Technology of China(中国科学技术大学) ; Technical University of Munich(慕尼黑工业大学)
专题命中 规划决策 :agent(title,abstract);planning(abstract);分类 cs.LG
AI总结 研究针对CT诊断阶段选择协议差异及现有方法局限,提出策略驱动的CT智能体(PD-CTAgent)。通过临床结构抽象模块和知识引导诊断控制模型,实现阶段感知诊断推理,实验验证其在多数据集上的有效性与临床一致性。
Comments 8 pages, 4 figures
扩展视野而非参数:以35B智能体达到万亿参数性能
机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
专题命中 规划决策 :agent(title,abstract);agentic(abstract);分类 cs.CL
AI总结 提出35B混合专家智能体模型Agents-A1,通过扩展智能体视野(长程轨迹与异构能力)达到万亿参数级别性能,采用三阶段训练(全领域微调、领域教师模型、多教师领域路由策略蒸馏)在多个长程基准上取得领先或竞争力结果。
Comments The model checkpoints and evaluation codebase are available at https://huggingface.co/collections/InternScience/agents-a1 and https://github.com/InternScience/Agents-A1
用于物联网支持的自动驾驶的大语言模型增强可微轨迹规划
机构 * State Key Laboratory of Automotive Simulation and Control, Jilin University(吉林大学汽车仿真与控制国家重点实验室) ; Center of Research for Cyber Security and Network (CSNET), Faculty of Computer Science and Information Technology, Universiti Malaya(马来西亚大学计算机科学与信息技术学院网络安全与网络研究中心) ; Interdisciplinary Centre for Security, Reliability and Trust (SnT), University of Luxembourg(卢森堡大学安全、可靠性与信任跨学科中心) ; IMT, Department of Humanities and Technology, Roskilde University(罗斯基勒大学人文与技术系IMT) ; Center for Security, Theory and Algorithmic Research, International Institute of Information Technology(国际信息技术研究所安全、理论与算法研究中心) ; Department of Computer Science and Engineering, College of Informatics, Korea University(韩国大学信息学院计算机科学与工程系)
专题命中 规划决策 :planning(title,abstract);agent(abstract)
AI总结 针对物联网支持的自动驾驶规划问题,提出大语言模型增强可微轨迹规划框架。通过以周围智能体为中心的数据增强、复杂度感知的语义增强模块及可微优化模块,提升规划效果,在相关基准测试中取得高分,验证了在线部署和实时闭环执行能力。
Comments 13 pages, 5 figures
PrismAD:通过语义规划器混合实现端到端自动驾驶的解耦规划
机构 * School of Vehicle and Mobility, Tsinghua University(清华大学车辆与运载学院) ; State Key Laboratory of Intelligent Green Vehicle and Mobility, Tsinghua University(清华大学智能绿色车辆与出行国家重点实验室) ; School of Cyberspace Security, Southeast University(东南大学网络空间安全学院) ; School of Computer Science and Engineering, Southeast University(东南大学计算机科学与工程学院) ; School of Automotive Engineering, Wuhan University of Technology(武汉理工大学汽车工程学院) ; SAIC GM Wuling Automobile Co., Ltd.(上汽通用五菱汽车股份有限公司)
专题命中 规划决策 :planning(title,abstract);agent(abstract)
AI总结 研究针对自动驾驶规划器耦合问题,提出PrismAD框架,将场景令牌分组,用独立规划专家学习专门表示,语义感知路由器聚合预测,引入稀疏top-$K$激活,实验证明该框架性能具竞争力。
Comments 8 pages,5 figures
用于无人机群的以大语言模型为中心的智能体人工智能:架构、使能技术及开放问题
专题命中 规划决策 :agentic(title,abstract);planning(abstract)
AI总结 研究针对无人机群实际部署受限问题,提出以大语言模型为中心的智能体人工智能LAUS,回顾相关使能技术,分析威胁,确定包括抗幻觉推理等在内的开放研究挑战。
Comments 8 pages, 4 figures, 2 tables
为协助多个智能体依次导航的协作导航辅助车路径规划
机构 * Department of Mechanical Engineering(机械工程系) ; Engineering Science, University of North Carolina at Charlotte(工程科学,北卡罗来纳大学夏洛特分校)
专题命中 规划决策 :planning(title,abstract);agent(abstract)
AI总结 本文提出了一种贪心算法,用于规划协作导航辅助车路径,以依次协助多个智能体并减少导航不确定性。
Comments 6 pages
Journal ref IFAC-PapersOnLine 58 (20), 133-138, 2024
智能体技能中的跨层错位检测:一种渐进式加载感知对比学习方法
机构 * Indiana University Bloomington(印第安纳大学布卢明顿分校)
专题命中 规划决策 :agent(title,abstract);分类 cs.AI、cs.LG;agentic(comments)
AI总结 研究智能体技能跨层错位问题,提出渐进式加载感知分层对比学习框架PL-HCL,通过建模技能分层结构和学习跨层一致性来检测错位,使用相关语料库与挑战集,提升宏F1指标,为用户和运营商提供筛选工具与设计原则。
Comments 10 pages, 5 pages supplemental. Accepted at the KDD 2026 Workshop on Evaluation and Trustworthiness of Agentic AI
NVAITC人工智能科学家:一个受治理的端到端研究系统——以高血压全基因组关联研究为例
机构 * Department of Medical Research, China Medical University Hospital(中国医药大学附设医院医学研究部) ; Master Program for Digital Health Innovation, China Medical University(中国医药大学数字健康创新硕士项目) ; Laboratory for Statistical and Translational Genetics, RIKEN Center for Integrative Medical Sciences(理化学研究所综合医学科学中心统计与转化遗传学实验室) ; AI-Driven Genomic Medicine and Drug Discovery Lab, China Medical University Hospital(中国医药大学附设医院人工智能驱动的基因组医学与药物发现实验室)
专题命中 规划决策 :agent(abstract);planning(abstract);workflow(abstract);agentic(abstract)
AI总结 研究以高血压GWAS为例,介绍受治理的端到端智能研究系统NAIS,其集成多种功能。通过真实数据验证,NAIS能支持生物医学发现,规划队列提取等,重现高血压基因座,在药物性肝损伤预测中也有成果,可产生与专家主导流程相当的输出。
Comments 22 pages, 6 figures, 4 tables
MemDecay:用于高效大语言模型智能体推理的区域感知键值缓存逐出策略
机构 * Independent Researcher(独立研究者)
专题命中 规划决策 :agent(title,abstract);分类 cs.AI、cs.LG
AI总结 研究大语言模型智能体KV缓存内存瓶颈问题,提出无需训练的区域感知逐出策略MemDecay,为令牌分配特定区域优先级和衰减率,经实验验证该策略能有效管理缓存,确立语义提示结构对KV缓存管理的作用并明确其与关注重要性的结合方式。
大语言模型在代理临床推理中的信息获取失败
专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.CL
AI总结 研究大语言模型在临床推理中信息获取失败问题,开发血液肿瘤学代理评估框架,发现信息利用率是诊断准确性关键指标,推理痕迹与准确性不相关,主要失败模式为搜索满足等,指出模型主要限制是不确定性下信息获取失败。
Comments 66 pages, 9 figures; includes supplementary material
李代数胚上的智能体技能优化
机构 * Adobe Research(Adobe研究院) ; University of Massachusetts, Amherst(马萨诸塞大学阿默斯特分校)
专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.LG
AI总结 研究智能体技能优化问题,提出LASKO框架,将技能建模为李代数胚截面,利用李括号筛选测试替代昂贵验证,在自然语言任务因果提取中实现近15倍加速,提升技能优化速度。
Comments 20 pages
当我们谈论大语言模型规划时我们在谈论什么:两种不同规划能力的证据
机构 * Faculty of Information Technology, Monash University(莫纳什大学信息技术学院)
专题命中 规划决策 :planning(title,abstract);分类 cs.AI
AI总结 研究大语言模型规划任务性能差异原因,通过在ACPBench-Hard上评估多个模型家族,应用多维项目反应理论模型,发现操作推理和结构枚举两个塑造规划性能的维度,推动大语言模型规划的能力层面评估。
Comments 19 pages. Keywords: Reasoning, Automated Planning, Item Responses Theory, LLMs as Planner Research Area: NLP and Symbolic Reasoning Research Area Keywords: neurosymbolic, planning in agents, symbolic reasoning Contribution Types: Model analysis & interpretability
RefineEvo:基于双向经验的规划引导启发式进化
机构 * C$^2$DL, Institute of Automation, Chinese Academy of Sciences(C2DL,自动化研究所,中国科学院) ; School of Artificial Intelligence, University of Chinese Academy of Sciences, Beijing(人工智能学院,中国科学院大学,北京) ; University of Chinese Academy of Sciences, Nanjing(中国科学院大学,南京)
专题命中 规划决策 :planning(title,abstract);分类 cs.CL
AI总结 针对自动启发式设计中基于LLM方法的不足,提出RefineEvo框架,通过规划器和反射器,结合双向经验池动态调度进化算子,在经典组合优化基准测试中表现出色,提升了解质量和令牌效率。
基于文本目标和通过实到模拟图像转换实现从模拟到现实泛化的基于可供性的操纵规划
专题命中 规划决策 :planning(title,abstract);分类 cs.AI
AI总结 该研究提出基于可供性识别与动作效果预测的操纵规划系统,通过多模态目标匹配模块评估候选计划,能跟踪遮挡物体位置。还用图像转换模块辅助,分别评估模块性能并展示集成系统在模拟与硬件上的规划能力。
Comments 14 pages, 10 figures
分布式智能体系统:具身智能体间的容错协作
专题命中 规划决策 :agent(title,abstract);分类 cs.AI
AI总结 针对人工智能工程中智能体驱动任务执行面临的可靠性挑战,提出分布式智能体系统(DAS)框架,重新定义智能体可靠性,构建两层容错架构,为工业场景中异构具身智能体可靠协作提供实用工程途径。
即刻出发:面向多日城市旅行行程规划的用户需求导向框架
机构 * Jiangxi Normal University(江西师范大学)
专题命中 规划决策 :planning(title,abstract);分类 cs.AI
AI总结 针对大城市多日旅行行程规划难题,提出集成大语言模型与增强GRASP算法的框架,经实验验证其在行程质量和计算效率上显著优于现有方法,能动态满足多样用户需求。
Comments 37 pages, 16 figures, 7 tables
覆盖路径规划:经典基础、最新进展与未来方向
机构 * College of Information Science and Technology, Jinan University(暨南大学信息科学技术学院) ; Department of Electrical and Computer Engineering, University of Connecticut(康涅狄格大学电气与计算机工程系) ; Global College, Shanghai Jiao Tong University(上海交通大学密西根学院) ; School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) ; School of Electronics and Information Engineering, Wuyi University(五邑大学电子与信息工程学院) ; School of Computer Science and Engineering, South China University of Technology(华南理工大学计算机科学与工程学院)
专题命中 规划决策 :planning(title,abstract);分类 cs.AI
AI总结 本文全面综述2015至2026年125篇覆盖路径规划(CPP)代表性作品,结合经典方法展示其演变。CPP方法分六类,总结各类规划公式、算法等,分析相关因素对问题的塑造,讨论开放挑战,提供了发展概况与未来研究方向。
BucketKD:用于端到端运动规划的基于桶的安全感知知识蒸馏框架
机构 * University of Memphis(孟菲斯大学)
专题命中 规划决策 :planning(title,abstract);分类 cs.LG
AI总结 针对端到端运动规划模型规模大难在资源受限平台部署的问题,提出BucketKD框架。该框架将关键环境变量离散化,并设计安全感知航路点注意力机制。实验表明,其在规划精度、安全性及压缩率方面表现出色,显著优于现有方法。
LegalFarePlan:非加法票价规则下票价透明的城市轨道交通线路规划标签设定框架
专题命中 规划决策 :planning(title,abstract);分类 cs.AI
AI总结 研究非加法票价规则下城市轨道交通线路规划问题,提出LegalFarePlan框架,将合法进出站建模为约束条件,通过多种算法实现可解释线路规划,在半合成基准测试中取得一定票价降低成果,展示方法行为与可重复性。
Comments 6 pages, 4 tables; author preprint version, not the conference camera-ready version
SkillGuard:一种面向智能体技能的权限框架
专题命中 规划决策 :agent(title,abstract);分类 cs.SE
AI总结 提出SkillGuard权限框架,通过双平面治理模型联合管控上下文影响和动作副作用,以缩小技能声明意图与运行时行为之间的安全差距。
未知多房间家庭环境中多目标搜索的交错部分可观测马尔可夫决策过程规划
机构 * Georgia Institute of Technology(佐治亚理工学院) ; The Hong Kong University of Science and Technology(香港科技大学) ; Ising AI(伊辛人工智能公司) ; MIT(麻省理工学院) ; Notre Dame University(圣母大学)
专题命中 规划决策 :planning(title,abstract)
AI总结 研究未知多房间家庭环境下多目标搜索问题,提出Inter-POMDP算法,通过高级POUCT规划器与低级运动规划器相互作用,平衡规划质量与效率,相比基线方法减少碰撞、导航步数及检测次数。
使用具有迭代重新规划的基础模型进行零售商店中的移动操作任务规划
机构 * TCS Research, Tata Consultancy Services Ltd.(塔塔咨询服务公司TCS研究院)
专题命中 规划决策 :planning(title,abstract)
AI总结 研究零售场景补货问题,利用大语言模型和视觉语言模型,结合定制移动操作平台、用户驱动提示及反馈迭代重新规划方法纠错,在模拟环境验证端到端系统,为零售自动化提供了新的任务规划方案。
人类共享环境中长距离多机器人路径规划的扩散方法
机构 * Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)
专题命中 规划决策 :planning(title,abstract)
AI总结 研究人类共享环境中多机器人长距离路径规划问题,提出MRRD框架,结合滚动时域、并行扩散推理及冲突搜索机制,纳入时间条件与引导项,实验证明该框架能实时扩展到15个机器人,性能优于现有基线。
Comments 8 pages, 3 figures, to be published in IROS 2026