Agentic AI: User Empowerment or Enclosure?
智能体AI:用户赋能还是圈地?
专题命中 工具调用 :agentic(title,abstract);分类 cs.AI
AI总结 本文通过分析广告拦截器等四个领域,指出智能体AI的治理决策本质是政治选择,其配置正被模型上下文协议等专有框架锁定,可能损害用户权益。
Comments Extended version of AIES'2026 publication
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
智能体AI:用户赋能还是圈地?
专题命中 工具调用 :agentic(title,abstract);分类 cs.AI
AI总结 本文通过分析广告拦截器等四个领域,指出智能体AI的治理决策本质是政治选择,其配置正被模型上下文协议等专有框架锁定,可能损害用户权益。
Comments Extended version of AIES'2026 publication
AgentChaos:通过可编程故障注入实现智能体系统的混沌工程
专题命中 工具调用 :agent(title,abstract);分类 cs.SE
AI总结 提出AgentChaos框架,在不修改源代码的情况下于LLM API共享层注入故障,评估显示智能体系统鲁棒性取决于自身实现,现有故障诊断方法仍有提升空间。
Comments Accepted at the 41st IEEE/ACM International Conference on Automated Software Engineering (ASE 2026)
CEDAR:面向复杂系统目标导向优化的智能体编排树搜索算法
机构 * Sakana AI
专题命中 工具调用 :agent(title);分类 cs.AI
AI总结 针对复杂系统目标导向设计的难题,提出基于LLM智能体的CEDAR方法,通过LLM驱动的MCTS实现复杂系统的目标导向发现,减少人力投入并促进其跨领域应用。
Comments Accepted as Talk in ALIFE 2026: The 2026 Conference on Artificial Life
BONSAI:基于可进化性的技能树搜索
专题命中 工具调用 :agent(abstract);分类 cs.AI
AI总结 该研究提出BONSAI技能优化框架,基于可进化性的蒙特卡洛树搜索优化冻结智能体的技能,在30B智能体和三个基准上,较无技能智能体及GEPA、SkillOpt基线显著提升保留集准确率。
基于物理学原理的材料人工智能用于可靠的材料发现
专题命中 工具调用 :AI agent(abstract)
AI总结 该研究提出PhysMat AI框架,整合物理知识用于材料发现,通过多领域示例说明其应用,还规划了从物理感知到自主AI的发展路线,助力可靠材料发现。
NiyamAI——一种使用零知识证明实现密码学可验证护栏的意图绑定AI智能体
专题命中 规划决策 :agent(title,summary_cn);AI agent(title,abstract);分类 cs.AI
AI总结 Niyam-AI是一种基于零知识证明的意图绑定AI智能体框架,通过SHA-256承诺意图合约、Judge模型验证和zk-SNARK确保证明,在Agent-SafetyBench评估中较多款基线护栏实现显著安全性能提升。
符号执行的智能体规划
专题命中 规划决策 :planning(title,abstract);agentic(title,abstract);agent(abstract);分类 cs.AI、cs.SE
AI总结 该研究提出智能体规划系统Agolic,利用早期符号执行运行的证据配置后续有界符号执行,在C/C++程序上平均覆盖3倍以上分支,覆盖更多分支及对比语料库未覆盖的分支,扩展了符号执行的实际覆盖范围。
面向终身多智能体路径发现(LMAPF)的、采用交错更新机制的可扩展长时程规划
专题命中 规划决策 :planning(title,abstract);agent(abstract,abstract_cn);multi-agent(abstract,abstract_cn);分类 cs.AI
AI总结 该研究针对通用地图的终身多智能体路径发现问题,提出PUSH规划器,结合多种框架优势实现可扩展长时程规划,在10k智能体场景下吞吐量优于基线方法
Comments 11 pages, 6 figures
AgentPatch:用于合并智能体多模态大语言模型的由粗到细弱任务修复
专题命中 规划决策 :agentic(title,abstract);agent(abstract,abstract_cn);tool use(abstract);planning(abstract)
AI总结 针对智能体多模态大语言模型合并时的弱任务退化与关键行为遗忘问题,提出无需训练的AgentPatch框架,通过由粗到细修复实现能力平衡,提升合并模型性能。
编程智能体的在线监控与纠正引导
专题命中 规划决策 :agent(summary_cn,abstract);planning(abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 本文提出LivePlan,通过解耦判断与建议的设计,在SWE-agent基础上实现编程智能体的在线监控与纠正,在SWE-bench数据集上显著提升问题解决率,且成本增量极小。
KNOWPLAN:用于智能学位路径规划的知识驱动型AI智能体
专题命中 规划决策 :planning(title,abstract);AI agent(title);分类 cs.AI
AI总结 KnowPlan将学位路径规划拆分为提取与优化阶段,CatalogBrowse负责课程爬取解析,DegreeMap基于超图优化,在多赛道实验中实现了高召回率、可行性与效用提升。
CAi Copilot:通过意图驱动的智能体工作流减少分子设计中的操作工作量
机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) ; Nanjing University(南京大学)
专题命中 规划决策 :agentic(title);agent(abstract);workflow(abstract);分类 cs.AI、cs.LG
AI总结 CAi Copilot是面向专家的意图驱动智能体,通过三层架构整合分子设计分散工具,在45项任务中整体性能最优,得分84.59,可将设计意图转化为可追溯工作流。
超越《星夜》:面向艺术家基础的文本到图像生成的捷径感知控制状态规划
机构 * Jilin University(吉林大学) ; Adobe(奥多比公司) ; University of Wisconsin(威斯康星大学)
专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI
AI总结 该研究针对艺术家基础的文本到图像生成存在的捷径偏差问题,提出 Atelier 框架,结合 ArtIntentBench 基准测试,提升了风格保真度与结构保留度,减少了捷径替换。
Comments 47 pages, 13 figures, including appendices. Kuan Xing and Ye Wang contributed equally
评估人机协作中分层强化学习策略的可解释人工智能(XAI)支持
专题命中 规划决策 :agent(title,abstract);分类 cs.AI;autonomous agent(journal_ref)
AI总结 本文首次在Overcooked-AI基准中,对分层特设智能体(HA²)架构生成的文本/音频实时解释开展被试间实验,分析XAI对人机协作的影响,为评估可解释强化学习架构建立基线方法。
Comments 13 pages, 6 figures, accepted as an Extended Abstract at AAMAS 2026
Journal ref Proc. of the 25th International Conference on Autonomous Agents and Multiagent Systems. 2026. p. 3259-3261
复杂天然产物的优先策略合成规划
专题命中 规划决策 :planning(title);agentic(abstract);分类 cs.AI
AI总结 基于大语言模型的智能体框架SynthEx,可规划出传统算法无法实现的复杂天然产物合成路线,其关键步骤获化学家认可,相关路线数据库SynthAtlas已开放。
面向决策与智能体AI的因果数据管理生态系统
专题命中 规划决策 :agentic(title);agent(abstract);分类 cs.AI
AI总结 本文针对AI生态系统决策混杂问题,提出构建共享可查询的因果世界系统(CWS),为面向决策与智能体AI的因果数据管理生态系统提供支持。
Comments Accepted at ACM AI Leadership Summit 2026
那么多少,然后在哪里:多轮智能体强化学习中保留信用的动作到令牌分配
专题命中 规划决策 :agent(title,abstract);分类 cs.AI
AI总结 本文提出FACTOR算法,通过分离动作级与令牌级信用分配,在多轮智能体强化学习的ALFWorld等环境中实现性能提升,且超参数可跨模型迁移。
优化器即智能体:跨提示、程序与机器学习工作流的推理驱动搜索
机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校) ; Snowflake(思诺飞克公司)
专题命中 规划决策 :agent(title,abstract);分类 cs.AI
AI总结 该研究提出ReASearch统一框架,让智能体自主优化提示、程序与ML工作流,在14项任务中优于专用系统,部分发现超人类最佳结果的方案。
Journal ref COLM 2026
基于深度强化学习的车辆路径问题——工业中卡车规划的案例研究
机构 * Bosch Center for Artificial Intelligence(博世人工智能中心) ; School of Electronic Information and Electrical Engineering(电子信息与电气工程学院) ; School of Computer Science, Macau University of Science and Technology(澳门科技大学计算机学院)
专题命中 规划决策 :planning(title);agent(abstract);分类 cs.AI
AI总结 本文以工业卡车规划为案例,针对三个物流场景,提出基于深度强化学习的车辆路径优化方法,其优化后路径总成本较基线降低10%以上,还提出可将该算法推广至更多VRP变体。
视界差距:长视界大语言模型智能体的规划、记忆、执行、训练与评估
机构 * DeepGrounding(深地研究机构) ; AlphaAvatar(阿尔法 Avatar 公司)
专题命中 规划决策 :planning(title,abstract);分类 cs.CL
AI总结 本文提出长视界大语言模型智能体存在的视界差距,调研1547篇相关论文,厘清长视界等属性,分析领域应对措施并提出开放测量问题。
Comments 39 pages, 6 figures
通过逆优化揭示生产规划中的专家目标:一项工业案例研究
专题命中 规划决策 :planning(title,abstract);分类 cs.LG
AI总结 本研究提出数据驱动的逆优化框架,推断工业生产规划中专家决策隐含的目标函数,应用于陶氏化学案例证实该方法可将隐性专业知识转化为可解释的决策支持模型。
Journal ref Chemical Engineering Research and Design, 2026
驾驶视觉-语言-动作模型中规划 token 的深度探测与剪枝
机构 * Robert Bosch GmbH(罗伯特·博世有限公司) ; Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院)
专题命中 规划决策 :planning(title,abstract)
AI总结 本文针对驾驶 VLA 模型的规划 token,通过探测其 32 个解码器层的信号并剪枝部分层,在误差小幅增加下实现 1.33 倍解码器加速,验证了规划信息早期存在但格式适配问题。
Comments Accepted at the 6th DriveX Workshop (Foundation Models for Autonomous Driving), ECCV 2026. 14 pages, 8 figures, 4 tables
基于运动学耦合SVSDF的移动操作臂携带任意形状负载的实时全身运动规划
机构 * University of Hong Kong(香港大学) ; Tsinghua University(清华大学)
专题命中 规划决策 :planning(title,abstract)
AI总结 本文提出基于KC-SVSDF的移动操作臂实时全身运动规划框架,通过链分解碰撞检查等方法,可可靠在复杂环境中运输大型非凸任意形状负载。
面向多机器人多目标规划的伊辛加速
专题命中 规划决策 :planning(title,abstract)
AI总结 本文研究CMOS伊辛机在多机器人多目标规划中的加速能力,提出适配硬件的规划方法与流水线,其能耗远低于经典方案,路径质量接近经典基准,可用于规划栈的部分环节。
Comments 11 pages, 14 figures
用于控制的学习型世界模型中的度量非崩溃:逼近理论、有限样本几何保证与确定性规划迁移
专题命中 规划决策 :planning(title,abstract)
AI总结 该研究为非线性确定性控制系统的学习型世界模型构建三部分数学理论,含逼近理论、有限样本几何保证及确定性规划迁移方法,通过数值实验验证了相关方法的有效性。
ResidencyRL:在模拟临床环境中开展的强化学习
机构 * Google DeepMind(谷歌DeepMind) ; Google Research(谷歌研究院) ; Houston Methodist Hospital(休斯顿卫理公会医院) ; Trinity Health Group(三一健康集团) ; Stanford Oncology Partners(斯坦福肿瘤学伙伴) ; St. Luke Hospital(圣卢克医院)
专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL
AI总结 本研究提出 ResidencyRL,通过多轮强化学习训练临床 AI 智能体,在模拟临床环境中提升诊断准确性、降低漏报率,且能力可迁移至多个医学基准测试,为临床 AI 发展提供了新路径。
面向AI原生大规模敏捷软件开发中的保证闭合
专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.SE
AI总结 针对AI原生大规模敏捷软件开发中保证推理机器可操作的缺口,提出基于共享语义保证层的高层架构及六项对应能力,以实现保证闭合。
Transformer难以利用其涌现的世界模型:重新审视汉诺塔与思维的错觉
机构 * University of Amsterdam(阿姆斯特丹大学)
专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG
AI总结 本文研究发现,Qwen3.6-27B等大型推理模型虽能编码汉诺塔的谢尔宾斯基世界模型,但因表示衰减导致圆环数超3时失败,注入提示词时间表示可部分恢复性能。
用于小企业短历史多KPI预测的会计图变换器
机构 * Foresight-AI, Intuit(富睿特远见人工智能实验室,Intuit公司)
专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG
AI总结 提出Accounting Graph Transformer模型,针对小企业短历史数据完成13项财务KPI的12个月联合预测,在多组测试集上均优于LightGBM等基准模型,为企业财务分析提供集成预测层。
IB-RL:用于策略性对话智能体的孤立双边强化学习
专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL
AI总结 针对现有RL训练范式的静态对应智能体不匹配问题,提出IB-RL方法,在Vehicle TeleSales和Deal-or-NoDeal任务上较单边RL基线显著提升了策略对未见过对应智能体的泛化能力。