arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 2976 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 909 篇

2510.24891 2026-07-17 cs.CL cs.LG 版本更新 81%

Idea2Plan: Exploring AI-Powered Research Planning

Idea2Plan:探索人工智能驱动的研究规划

Jin Huang, Silviu Cucerzan, Sujay Kumar Jauhar, Ryen W. White

机构 * University of Michigan(密歇根大学) Microsoft Research(微软研究院)

专题命中 规划决策 :planning(title,abstract);分类 cs.CL、cs.LG

AI总结 探讨大语言模型从概念研究想法到结构化研究计划的过渡能力,通过引入Idea2Plan任务、基准及JudgeEval评估,实验发现GPT-5表现最佳但仍有提升空间,为LLMs研究规划能力研究提供新见解和基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12547 2026-07-16 cs.RO cs.AI cs.LG 版本更新 81%

Mind the Gap: Promises and Pitfalls of Hierarchical Planning in LeWorldModel

注意差距:LeWorldModel中分层规划的前景与陷阱

Niccolò Caselli, Francesco Massafra, Samuele Punzo, Salvatore Lo Sardo, Ippokratis Pantelidis, Sathya Kamesh Bhethanabhotla

机构 * University of Amsterdam(阿姆斯特丹大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 研究长期目标条件控制下时间层次结构对LeWorldModel的影响,提出Hi-LeWM扩展,通过冻结低级模型并添加高级规划。实验发现层次结构需合理设计,无约束搜索有问题,约束搜索可改善性能,表明时间抽象有益,但高级搜索要与低级控制器兼容。

Comments Accepted at WM@Booth 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04464 2026-07-16 cs.LG cs.AI 版本更新 81%

Operator-on-F complements value-equivalence: a planning-time diagnostic for latent world models

算子对F补充值等价性:潜在世界模型的规划时诊断

Donna Vakalis

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 研究针对基于模型的强化学习中世界模型评估问题,引入算子对F诊断,通过模型自身预测器比较模型与环境的k步潜在前推,揭示其与规划回报的强关联及在跨架构比较中的作用,补充而非替代值等价性诊断。

Comments Accepted at RLC 2026 WM Workshop. V2 places the diagnostic in Koopman representation theory; references expanded. Results unchanged

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18223 2026-07-16 cs.CR cs.AI cs.LG cs.SY eess.SY 版本更新 81%

Learning Red Agent Policy from Observations for Neurosymbolic Autonomous Cyber Agents

从观测中学习红方代理策略用于神经符号自主网络代理

Ankita Samaddar, Sandeep Neema, Daniel Balasubramanian, Xenofon Koutsoukos

机构 * MIT(麻省理工学院)

专题命中 规划决策 :agent(title,abstract);分类 cs.AI、cs.LG

AI总结 针对网络攻击中红方动作不可观测的问题,提出基于模仿学习的策略学习技术,从网络观测和防御动作预测红方行为,集成神经符号防御代理实现高精度预测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07743 2026-06-29 cs.AI cs.LG 版本更新 81%

Symmetry-Aware Transformer Training for Automated Planning

面向自动规划的对称感知Transformer训练

Markus Fritzsche, Elliot Gestrin, Jendrik Seipp

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 提出对比学习目标使Transformer感知对称性,结合架构改进,解决其在自动规划中因问题对称性导致的泛化困难。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03476 2026-06-24 cs.LG cs.AI cs.MA cs.NA math.NA physics.comp-ph 版本更新 81%

ATHENA: Agentic Team for Hierarchical Evolutionary Numerical Algorithms

ATHENA:分层进化数值算法的智能团队

Juan Diego Toscano, Daniel T. Chen, George Em Karniadakis

机构 * Division of Applied Mathematics, Brown University(布朗大学应用数学系)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.LG

AI总结 ATHENA通过知识驱动的诊断流程,实现科学计算与科学机器学习的自动化,结合专家蓝图和组合空间,生成高精度数值解和稳定求解器,达到10^-14的验证误差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15555 2026-06-23 cs.MA cs.CE cs.LG cs.NE cs.SE 版本更新 81%

HEAS: Hierarchical Evolutionary Agent-Based Simulation Framework for Multi-Objective Policy Search

HEAS:面向多目标策略搜索的层次化进化智能体仿真框架

Ruiyu Zhang, Lin Nie, Xin Zhao

机构 * Department of Politics and Public Administration(政治与公共行政系) The University of Hong Kong(香港大学) Department of Applied Social Sciences(应用社会科学系) The Hong Kong Polytechnic University(香港理工大学)

专题命中 规划决策 :agent(title,abstract);分类 cs.LG、cs.SE

AI总结 提出HEAS框架,结合智能体仿真、进化搜索与场景评估,通过“度量契约”统一优化、评估和验证,支持多目标策略搜索。

Comments 6 pages, 2 figures. Python package: https://pypi.org/project/heas/ | Web playground: https://ryzhanghason.github.io/heas/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07459 2026-06-17 cs.CL cs.AI 版本更新 81%

MedicalAgentsBench for Complex Medical Reasoning: Comparing Internalized Reasoning Models versus Externalized Agent-based Frameworks

MedicalAgentsBench:复杂医学推理基准——比较内化推理模型与外化智能体框架

Yanjun Shao, Xiangru Tang, Jiwoong Sohn, Jiapeng Chen, Yuxuan Liao, Jiayi Zhang, Jinyu Xiang, Fang Wu, Yilun Zhao, Chenglin Wu, Wenqi Shi, Arman Cohan, Mark Gerstein

机构 * Program in Computational Biology & Biomedical Informatics, Yale University(计算生物学与生物医学信息学项目,耶鲁大学) Department of Biomedical Informatics & Data Science, Yale University(生物医学信息学与数据科学系,耶鲁大学) Department of Computer Science, Yale University(计算机科学系,耶鲁大学) Department of Biosystems Science and Engineering, ETH Zurich(生物系统科学与工程系,苏黎世联邦理工学院) Department of Computer Science, Stanford University(计算机科学系,斯坦福大学) Department of Bioinformatics, UT Southwestern Medical Center(生物信息学系,德克萨斯西南医学中心)

专题命中 规划决策 :agent(title,abstract);分类 cs.AI、cs.CL

AI总结 提出MedicalAgentsBench基准(862个复杂临床问题),比较内化推理模型与外化智能体框架在医学推理中的表现,发现两者效果可叠加,最优组合为o3-mini+MDAgents(准确率35.1%)。

Comments https://github.com/gersteinlab/MedicalAgentsBench

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09365 2026-06-16 cs.AI cs.CL 版本更新 81%

Experience Makes Skillful: Enabling Generalizable Medical Agent Reasoning via Self-Evolving Skill Memory

经验造就熟练:通过自进化技能记忆实现可泛化的医疗智能体推理

Haoran Sun, Wenjie Li, Yujie Zhang, Zekai Lin, Fanrui Zhang, Kaitao Chen, Xingqi He, Yichen Li, Mianxin Liu, Lei Liu, Yankai Jiang

机构 * Fudan University(复旦大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Shanghai Innovation Institute(上海创新研究院) Huazhong University of Science and Technology(华中科技大学)

专题命中 规划决策 :agent(title,abstract);分类 cs.AI、cs.CL

AI总结 提出SkeMex框架,通过技能记忆实现医疗智能体后部署自进化,无需更新模型权重,在临床任务中优于现有记忆型智能体。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05060 2026-06-16 cs.LG cs.CL 版本更新 81%

StagePilot: Stage-Level Planning for Long-Horizon Dialogue Simulation in Cybergrooming

StagePilot: 网络诱骗中长程对话模拟的阶段级规划

Heajun An, Qi Zhang, Minqian Liu, Xinyi Zhang, Sang Won Lee, Lifu Huang, Pamela J. Wisniewski, Jin-Hee Cho

机构 * Virginia Tech(弗吉尼亚理工大学) University of California, Davis(加州大学戴维斯分校) International Computer Science Institute(国际计算机科学研究所)

专题命中 规划决策 :planning(title,abstract);分类 cs.CL、cs.LG

AI总结 提出StagePilot框架,通过分离阶段级规划与响应生成,结合强化学习学习阶段策略,实现网络诱骗对话的结构化、连贯模拟,相比基线减少对话停滞,IQL+AWAC变体最终阶段到达率提升43%。

Comments Accepted at the 27th Annual Meeting of the Special Interest Group on Discourse and Dialogue (SIGDIAL 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07984 2026-06-15 cs.LG cs.AI 版本更新 81%

Where's the Plan? Locating Latent Planning in Language Models with Lightweight Mechanistic Interventions

计划在哪里?通过轻量级机制干预定位语言模型中的潜在规划

Nicole Ma, Nick Rui

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 通过押韵对句补全任务,使用线性探针和激活修补方法,研究语言模型在生成过程中是否形成并因果依赖未来约束的潜在规划,发现仅Gemma-3-27B模型存在因果依赖,并定位到五个注意力头。

Comments 13 pages, 20 figures, 3 tables. Accepted to Workshop on Mechanistic Interpretability @ ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03077 2026-06-11 cs.LG cs.AI cs.DC 版本更新 81%

Libra: Efficient Resource Management for Agentic RL Post-Training

Libra:面向智能体强化学习后训练的高效资源管理

Kaiwen Chen, Xin Tan, Jingzong Li, Hong Xu

机构 * The Chinese University of Hong Kong(香港中文大学) The Hang Seng University of Hong Kong (2018)(香港恒生大学)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.LG

AI总结 针对智能体强化学习中长尾、非平稳工作负载带来的资源管理挑战,提出Libra系统,通过周期性全局资源规划器和因果驱动多级反馈队列调度器,实现GPU分配优化和请求调度,最高提升3倍吞吐量和2.5倍收敛速度。

Comments 19 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04514 2026-06-10 cs.AI cs.CE cs.CL cs.CV stat.ME 版本更新 81%

ChartAgent: A Multimodal Agent for Visually Grounded Reasoning in Complex Chart Question Answering

ChartAgent: 一种用于复杂图表问答中视觉基础推理的多模态智能体

Rachneet Kaur, Nishan Srishankar, Zhen Zeng, Sumitra Ganesh, Manuela Veloso

机构 * J.P. Morgan AI Research(摩根大通人工智能研究)

专题命中 规划决策 :agent(title);agentic(abstract);分类 cs.AI、cs.CL

AI总结 提出ChartAgent框架,通过迭代分解查询为视觉子任务并利用图表专用视觉工具(如绘制注释、裁剪区域)进行空间域推理,在ChartBench和ChartX上取得最先进性能,尤其对无标注图表提升显著。

Comments Accepted at ACL 2026 (Main Conference). Also presented as an oral paper at the NeurIPS 2025 Multimodal Algorithmic Reasoning Workshop (https://marworkshop.github.io/neurips25/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01619 2026-06-09 cs.AI cs.LG stat.ML 版本更新 81%

ReSkill: Reconciling Skill Creation with Policy Optimization in Agentic RL

ReSkill:在智能体强化学习中协调技能创建与策略优化

Zelin He, Haotian Lin, Boran Han, Wei Zhu, Haoyang Fang, Bernie Wang, Xuan Zhu, Runze Li, Matthew Reimherr

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.LG

AI总结 提出ReSkill框架,通过GRPO的组结构嵌入断言驱动技能创建、组内轨迹采样和自适应汤普森采样,实现技能与策略的协同进化,在多个领域超越现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23292 2026-06-08 cs.AI cs.LG 版本更新 81%

Agentic Physical AI toward a Domain-Specific Foundation Model for Energy Systems: A Case Study on Nuclear Reactor Control

面向能源系统的领域特定基础模型的具身物理人工智能:以核反应堆控制为例

Yoon Pyo Lee, Samrendra Roy, Kazuma Kobayashi, Sajedul Talukder, Diab Abueidda, Seid Koric, Souvik Chakraborty, Syed Bahauddin Alam

机构 * The Grainger College of Engineering, Nuclear, Plasma & Radiological Engineering, University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校格雷格学院工程学院、核等工程学院) Department of Nuclear Engineering, Hanyang University(汉阳大学核工程系) University of Texas - El Paso(德克萨斯大学埃尔帕索分校) National Center for Supercomputing Applications(国家超级计算应用中心) Department of Applied Mechanics, Indian Institute of Technology Delhi(印度德里理工学院应用力学系) Yardi School of Artificial Intelligence, Indian Institute of Technology Delhi(印度德里理工学院亚里人工智能学院)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.LG

AI总结 本研究提出通过紧凑语言模型作为具身物理人工智能,利用基于物理模拟器验证的策略优化替代感知推理,在核反应堆控制任务中实现领域特定基础模型,并展示了规模扩展带来的可靠性提升和策略集中化行为。

Comments Accepted for publication in npj Artificial Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23545 2026-06-11 cs.AI 版本更新 80%

Planning under Distribution Shifts with Causal POMDPs

基于因果POMDP的分布偏移下规划

Matteo Ceriscioli, Karthika Mohan

机构 * School of Electrical Engineering and Computer Science (EECS)(电气工程与计算机科学学院)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 提出因果POMDP框架,通过干预表示环境变化,在部分可观测下维持PWLC性质,实现分布偏移下的规划与更新。

Comments To appear at the 36th International Conference on Automated Planning and Scheduling (ICAPS-26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14828 2026-06-11 cs.AI cs.RO 版本更新 80%

RoboGPT-R1: Enhancing Robot Task Planning with Reinforcement Learning

RoboGPT-R1: 通过强化学习增强机器人任务规划

Jinrui Liu, Bingyan Nie, Boyu Li, Yaran Chen, Yuze Wang, Shunsen He, Haoran Li

机构 * Institute of Automation, CASIA(中国科学院自动化研究所) School of Artificial Intelligence, UCAS(中国科学技术大学人工智能学院) Huawei Cloud Technology Co., Ltd(华为云技术有限公司)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI;autonomous agent(journal_ref)

AI总结 提出RoboGPT-R1两阶段微调框架,先监督学习获取基础知识,再通过强化学习提升视觉空间理解和推理能力,在EmbodiedBench上超越GPT-4o-mini 21.33%。

Journal ref Proceedings of the 25th International Conference on Autonomous Agents and Multiagent Systems (AAMAS 2026), pp. 2827-2837, IFAAMAS, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02386 2026-06-10 cs.AI q-bio.QM 版本更新 80%

AgentPLM: Agentic Protein Language Models with Reasoning-Augmented Decoding for Protein Sequence Design

AgentPLM:具有推理增强解码的智能体蛋白质语言模型用于蛋白质序列设计

Sahil Rahman, Maxx Richard Rahman

机构 * Sahil Rahman Maxx Richard Rahman

专题命中 规划决策 :agentic(title,journal_ref);agent(abstract);分类 cs.AI

AI总结 提出AgentPLM,通过推理增强解码和对比智能体策略优化,使预训练蛋白质语言模型能够利用外部生物物理反馈进行在线纠错,在多项蛋白质设计任务上取得最优结果。

Journal ref Workshop on Generative and Agentic AI for Biology, 43rd International Conference on Machine Learning (ICML 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12558 2026-07-09 physics.soc-ph 版本更新 80%

Involution game with migration and spatial heterogeneity of social resources

自反游戏与迁移及社会资源空间异质性

Bo Li, Qiwen Ge, Yong Shi

专题命中 规划决策 :agent(summary_cn,abstract)

AI总结 本文提出一个包含 agent 迁移和资源分布空间异质性的自反博弈模型,探讨迁移和资源分配条件对自反动态的影响,发现总资源恒定时相似资源水平抑制自反,而总资源增加会加剧自反,并识别努力比和效用乘数的阈值效应。

Comments 20 pages, 7figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14084 2026-06-11 cs.SE cs.AI cs.CL 版本更新 80%

CRANE: Constrained Reasoning Injection for Code Agents via Nullspace Editing

CRANE:通过空域编辑实现代码代理的约束推理注入

Mingzhi Zhu, Michele Merler, Raju Pavuluri, Stacy Patterson

机构 * Rensselaer Polytechnic Institute(拉特格斯理工学院) IBM Research(IBM研究院)

专题命中 规划决策 :agent(abstract);tool-use(abstract);planning(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 CRANE通过空域编辑技术,结合推理和工具使用能力,提升代码代理性能,在多个基准测试中取得显著成果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19082 2026-06-09 cs.AI cs.CL cs.GT cs.LG cs.MA 版本更新 80%

Payoff scaling shapes cooperation in LLM agents across languages

收益规模塑造跨语言LLM代理的合作行为

Trung-Kiet Huynh, Dao-Sy Duy-Minh, Thanh-Bang Cao, Phong-Hao Le, Hong-Dan Nguyen, Phu-Quy Nguyen-Lam, Minh-Luan Nguyen-Vo, Hong-Phat Pham, Phu-Hoa Pham, Thien-Kim Than, Chi-Nguyen Tran, Huy Tran, Gia-Thoai Tran-Le, Alessio Buscemi, Le Hong Trang, The Anh Han

机构 * Faculty of Information Technology, University of Science (HCMUS), Ho Chi Minh City, Vietnam(信息技术学院,科学大学(HCMUS),胡志明市,越南) Faculty of Computer Science and Engineering, Ho Chi Minh City University of Technology (HCMUT), Ho Chi Minh City, Vietnam(计算机科学与工程学院,胡志明市技术大学(HCMUT),胡志明市,越南) Vietnam National University – Ho Chi Minh City (VNU-HCM), Ho Chi Minh City, Vietnam(越南国家大学——胡志明市(VNU-HCM),胡志明市,越南) Luxembourg Institute of Science and Technology (LIST), Luxembourg(卢森堡科学与技术研究所(LIST),卢森堡) School of Computing, Engineering and Digital Technologies, Teesside University, Middlesbrough, United Kingdom(计算、工程与数字技术学院,泰赛德大学,米德尔斯布罗,英国)

专题命中 规划决策 :agent(abstract);autonomous agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 通过监督分类器识别重复囚徒困境中的策略,结合演化博弈论基线,发现随着收益增加,LLM反而更合作,与演化预测相反,表明对齐训练和人类推理模式的影响。

Comments 44 pages, 17 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21275 2026-06-08 econ.TH 版本更新 80%

Compromise by "multimatum"

通过“multimatum”达成妥协

Federico Echenique, Matías Núñez

专题命中 规划决策 :agent(summary_cn,abstract)

AI总结 本文提出了一种解决两agent社会选择问题的机制,通过构建共同的偏好基数化来实现两agent间的高效妥协,展示了multimatum在政治经济学、其他关照偏好和设施选址中的应用价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12751 2026-08-17 cs.AR cs.AI 版本更新 79%

SynAct: A Reasoning-Acting Large Language Model Agent for Adaptive Synthesis Optimization

SynAct:用于自适应综合优化的推理-行动大语言模型智能体

Fangzhou Liu, Peiyi Han, Jiawei Liu, Yuan Pu, Zhuolun He, Rongliang Fu, Tsung-Yi Ho, Bei Yu

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 SynAct是一种自适应闭环LLM推理-行动智能体,通过结合电路状态、工具知识与历史经验发布针对性命令,在14个商用设计实验中将平均WNS降至引导式综合的27%,实现高效自适应逻辑综合优化。

Comments 12 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09035 2026-08-17 cs.SD cs.AI cs.MM 版本更新 79%

MusicLayout: Explicit Structural Planning for Controllable Text-to-Music Generation

MusicLayout:用于可控文本生成音乐的显式结构规划

Shuyu Li, Kejun Zhang, Jiahe Lei, Shulei Ji, Zihao Wang, Jiaxing Yu, Wanying Wu, Lei Wang

机构 * College of Artificial Intelligence, Zhejiang University(浙江大学人工智能学院) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) Innovation Center of Yangtze River Delta, Zhejiang University(浙江大学长三角创新中心) The Chinese University of Hong Kong(香港中文大学) Shandong University(山东大学) Chu Kochen Honors College, Zhejiang University(浙江大学竺可桢学院) Ant Group(蚂蚁集团)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 针对文本生成音乐结构隐含难控的问题,提出MusicLayout显式中间表示,将其集成到统一自回归框架实现布局级控制,实验证实该方法可改进音乐长程结构组织并支持布局级控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01236 2026-08-17 cs.RO cs.AI 版本更新 79%

LLM-Advisor: An LLM Advisor for Cost-efficient Path Planning across Multiple Terrains

LLM-Advisor: 一种用于多地形高效路径规划的LLM基准

Ling Xiao, Toshihiko Yamasaki

机构 * Graduate School of Information Science and Technology, Hokkaido University(弘前大学信息科学与技术研究生院) Department of Information and Communication Engineering, The University of Tokyo(东京大学信息与通信工程系)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 LLM-Advisor利用大型语言模型优化多地形路径规划,提升路径成本效率,适用于现实场景。

Comments This paper has been accepted by IEEE Transactions on Automation Science and Engineering

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09430 2026-08-17 cs.RO cs.AI 版本更新 79%

AtomBridge: Agentic VLA Inference Plugin for Long-Horizon Tasks in Scientific Experiments

Sci-VLA:用于科学实验中长周期任务的代理VLA推理插件

Yiwen Pang, Bo Zhou, Changjin Li, Xuanhao Wang, Shengxiang Xu, Deng-Bao Wang, Peng Cheng, Shimin Di, Jingkuan Song, Min-Ling Zhang

机构 * School of Computer Science and Engineering & School of Software Engineering & School of Artificial Intelligence, Southeast University, Nanjing, China(计算机科学与工程学院、软件工程学院、人工智能学院,东南大学,南京,中国) Pattern Learning and Mining Lab, Southeast University, Nanjing, China(模式学习与挖掘实验室,东南大学,南京,中国)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 本文提出了一种基于大语言模型的代理VLA推理插件,用于提升科学实验中长周期任务的执行效率和成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11344 2026-08-14 cs.CY cs.AI q-fin.RM 版本更新 79%

Governing Agentic AI in FinTech

金融科技中智能体人工智能的治理

Henry Han

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 针对金融科技中智能体AI治理研究不足的问题,构建多层次治理理论,通过三项研究验证其机制,发现可验证性缺口是核心约束,该框架可扩展至其他高风险领域。

Comments 58 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07316 2026-08-14 cs.MA cs.AI cs.DC 版本更新 79%

Certifiable Semantic Agreement Among LLM Agents: What the Admissibility Instrument Decides

面向拜占庭鲁棒的大语言模型智能体协作的分层认证语义承诺

Haoran Xu, Lei Zhang, Iadh Ounis, Xianbin Wang

机构 * University of Glasgow(格拉斯哥大学) University of Western Ontario(西部 Ontario 大学)

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 提出H-CSC协议,将基于嵌入的终结性信号转换为三种类型输出(语义承诺、判决承诺或显式中止),实现大语言模型智能体拜占庭协作的最终性控制,在语义投毒和拜占庭攻击下保持低角度偏差和高中止率。

Comments 43 pages, 5 figures, 20 tables, 1 algorithm. Substantial revision: new title, new framing, new downstream-audit experiment; supersedes v1

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13372 2026-08-14 cs.AI 版本更新 79%

Exploiting Symbolic Heuristics for the Synthesis of Domain-Specific Temporal Planning Guidance using Reinforcement Learning

利用符号启发式方法,通过强化学习合成面向领域特定的时序规划引导

Irene Brugnara, Alessandro Valentini, Andrea Micheli

机构 * Fondazione Bruno Kessler(布伦诺·科塞勒基金会)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出一种改进的时序规划学习框架,结合符号启发式与强化学习,通过学习符号启发式的残差,采用多队列规划方法,提升了时序规划的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16149 2026-08-13 cs.AI 版本更新 79%

Teaching agentic AI to learn expert reasoning for rare disease diagnosis

LiteOdyssey: 一种用于可解释罕见病诊断的轻量级推理AI智能体

Minh-Ha Nguyen, Erica Gray, Bryce A. Schuler, Kevin W. Byram, Chih-Ting Yang, Fan Ma, Hua Xu, Wu-Chen Su, Chao Yan, Wei-Qi Wei, Adam Wright, Lisa Bastarache, Josh Peterson, Lingyao Li, Siyuan Ma, Undiagnosed Diseases Network, Rizwan Hamid, Thomas A. Cassini, Cathy Shyr

机构 * Vanderbilt University(范德堡大学) Vanderbilt University Medical Center(范德堡大学医学中心) University of South Florida(南佛罗里达大学)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 提出轻量级框架LiteOdyssey,通过人类-AI协作的诊断策略和公共生物医学工具增强单个推理语言模型,在罕见病诊断基准上达到最先进性能,无需微调或多智能体集成。

Comments 69 pages, submission version

详情

展开后加载摘要…

URL PDF HTML 收藏