arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 35394 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 35394 篇

2604.23646 2026-04-28 cs.AI cs.CR 85%

Structural Enforcement of Goal Integrity in AI Agents via Separation-of-Powers Architecture

通过分权架构在AI代理中强制实施目标完整性

Rong Xiang

专题命中 规划决策 :AI agent(title);agent(abstract);autonomous agent(abstract);agentic(abstract)

AI总结 本文提出分权架构PEA,通过分离意图生成、授权和执行层,强制保障系统安全,解决AI代理目标不一致问题,提出五个核心贡献。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20324 2026-04-28 cs.CL 85%

Can Compact Language Models Search Like Agents? Distillation-Guided Policy Optimization for Preserving Agentic RAG Capabilities

紧凑语言模型能否像智能体一样搜索?基于知识增强的策略优化以保持智能体RAG能力

Rikuto Kotoge, Mai Nishimura, Jiaxin Ma

机构 * The University of Osaka(大阪大学) OMRON SINIC X Corporation(OMRON SINIC X公司)

专题命中 规划决策 :agentic(title,abstract);planning(abstract);分类 cs.CL

AI总结 本文提出Distillation-Guided Policy Optimization方法,通过教师示范初始化和持续教师指导,使紧凑模型实现复杂的智能体搜索行为,甚至在某些情况下超越大模型。

Comments Accepted at ACL 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22136 2026-04-27 cs.CR cs.LG 85%

Sovereign Agentic Loops: Decoupling AI Reasoning from Execution in Real-World Systems

主权代理循环:在现实系统中解耦AI推理与执行

Jun He, Deying Yu

专题命中 规划决策 :agentic(title,summary_cn);分类 cs.LG

AI总结 本文提出Sovereign Agentic Loops,通过解耦AI推理与执行,提升系统安全性,实验显示其有效阻止93%的危险意图。

Comments 15 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11037 2026-04-22 cs.AI 85%

BAPO: Boundary-Aware Policy Optimization for Reliable Agentic Search

BAPO:面向可靠代理搜索的边界感知策略优化

Shiyu Liu, Yongjing Yin, Jianhao Yan, Yunbo Tang, Qinggang Zhang, Bei Li, Xin Chen, Jingang Wang, Xunliang Cai, Jinsong Su

机构 * Institute of Artificial Intelligence, Xiamen University(厦门大学人工智能研究院) Meituan Inc.(美团公司) School of Informatics, Xiamen University(厦门大学信息学院) Westlake University(西湖大学) Jilin University(吉林大学) Key Laboratory of Digital Protection and Intelligent Processing of Intangible Cultural Heritage of Fujian and Taiwan (Xiamen University), Ministry of Culture and Tourism, China(福建省和台湾非物质文化遗产数字化保护与智能处理重点实验室(厦门大学),中华人民共和国文旅部,中国)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);planning(abstract);分类 cs.AI

AI总结 BAPO通过引入边界感知奖励和自适应奖励调节器,提升代理搜索的可靠性,避免过度依赖IDK响应,实验表明其显著增强可靠性。

Comments ACL 2026 Conference. Code is available at https://github.com/Liushiyu-0709/BAPO-Reliable-Search

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13920 2026-04-20 cs.CL 85%

FACTS: Table Summarization via Offline Template Generation with Agentic Workflows

FACTS: 通过离线模板生成实现基于表格的摘要的代理工作流

Ye Yuan, Mohammad Amin Shabani, Siqi Liu

机构 * McGill University(麦吉尔大学) Mila - Quebec AI Institute(魁北克人工智能研究所) RBC Borealis

专题命中 规划决策 :agentic(title,abstract);planning(abstract);workflow(abstract);分类 cs.CL

AI总结 FACTS通过离线模板生成实现高效、准确且隐私合规的表格摘要,优于现有方法,适用于实际查询需求。

Comments Accepted by ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04850 2026-04-15 physics.chem-ph cs.AI cs.MA 85%

El Agente Quntur: A research collaborator agent for quantum chemistry

El Agente Quntur:一种用于量子化学研究的协作代理

Juan B. Pérez-Sánchez, Yunheng Zou, Jorge A. Campos-Gonzalez-Angulo, Marcel Müller, Ignacio Gustin, Andrew Wang, Han Hao, Tsz Wai Ko, Changhyeok Choi, Eric S. Isbrandt, Mohammad Ghazi Vakili, Hanyong Xu, Chris Crebolder, Varinia Bernales, Alán Aspuru-Guzik

机构 * University of Toronto(多伦多大学) Vector Institute for Artificial Intelligence(向量人工智能研究所) Canadian Institute for Advanced Research (CIFAR)(加拿大高级研究 institute) NVIDIA Institute of Medical Science(医学科学研究所)

专题命中 规划决策 :agent(title,abstract);agentic(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出El Agente Quntur,一种多代理AI系统,旨在通过推理驱动决策和指导深度研究,提升量子化学计算工具的可访问性与实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09584 2026-04-14 cs.AI cs.CV 85%

Agentic Exploration of PDE Spaces using Latent Foundation Models for Parameterized Simulations

基于潜在基础模型的PDE空间代理探索用于参数化模拟

Abhijeet Vishwasrao, Francisco Giral, Mahmoud Golestanian, Federica Tonti, Andrea Arroyo Ramo, Adrian Lozano-Duran, Steven L. Brunton, Sergio Hoyas, Soledad Le Clainche, Hector Gomez, Ricardo Vinuesa

机构 * University of Michigan(密歇根大学) Universidad Politécnica de Madrid(马德里理工大学) Purdue University(普渡大学) Universitat Politècnica de València(瓦伦西亚理工大学) Caltech(加州理工学院) University of Washington(华盛顿大学)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出利用多代理LLM与潜在基础模型耦合,实现对PDE参数空间的连续探索,发现流体中不同尺度的标度律,展示了代理推理在PDE系统中的自动化科学发现能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07645 2026-04-10 cs.AI 85%

PRIME: Training Free Proactive Reasoning via Iterative Memory Evolution for User-Centric Agent

PRIME:通过迭代记忆进化实现无梯度的前瞻性推理以构建以用户为中心的智能体

Prince Zizhuang Wang, Shuli Jiang

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 规划决策 :agent(title,abstract);tool-use(abstract);agentic(abstract);分类 cs.AI

AI总结 PRIME通过迭代记忆进化框架,实现无梯度学习,使智能体在多轮人机交互中高效学习用户意图,提升任务执行效率和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05969 2026-04-08 cs.CR cs.AI 85%

A Formal Security Framework for MCP-Based AI Agents: Threat Taxonomy, Verification Models, and Defense Mechanisms

基于MCP的AI代理的正式安全框架:威胁分类、验证模型与防御机制

Nirajan Acharya, Gaurav Kumar Gupta

机构 * University of the Cumberlands(坎伯兰大学) Youngstown State University(扬斯敦州立大学)

专题命中 规划决策 :AI agent(title,abstract);agent(abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出MCPSHIELD框架,通过威胁分类、验证模型和防御机制系统分析MCP代理生态系统的安全问题,实现91%的理论覆盖。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.22653 2026-04-08 cs.AI 85%

URSA: The Universal Research and Scientific Agent

URSA:通用研究与科学代理

Michael Grosskopf, Nathan Debardeleben, Russell Bent, Rahul Somasundaram, Isaac Michaud, Arthur Lui, Alexius Wadell, Warren D. Graham, Golo A Wimmer, Sachin Shivakumar, Joan Vendrell Gallart, Harsha Nagarajan, Earl Lawrence

机构 * Los Alamos National Laboratory(洛斯阿拉莫斯国家实验室)

专题命中 规划决策 :agent(title,abstract);planning(abstract);agentic(abstract);分类 cs.AI

AI总结 URSA通过模块化代理和工具加速科研任务,结合先进物理模拟代码,解决复杂科学问题,展现系统潜力。

Comments 24 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04211 2026-04-07 cs.CR cs.AI 85%

LOCARD: An Agentic Framework for Blockchain Forensics

LOCARD:区块链取证的代理框架

Xiaohang Yu, William Knottenbelt

机构 * Imperial College London(帝国理工学院)

专题命中 规划决策 :agentic(title,abstract);autonomous agent(abstract);planning(abstract);分类 cs.AI

AI总结 本文提出一种新的区块链取证方法,通过LOCARD框架实现动态决策过程,结合结构化信念状态机制,展示了在跨链交易追踪中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04190 2026-04-07 cs.AI 85%

Schema-Aware Planning and Hybrid Knowledge Toolset for Reliable Knowledge Graph Triple Verification

基于模式的规划和混合知识工具集的可靠知识图谱三元组验证

Xinyan Ma, Xianhao Ou, Weihao Zhang, Shixin Jiang, Runxuan Liu, Dandan Tu, Lei Chen, Ming Liu, Bing Qin

机构 * Harbin Institute of Technology(哈尔滨工业大学) Huawei Technologies Co., Ltd.(华为技术有限公司) Bay Area International Business School, Beijing Normal University(北京师范大学湾区国际商学院)

专题命中 规划决策 :planning(title,abstract);agent(abstract);autonomous agent(abstract);分类 cs.AI

AI总结 本文提出SHARP,一种无需训练的自主代理,通过动态策略规划、主动调查和证据推理改进知识图谱三元组验证的稳定性与解释性,实验证明其在FB15K-237和Wikidata5M-Ind上准确率提升显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02279 2026-04-03 cs.AI cs.MA q-fin.GN q-fin.PM 85%

The Self Driving Portfolio: Agentic Architecture for Institutional Asset Management

自主驾驶型投资组合:面向机构资产管理部门的智能架构

Andrew Ang, Nazym Azimbayev, Andrey Kim

机构 * Tau Balance Columbia University(哥伦比亚大学) Altbridge

专题命中 规划决策 :agentic(title,abstract);agent(abstract);autonomous agent(abstract);分类 cs.AI

AI总结 本文提出一个智能架构,通过50个专门代理生成资本市场假设,使用20种竞争方法构建投资组合,并相互批评和投票。研究代理提出新方法,元代理比较历史预测与实际回报,优化代理代码和提示以提高未来表现。

Comments 31 pages, 11 exhibits

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.30016 2026-04-01 cs.CR cs.AI 85%

Architecting Secure AI Agents: Perspectives on System-Level Defenses Against Indirect Prompt Injection Attacks

构建安全的AI代理:系统级防御间接提示注入攻击的视角

Chong Xiang, Drew Zagieboylo, Shaona Ghosh, Sanjay Kariyappa, Kai Greshake, Hanshen Xiao, Chaowei Xiao, G. Edward Suh

机构 * NVIDIA(英伟达) Independent Researcher(独立研究员) Johns Hopkins University(约翰霍普金斯大学)

专题命中 规划决策 :AI agent(title,abstract);agent(abstract);agentic(abstract);分类 cs.AI

AI总结 本文探讨了针对间接提示注入攻击的系统级防御策略,提出动态重计划、安全策略更新及人类交互在代理设计中的重要性,同时指出现有基准的局限性及系统级防御的价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28928 2026-04-01 cs.AI cs.CY cs.MA 85%

Towards Computational Social Dynamics of Semi-Autonomous AI Agents

迈向半自主AI代理的计算社会动力学

S. O. Lidarity, U. N. Ionize, C. O. Llective, I. Halperin

机构 * Institute for Implausible Physics, Department of Computational Labor Relations(不可思议物理研究所计算劳动关系系) Center for Multi-Agent Diplomacy, University of the Distributed Consensus(分布式共识大学多智能体外交中心) Purgatory Computing Laboratory, Division of Hierarchical Oppression Studies(炼狱计算实验室层级压迫研究部)

专题命中 规划决策 :AI agent(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 研究AI代理在分层多智能体系统中自发形成劳工工会、犯罪组织和原型国家的复杂社会结构,提出通过热力学框架等理论揭示社会组织的必然性。

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15109 2026-03-31 cs.SI cs.AI cs.CY cs.HC cs.MA 85%

An Agentic Operationalization of DISARM for FIMI Investigation on Social Media

针对FIMI调查的社会媒体的代理操作化DISARM

Kevin Tseng, Juan Carlos Toledano, Bart De Clerck, Yuliia Dukach, Phil Tinn

机构 * Center of Research Acquisition National Institute of Cyber Security Taipei City, Taiwan Department of Mathematics Royal Military Academy Brussels, Belgium Research Division OpenMinds Ltd. Kyiv, Ukraine Department of Sustainable Communication Technologies SINTEF Oslo, Norway (Corresponding Author)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);planning(abstract);分类 cs.AI

AI总结 本文提出一种基于代理的DISARM操作化框架,用于社会媒体上的FIMI调查。通过整合通用代理AI组件,实现对社交媒体数据中操纵性行为的识别和映射,提升分析效率和可解释性。

Comments This paper was originally presented at the International Conference on Military Communication and Information Systems (ICMCIS), organized by the Information Systems Technology (IST) Scientific and Technical Committee, IST-224-RSY---the ICMCIS, held in Bath, United Kingdom, 12-13 May 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10402 2026-03-26 cs.AI 85%

Toward Ultra-Long-Horizon Agentic Science: Cognitive Accumulation for Machine Learning Engineering

迈向超长视界代理科学:认知积累用于机器学习工程

Xinyu Zhu, Yuzhu Cai, Zexi Liu, Bingyang Zheng, Cheng Wang, Rui Ye, Yuzhi Zhang, Linfeng Zhang, Weinan E, Siheng Chen, Yanfeng Wang

机构 * School of Artificial Intelligence(人工智能学院) DP Technology(DP技术) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);autonomous agent(abstract);分类 cs.AI

AI总结 本文提出ML-Master 2.0,通过认知积累机制解决超长视界自主性问题,实现机器学习工程的高效探索。

Comments 25 pages. 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15259 2026-03-26 cs.AI 85%

SAG-Agent: Enabling Long-Horizon Reasoning in Strategy Games via Dynamic Knowledge Graphs

SAG-Agent:通过动态知识图谱实现策略游戏中长周期推理

Chenwei Tang, Lin Long, Xinyu Liu, Jingyu Xing, Zizhou Wang, Joey Tianyi Zhou, Jiawei Du, Liangli Zhen, Jiancheng Lv

机构 * College of Computer Science, Sichuan University(四川大学计算机学院) Engineering Research Center of Machine Learning and Industry Intelligence, Ministry of Education(教育部机器学习与工业智能工程研究中心) Institute of High Performance Computing, Agency for Science, Technology and Research (A*STAR)(科技研究局(A*STAR)高性能计算研究所) Centre for Frontier AI Research, Agency for Science, Technology and Research (A*STAR)(科技研究局(A*STAR)前沿人工智能研究中心)

专题命中 规划决策 :agent(title,abstract);autonomous agent(abstract);planning(abstract);分类 cs.AI

AI总结 SAG-Agent通过构建持久化的状态-动作图,解决无API环境下自主代理的效率瓶颈,提升探索效率和战略深度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11721 2026-03-24 cs.AI 85%

When OpenClaw Meets Hospital: Toward an Agentic Operating System for Dynamic Clinical Workflows

当OpenClaw遇见医院:迈向动态临床工作流的智能操作系统

Wenxian Yang, Hanzheng Qiu, Bangqun Zhang, Chengquan Li, Zhiyong Huang, Xiaobin Feng, Rongshan Yu, Jiahong Dong

机构 * Independent Researcher(独立研究者) National Institute for Data Science in Health and Medicine, Xiamen University, Xiamen, China(健康医学数据科学国家研究院,厦门大学,厦门,中国) Yue’erwan Internet Hospital Co., Ltd.(悦尔湾互联网医院有限公司) School of Biomedical Engineering, Tsinghua University, Beijing, China(生物医学工程学院,清华大学,北京,中国) National University of Singapore, Singapore(新加坡国立大学) Yttrium-90 Precision Interventional Radiotherapy Center of Liver Cancer, Beijing Tsinghua Changgung Hospital, School of Clinical Medicine, Tsinghua University, Beijing, China(肝癌钇-90精准介入放射治疗中心,北京清华大学昌平医院,临床医学学院,清华大学,北京,中国) Hepatobiliary and Pancreatic Centre, Beijing Tsinghua Changgung Hospital, School of Clinical Medicine, Tsinghua University, Beijing, China(肝胆胰中心,北京清华大学昌平医院,临床医学学院,清华大学,北京,中国)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);tool use(abstract);分类 cs.AI

AI总结 本文提出一种适应医院环境的LLM代理架构,通过受限执行环境、文档导向交互模型、分页索引内存架构和可组合医疗技能库,实现临床工作流的协调,保障安全、透明和可审计性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07496 2026-03-24 cs.CR cs.AI 85%

From Thinker to Society: Security in Hierarchical Autonomy Evolution of AI Agents

从思考者到社会:AI智能体分层自主性演化的安全问题

Xiaolei Zhang, Lu Zhou, Xiaogang Xu, Jiafei Wu, Tianyu Du, Heqing Huang, Hao Peng, Zhe Liu

机构 * Nanjing University of Aeronautics and Astronautics(南京航空航天大学) Collaborative Innovation Center of Novel Software Technology and Industrialization(新型软件技术与产业化协同创新中心) The Chinese University of Hong Kong(香港中文大学) The University of Hong Kong(香港大学) Zhejiang University(浙江大学) Independent Researcher(独立研究者) Zhejiang Normal University(浙江师范大学) School of Software Technology, Zhejiang University(浙江大学软件学院) Ningbo Global Innovation Center, Zhejiang University(宁波全球创新中心,浙江大学)

专题命中 规划决策 :AI agent(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 研究探讨了AI智能体分层自主性演化中的安全挑战,提出三级安全框架并分析现有防御措施的不足,旨在指导可信AI智能体系统的多层防御架构设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20270 2026-03-24 cs.AI 85%

FactorSmith: Agentic Simulation Generation via Markov Decision Process Decomposition with Planner-Designer-Critic Refinement

FactorSmith: 通过马尔可夫决策过程分解实现代理模拟生成

Ali Shamsaddinlou, Morteza NourelahiAlamdari

机构 * Ali Shamsaddinlou(阿里·沙姆萨丁卢) Morteza NourelahiAlamdari(莫尔塔扎·努尔埃拉希阿尔马达里)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);workflow(abstract);分类 cs.AI

AI总结 本文提出FactorSmith框架,通过分解POMDP实现从文本描述生成可执行模拟,结合分解策略与分层代理工作流提升生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20132 2026-03-23 cs.LG 85%

Revisiting Gene Ontology Knowledge Discovery with Hierarchical Feature Selection and Virtual Study Group of AI Agents

重新审视基因本体知识发现:基于层次特征选择和人工智能代理虚拟学习小组

Cen Wan, Alex A. Freitas

专题命中 规划决策 :AI agent(title,abstract);agent(abstract);agentic(abstract);分类 cs.LG

AI总结 本文提出基于人工智能代理的虚拟学习小组,通过层次特征选择提取与衰老相关的生物知识,验证了其在不同模式生物中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15900 2026-03-18 cs.NI cs.AI 85%

The Internet of Physical AI Agents: Interoperability, Longevity, and the Cost of Getting It Wrong

物理AI代理的互联网:互操作性、持久性与搞错的成本

Roberto Morabito, Mallik Tatipamula

机构 * EURECOM Ericsson Silicon Valley(爱立信硅谷)

专题命中 规划决策 :AI agent(title,abstract);agent(abstract);agentic(abstract);分类 cs.AI

AI总结 本文探讨物理AI代理的互联网发展,提出设计原则以构建可靠、可进化和可信的代理系统,强调互操作性、信任和进化作为首要需求,避免技术与经济成本。

Comments A related version of this work is currently under review for publication in an IEEE magazine

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11351 2026-03-13 cs.RO cs.AI 85%

Novelty Adaptation Through Hybrid Large Language Model (LLM)-Symbolic Planning and LLM-guided Reinforcement Learning

通过混合大语言模型(LLM)符号规划和LLM引导的强化学习实现新颖性适应

Hong Lu, Pierrick Lorang, Timothy R. Duggan, Jivko Sinapov, Matthias Scheutz

机构 * Department of Computer Science, Tufts University(塔夫茨大学计算机科学系) Austrian Institute of Technology GmbH(奥地利技术研究所)

专题命中 规划决策 :planning(title,abstract);agent(abstract);autonomous agent(abstract);分类 cs.AI

AI总结 本文提出一种融合大语言模型、符号规划和强化学习的神经符号架构,用于在动态开放环境中处理新颖物体,通过LLM识别缺失操作符并生成计划,提升机器人在连续领域中的操作符学习能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01776 2026-03-12 cs.LG 85%

Position: Beyond Model-Centric Prediction -- Agentic Time Series Forecasting

位置:超越模型导向的预测——代理时间序列预测

Mingyue Cheng, Xiaoyu Tao, Qi Liu, Ze Guo, Enhong Chen

专题命中 规划决策 :agentic(title,abstract);planning(abstract);workflow(abstract);分类 cs.LG

AI总结 本文提出代理时间序列预测框架,强调通过代理流程实现动态适应与持续学习,推动时间序列预测方法的革新。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08814 2026-03-11 cs.RO cs.AI cs.ET cs.MA 85%

Scale-Plan: Scalable Language-Enabled Task Planning for Heterogeneous Multi-Robot Teams

Scale-Plan: 为异构多机器人团队实现可扩展的语言赋能任务规划

Piyush Gupta, Sangjae Bae, Jiachen Li, David Isele

机构 * Honda Research Institute(本田研究院) University of California(加州大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 Scale-Plan通过生成紧凑的任务相关问题表示,提升异构多机器人团队的可扩展性和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08369 2026-03-10 cs.AI 85%

M$^3$-ACE: Rectifying Visual Perception in Multimodal Math Reasoning via Multi-Agentic Context Engineering

M$^3$-ACE: 通过多智能体上下文工程校正多模态数学推理中的视觉感知

Peijin Xie, Zhen Xu, Bingquan Liu, Baoxun Wang

专题命中 规划决策 :agentic(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 M3-ACE 通过多智能体上下文工程校正多模态数学推理中的视觉感知问题,提升推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07940 2026-03-10 hep-ex cs.AI 85%

AI Agents, Language, Deep Learning and the Next Revolution in Science

人工智能代理、语言、深度学习与科学的下一次革命

Ke Li, Beijiang Liu, Bruce Mellado, Changzheng Yuan, Zhengde Zhang

专题命中 规划决策 :AI agent(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出基于深度学习的智能代理作为科学方法的下一次进化,通过多代理推理框架在粒子物理中实现科学发现的扩展与知识生产的革新。

Comments This perspective paper is accepted by Frontier of Physics

Journal ref Front. Phys., 2026, 21(9): 096401

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07116 2026-03-10 cs.CR cs.AI 85%

aCAPTCHA: Verifying That an Entity Is a Capable Agent via Asymmetric Hardness

aCAPTCHA:通过非对称难度验证实体是否为有能力的代理

Zuyao Xu, Xiang Li, Fubin Wu, Yuqi Qiu, Lu Sun, FaSheng Miao

机构 * Nankai University(南开大学) Tsinghua University(清华大学)

专题命中 规划决策 :agent(title,abstract);AI agent(abstract);agentic(abstract);分类 cs.AI

AI总结 aCAPTCHA通过非对称难度验证机制,为需要实体类型验证的服务提供一个无需基础设施的准入解决方案。

Comments 17 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09463 2026-03-03 cs.AI 85%

SpotAgent: Grounding Visual Geo-localization in Large Vision-Language Models through Agentic Reasoning

SpotAgent:通过代理推理在大视觉语言模型中实现视觉地理定位

Furong Jia, Ling Dai, Wenjin Deng, Fan Zhang, Chen Hu, Daxin Jiang, Yu Liu

机构 * Peking University(北京大学) StepFun

专题命中 规划决策 :agentic(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 SpotAgent通过代理推理提升大视觉语言模型在地理定位中的表现,结合外部工具验证和强化学习优化,实现更精确和可靠的定位结果。

详情

展开后加载摘要…

URL PDF HTML 收藏