arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-03-25 至 2026-03-25 共收录 109 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 37 篇

2603.21376 2026-03-25 cs.AI 57%

A transformer architecture alteration to incentivise externalised reasoning

一种变换器架构的修改以激励外部化推理

Elizabeth Pavlova, Mariia Koroliuk, Karthik Viswanathan, Cameron Tice, Edward James Young, Puria Radmard

机构 * MARS University of Amsterdam(阿姆斯特丹大学) Geodesic Research

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文提出一种变换器架构修改和训练流程,使大语言模型更倾向于产生详细推理。通过在中间层加入早退机制,训练模型在预测下一个token时提前退出计算,从而减少冗余计算。

详情

展开后加载摘要…

URL PDF HTML 收藏
2003.08745 2026-03-25 cs.CV cs.LG stat.ML 57%

On the Road with 16 Neurons: Mental Imagery with Bio-inspired Deep Neural Networks

16个神经元的旅程:基于生物启发深度神经网络的视觉预测

Alice Plebe, Mauro Da Lio

机构 * Dept. of Information Engineering and Computer Science(信息工程与计算机科学系) Dept. of Industrial Engineering(工业工程系) University of Trento, Italy(意大利特伦托大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出了一种基于生物启发深度神经网络的视觉预测策略,通过构建具有层次结构的神经元集合来提取抽象概念,并在自动驾驶任务中实现高效表示学习。

Comments 18 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23489 2026-03-25 cs.CV 50%

AgentRVOS: Reasoning over Object Tracks for Zero-Shot Referring Video Object Segmentation

AgentRVOS: 基于对象跟踪的零样本视频对象分割

Woojeong Jin, Jaeho Lee, Heeseong Shin, Seungho Jang, Junhwan Heo, Seungryong Kim

机构 * KAIST AI Project(韩国科学技术院人工智能项目)

专题命中 规划决策 :agentic(abstract)

AI总结 AgentRVOS通过结合SAM3和MLLM的优势,提出无需训练的管道,利用生成的掩码跟踪提供可靠的时空信息,通过查询引导的推理实现零样本视频对象分割。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23478 2026-03-25 cs.CV 50%

UniFunc3D: Unified Active Spatial-Temporal Grounding for 3D Functionality Segmentation

UniFunc3D: 统一的主动空间-时间接地用于3D功能分割

Jiaying Lin, Dan Xu

机构 * The Hong Kong University of Science and Technology(香港科技大学)

专题命中 规划决策 :agent(abstract)

AI总结 UniFunc3D通过统一框架实现3D场景功能分割,利用多模态大语言模型作为主动观察者,结合语义、时间和空间推理,提升任务分解的准确性与效率,实现优于其他方法的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23450 2026-03-25 eess.SY cs.SY 50%

Information-Driven Active Perception for k-step Predictive Safety Monitoring

信息驱动的主动感知用于k步预测安全监控

Sumukha Udupa, Jie Fu

专题命中 规划决策 :planning(abstract)

AI总结 本文研究了在部分可观测随机系统中预测安全监控的主动感知策略合成,通过动态调度传感器查询以最大化未来状态安全性的信息增益,利用标记隐藏马尔可夫模型和确定有限自动机定义安全要求,提出基于k步香农条件熵最小化的规划目标。

Comments 6 pages, 6 figures, 1 table, submitted to IEEE L-CSS

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23344 2026-03-25 cs.CV 50%

An Explainable AI-Driven Framework for Automated Brain Tumor Segmentation Using an Attention-Enhanced U-Net

基于可解释AI的自动化脑肿瘤分割框架:使用增强注意力的U-Net

MD Rashidul Islam, Bakary Gibba

机构 * School of Computing and Informatics(计算机与信息学学院)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出一种基于增强注意力U-Net的框架,利用BraTS 2020数据集进行脑肿瘤分割,通过自定义损失函数和可解释AI提升分割精度与可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23112 2026-03-25 cs.RO 50%

Active Robotic Perception for Disease Detection and Mapping in Apple Trees

主动机器人感知用于苹果树疾病检测与制图

Hayden Feddock, Francisco Yandun, Srđan Aćimović, Abhisesh Silwal

机构 * Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所) Department of Plant Pathology, Virginia Polytechnic Institute and State University(弗吉尼亚理工大学植物病理学系)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出一种自主移动主动感知系统,用于在苹果树休眠期精准检测和制图疾病,通过融合多种传感技术实现疾病症状的精确定位,并评估了三种视角规划策略以提升观测精度。

Comments 8 pages, 6 figures, IROS 2026 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22753 2026-03-25 cs.NI cs.CR 50%

Digital Twin Enabled Simultaneous Learning and Modeling for UAV-assisted Secure Communications with Eavesdropping Attacks

基于数字孪生的UAV辅助安全通信中同时学习与建模

Jieting Yuan, Songhan Zhao, Ye Xue, Yu Zhao, Bo Gu, Shimin Gong

专题命中 规划决策 :planning(abstract)

AI总结 本文研究UAV辅助无线网络中的安全通信问题,提出DT-SLAM框架通过数字孪生实现高效学习,以应对智能窃听UAV的威胁,提升安全吞吐量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22604 2026-03-25 cs.RO 50%

Trajectory Generation for Underactuated Soft Robot Manipulators using Discrete Elastic Rod Dynamics

基于离散弹性杆动力学的欠驱动软机器人轨迹生成

Beibei Liu, Akua K. Dickson, Ran Jing, Andrew P. Sabelhaus

机构 * Division of Systems Engineering, Boston University(系统工程系,波士顿大学) Department of Mechanical Engineering, Boston University(机械工程系,波士顿大学)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种基于离散弹性杆动力学的控制导向建模方法,用于生成欠驱动软机器人动态可行的轨迹,实验验证了其在复杂驱动条件下优于常曲率基线的轨迹跟踪性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22538 2026-03-25 hep-ph 50%

The FERMIACC: Agents for Particle Theory

FERMIACC:粒子理论中的代理

Prateek Agrawal, Nathaniel Craig, Amalia Madden, Iñigo Valenzuela Lombera

专题命中 规划决策 :AI agent(abstract)

AI总结 FERMIACC基于OpenAI代理构建,可自主生成并定量验证高能物理数据的理论假设。

Comments 15 pages, 9 figure, 4 appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16228 2026-03-25 cs.RO 50%

PA-LVIO: Real-Time LiDAR-Visual-Inertial Odometry and Mapping with Pose-Only Bundle Adjustment

PA-LVIO: 基于姿态仅捆绑调整的实时激光雷达-视觉-惯性里程计与建图

Hailiang Tang, Tisheng Zhang, Liqiang Wang, Xin Ding, Man Yuan, Xiaoji Niu

专题命中 规划决策 :planning(abstract)

AI总结 本文提出PA-LVIO,通过姿态仅捆绑调整实现高精度实时激光雷达-视觉-惯性里程计与建图,结合无边际化和帧到地图的激光雷达测量模型,消除里程计漂移,实现高精度点云地图生成。

Comments 14 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02448 2026-03-25 cs.CV cs.RO 50%

nuScenes Revisited: Progress and Challenges in Autonomous Driving

nuScenes 重新审视:自动驾驶领域的进展与挑战

Whye Kit Fong, Venice Erin Liong, Kok Seang Tan, Holger Caesar

专题命中 规划决策 :planning(abstract)

AI总结 本文重新审视nuScenes数据集,探讨其在自动驾驶发展中的核心作用,分析其技术细节及对后续研究的影响,总结多模态传感器融合与标准化评估的关键贡献。

Comments 18 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11859 2026-03-25 physics.chem-ph cond-mat.soft physics.comp-ph 50%

Martini Mapper: An Automated Fragment-Based Framework for Developing Coarse-Grained Models within the Martini 3 Framework

Martini Mapper: 一种基于片段的自动化框架,用于在Martini 3框架内开发粗粒模型

Kevin V. Bigting, Shubhadeep Nag, Yaxin An

专题命中 规划决策 :workflow(abstract)

AI总结 本文提出Martini Mapper,通过结合定制化的珠字典和分层规则算法,自动从SMILES字符串生成Martini 3模型,适用于多种化学数据集,提升了大分子建模效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11467 2026-03-25 eess.SY cs.SY 50%

A Goal-Oriented Approach for Active Object Detection with Exploration-Exploitation Balance

面向目标的主动物体检测与探索-利用平衡方法

Yalei Yu, Matthew Coombes, Wen-Hua Chen, Cong Sun, Myles Flanagan, Jingjing Jiang, Pramod Pashupathy, Masoud Sotoodeh-Bahraini, Peter Kinnell, Niels Lohse

专题命中 规划决策 :planning(abstract)

AI总结 本文提出一种面向目标的主动物体检测方法,通过探索-利用平衡的成本函数指导下一步视角选择,结合不确定性估计实现高效检测,适用于未知环境中的制造任务。

Comments 12 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 多智能体 15 篇

2603.23419 2026-03-25 cs.HC cs.AI 90%

Biased Error Attribution in Multi-Agent Human-AI Systems Under Delayed Feedback

多智能体人机系统中延迟反馈下的偏差性错误归因

Teerthaa Parakh, Karen M. Feigh

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);AI agent(abstract);autonomous agent(abstract)

AI总结 研究探讨了在延迟反馈下多智能体人机系统中决策与责任归因受认知偏差的影响,通过实验发现参与者对负反馈的修正更强烈,且常错误归因于不同AI代理,导致决策调整与实际原因弱相关。

Comments 14 pages, 9 figures. Preprint. An extended abstract is under submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23271 2026-03-25 cs.RO cs.AI 89%

A Multimodal Framework for Human-Multi-Agent Interaction

人-多智能体交互的多模态框架

Shaid Hasan, Breenice Lee, Sujan Sarker, Tariq Iqbal

机构 * University of Virginia(弗吉尼亚大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract);分类 cs.AI

AI总结 本文提出一个多模态框架,用于人与多智能体交互,通过集成多模态感知和大语言模型驱动的规划,实现自主认知代理的协调决策,解决现有系统在统一框架下整合多模态感知、具身表达和协同决策的难题。

Comments 4 pages, 3 figures. Accepted at ACM/IEEE HRI 2026 Workshop (MAgicS-HRI)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20644 2026-03-25 cs.CV 89%

ScaleEdit-12M: Scaling Open-Source Image Editing Data Generation via Multi-Agent Framework

ScaleEdit-12M:通过多智能体框架实现开源图像编辑数据生成的规模化

Guanzhou Chen, Erfei Cui, Changyao Tian, Danni Yang, Ganlin Yang, Yu Qiao, Hongsheng Li, Gen Luo, Hongjie Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) CUHK MMLab(香港中文大学多模态实验室) Fudan University(复旦大学) University of Science and Technology of China(中国科学技术大学) Xiamen University(厦门大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);agentic(abstract)

AI总结 本文提出ScaleEditor框架,通过多智能体方法构建大规模高质量图像编辑数据集,生成ScaleEdit-12M,涵盖23类任务,提升多种编辑模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20502 2026-03-25 cs.CL cs.AI 88%

MARS: toward more efficient multi-agent collaboration for LLM reasoning

MARS:迈向更高效的多智能体协作以提升大语言模型推理

Xiao Wang, Jia Wang, Yijie Wang, Pengtao Dang, Sha Cao, Chi Zhang

机构 * Indiana University Bloomington(印第安纳大学布卢明顿分校) Oregon Health & Science University(俄勒冈健康与科学大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出MARS框架,通过角色化协作提升LLM推理能力,相比MAD等方法,在多个基准测试中实现准确率相当但token消耗和推理时间减少约50%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20670 2026-03-25 cs.AI cs.MA 88%

Towards Intelligent Geospatial Data Discovery: a knowledge graph-driven multi-agent framework powered by large language models

迈向智能地理空间数据发现:一种由大型语言模型驱动的知识图谱多智能体框架

Ruixiang Liu, Zhenlong Li, Ali Khosravi Kazazi

机构 * Geoinformation and Big Data Research Laboratory, Department of Geography, The Pennsylvania State University(地理信息与大数据研究实验室,地理系,宾夕法尼亚州立大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本文提出基于知识图谱的多智能体框架,利用大型语言模型提升地理空间数据发现的语义性和智能性,通过统一元数据本体和多智能体协作提高检索性能和透明度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22791 2026-03-25 cs.AI 88%

ABSTRAL: Automatic Design of Multi-Agent Systems Through Iterative Refinement and Topology Optimization

ABSTRAL:通过迭代精进与拓扑优化自动设计多智能体系统

Weijia Song, Jiashu Yue, Zhe Pang

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 ABSTRAL通过对比追踪分析将多智能体系统架构视为演化的自然语言文档,发现多智能体协调成本测量、设计知识迁移与专有角色发现三大核心贡献。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17112 2026-03-25 cs.AI cs.LG 85%

Cascade-Aware Multi-Agent Routing: Spatio-Temporal Sidecars and Geometry-Switching

级联感知多智能体路由:时空侧车与几何切换

Davide Di Gioia

专题命中 多智能体 :agent(title);multi-agent(title);分类 cs.AI、cs.LG

AI总结 本文提出时空侧车模型,通过结合欧几里得和双曲评分器,解决路由几何结构感知问题,提升调度器在不同拓扑下的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05520 2026-03-25 cs.AI cs.MA 79%

Toward Data Systems That Are Business Semantic Centric and AI Agents Assisted

迈向以业务语义为中心且由AI代理辅助的数据系统

Cecil Pang

机构 * School of Systems Science and Industrial Engineering, Binghamton University, State University of New York(系统科学与工业工程学院,宾夕法尼亚州立大学)

专题命中 多智能体 :AI agent(title,abstract);分类 cs.AI

AI总结 本文提出BSDS系统,通过整合架构、工作流和团队组织,使数据系统贴合业务需求而非技术限制,提升效率与可扩展性,同时强调人类因素与业务语义的结合。

Comments Published by IEEE Access

Journal ref IEEE Access, vol. 13, pp. 113752-113762, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22567 2026-03-25 cs.CE cs.MA 75%

TrustTrade: Human-Inspired Selective Consensus Reduces Decision Uncertainty in LLM Trading Agents

TrustTrade: 人类启发的选 择性共识降低LLM交易代理决策不确定性

Minghan Li, Rachel Gonsalves, Weiyue Li, Sunghoon Yoon, Mengyu Wang

专题命中 多智能体 :agent(abstract);autonomous agent(abstract);multi-agent(abstract)

AI总结 TrustTrade通过引入多代理选择性共识框架,减少LLM交易代理在高噪声市场中的决策不确定性,提升风险意识和稳定性。

Comments 24 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22312 2026-03-25 cs.AI cs.CL cs.LG 75%

The Efficiency Attenuation Phenomenon: A Computational Challenge to the Language of Thought Hypothesis

思维效率衰减现象:对思维语言假说的计算挑战

Di Zhang

机构 * School of Advanced Technology(先进技术学院)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文通过计算实验探讨思维是否需要语言式格式,提出AI私有语言假想实验,证明在多智能体强化学习中,高效协议在被迫使用人类可理解语言时效率下降,挑战了思维语言假说。

Comments 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22474 2026-03-25 cs.SE 70%

From Brittle to Robust: Improving LLM Annotations for SE Optimization

从易碎到稳健:改进LLM注释以优化SE性能

Lohith Senthilkumar, Tim Menzies

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.SE

AI总结 本文提出SynthCore策略,通过集成多个LLM意见提升多目标优化任务的标注效果,优于现有方法,且无需人工参与。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21597 2026-03-25 cs.AI cs.CV 70%

Cerebra: A Multidisciplinary AI Board for Multimodal Dementia Characterization and Risk Assessment

Cerebra:一个多学科AI平台用于多模态痴呆症特征化和风险评估

Sheng Liu, Long Chen, Zeyun Zhao, Qinglin Gou, Qingyue Wei, Arjun Masurkar, Kevin M. Spiegler, Philip Kuball, Stefania C. Bray, Megan Bernath, Deanna R. Willis, Jiang Bian, Lei Xing, Eric Topol, Kyunghyun Cho, Yu Huang, Ruogu Fang, Narges Razavian, James Zou

机构 * Department of Biomedical Data Science, Stanford University(斯坦福大学生物医学数据科学系) Department of Radiation Oncology, Stanford University(斯坦福大学放射肿瘤科) Center for Data Science, New York University(纽约大学数据科学中心) J. Crayton Pruitt Family Department of Biomedical Engineering, University of Florida(佛罗里达大学杰·克雷顿·普瑞特家庭生物医学工程系) Department of Biomedical Engineering and Informatics, Indiana University Indianapolis(印第安纳大学印第安纳波利斯分校生物医学工程与信息学系) Department of Neurology, NYU Grossman School of Medicine(纽约大学格罗斯曼医学院神经科) Department of Neuroscience, NYU Grossman School of Medicine(纽约大学格罗斯曼医学院神经科学系) UF Health Family Medicine – Haile Plantation(佛罗里达大学健康家庭医学-海莱种植园) Department of Family Medicine, Indiana University School of Medicine(印第安纳大学医学院家庭医学系) Department of Biostatistics and Health Data Science, Indiana University School of Medicine(印第安纳大学医学院生物统计学与健康数据科学系) Scripps Research Translational Institute(斯克里普斯研究转化研究所) Courant Institute, New York University(纽约大学柯朗研究所) Center for Biomedical Informatics, Regenstrief Institute(再生斯蒂夫研究所生物医学信息中心) Center for Cognitive Aging and Memory, McKnight Brain Institute, University of Florida(佛罗里达大学麦金托神经研究所认知衰老与记忆中心) Population Health Department, NYU Langone Health(纽约大学兰戈恩健康人口健康部) Radiology Department, NYU Langone Health(纽约大学兰戈恩健康放射科)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 Cerebra通过多智能体协调处理电子病历、临床笔记和医学影像,提供可视化分析和对话界面,提升临床决策支持的可解释性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10766 2026-03-25 cs.CR cs.AI cs.CV 70%

Metaphor-based Jailbreak Attacks on Text-to-Image Models

基于隐喻的文本到图像模型劫持攻击

Chenyu Zhang, Lanjun Wang, Yiwen Ma, Wenhui Li, Yi Tu, An-An Liu

机构 * Huawei Technologies Co Ltd.(华为技术有限公司)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出基于隐喻的劫持攻击方法,通过生成隐喻对抗提示绕过未知或多样化的防御机制,实验表明其在攻击性能和查询效率方面优于基线方法。

Comments Code is available in \url{https://github.com/datar001/metaphor-based-jailbreaking-attack}

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22881 2026-03-25 eess.SY cs.SY math.OC 67%

Cooperative Bandit Learning in Directed Networks with Arm-Access Constraints

有向网络中带臂访问约束的协同老虎机学习

Evagoras Makridis, Themistoklis Charalambous

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 研究带臂访问约束的协同多智能体老虎机问题,提出基于共识的分布式UCB算法,考虑臂访问结构和网络不对称性,实现对数 regret 分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23387 2026-03-25 cs.NI 50%

A Joint Reinforcement Learning Scheduling and Compression Framework for Teleoperated Driving

协同强化学习调度与压缩框架用于远程驾驶

Giacomo Avanzi, Marco Giordani, Michele Zorzi

专题命中 多智能体 :agent(abstract)

AI总结 本文提出协同强化学习框架,通过优化压缩与调度配置提升远程驾驶性能,尤其在受限网络中表现更优。

Comments 13 pages, 8 figures, 1 table. This paper is currently under review by IEEE Transactions on Communications

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 工作流自动化 13 篇

2603.22651 2026-03-25 cs.AI cs.CL cs.LG 90%

Benchmarking Multi-Agent LLM Architectures for Financial Document Processing: A Comparative Study of Orchestration Patterns, Cost-Accuracy Tradeoffs and Production Scaling Strategies

多代理LLM架构在金融文档处理中的基准测试:协作模式、成本准确性权衡及生产扩展策略的比较研究

Siddhant Kulkarni, Yukta Kulkarni

机构 * Department of Computer Science and Engineering(计算机科学与工程系) New York University(纽约大学) New York, NY 10012(纽约市NY 10012)

专题命中 工作流自动化 :agent(title,abstract);multi-agent(title,abstract);planning(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文比较四种多代理架构在金融文档处理中的表现,揭示了反射架构在字段级F1得分最高但成本更高,而分层架构在成本准确性帕累托前沿表现最佳,同时展示了语义缓存等策略对性能的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏