arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-02 至 2026-07-02 共收录 162 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 31 篇

2605.03847 2026-07-02 cs.AI 版本更新 70%

Mechanical Conscience: A Mathematical Framework for Dependability of Machine Intelligence

机械良知:机器智能可信赖性的数学框架

Munkhdelgerekh Batzorig, Purevbaatar Ganbold, Kyungbin Park, Pilkong Jeong, Kangbin Yim

机构 * Department of Information Security Engineering, Soonchunhyang University(信息安全工程系,Soonchunhyang大学) Department of Mobility Convergence Security, Soonchunhyang University(移动融合安全系,Soonchunhyang大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 提出机械良知(MC)概念,通过轨迹级规范过滤最小化修正基线策略,降低累积偏离,并处理认知不确定性,实现单智能体与分布式智能系统的可信赖性。

Comments 9 pages, 2 figures. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00537 2026-07-02 eess.SP 新提交 67%

B2X Networks: Joint Design of Communication and Control for Embodied Intelligence

B2X网络:具身智能的通信与控制联合设计

Yuanwei Liu, Xu Gan, Zhaolin Wang, Chongjun Ouyang, Hao Jiang, Zongyao Zhao, Kaibin Huang, Robert Schober

专题命中 多智能体 :agent(abstract);planning(abstract)

AI总结 提出脑-体-万物(B2X)网络概念,通过分布式与集中式脑架构,重新设计上下行通信以平衡传输性能与控制质量,实现无线网络与具身智能的融合。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00316 2026-07-02 eess.SP 新提交 67%

Evolving Intelligent Complex Systems via Intellicise Networks: Architecture, Technologies, and Pathways

通过智能网络演化智能复杂系统:架构、技术与路径

Ping Zhang, Rui Meng, Xiaodong Xu, Song Gao, Zixuan Huang, Yaheng Wang, Yinqiu Liu, Ruichen Zhang, Yiming Liu, Kaiwen Yu, Yaping Sun, Han Meng, Haonan Tong, Huishi Song, Qianqian Yang, Shuoyao Wang, Lexi Xu, Qinghe Du, Geng Sun, Jiawen Kang, Gang Wu, Yiqing Zhou, Haixia Zhang, Zesong Fei, Aimin Hao, Ming Li

专题命中 多智能体 :agent(abstract);agentic(abstract)

AI总结 本文提出基于智能网络的跨域智能通信网络架构,融合信息论、系统论等理论,通过语义提取、意图理解、生成式AI等技术,实现复杂系统的自配置与自优化,并给出具身智能通信案例。

Comments 23 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01044 2026-07-02 cs.RO 新提交 67%

Robots Ask the Way: Communication-Enabled Social Navigation

机器人问路:支持通信的社交导航

Valentino Sacco, Luca Scofano, Indro Spinelli, Fabio Galasso

机构 * Sapienza University of Rome(罗马大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 提出CommNav任务,让机器人通过主动与居民通信获取信息来定位目标个体,在Habitat 3.0c环境中评估,通信模块使导航成功率提升10个百分点,且对自然语言鲁棒。

Comments Accepted to IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00604 2026-07-02 math.OC 新提交 67%

Vehicle Routing Problem Meets Large Language Models: An Overview and Perspectives

车辆路径问题遇上大语言模型:综述与展望

Xianchao Xiu, Chong Shen, Yanjiao Zhu, Wanquan Liu

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 综述大语言模型在车辆路径问题中的应用,涵盖模型构建、算法设计、协调工具等角色,并讨论基准测试与实验。

Comments working in process

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00359 2026-07-02 math.RA 新提交 67%

The Equivalence Problem for Generalized Airy Operators

广义Airy算子的等价问题

Yichuan Cao, Ruyong Feng, Yunfei Li, Ruichen Qiu

专题命中 多智能体 :agent(abstract,abstract_cn)

AI总结 本文建立了同类型广义Airy算子等价的度障碍,并回答了Katz在1987年提出的问题,主要结果通过人机协作获得。

Comments 17 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16719 2026-07-02 cs.CV 67%

Emotion-Aware Classroom Quality Assessment Leveraging IoT-Based Real-Time Student Monitoring

基于物联网的实时学生监控情感感知教室质量评估

Hai Nguyen, Hieu Dao, Hung Nguyen, Nam Vu, Cong Tran

机构 * Posts and Telecommunications Institute of Technology (PTIT)(邮电技术学院(PTIT))

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文提出一个高吞吐量的多智能体情感计算框架,通过实时监控学生情绪状态提升课堂教学质量,利用教室情绪数据集验证了系统在实时处理和情感分类中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00654 2026-07-02 cs.CV 版本更新 67%

RC-GeoCP: Geometric Consensus for Radar-Camera Collaborative Perception

RC-GeoCP:雷达-相机协同感知的几何一致性

Xiaokai Bai, Lianqing Zheng, Runwei Guan, Siyuan Cao, Songkai Wang, Huiliang Shen

机构 * College of Information Science and Electronic Engineering, Zhejiang University(浙江大学信息科学与电子工程学院) School of Automotive Studies, Tongji University(同济大学汽车学院) Thrust of Artificial Intelligence, Hong Kong University of Science and Technology(香港科技大学人工智能研究所)

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 提出首个4D雷达与相机协同感知框架RC-GeoCP,通过雷达锚定几何一致性解决深度模糊和空间分散导致的错位,实现高效通信与全局一致表示。

Comments 11 pages, 6 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00481 2026-07-02 cs.CR cs.AI 新提交 57%

Beyond the Prompt: Jailbreaking Function-Calling LLMs via Simulated Moderation Traces

超越提示:通过模拟审核轨迹越狱函数调用大语言模型

Junlong Liu, Haobo Wang, Weiqi Luo, Xiaojun Jia

专题命中 多智能体 :workflow(abstract);分类 cs.AI

AI总结 针对函数调用大语言模型的结构性漏洞,提出基于模拟审核轨迹的黑盒攻击框架SMT,通过多轮交互绕过安全约束,在多个商业模型上实现高攻击成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00910 2026-07-02 cs.MA 新提交 50%

Calibrating the Instrument: Controllability of an LLM-Driven Synthetic Population

校准仪器:LLM驱动的合成人群的可控性

Mirko Degli Esposti

专题命中 多智能体 :agent(abstract)

AI总结 提出SIVE实验,通过七项预注册标准评估LLM驱动合成人群对已知效价刺激的响应可控性,发现弱阳性消息被识别为阴性,经重新设计后恢复预期排序,并揭示噪声特性与微观动力学。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 工作流自动化 13 篇

2604.18752 2026-07-02 hep-ph hep-ex 版本更新 82%

A Scientific Human-Agent Reproduction Pipeline

一种科学人机再生产流水线

Joschka Birk, Gregor Kasieczka, Siddharth Mishra-Sharma, Benjamin Nachman, Dennis Noll, Tanvi Wamorkar

专题命中 工作流自动化 :agent(title,abstract);AI agent(abstract)

AI总结 本文提出SHARP框架,通过人机协作实现科学分析的再生产,通过AI代理自动执行代码生成、测试和质量保证,研究人员在关键节点提供反馈和指导,提升科学理解而非替代人类。

Comments 6 pages, 1 figure, submitted to 2026 Conference on Physics and AI (PAI26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01102 2026-07-02 cs.SE 新提交 79%

SAGE: Structured Agentic Graph Editing for Software Diagrams

SAGE: 结构化智能体图编辑用于软件图表

Tyler Sivertsen, Neal Singh, James C. Davis

专题命中 工作流自动化 :agentic(title);workflow(abstract);分类 cs.SE

AI总结 提出SAGE工具,通过自然语言提示编辑软件图表,将图表映射为可编辑图结构,翻译请求为结构化编辑意图并执行操作,支持验证修复和版本管理,通过单元测试和Kubernetes案例评估有效性。

Comments 4 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00989 2026-07-02 cs.HC cs.AI 新提交 79%

SenseWalk: Agent-Based Semantic Trajectory Simulation Powered by Large Language Models in Zoned Environments

SenseWalk: 基于智能体的语义轨迹模拟——由大型语言模型在分区环境中驱动

Ziyue Lin, Xinhang Xie, Kangyi Wang, Siming Chen

机构 * School of Data Science, Fudan University(复旦大学数据科学学院)

专题命中 工作流自动化 :agent(title);workflow(abstract);分类 cs.AI

AI总结 提出SenseWalk系统,结合大语言模型与社会力模型,通过智能体模拟语义轨迹,并提供用户界面以简化配置与分析,实验验证了其有效性和效率。

Comments 18 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00941 2026-07-02 cs.CY 新提交 78%

From Runtime Records to Legal Findings: An Evidentiary-Adequacy Criterion for Agentic AI Oversight

从运行时记录到法律认定:面向智能体AI监管的证据充分性标准

Jeroen Janssen

专题命中 工作流自动化 :agentic(title,abstract)

AI总结 提出一个证据充分性标准,要求运行时记录必须包含事件类型和关系(如来源、权限)才能支持法律认定,并基于欧盟AI法案监管义务实例化该标准。

Comments 12 pages, technical report; companion materials deposited on Zenodo, DOI: 10.5281/zenodo.21025237

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17041 2026-07-02 cs.CL cs.IR 新提交 70%

MetaSyn: A Benchmark for LLM Agents on Meta-Analysis Articles from Nature Portfolio

对Nature Portfolio元分析文章进行LLM代理基准测试

Anzhe Xie, Weihang Su, Yujia Zhou, Yiqun Liu, Min Zhang, Qingyao Ai

机构 * Tsinghua University(清华大学)

专题命中 工作流自动化 :agent(abstract);workflow(abstract);分类 cs.CL

AI总结 提出MetaSyn数据集,包含442篇专家策划的元分析,用于评估LLM代理在检索-筛选-综合全流程中的表现,发现当前系统在筛选阶段存在严重瓶颈。

Comments 17 pages, 8 figures, 11 tables. Code and evaluation: https://github.com/THUIR/MetaSyn Dataset: https://huggingface.co/datasets/THUIR/MetaSyn Model: https://huggingface.co/BFTree/MA-Retriever

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16085 2026-07-02 cs.CV cs.AI 版本更新 57%

Interact3D: Compositional 3D Generation of Interactive Objects

Interact3D: 交互式物体的组合3D生成

Hui Shan, Keyang Luo, Ming Li, Sizhe Zheng, Yanwei Fu, Zhen Chen, Xiangru Huang

机构 * Zhejiang University(浙江大学) Shanghai Innovation Institute(上海创新研究院) Westlake University(西湖大学) Adobe Fudan University(复旦大学)

专题命中 工作流自动化 :agentic(abstract);分类 cs.AI

AI总结 提出Interact3D框架,通过统一3D引导场景、两阶段组合流水线(全局到局部几何对齐和基于SDF的优化)以及闭环智能体修正策略,从单张图像生成物理合理的交互式3D组合物体,解决遮挡和空间关系保持问题。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11046 2026-07-02 cs.LG 版本更新 57%

OpFML: Pipeline for ML-based Operational Inference

OpFML:基于机器学习的业务推理管道

Shahbaz Alvi, Giusy Fedele, Gabriele Accarino, Italo Epicoco, Ilenia Manco, Pasquale Schiano

机构 * CMCC Foundation - Euro-Mediterranean Center on Climate Change(CMCC基金会 - 欧洲地中海气候变化中心) Columbia University, Department of Earth and Environmental Engineering(哥伦比亚大学地球与环境工程系)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 提出OpFML管道,整合数据消费、应急处理、预处理和模型推理四步,消除部署样板代码,用于气候与地球科学模型的业务化推理。

Comments 7 pages, 2 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00851 2026-07-02 q-bio.NC q-bio.QM 50%

DRIADA: A Python Toolkit for Cross-Scale Analysis of Single-Neuron Selectivity and Population Dynamics

DRIADA: 一个用于单神经元选择性和群体动力学跨尺度分析的Python工具包

Nikita Pospelov, Viktor Plusnin, Olga Rogozhnikova, Anna Ivanova, Vladimir Sotskov, Margarita Orobets, Ksenia Toropova, Olga Ivashkina, Vladik Avetisov, Konstantin Anokhin

专题命中 工作流自动化 :workflow(abstract)

AI总结 提出DRIADA,一个统一神经信号与行为数据的Python框架,通过共享数据模型整合选择性测试、降维和网络分析,在合成数据、小鼠海马钙成像和环形吸引子网络验证中实现跨尺度分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00350 2026-07-02 stat.ME 50%

Robust Estimation and Inference with Selective Borrowing in Hybrid Controlled Trials: A Tutorial with SelectiveIntegrative and intFRT

混合对照试验中选择性借用的稳健估计与推断:基于SelectiveIntegrative和intFRT的教程

Ke Zhu, Hairong Huang, Shu Yang, Xiaofei Wang

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出混合对照试验中利用外部对照进行选择性借用的工作流程,通过SelectiveIntegrative和intFRT包实现稳健估计与推断,提高效率并保证推断有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01189 2026-07-02 eess.SY cs.SY 新提交 50%

TERA: A Unified Taylor Model Enabled Reachability Analysis Framework

TERA: 一个统一的泰勒模型可达性分析框架

Salma Iraky, Andrew Sogokon

专题命中 工作流自动化 :workflow(abstract)

AI总结 提出TERA框架,基于泰勒模型对连续、混合和随机系统进行统一的可达性分析,通过符号-数值工作流计算紧致可达集上近似,支持非线性ODE和混合系统基准测试。

Comments Presented at CONTROL 2026: 15th United Kingdom Automatic Control Council (UKACC) International Conference on Control, Newcastle upon Tyne, 23-25 June 2026. Proceedings: https://web.archive.org/web/20260622121207/http://control2026.ukcontrol.org/wp-content/uploads/2026/06/Control-2026-Proceedings-Booklet.pdf

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01132 2026-07-02 astro-ph.IM 新提交 50%

WST, the Wide-field Spectroscopic Telescope: Mechanical Design and FE Analyses for the High Resolution Spectrograph

WST,广域光谱望远镜:高分辨率光谱仪的机械设计与有限元分析

Simone D'Auria, Andrea Tozzi, Anna Brucalassi, Matteo Munari, Ciro Del Vecchio, Maria Sofia Randich, Roland Bacon, David Lee

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文介绍了WST高分辨率多目标光谱仪(MOS-HR)的机械设计,采用垂直光学平台配置,通过有限元分析验证了结构稳定性和环境鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07221 2026-07-02 cs.CV 版本更新 50%

Histopathology Multi-modal Embedding for Pathology Composed Retrieval

病理学组合检索的组织病理学多模态嵌入

Qifeng Zhou, Wenliang Zhong, Thao M. Dang, Hehuan Ma, Saiyang Na, Yuzhi Guo, Junzhou Huang

机构 * The University of Texas at Arlington(德克萨斯大学阿灵顿分校)

专题命中 工作流自动化 :workflow(abstract)

AI总结 提出HOMIE框架,将生成式多模态大语言模型适配为病理检索专家,解决组合查询中的架构、任务和领域不匹配问题,在病理组合检索基准上显著优于现有方法。

Comments Accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09907 2026-07-02 physics.chem-ph 50%

Multi-head committees enable direct uncertainty prediction for atomistic foundation models

多头委员会使原子基础模型能够直接进行不确定性预测

Hubert Beck, Pavol Simko, Lars L. Schaaf, Ondrej Marsalek, Christoph Schran

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出利用多头委员会机制构建神经网络势能,用于原子基础模型的不确定性预测,通过主动学习将训练集缩小至原大小的5%,同时保持预测精度。

Comments 11 pages, 7 figures in main article + supporting information

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 软件智能体 12 篇

2607.00911 2026-07-02 cs.SE 新提交 88%

From Registry to Repository: How AI Agent Skills Are Written, Adapted, and Maintained

从注册表到仓库:AI代理技能如何编写、适配和维护

Haoyu Gao, Jai Lal Lulla, Hong Yi Lin, Sebastian Baltes, Christoph Treude, Mansooreh Zahedi

专题命中 软件智能体 :agent(title,abstract);AI agent(title,abstract);分类 cs.SE

AI总结 本研究首次对AI代理技能作为工程制品进行实证分析,通过挖掘公共注册表和GitHub仓库中的技能,发现技能重用多为一次性复制,定制化主要适配本地环境,而行为契约几乎不变。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14690 2026-07-02 cs.SE 版本更新 84%

Harness Engineering for Agentic AI Coding Tools: An Exploratory Study

配置代理AI编码工具:探索性研究

Matthias Galster, Seyedmoein Mohsenimofidi, Jai Lal Lulla, Muhammad Auwal Abubakar, Christoph Treude, Sebastian Baltes

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);分类 cs.SE

AI总结 本文探讨了代理AI编码工具的配置机制,分析了多种工具的配置方法,发现Context Files主导配置,并提出AGENTS.md作为通用标准。

Comments 10 pages, 7 figures, 3 tables, based on "Configuring Agentic AI Coding Tools: An Exploratory Study" published in Proceedings of the 3rd ACM/IEEE International Conference on AI-powered Software (AIware 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00016 2026-07-02 cs.IR cs.AI 新提交 83%

Libra: Training the Environment for Agentic Information Retrieval

Libra: 为智能信息检索训练环境

Xuan Zhao, Andy Chiu, Gengyu Wang

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 提出Libra框架,通过引入可变目录和LLM驱动优化循环,自动改进代码仓库的索引结构,提升代码定位准确率,并实现跨模型和问题的零样本迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00053 2026-07-02 cs.SE cs.AI 新提交 81%

SWE-Router: Routing in Multi-turn Agentic Software Engineering Tasks

SWE-Router:多轮智能体软件工程任务中的路由

Seongho Son, Sangwoong Yoon, Jiahua Tang, Shuhan Wang, Lorenz Wolf, Ilija Bogunovic

专题命中 软件智能体 :agentic(title,abstract);分类 cs.AI、cs.SE

AI总结 提出SWE-Router,一种基于价值的时间路由方法,通过让廉价模型探索几轮后根据部分轨迹决定是否升级到昂贵模型,在保持强模型大部分性能的同时大幅提升成本效率。

Comments The 5th Deep Learning for Code Workshop, ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00038 2026-07-02 cs.SE 新提交 79%

Stop Hand-Holding Your Coding Agent: Engineering the Loops that Replace Step-by-Step Prompting

停止手把手指导你的编码智能体:设计替代逐步提示的循环机制

Sandeco Macedo

专题命中 软件智能体 :agent(title,abstract);分类 cs.SE

AI总结 本文提出循环规范作为替代逐步提示的编码智能体新范式,定义其结构、分类与设计原则,并通过真实语料分析验证其成熟度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00035 2026-07-02 cs.AI 新提交 79%

Making Failure Safe: A Constrained, Verifiable Agent Framework for Open-Web Data Collection

确保失败安全:一个用于开放网络数据收集的受约束、可验证的智能体框架

Bo Chen

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)

专题命中 软件智能体 :agent(title,abstract);分类 cs.AI

AI总结 提出一个受约束、可验证的智能体框架,通过将LLM输出从自由形式代码转换为类型化JSON收集器配置,结合六类型收集器分类、模板和效用函数约束、静态Airflow DAG执行、基于规则的质量检查和结构化反馈纠正,实现了零执行阶段LLM令牌消耗和最低平均挂钟时间。

Comments 15 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00990 2026-07-02 cs.SE cs.AI 新提交 62%

SWE-Doctor: Guiding Software Engineering Agents with Runtime Diagnosis from Multi-Faceted Bug Reproduction Tests

SWE-Doctor: 通过多面缺陷复现测试的运行时诊断引导软件工程智能体

Yaoqi Guo, Yang Liu, Jie M. Zhang, Yun Ma, Yiling Lou, Zhenpeng Chen

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.SE

AI总结 提出SWE-Doctor,通过生成多面缺陷复现测试并执行调试,构建运行时诊断记录,结合定位信息指导补丁生成,在SWE-bench Verified和Pro上平均解决率分别达75.7%和59.4%。

详情

展开后加载摘要…

URL PDF HTML 收藏