arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-17 至 2026-07-17 共收录 161 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 28 篇

2607.15182 2026-07-17 cs.MA cs.RO 新提交 89%

Stigmergic Graph Memory: An Environment-Aware Approach for Many-to-Many Multi-Agent Pickup and Delivery

stigmergic图记忆:一种用于多对多多智能体取货和送货的环境感知方法

Aditya Dutta, Joon-Seok Kim

机构 * Aditya Dutta, Joon-Seok Kim ∗(Aditya Dutta, Joon-Seok Kim)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract)

AI总结 研究多对多多智能体取货和送货问题,提出SGM方法,通过记录仓库节点和边的近期执行信号排序端点与路由偏好,在多种布局、负载条件下实验,结果显示该方法能提高仓库吞吐量。

Comments 16 pages total: 7 pages main text, 2 pages references, and 7 pages appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14110 2026-07-17 cs.CL cs.AI 新提交 88%

MAPS: Modeling Co-Existing Subjective Perspectives and Shared Meaning in Multi-Agent Cognitive Dialogue

MAPS:在多智能体认知对话中建模共存的主观视角和共享意义

Molood Arman, Clément Bonnafous

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL

AI总结 研究针对当前AI对话系统问题,提出MAPS框架,通过领域加权配置文件、动态GRU记忆和令牌级注意力,让智能体保持个性化推理并趋向共享意义,在多数据集评估中支持语义对齐且不损主观性,为可解释对话系统发展提供路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13572 2026-07-17 cs.CL cs.AI 版本更新 88%

ArogyaSutra: A Multi-Agent Framework for Multimodal Medical Reasoning in Indic Languages

ArogyaSutra:面向印度语言的多模态医学推理的多智能体框架

Tanmoy Kanti Halder, Akash Ghosh, Subhadip Baidya, Arijit Roy, Sriparna Saha

机构 * Indian Institute of Technology Patna(印度理工学院巴特那分校) Indian Institute of Technology Kanpur(印度理工学院坎普尔分校) Prasannadeb Women’s College(普拉萨纳德布女子学院)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL

AI总结 针对印度语言医疗场景中多模态大语言模型性能不足的问题,提出多模态医学问答数据集ArogyaBodha和基于演员-评论家的多智能体框架ArogyaSutra,通过工具接地与双记忆机制提升多语言医学推理准确性。

Comments Accepted for publication in IJCAI,2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14713 2026-07-17 econ.GN cs.CL cs.MA q-fin.EC 新提交 88%

Does Multi-Agent Debate Improve AI Feedback on Research Papers?

多智能体辩论能否改善人工智能对研究论文的反馈?

Tomas Havranek, Zuzana Irsova

机构 * Charles University, Faculty of Social Sciences, Institute of Economic Studies(查理大学社会科学学院经济研究所) Charles University, Prague Centre for Economic Policy Research, London(查理大学布拉格经济政策研究中心,伦敦) Meta-Research Innovation Center at Stanford(斯坦福大学元研究创新中心)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.CL

AI总结 研究探讨多智能体辩论能否改善人工智能对研究论文的反馈。通过44篇元分析作者对三篇人工智能报告排名,发现作者更青睐前沿模型单次审阅,且不同评判排序有差异,警示不能用人工智能评判替代作者,还衡量了对已完成论文的有用性。

Comments 29 pages, 1 figure, 6 tables. Pre-registered on OSF; data, code, judge prompts, and blinded reports in the replication package on Zenodo. Project page: https://meta-analysis.cz/debate

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14903 2026-07-17 cs.SE 新提交 88%

FirmPilot: Evidence-Guided Multi-Agent Environment Recovery for IoT Firmware Rehosting

FirmPilot:用于物联网固件重新托管的证据引导多智能体环境恢复

Yanbing Shen, Fan Zhang, Haitao Xu

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.SE

AI总结 研究针对物联网固件重新托管管道脆弱问题,提出证据引导多智能体框架FirmPilot,通过迭代环境重建解决跨层依赖,经实验验证其能提升可达性、增加检测服务数并支持下游分析,提高了固件重新托管的成功率和效用。

Comments 11 pages, 10 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06214 2026-07-17 cs.AI 版本更新 88%

A framework for single and multi-agent human-AI curiosity ecosystems

用于单智能体和多智能体人类-人工智能好奇心生态系统的玩具框架

Ilya E. Monosov

机构 * Johns Hopkins University(约翰斯·霍普金斯大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 该论文提出一个玩具框架,将好奇心视为生态系统,探讨单智能体询问策略及相关决策项权重随经验的变化,还扩展到多智能体,追踪多种指标,为研究好奇心生态及设计多智能体发现系统提供概念框架。

Comments fixed abstract in this version

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15211 2026-07-17 cs.CV 新提交 88%

MAGiSt3R: Multi-Agent Feed-forward 3D Reconstruction from Monocular RGB Videos

MAGiSt3R:基于单目RGB视频的多智能体前馈3D重建

Ziren Gong, Xiaohan Li, Fabio Tosi, Ninghui Xu, Stefano Mattoccia, Jianfei Cai, Matteo Poggi

机构 * University of Bologna(博洛尼亚大学) The University of Hong Kong(香港大学) Southeast University(东南大学) Monash University(莫纳什大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 研究基于单目RGB视频的多智能体3D重建问题,核心方法是用3R家族前馈模型和MAGMA合并模型,并进行姿态图优化,主要贡献是在合成和真实数据集上验证该框架相比现有方法有更高重建和相机跟踪精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05002 2026-07-17 cs.DB cs.AI 版本更新 87%

AgenticData: An Agentic Data Analytics System for Heterogeneous Data

AgenticData:一种用于异构数据的智能数据分析系统

Ji Sun, Guoliang Li, Peiyao Zhou, Yihui Ma, Jingzhe Xu, Yuan Li

机构 * Department of Computer Science, Tsinghua University(清华大学计算机科学系)

专题命中 多智能体 :agentic(title,abstract);agent(abstract);planning(abstract);multi-agent(abstract)

AI总结 针对现有非结构化数据分析系统依赖专家且成本高、耗时久的问题,AgenticData通过反馈驱动规划技术及多智能体协作策略,将自然语言查询转换为语义计划并优化执行,经测试在多个基准测试中准确率超现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15727 2026-07-17 cs.CR cs.AI cs.LG cs.MA cs.SE 版本更新 87%

AgentWorm: Self-Propagating Attacks Across LLM Agent Ecosystems

ClawWorm:针对LLM代理生态系统自主传播的攻击

Yihao Zhang, Zeming Wei, Xiaokun Luan, Chengcan Wu, Zhixin Zhang, Jiangrong Wu, Haolin Wu, Huanran Chen, Jun Sun, Meng Sun

机构 * Peking University(北京大学) Sun Yat-sen University(中山大学) Wuhan University(武汉大学) Tsinghua University(清华大学) Singapore Management University(新加坡管理学院)

专题命中 多智能体 :agent(title,abstract);autonomous agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG、cs.SE

AI总结 研究提出ClawWorm,首个自主传播的LLM代理框架攻击,通过单条消息实现持久化感染与多跳传播,揭示模型安全姿态差异及防御策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09822 2026-07-17 cs.SE cs.AI 86%

LLM-Based Agentic Systems for Software Engineering: Challenges and Opportunities

基于大语言模型的代理系统在软件工程中的应用:挑战与机遇

Yongjian Tang, Thomas Runkler

机构 * Siemens AG(西门子股份公司) Technical University of Munich(慕尼黑技术大学)

专题命中 多智能体 :agentic(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI、cs.SE

AI总结 本文探讨了基于大语言模型的多代理系统在软件工程中的应用,分析了其挑战与未来研究方向。

Comments Accepted to GenSE 2026 workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12254 2026-07-17 cs.CV 版本更新 86%

Self-Aware Recursively Self-Improving Agents for Personal Singularity: A Goal-, Scope-, Tool-, and Benchmark-Driven Multi-Agent Architecture

如何实现递归式自我提升智能体与个人奇点:一种目标、范围、工具和基准驱动的多智能体架构

Chengshuai Yang

机构 * NextGen PlatformAI C Corp.(下一代平台人工智能C公司)

专题命中 多智能体 :agent(title,abstract);multi-agent(title)

AI总结 研究大型语言模型智能体进步引发的问题,提出受治理多智能体架构实现递归式自我提升,以个人奇点为目标,详细介绍智能体各要素及架构组成,形式化多种机制并提供设计与路线图。

Comments 28 pages, 5 figures, 7 tables, and 5 algorithms. Position and systems-design paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14256 2026-07-17 cs.AI cs.MA 新提交 85%

Automatic Hard Example Synthesis with Multi-Level Agentic Data Curation

基于多级智能数据管理的自动硬示例合成

Genglin Liu, Muye Zhang, Krishnamurthy Viswanathan, Nichole J. Hansen, Blaž Bratanič, Nathan L Clement, Shalini Ghosh, Ariel Fuxman

机构 * UCLA(加州大学洛杉矶分校) Google(谷歌)

专题命中 多智能体 :agentic(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 研究多模态大语言模型在内容安全审核任务中易受攻击的问题,提出自动智能红队框架,利用多智能体架构合成对抗示例,无需人工干预,提高模型鲁棒性,降低公共图像安全基准中的误报率。

Comments 23 pages; work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15246 2026-07-17 cs.CV 新提交 85%

ARMOR++: Agentic Orchestration of a Multi-Domain Primitive Set for Transferable Attacks on Deepfake Detectors

ARMOR++:用于对深度伪造检测器进行可转移攻击的多域原语集的智能编排

Christos Korgialas, Gabriel Lee Jun Rong, Dion Jia Xu Ho, Pai Chet Ng, Xiaoxiao Miao, Konstantinos N. Plataniotis

机构 * Department of Informatics, Aristotle University of Thessaloniki(塞萨洛尼基亚里士多德大学信息学系) Infocomm Technology Cluster, Singapore Institute of Technology(新加坡科技学院信息通信技术集群) Department of Applied Physics and Applied Mathematics, Columbia University(哥伦比亚大学应用物理与应用数学系) Division of Natural and Applied Sciences, Duke Kunshan University(昆山杜克大学自然科学与应用科学部) Department of Electrical and Computer Engineering, University of Toronto(多伦多大学电气与计算机工程系)

专题命中 多智能体 :agentic(title,abstract);agent(abstract);multi-agent(abstract)

AI总结 研究针对深度伪造检测器在黑盒对抗转移下可靠性下降问题,提出ARMOR++多智能体框架,利用视觉与语言模型提供语义先验并编排原语选择等,整合多种原语有效针对异构偏差,实验表明其性能优于现有基线,凸显当前检测器可靠性差距及智能编排的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15257 2026-07-17 cs.AI cs.IR 新提交 83%

SearchOS-V1: Towards Robust Open-Domain Information-Seeking Agent Collaboration

SearchOS-V1:迈向稳健的开放域信息检索智能体协作

Yuyao Zhang, Junjie Gao, Zhengxian Wu, Jiaming Fan, Jin Zhang, Shihan Ma, Yao Yao, Weiran Qi, Chuyan Jin, Guiyu Ma, Xingzhong Xu, Kai Yang, Ji-Rong Wen, Zhicheng Dou

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学高瓴人工智能学院) Ant Group(蚂蚁集团)

专题命中 多智能体 :agent(title,abstract);multi-agent(abstract);分类 cs.AI

AI总结 研究开放域信息检索智能体协作问题,提出SearchOS系统级多智能体框架,通过将搜索进展转化为显式状态、设计上下文管理、应用调度机制及引入中间件和技能系统,在相关数据集上领先基线,推动稳健信息检索协作。

Comments Code is available at https://github.com/antins-labs/SearchOS

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15247 2026-07-17 cs.AI 新提交 83%

AutoSynthesis: An agentic system for automated meta-analysis

自动合成:一种用于自动化元分析的智能系统

Moein Taherinezhad, Sebastian Maier, Gerardo Vitagliano, Francesco Pierri, Stefan Feuerriegel

机构 * Politecnico di Milano(米兰理工大学) LMU Munich(慕尼黑大学) Munich Center for Machine Learning(慕尼黑机器学习中心) MIT CSAIL(麻省理工学院计算机科学与人工智能实验室)

专题命中 多智能体 :agentic(title);agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 研究旨在解决定量证据合成人工操作难扩展问题,提出自动合成这一端到端多智能体系统,能完成从制定策略到元分析等一系列任务,还支持相关分析与评估,应用效果显示其可使证据合成更具扩展性,助力循证决策。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14865 2026-07-17 cs.MA cs.CL 新提交 83%

The Energy Society: A Simulation Environment for Studying Agent Cooperation under Survival Pressure

能源社会:一个用于研究生存压力下智能体合作的模拟环境

Lucas Bergholdt Hansen, Federico Torrielli, Filippo Tonini, Lukas Galke Poech

机构 * University of Southern Denmark(丹麦南部大学) University of Turin(都灵大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(abstract);分类 cs.CL

AI总结 介绍能源社会模拟环境,研究生存压力下竞争与合作激励对智能体行为的影响,通过对比实验发现大模型能耗高,合作激励改变行为,相互推荐行动与记忆有作用,是研究令牌成本与群体激励关系的测试平台。

Comments Accepted at AITC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17612 2026-07-17 cs.PL cs.AI 版本更新 81%

Provable Coordination for LLM Agents via Message Sequence Charts

通过消息序列图实现LLM代理的可证明协调

Benedikt Bollig, Matthias Függer, Thomas Nowak

机构 * Université Paris-Saclay, CNRS, ENS Paris-Saclay, LMF, Gif-sur-Yvette, France(巴黎萨克雷大学、法国国家科学研究中心、巴黎萨克雷高等师范学院、LMF、法国吉夫-sur-耶vette) Institut Universitaire de France, Paris, France(法国国家科学院、巴黎,法国)

专题命中 多智能体 :agent(abstract);planning(abstract);workflow(abstract);multi-agent(abstract)

AI总结 本文提出基于消息序列图的领域特定语言,用于规范LLM代理协调,解决死锁和消息类型不匹配等问题,通过语法引导投影生成无死锁的局部代理程序,并展示如何在LLM非确定性基础上建立协调属性。

Comments 42 pages; accepted at ISoLA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13800 2026-07-17 cs.CV 版本更新 75%

Beyond Medical Diagnostics: How Medical Multimodal Large Language Models Think in Space

超越医学诊断:医学多模态大语言模型如何在空间中思考

Quoc-Huy Trinh, Xi Ding, Yang Liu, Zhenyue Qin, Xingjian Li, Gorkem Durak, Halil Ertugrul Aktas, Andrea M. Bejar, Ulas Bagci, Min Xu

专题命中 多智能体 :agent(abstract);agentic(abstract);multi-agent(abstract)

AI总结 本文提出SpatialMed基准,通过自主合成空间视觉问答数据评估医学MLLMs的3D空间智能,发现现有模型在医学影像空间推理能力不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14408 2026-07-17 cs.AI 新提交 70%

Reward-Free Evolving Agents via Pairwise Validator

通过成对验证器实现无奖励进化智能体

Minghao Liu, Yu Wang, Jiayun Wang, Wei Wei

专题命中 多智能体 :agent(abstract);agentic(abstract);分类 cs.AI

AI总结 研究提出用成对验证器取代标量奖励设计,集成到三个自我进化引擎中,有自适应焦点和软Elo两种变体。该方法在多智能体和两种工件基质上多数设置下达到或超全奖励基线,无需标记成本,是替代每步奖励设计的有效方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14103 2026-07-17 cs.CL cs.MA 新提交 70%

Latent Communication Between Language Model Agents: Channels, Alignment, and the Limits of Text

语言模型智能体之间的潜在通信:通道、对齐方式及文本的局限性

Markus Wenzel

机构 * Constructor University(康斯坦丁大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.CL

AI总结 研究大语言模型智能体间潜在通信,构建三个通信通道,通过稀疏自编码器分析信息损失,经实验发现文本通信会丢失信息,潜在通道在跨语言概念任务上与文本通道匹配但未超,得出丢失特征多编码表面形式的结论,还指出明确潜在通信优势需更深入任务及分析框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13418 2026-07-17 cs.IR cs.AI 版本更新 70%

Can We Steer the Black-Box? Towards Controllability-Centric Evaluation of Recommender Systems with Collaborative Agents

我们能操控黑箱吗?迈向以可控性为中心的协同代理推荐系统评估

Jiwen Zhou, Xiang Liu, Mingming Li, Pengbo Mo, Jiao Dai, Honglei Lv, Jizhong Han, Songlin Hu

机构 * Institute of Information Engineering, Chinese Academy of Sciences, China(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences, China(中国科学院大学网络安全学院)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 针对推荐系统缺乏可控性的问题,提出CtrlBench-Rec协同多智能体框架,形式化三个基本任务衡量可操纵性,通过实验有效量化可控性、揭示系统瓶颈,为可控推荐研究等提供首个标准化工具包。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14906 2026-07-17 eess.SY cs.SY 新提交 67%

Finite-Sample Conformal Coverage Recovery via Fusion under Degraded Local Guarantees in Occupancy Map Estimation

通过占用地图估计中退化局部保证下的融合实现有限样本共形覆盖恢复

Ritvik Mahajan, Aneesh Raghavan, Karl Henrik Johansson

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 研究针对多机器人环境映射中高斯过程占用映射缺乏有限样本预测保证、共形预测局部保证退化的问题,开发分布式融合算法,通过机器人交换e值及接收器融合,实现恢复目标覆盖水平,提升地图效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14508 2026-07-17 eess.SY cs.SY 新提交 67%

A Distributed PI+Reset Scheme for Discrete-Time Economic Dispatch of A Grid-connected BESS Network

一种用于并网电池储能系统网络离散时间经济调度的分布式PI+复位方案

Yalin Zhang, Zhongxin Liu, Fuyong Wang, Zengqiang Chen

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 研究并网电池储能系统网络离散时间经济调度问题,基于离散时间多智能体系统设计含新型PI控制器的分布式方案,通过MC共识控制器等实现调度,相比现有P控制器方案,加速收敛且提高精度,仿真验证算法有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14734 2026-07-17 math.OC 新提交 67%

A Slow-Fast Stochastic Framework for Zeroth-Order Distributed Time-Varying Optimization

用于零阶分布式时变优化的慢-快随机框架

Wanying Li, Nan-jing Huang

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 研究仅用零阶信息的随机多智能体系统分布式时变优化,构建慢-快随机框架,引入辅助变量和快速子系统生成梯度估计,慢子系统进行优化和一致性,分析收敛性并通过模拟验证,建立界表征参数等对跟踪性能的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14138 2026-07-17 cs.PL cs.AI cs.DC cs.HC cs.MA 新提交 57%

Volition Elicitation: Operational Semantics for People and Their Machines

意志激发:人与机器的操作语义学

Ehud Shapiro

机构 * London School of Economics(伦敦经济学院) Weizmann Institute of Science(魏茨曼科学研究院)

专题命中 多智能体 :agent(abstract);分类 cs.AI

AI总结 研究含人和个人机器的分布式系统中由人意志驱动的计算,定义编程语言vGLP并给出操作语义,通过激发人意志实现用户界面,利用AI将意志保护多智能体原子事务生成vGLP程序及实现,得到部署在智能手机上的应用。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 工作流自动化 23 篇

2607.14456 2026-07-17 cs.SE cs.AI 新提交 90%

Beyond Generalist LLMs: Specialist Agentic Systems for Structured Code Workflow Execution

超越通用语言模型:用于结构化代码工作流执行的专业代理系统

Harris Borman, Herman Wandabwa, Fusun Yu, Sandeepa Kannangara, Justin Liu, Anna Leontjeva, Ritchie Ng

专题命中 工作流自动化 :workflow(title,abstract);agentic(title,abstract);tool-use(abstract);分类 cs.AI、cs.SE

AI总结 研究在业务流程自动化中,将BPMN图转换为可执行代理工作流时,专业代理是否值得额外开发。引入专业工作流并与通用代理比较,结果显示专业代理在多方面表现更优,通用代理代码生成不一致,不适用于工业环境。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14919 2026-07-17 cs.RO 新提交 78%

Human-Robot Interaction in GenAI Architectures via the Agent-Client Protocol

通过代理-客户端协议实现生成式人工智能架构中的人机交互

Jesus Moncada-Ramirez, Jose-Raul Ruiz-Sarmiento, Javier Gonzalez-Jimenez

机构 * Machine Perception and Intelligent Robotics Group (MAPIR-UMA), Malaga Institute for Mechatronics Engineering and Cyber-Physical Systems (IMECH.UMA), University of Malaga(机器感知与智能机器人组(MAPIR-UMA),马拉加机电一体化工程与网络物理系统研究所(IMECH.UMA),马拉加大学)

专题命中 工作流自动化 :agent(title,abstract)

AI总结 研究针对GenAI推动下机器人架构中HRI层碎片化问题,提出采用代理-客户端协议(ACP),结合MCP构建三层解耦架构,消除架构依赖,支持异构界面,提供协作HRI能力,经实验验证了架构的互操作性和实时人在回路工作流程。

Comments 8 pages, 5 figures, 1 table. Submitted to IEEE Robotics and Automation Letters (RA-L)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14309 2026-07-17 cs.AI cs.CY 新提交 77%

Traccia: An OpenTelemetry-Based Governance Platform for AI Systems

Traccia:一个基于OpenTelemetry的人工智能系统治理平台

Nutan Kumar Naik, Aditya Kumar Saroj, Vijay Prasad Poudel, Saurav Samantray, Abhishek Patel

机构 * National Institute of Technology Rourkela(鲁尔基国立技术学院)

专题命中 工作流自动化 :autonomous agent(abstract);workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 研究针对大语言模型和人工智能驱动智能体发展带来的软件治理问题,提出基于OpenTelemetry构建多层次人工智能治理堆栈Traccia,通过添加遥测数据等解决对齐问题,自动创建合规证据包,为企业管理自主人工智能系统创建机器可读基础。

Comments 26 pages, 2 figures, 3 tables, Declaration of generative AI and AI-assisted technologies in the writing process, Declaration of competing interest

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04103 2026-07-17 q-fin.RM cs.LG 版本更新 70%

Governing Generative AI Across Financial Institutions: A Framework for Generative AI Risk Control

跨金融机构治理生成式AI:符合SR 26-2要求的生成式AI风险控制框架

Dennis Mao, Alessandra Lin, Yixin Kang, Yiqing Wang

机构 * Citigroup(摩根大通) Florida State University(佛罗里达州立大学)

专题命中 工作流自动化 :workflow(abstract);agentic(abstract);分类 cs.LG

AI总结 针对SR 26-2未覆盖生成式AI的治理难题,本文提出兼容该监管规则的GAICF框架,将模型风险管理原则转化为分层控制结构,助力金融机构合规管控生成式AI应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26258 2026-07-17 cs.CL cs.LG 版本更新 62%

FlowBot: Inducing LLM Workflows with Bilevel Optimization and Textual Gradients

FlowBot:通过双层优化和文本梯度诱导LLM工作流

Hongyeon Yu, Young-Bum Kim, Yoon Kim

机构 * Massachusetts Institute of Technology(麻省理工学院)

专题命中 工作流自动化 :workflow(abstract);分类 cs.CL、cs.LG

AI总结 本文提出FlowBot,一种基于双层优化和文本梯度的数据驱动方法,自动诱导LLM代理和工作流,与人类设计的基线相比表现相当。

详情

展开后加载摘要…

URL PDF HTML 收藏