arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-03-20 至 2026-03-20 共收录 133 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 15 篇

2603.18960 2026-03-20 cs.HC 50%

Sketch2Topo: Using Hand-Drawn Inputs for Diffusion-Based Topology Optimization

Sketch2Topo: 利用手绘输入进行基于扩散的拓扑优化

Shuyue Feng, Cedric Caremel, Yoshihiro Kawahara

专题命中 工作流自动化 :workflow(abstract)

AI总结 Sketch2Topo通过结合图像到图像生成和图像编辑能力,提升扩散模型在拓扑优化中的定制化与用户交互体验,平衡功能与美学。

Comments 5 pages, 4 figures, accepted at CHI 2026 as a poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18398 2026-03-20 cs.HC 50%

Deconstructing Open-World Game Mission Design Formula: A Thematic Analysis Using an Action-Block Framework

解构开放世界游戏任务设计公式:一种使用动作块框架的主题分析

Kaijie Xu, Yiwei Zhang, Brian Yang, Clark Verbrugge

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出MAQV框架,通过分析2200个任务数据,揭示任务设计中的平衡与变化规律,提供可复现的分析流程和可视化工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18354 2026-03-20 cs.RO 50%

Multi-material Direct Ink Writing and Embroidery for Stretchable Wearable Sensors

多材料直接墨水书写与刺绣用于可拉伸可穿戴传感器

Lukas Cha, Ryman Hashem, Ria Prakash, Tanguy Declety, Wenze Zhang, Liang He

机构 * Institute of Biomedical Engineering, University of Oxford, UK(生物医学工程研究所,牛津大学,英国) The Podium Institute for Sports Medicine and Technology, University of Oxford, UK(体育医学与技术研究所,牛津大学,英国) École Polytechnique Fédérale de Lausanne, Switzerland(洛桑联邦理工学院,瑞士)

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出一种纺织品兼容的制造流程,结合多材料直接墨水书写与自动化刺绣,实现可拉伸应变传感器直接嵌入服装中,展示出高达120%的拉伸性能和线性响应特性,适用于运动捕捉和柔性机器人应用。

Comments 6 pages, 8 figures, conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00960 2026-03-20 cs.CV 50%

Efficient and Scalable Monocular Human-Object Interaction Motion Reconstruction

高效且可扩展的单目人类-物体交互运动重建

Boran Wen, Ye Lu, Sirui Wang, Keyan Wan, Jiahong Zhou, Junxuan Liang, Xinpeng Liu, Bang Xiao, Ruiyang Liu, Yong-Lu Li

机构 * SJTU(上海交通大学) SII(上海信息院) FDU(福建大学) BJTU(北京理工大学) ZJU(浙江大学)

专题命中 工作流自动化 :agent(abstract)

AI总结 本文提出一种高效的稀疏接触标注方法和InterPoint多模态预测器,结合4DHOISolver框架,构建了大规模4D HOI数据集,并通过强化学习验证了运动重建的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 9 篇

2603.18122 2026-03-20 cs.AI cs.HC cs.PL cs.SY eess.SY 86%

Don't Vibe Code, Do Skele-Code: Interactive No-Code Notebooks for Subject Matter Experts to Build Lower-Cost Agentic Workflows

不要编写代码,而是构建骨架代码:面向领域专家的交互式无代码笔记本以构建低成本的代理工作流

Sriram Gopalakrishnan

机构 * JP Morgan Chase & Co.(摩根大通公司)

专题命中 软件智能体 :agentic(title,comments);agent(abstract);AI agent(abstract);multi-agent(abstract)

AI总结 Skele-Code通过自然语言和图形界面帮助非技术人员构建工作流,通过增量交互式笔记本开发减少token成本,生成模块化且易扩展的工作流。

Comments Main paper 9 pages. Topics: Agentic Coding, HCI, LLMs, Workflows

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17973 2026-03-20 cs.SE cs.AI 84%

TDAD: Test-Driven Agentic Development - Reducing Code Regressions in AI Coding Agents via Graph-Based Impact Analysis

TDAD:基于图的影响力分析减少AI编码代理中的代码回归

Pepe Alonso, Sergio Yovine, Victor A. Braberman

机构 * Universidad ORT Uruguay(ORT大学乌拉圭分校) DC, UBA, Argentina(阿根廷布宜诺斯艾利斯大学(DC, UBA))

专题命中 软件智能体 :agentic(title,abstract);agent(abstract);分类 cs.AI、cs.SE

AI总结 TDAD通过在AI编码代理提交更改前进行影响分析,减少代码回归。实验表明其将回归率降低70%,优于传统方法。

Comments Toolpaper, 7 pages, 7 tables, 3 figures, 1 algorithm. Submitted to ACM AIWare 2026 (Data and Benchmark Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16744 2026-03-20 cs.AI cs.SI 83%

Nonstandard Errors in AI Agents

AI代理中的非标准误差

Ruijiang Gao, Steven Chong Xiao

机构 * School of Management, University of Texas at Dallas(德克萨斯大学达拉斯分校管理学院)

专题命中 软件智能体 :AI agent(title,abstract);agent(abstract);分类 cs.AI

AI总结 研究AI代理在相同数据和问题下是否产生相同结果,发现其存在显著非标准误差,源于代理间分析选择的不确定性。不同模型家族在方法偏好上存在系统差异,同行评审对分散影响有限,但接触高质量论文可大幅缩小估计范围。

Comments 45 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18018 2026-03-20 cs.CL cs.DB 79%

An Agentic System for Schema Aware NL2SQL Generation

一种基于模式的代理系统用于自然语言到SQL生成

David Onyango, Naseef Mansoor

机构 * Project Path Minnesota State University Mankato(明尼苏达州立大学曼科托分校)

专题命中 软件智能体 :agentic(title,abstract);分类 cs.CL

AI总结 本文提出一种基于模式的代理系统,利用小型语言模型作为主要代理,结合选择性LLM回退机制,降低计算成本,实验显示在BIRD基准上实现90%以上的成本节省。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18740 2026-03-20 cs.SE cs.AI cs.CR 73%

Measuring and Exploiting Confirmation Bias in LLM-Assisted Security Code Review

衡量和利用LLM辅助安全代码审查中的确认偏见

Dimitris Mitropoulos, Nikolaos Alexopoulos, Georgios Alexopoulos, Diomidis Spinellis

机构 * University of Athens(雅典大学) National Infrastructures for Research(研究与技术国家基础设施) Athens University of Economics and Business(雅典经济与商业大学)

专题命中 软件智能体 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.SE

AI总结 研究LLM在安全代码审查中是否存在确认偏见及其对漏洞检测的影响,并通过实验验证偏见在软件供应链攻击中的可利用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18314 2026-03-20 cs.LG cs.AI 62%

Approximate Subgraph Matching with Neural Graph Representations and Reinforcement Learning

基于神经图表示与强化学习的近似子图匹配

Kaiyang Li, Shihao Ji, Zhipeng Cai, Wei Li

机构 * IEEE Publication Technology Group(IEEE出版技术组)

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出基于强化学习的近似子图匹配算法,利用图变压器提取图表示并结合PPO优化策略,提升匹配效果与效率。

Comments 10 pages, 5 figures. Code available at https://github.com/KaiyangLi1992/RL-ASM

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20636 2026-03-20 cs.LG 57%

Image2Gcode: Image-to-G-code Generation for Additive Manufacturing Using Diffusion-Transformer Model

Image2Gcode: 基于扩散-变换器模型的图像到G-code生成用于增材制造

Ziyue Wang, Yayati Jadhav, Peter Pak, Amir Barati Farimani

机构 * Department of Materials Science and Engineering, Carnegie Mellon University, Pittsburgh, PA, USA(材料科学与工程系,卡内基梅隆大学,匹兹堡,PA,USA) Department of Mechanical Engineering, Carnegie Mellon University, Pittsburgh, PA, USA(机械工程系,卡内基梅隆大学,匹兹堡,PA,USA)

专题命中 软件智能体 :planning(abstract);分类 cs.LG

AI总结 本文提出Image2Gcode框架,通过图像直接生成可打印的G-code,省去CAD建模步骤,提升增材制造的易用性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18407 2026-03-20 cs.GT cs.MA cs.SY eess.SY 50%

Interleaved Information Structures in Dynamic Games: A General Framework with Application to the Linear-Quadratic Case

动态博弈中的交错信息结构:一个通用框架及其在线性二次情况中的应用

Janani S K, Kushagra Gupta, Ufuk Topcu, David Fridovich-Keil

专题命中 软件智能体 :agent(abstract)

AI总结 本文提出一个通用框架,用于建模和求解具有任意交错信息结构的动态博弈,通过数学程序网络(MPNs)方法和线性二次动态博弈的Riccati方程推导,展示了其在三代理论信息结构中的应用。

Comments 6 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21258 2026-03-20 quant-ph 50%

The Quantum Agreement Theorem

量子共识定理

María García Díaz, Adam Brandenburger, Giannicola Scarpa

专题命中 软件智能体 :agent(abstract)

AI总结 本文提出并证明了量子力学中的共识定理,探讨了在不同实验室中代理维持不同概率估计的可能性,通过共同确定性算子层级分析,揭示了量子非交换算子下的分歧现象及记录测量结果后共识的重新出现。

Comments 19 pages, 5 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

3. GUI与网页智能体 4 篇

2603.19191 2026-03-20 cs.AI 70%

OS-Themis: A Scalable Critic Framework for Generalist GUI Rewards

OS-Themis:一种可扩展的通用GUI奖励批评框架

Zehao Li, Zhenyu Wu, Yibo Zhao, Bowen Yang, Jingjing Xie, Zhaoyang Liu, Zhoumianze Liu, Kaiming Jin, Jianze Liang, Zonglin Li, Feng Wu, Bowen Zhou, Zun Wang, Zichen Ding

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai AI Laboratory(上海人工智能实验室) CUHK MMLab(香港中文大学多模态实验室) The Hong Kong University of Science and Technology(香港科学大学) National University of Singapore(新加坡国立大学)

专题命中 GUI与网页智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出OS-Themis框架,通过分解轨迹为可验证里程碑并采用审核机制,提升GUI奖励的可扩展性和准确性,实验表明其在AndroidWorld中提升了在线强化学习和轨迹验证的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18443 2026-03-20 cs.CV 50%

SR-Nav: Spatial Relationships Matter for Zero-shot Object Goal Navigation

SR-Nav:空间关系对于零样本物体目标导航至关重要

Leyuan Fang, Zan Mao, Zijing Wang, Yinlong Yan

机构 * School of Artificial Intelligence and Robotics, Hunan University(湖南大学人工智能与机器人学院)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 SR-Nav通过建模观察和经验的空间关系,提升感知与规划能力,在HM3D实验中实现最先进的成功率和导航效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12696 2026-03-20 cs.RO cs.CV 50%

HaltNav: Reactive Visual Halting over Lightweight Topological Priors for Robust Vision-Language Navigation

HaltNav: 基于轻量拓扑先验的反应式视觉停止用于鲁棒视觉-语言导航

Zihui Yu, Pingcong Li, Bichi Zhang, Sören Schwertfeger

机构 * SIST, ShanghaiTech University(上海科技大学信息与通信科学核心平台,上海科技大学) Key Laboratory of Intelligent Perception and Human-Machine Collaboration(智能感知与人机协同重点实验室)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 本文提出HaltNav框架,结合轻量拓扑先验与局部探索能力,通过反应式视觉停止机制提升视觉-语言导航的鲁棒性,实验表明其在复杂环境下的表现优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01122 2026-03-20 cs.RO 50%

Fast Confidence-Aware Human Prediction via Hardware-accelerated Bayesian Inference for Safe Robot Navigation

通过硬件加速的贝叶斯推理实现快速置信度感知的人类预测以实现安全的机器人导航

Michael Lu, Minh Bui, Xubo Lyu, Mo Chen

机构 * School of Computing Science, Simon Fraser University(西蒙弗雷泽大学计算科学学院)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 本文提出一种基于GPU加速的贝叶斯推理方法,实现高效安全的人类行为预测,支持更精细的轨迹预测,通过实验证明机器人在动态环境中与人类共存的潜力。

Comments Update the paper

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 记忆与上下文管理 6 篇

2503.13194 2026-03-20 cs.AI cs.LG 81%

A representational framework for learning and encoding structurally enriched trajectories in complex agent environments

一种用于学习和编码结构丰富轨迹的表示框架

Corina Catarau-Cotutiu, Esther Mondragon, Eduardo Alonso

机构 * Artificial Intelligence Research Centre (CitAI), Department of Computer Science(人工智能研究中心(CitAI)、计算机科学系)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出结构丰富轨迹(SETs)框架,通过多级图结构提升复杂环境中的轨迹表示能力,结合强化学习提升下游任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18330 2026-03-20 cs.AI cs.HC cs.LG cs.MA 62%

MemArchitect: A Policy Driven Memory Governance Layer

MemArchitect:一种基于策略的记忆管理层

Lingavasan Suresh Kumar, Yang Ba, Rong Pan

机构 * Arizona State University(亚利桑那州立大学)

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.AI、cs.LG

AI总结 MemArchitect通过引入规则化的记忆治理机制,解决大语言模型代理中的内存管理问题,提升自主系统可靠性和安全性。

Comments This is an on going research work and will be updated periodically

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18968 2026-03-20 cs.AI 57%

Teleological Inference in Structural Causal Models via Intentional Interventions

通过意图干预在结构因果模型中进行目的推理

Dario Compagno, Fabio Massimo Zennaro

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 本文提出通过意图干预在结构因果模型中处理目的性问题,引入结构最终模型以识别和发现智能体的意图。

Comments 29 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18712 2026-03-20 cs.AI 57%

Accurate and Efficient Multi-Channel Time Series Forecasting via Sparse Attention Mechanism

通过稀疏注意力机制实现准确且高效的多通道时间序列预测

Lei Gao, Hengda Bao, Jingfei Fang, Guangzheng Wu, Weihua Zhou, Yun Zhou

机构 * Department of Machine Learning(机器学习系) SF Express(顺丰快递) Department of Management(管理系) Zhejiang University of Technology(浙江工业大学) Zhejiang University(浙江大学)

专题命中 记忆与上下文管理 :planning(abstract);分类 cs.AI

AI总结 本文提出Li-Net架构,通过稀疏Top-K Softmax注意力机制和多尺度投影框架,有效捕捉多通道时间序列的线性和非线性依赖,提升预测精度与效率。

Comments Accepted by ICDE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18298 2026-03-20 cs.RO cs.AI cs.CV 57%

Sparse3DTrack: Monocular 3D Object Tracking Using Sparse Supervision

Sparse3DTrack: 基于稀疏监督的单目3D物体跟踪

Nikhil Gosala, B. Ravi Kiran, Senthil Yogamani, Abhinav Valada

机构 * University of Freiburg, Germany(弗赖堡大学) Qualcomm SARL France(法国高通公司) Automated Driving, Qualcomm Technologies, Inc., USA(美国高通技术公司自动驾驶部门)

专题命中 记忆与上下文管理 :autonomous agent(abstract);分类 cs.AI

AI总结 本文提出首个稀疏监督的单目3D物体跟踪框架,通过分解为2D查询匹配和3D几何估计两阶段任务,利用时空一致性增强稀疏标注样本,生成高质量3D伪标签,提升极端稀疏标注下的跟踪性能。

Comments 22 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11522 2026-03-20 physics.soc-ph nlin.AO 50%

A Self-Organized Tower of Babel: Diversification through Competition

自我组织的塔洛斯:通过竞争实现多样化

Riz Fernando Noronha, Kunihiko Kaneko

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文提出一个最小进化模型,展示局部合作与全局竞争如何导致社区多样性转变。通过高维状态代理的晶格模型,利用依赖局部邻居和全局差异的适应度,使不同适应度的多样化社区集群通过边界平衡形成。观察到准稳态下的连续转变,由边界新社区的出现触发。

Comments Main: 6 pages, 4 figures. Supplement: 7 pages, 9 figures

Journal ref Phys. Rev. Research 8, 013303 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏

5. Agent评测 18 篇

2602.08199 2026-03-20 cs.OS cs.DC 85%

Fork, Explore, Commit: OS Primitives for Agentic Exploration

分支、探索、提交:用于代理探索的操作系统原语

Cong Wang, Yusheng Zheng

专题命中 Agent评测 :agentic(title,abstract);agent(abstract);AI agent(abstract)

AI总结 本文提出分支上下文操作系统抽象,支持并行探索路径和原子提交回滚,通过BranchFS和branch系统调用实现,提升代理探索效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18197 2026-03-20 cs.AI cs.CR cs.NI 83%

Access Controlled Website Interaction for Agentic AI with Delegated Critical Tasks

受控网站交互用于代理AI的委托关键任务

Sunyoung Kim, Hokeun Kim

机构 * Arizona State University(亚利桑那州立大学)

专题命中 Agent评测 :agentic(title,abstract);AI agent(abstract);分类 cs.AI

AI总结 本文提出一种受控网站交互设计,用于代理AI执行关键任务,通过细粒度访问控制机制提升安全性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.01536 2026-03-20 cs.AI 79%

Algebras of actions in an agent's representations of the world

动作代数在代理对世界的表示中的代数

Alexander Dean, Eduardo Alonso, Esther Mondragon

机构 * Artificial Intelligence Research Centre (CitAI), Department of Computer Science, City St George's, University of London(人工智能研究与应用中心(CitAI)、计算机科学系、圣乔治学院、伦敦大学)

专题命中 Agent评测 :agent(title,abstract);分类 cs.AI

AI总结 本文提出从代理视角提取世界变换代数的框架,通过计算方法提取简单强化学习场景中的变换代数并分类,推广SBDRL的等变条件和解缠定义到任意代数的变换属性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18447 2026-03-20 cs.DB cs.AI cs.CL cs.CV cs.IR 79%

SODIUM: From Open Web Data to Queryable Databases

SODIUM:从开放网络数据到可查询数据库

Chuxuan Hu, Philip Li, Maxwell Yang, Daniel Kang

机构 * UIUC(伊利诺伊大学香槟分校)

专题命中 Agent评测 :agent(abstract);AI agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 研究针对需要整合多源网络数据的分析问题,提出SODIUM任务,通过系统化构建潜在数据库支持查询。开发SODIUM-Agent系统,采用ATP-BFS算法实现深度网络探索与结构化信息提取,准确率达91.1%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10971 2026-03-20 cs.CR cs.CL 77%

AJAR: Adaptive Jailbreak Architecture for Red-teaming

AJAR:适应性突破架构用于红队测试

Yipu Dou, Wang Yang

机构 * School of Cyber Science and Engineering(网络安全科学与工程学院)

专题命中 Agent评测 :agent(abstract);planning(abstract);agentic(abstract);分类 cs.CL

AI总结 AJAR框架通过可调用MCP服务实现多轮突破算法,提升X-Teaming攻击成功率至76.0%,并在工具访问下优化攻击面。

Comments 7 pages, 3 figures. Code and data available at https://github.com/douyipu/ajar

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18743 2026-03-20 cs.AI cs.CL cs.LG 67%

Memento-Skills: Let Agents Design Agents

Memento-Skills:让代理设计代理

Huichi Zhou, Siyuan Guo, Anjie Liu, Zhongwei Yu, Ziqin Gong, Bowen Zhao, Zhixun Chen, Menglong Zhang, Yihang Chen, Jinsong Li, Runyu Yang, Qiangbin Liu, Xinlei Yu, Jianmin Zhou, Na Wang, Chunyang Sun, Jun Wang

机构 * Memento-Team(Memento团队)

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 Memento-Skills是一种能够持续学习的通用大语言模型代理系统,通过经验自主构建、适应和改进任务特定代理,利用状态提示的强化学习框架和可重用的技能库实现持续学习。

Comments Memento-Skills Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18235 2026-03-20 cs.CR cs.CV 67%

Toward Reliable, Safe, and Secure LLMs for Scientific Applications

迈向科学应用中可靠、安全和安全的LLM

Saket Sanjeev Chaturvedi, Joshua Bergerson, Tanwi Mallick

机构 * Argonne National Laboratory(阿贡国家实验室)

专题命中 Agent评测 :agent(abstract);multi-agent(abstract)

AI总结 本文探讨了科学应用中LLM代理的安全与安全挑战,提出通过多代理系统生成领域特定对抗性安全基准,构建多层次防御框架以提升LLM可信度。

详情

展开后加载摘要…

URL PDF HTML 收藏