arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-06-04 至 2026-06-04 共收录 1118 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 128 篇

1808.04161 2026-06-04 eess.SY cs.SY 67%

Quantization effects and convergence properties of rigid formation control systems with quantized distance measurements

量化效应与刚性编队控制系统的收敛性质

Zhiyong Sun, Hector Garcia de Marina, Brian D. O. Anderson, Ming Cao

专题命中 Agent评测 :agent(abstract,abstract_cn)

AI总结 本文研究了在量化距离测量下刚性编队控制系统的量化效应与收敛性质,分析了均匀量化和对数量化对距离误差收敛的影响,并探讨了非对称均匀量化的作用。

Comments 29 pages, International Journal of Robust and Nonlinear Control 2018

详情

展开后加载摘要…

URL PDF HTML 收藏
1807.03823 2026-06-04 eess.SY cs.SY 67%

Verification of Uncertain POMDPs Using Barrier Certificates

使用屏障证书验证不确定POMDPs

Mohamadreza Ahmadi, Murat Cubuktepe, Nils Jansen, Ufuk Topcu

专题命中 Agent评测 :agent(abstract);autonomous agent(abstract)

AI总结 本文研究不确定POMDPs的验证问题,通过将POMDP转化为切换系统并利用屏障证书方法,结合求和平方编程实现最优性和安全性的验证,以火星探测器为例验证方法有效性。

Comments 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1709.10237 2026-06-04 eess.SY cs.RO cs.SY 67%

Beacon-referenced Mutual Pursuit in Three Dimensions

三维环境中基于信标的目标互追策略

Kevin S. Galloway, Biswadip Dey

专题命中 Agent评测 :agent(abstract,abstract_cn)

AI总结 本文提出一种三维环境中基于信标的互追控制律,通过引入额外项关注信标,分析了双体互追系统的闭环动态行为,证明在特定参数条件下,系统可形成具有共同半径的圆轨道稳定状态。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23420 2026-06-04 cs.AI 65%

Bilevel Autoresearch: Meta-Autoresearching Itself

双层自动研究:元自动研究自身

Yaonan Qu, Meng Lu

机构 * Independent Researcher(独立研究者)

专题命中 Agent评测 :agent(abstract);分类 cs.AI;AI agent(comments);agentic(comments)

AI总结 提出双层自动研究框架,外层循环通过读取内层循环代码和轨迹、识别瓶颈并注入可执行Python搜索机制来改进内层循环,在GPT预训练基准上实现5倍改进。

Comments 16 pages, 5 figures, 3 tables. v2 expands the framing as mechanism-level agentic self-improvement and updates related work and limitations; core method and experiments unchanged. This paper was primarily drafted by AI agents with human oversight and direction

详情

展开后加载摘要…

URL PDF HTML 收藏
1610.05202 2026-06-04 cs.LG cs.AI cs.DC cs.SY eess.SY stat.ML 62%

Decentralized Collaborative Learning of Personalized Models over Networks

网络上的去中心化协作学习个性化模型

Paul Vanhaesebrouck, Aurélien Bellet, Marc Tommasi

机构 * INRIA

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文研究了在协作对等网络中,如何通过与其他具有相似目标的代理通信来改进本地训练模型,提出两种异步 gossip 算法并基于 ADMM 实现去中心化算法。

Comments To appear in the Proceedings of the 20th International Conference on Artificial Intelligence and Statistics (AISTATS 2017)

详情

展开后加载摘要…

URL PDF HTML 收藏
1604.03912 2026-06-04 cs.AI cs.LG cs.SY eess.SY stat.ML 62%

Inverse Reinforcement Learning with Simultaneous Estimation of Rewards and Dynamics

逆强化学习与奖励和动态的同时估计

Michael Herman, Tobias Gindele, Jörg Wagner, Felix Schmitt, Wolfram Burgard

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种基于梯度的逆强化学习方法,同时估计系统动态和奖励函数,提升了样本效率和估计准确性。

Comments accepted to appear in AISTATS 2016

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05001 2026-06-04 cs.SE 57%

TeleSWEBench: A Commit-Driven Benchmark for Evaluating LLM-Powered Software Engineering in Telecommunications

TeleSWEBench:一个面向电信领域评估基于LLM的软件工程的提交驱动基准

Pranshav Gajjar, Ali Mamaghani, Dinesh Bharadia, Vijay K Shah

专题命中 Agent评测 :agent(abstract);分类 cs.SE

AI总结 提出TeleSWEBench,首个面向电信领域的提交驱动基准,通过从srsRAN 5G仓库挖掘真实提交并构建734个可执行测试用例,结合分层LLM评判框架TeleJudge,评估ASE工具在电信软件工程中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04072 2026-06-04 cs.RO cs.DC cs.LG cs.SY eess.SY 57%

CADET: A Modular Platform for Evaluating Distributed Cooperative Autonomy in Connected Autonomous Vehicles

CADET:用于评估网联自动驾驶车辆中分布式协作自主性的模块化平台

Pragya Sharma, Brian Wang, Mani Srivastava

机构 * UCLA Amazon Scholar(亚马逊学者)

专题命中 Agent评测 :planning(abstract);分类 cs.LG

AI总结 提出CADET模块化平台,通过解耦自动驾驶堆栈并集成网络与工作负载仿真,系统评估分布式协作自主系统在真实部署条件下的安全性与性能。

Journal ref ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00747 2026-06-04 cs.CV cs.AI 57%

SkyShield: Occupancy as a Safety Interface for Low-Altitude UAV Autonomy

SkyShield:占用作为低空无人机自主飞行的安全接口

Jie Gao, Jie Ma, Kaihui Lin, Kai Ye, Miaohui Zhang, Pingyang Dai, Liujuan Cao

机构 * Xiamen University(厦门大学) Jiangxi Academy of Sciences(江西省科学院)

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 针对低空无人机自主飞行中的三维空间理解问题,提出首个前视单目语义占用基准SkyShield、动态感知度量KAR-mIoU和几何优先基线SkyOcc,将占用作为安全接口。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22240 2026-06-04 cs.AI 57%

Unlocking Proactivity in Task-Oriented Dialogue

解锁任务导向型对话中的主动性

Azure Zhang, Ning Gao, Yuqin Dai, Ruiyuan Wu, Jinpeng Wang, Rena Wei Gao, Bingdong Tan, Shuzheng Gao, Zongjie Li, Chaozheng Wang

机构 * Keeta AI, Meituan(Keeta AI,美团) Independent Researcher(独立研究者) CUHK(香港中文大学) HKUST(香港科技大学)

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 针对任务导向型对话中主动性问题,提出认知用户模拟器和模拟器诱导的非对称视角策略优化,通过建模用户潜在关注实现主动对话。

详情

展开后加载摘要…

URL PDF HTML 收藏
1903.07266 2026-06-04 cs.LG cs.DC cs.MA cs.SY eess.SY stat.ML 57%

Distributed stochastic optimization with gradient tracking over strongly-connected networks

在强连通网络上进行分布式随机优化与梯度跟踪

Ran Xin, Anit Kumar Sahu, Usman A. Khan, Soummya Kar

机构 * Department of Electrical and Computer Engineering, Tufts University(Tufts大学电气与计算机工程系) Bosch Center for Artificial Intelligence(博世人工智能中心) Department of Electrical and Computer Engineering, Carnegie Mellon University(卡内基梅隆大学电气与计算机工程系)

专题命中 Agent评测 :agent(abstract);分类 cs.LG

AI总结 本文研究了在强连通网络上最小化平滑且强凸局部成本函数之和的分布式随机优化问题,提出了一种新的分布式方法$\mathcal{S}$-$\mathcal{AB}$,通过辅助变量在期望意义上渐近跟踪全局成本的梯度,利用行和列随机权重确保共识和最优性,并在任意强连通图上应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
1612.05971 2026-06-04 eess.SY cs.AI cs.GT cs.SY math.OC 57%

An Integrated Optimization + Learning Approach to Optimal Dynamic Pricing for the Retailer with Multi-type Customers in Smart Grids

在智能电网中面向多类型顾客的零售商最优动态定价集成优化与学习方法

Fanlin Meng, Xiao-Jun Zeng, Yan Zhang, Chris J. Dent, Dunwei Gong

机构 * School of Engineering and Computing Sciences, Durham University(工程与计算科学学院,达勒姆大学) School of Computer Science, The University of Manchester(计算机科学学院,曼彻斯特大学) College of Information System and Management, National University of Defense Technology(信息系统与管理学院,国防科技大学) School of Mathematics, University of Edinburgh(数学学院,爱丁堡大学) School of Information and Control Engineering, China University of Mining and Technology(信息与控制工程学院,中国矿业大学)

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 本文针对智能电网中零售商服务三种不同类型的顾客问题,提出两级决策框架,结合优化与学习方法实现动态定价优化,通过仿真实验验证模型的有效性。

Comments 38 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1802.08138 2026-06-04 cs.AI cs.GT cs.SY eess.SY 57%

Reliable Intersection Control in Non-cooperative Environments

非合作环境中的可靠交叉口控制

Muhammed O. Sayin, Chung-Wei Lin, Shinichi Shiraishi, Tamer Başar

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Toyota InfoTechnology Center(丰田信息技术中心)

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 本文提出一种可靠交叉口控制机制,用于非合作环境中的战略自主和联网车辆。通过分析车辆的战略行为,确定纳什均衡,并识别社会最优均衡以实现公平分配。

Comments Extended version (including proofs of theorems and lemmas) of the paper: M. O. Sayin, C.-W. Lin, S. Shiraishi, and T. Basar, "Reliable intersection control in non-cooperative environments", to appear in the Proceedings of American Control Conference, 2018

详情

展开后加载摘要…

URL PDF HTML 收藏
1508.07933 2026-06-04 math.OC cs.LG cs.SY eess.SY 57%

Coordinate Dual Averaging for Decentralized Online Optimization with Nonseparable Global Objectives

协调双平均法用于具有非分离全局目标的去中心化在线优化

Soomin Lee, Angelia Nedić, Maxim Raginsky

专题命中 Agent评测 :agent(abstract);分类 cs.LG

AI总结 本文提出两种去中心化变体ODA-C和ODA-PS,用于解决去中心化在线凸优化问题,通过双平均方法实现子线性悔度增长。

Comments 10 pages; accepted for publication in IEEE Transactions on Control of Network Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
1406.1128 2026-06-04 cs.AI cs.SY eess.SY 57%

A self-organizing system for urban traffic control based on predictive interval microscopic model

基于预测区间微观模型的自组织城市交通控制系统

Bartlomiej Placzek

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 本文提出一种基于预测区间微观模型的自组织交通信号系统,通过智能体预测控制动作对交通流的影响,优化交通控制性能,尤其在非均匀交通流中表现更优。

Comments 29 pages, 8 figures

Journal ref Engineering Applications of Artificial Intelligence, vol. 34, pp. 75-84, 2014

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04884 2026-06-04 cs.RO 50%

D$^3$-MoE:Dual Disentangled Diffusion Mixture-of-Experts for Style-Controllable End-to-End Autonomous Driving

D$^3$-MoE:面向风格可控的端到端自动驾驶的双解耦扩散混合专家模型

Renju Feng, Rukang Wang, Ning Xi, Jianguo Yu, Liping Lu, Pan Zhou, Duanfeng Chu

机构 * Intelligent Transportation Systems Research Center, Wuhan University of Technology(武汉理工大学智能交通系统研究中心) School of Mechanical and Electronic Engineering, Wuhan University of Technology(武汉理工大学机械电子工程学院) School of Computer Science and Artificial Intelligence, Wuhan University of Technology(武汉理工大学计算机科学与人工智能学院) Hubei Key Laboratory of Distributed System Security, School of Cyber Science and Engineering, Huazhong University of Science and Technology(湖北省分布式系统安全重点实验室,华中科技大学网络空间安全学院)

专题命中 Agent评测 :planning(abstract)

AI总结 提出D$^3$-MoE框架,通过行为轴(扩散生成与选择解耦)和物理轴(纵向与横向专家解耦)的双重解耦,实现风格可控的端到端自动驾驶,在NAVSIM基准上达到SOTA规划性能。

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04569 2026-06-04 cs.RO 50%

MineXplore: An Open-Source Reinforcement Learning Exploration Benchmark for GNSS-Denied Underground Environment

MineXplore: 面向GNSS拒止地下环境的开源强化学习探索基准

Abhishek S, Badrikanath Praharaj, Sreeram MV

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学)

专题命中 Agent评测 :agent(abstract)

AI总结 提出基于真实矿井数据的开源MuJoCo导航基准MineXplore,通过六阶段管道重建隧道网络,验证了在GNSS拒止、光照退化等极端条件下策略学习的稳定性与可复现性。

Comments 7 pages,11 figures, Submitted to the workshop Xplore:Cross-Disciplinary aspects of Exploration in Robotics, Reinforcement Learning and Search Held at International Conference on Robotics and Automation (ICRA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04282 2026-06-04 cs.CV 50%

FindIt: A Format-Informed Visual Detection Benchmark for Generalist Multimodal LLMs

FindIt:面向通用多模态大语言模型的格式感知视觉检测基准

Eshika Khandelwal, Jingjing Pan, Mingfang Zhang, Quan Kong, Lorenzo Garattoni, Hilde Kuehne

机构 * Tuebingen AI Center, University of Tuebingen(图宾根人工智能中心,图宾根大学) Woven by Toyota, Inc.(丰田公司) Toyota Motor Europe(丰田欧洲公司)

专题命中 Agent评测 :agentic(abstract)

AI总结 提出首个全面评估通用多模态大语言模型在可提示定位能力上的基准,涵盖四种核心任务,并标准化输入输出格式,揭示模型对格式约束的敏感性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04206 2026-06-04 cs.RO 50%

DLO-Lab: Benchmarking Deformable Linear Object Manipulations with Differentiable Physics

DLO-Lab: 基于可微物理的可变形线性物体操作基准测试

Junyi Cao, Yian Wang, Ziyan Xiong, Chunru Lin, Zhehuan Chen, Chuang Gan

机构 * DLO-Lab(DLO实验室)

专题命中 Agent评测 :agent(abstract)

AI总结 针对机器人操作绳索、电缆等可变形线性物体(DLO)的挑战,提出一个可微模拟器,支持多种材料属性,并构建基准任务套件,结合专用DLO智能体,评估策略学习算法并验证仿真到现实的迁移。

Comments ICML 2026, the project page: https://dlo-lab-26.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04172 2026-06-04 cs.RO 50%

Affordance2Action: Task-Conditioned Scene-level Affordance Grounding for Real-Time Manipulation

Affordance2Action: 任务条件下的场景级功能区域定位用于实时操作

Litao Liu, Yifan Han, Pengfei Yi, Wenbo Yu, Hanqing Wang, Haoran Du, Enze Yuan, Zilin Yuan, Ruiding Feng, Michael Liu, Qi Zhang, Jingjin Yu

机构 * Department of Computer Science, Rutgers University-New Brunswick(罗格斯大学新布朗斯维尔回声分校计算机科学系) The Hong Kong University of Science and Technology (GZ)(香港科学与技术大学(GZ)) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 Agent评测 :agent(abstract)

AI总结 提出Affordance2Action框架,通过构建A2A-Bench基准和A2A-AffordGen标注流程,解决场景级任务条件功能区域定位中的多区域对应问题,并支持实时操作。

Comments 23 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04131 2026-06-04 cs.SI math.PR 50%

Network node immunization: improving Netshield algorithm through random rooted forests

网络节点免疫:通过随机有根森林改进Netshield算法

Luca Avena, Alexandre Gaudillière, Irina Gurewitsch, Adoré Randriamandroso, Alessio Troiani

专题命中 Agent评测 :agent(abstract)

AI总结 针对复杂网络中的多节点免疫问题,提出基于随机游走核和随机生成森林的K-shield算法,在相同计算复杂度下提升Netshield算法的搜索性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09795 2026-06-04 physics.soc-ph cond-mat.stat-mech 50%

Symmetric preferences, asymmetric outcomes: Tipping dynamics in an open-city segregation model

对称偏好,非对称结果:开放城市隔离模型中的临界转变动力学

Fabio van Dissel, Tuan Minh Pham, Wout Merbis

专题命中 Agent评测 :agent(abstract)

AI总结 通过空间扩展化学反应网络建模,发现即使对称偏好下,系统在临界偏好水平发生非对称相变,一种类型主导,该相变与Ising普适类共享部分特征但临界指数不同。

Comments v1: 10+6 pages, 7+3 figures. v2: 11+8 pages, 7+3 figures, improved finite-size scaling robustness analysis. Comments welcome

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07991 2026-06-04 econ.TH 50%

Coordinate-free utility theory

无坐标效用理论

Safal Raman Aryal

专题命中 Agent评测 :agent(abstract)

AI总结 本文通过构建有向偏序群(账本群)及其对偶锥,为不完全或非传递偏好提供了规范的内在几何刻画,并将标准多属性效用表示重构为对偶锥与连续泛函子空间的交集。

Comments Significant gap in the literature review that calls into question the methodology of the paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.12272 2026-06-04 econ.GN q-fin.EC 50%

Peer Effects in Consideration and Preferences

考虑集与偏好中的同伴效应

Nail Kashaev, Natalia Lazzati, Ruli Xiao

专题命中 Agent评测 :agent(abstract)

AI总结 本文构建了一个包含同伴效应在偏好和考虑集中的离散选择模型,通过非参数方法从选择序列中恢复网络连接、个体偏好和考虑机制,并应用于茶饮连锁店扩张决策,发现有限考虑会减缓市场渗透和竞争。

详情

展开后加载摘要…

URL PDF HTML 收藏
1503.06408 2026-06-04 eess.SY cs.MA cs.SY 50%

Automated Linear Function Submission-based Double Auction as Bottom-up Real-Time Pricing in a Regional Prosumers' Electricity Network

基于线性函数提交的双拍卖的自动化机制作为区域供能者电力网络中的自下而上实时定价

Tadahiro Taniguchi, Koki Kawasaki, Yoshiro Fukui, Tomohiro Takata, Shiro Yano

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出了一种基于线性函数提交的双拍卖机制,用于区域电力网络中的自下而上实时定价,通过每个代理同时作为生产者和消费者进行电力交易,实现电力供需的精确平衡,无需中央定价者。

Journal ref Energies 2015, 8(7), 7381-7406

详情

展开后加载摘要…

URL PDF HTML 收藏
1412.4428 2026-06-04 stat.ME econ.GN q-fin.EC q-fin.MF 50%

Nonparametric Stochastic Discount Factor Decomposition

非参数随机折现因子分解

Timothy Christensen

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出了一种经验框架,用于分析随机折现因子过程的永久-暂时分解,通过非参数方法估计Hansen和Scheinkman(2009)的Perron-Frobenius特征函数问题的解,并研究了递归偏好模型中的持续价值函数非参数估计器。

Journal ref Econometrica 85(5) (2017) 1501-1536

详情

展开后加载摘要…

URL PDF HTML 收藏
1709.08746 2026-06-04 eess.SY cs.MA cs.SY math.OC 50%

DIeSEL: DIstributed SElf-Localization of a network of underwater vehicles

DIeSEL:水下车辆网络的分布式自定位

Cláudia Soares, Pusheng Ji, João Gomes, António Pascoal

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出了一种分布式自定位方法,通过优化非凸最大似然估计器,在存在范围测量噪声的情况下实现更准确和高效的定位,优于传统集中式扩展卡尔曼滤波器。

Journal ref IEEE OCEANS 2017, Anchorage, AK, 2017

详情

展开后加载摘要…

URL PDF HTML 收藏
1904.05286 2026-06-04 eess.SY cs.SY 50%

Privacy preservation in continuous-time average consensus algorithm via deterministic additive obfuscation signals

通过确定性加性混淆信号在连续时间平均一致性算法中实现隐私保护

Navid Rezazadeh, Solmaz S. Kia

专题命中 Agent评测 :agent(abstract)

AI总结 本文研究了在强连通且权衡平衡的有向图上,连续时间拉普拉斯平均一致性算法中对抗内部和外部恶意代理的隐私保护问题,通过加性扰动信号作为隐私保护措施的有效性进行评估,提出了必要的充分条件,设计了观察器以识别其他代理的初始条件。

详情

展开后加载摘要…

URL PDF HTML 收藏
1510.00983 2026-06-04 eess.SY cs.SY 50%

The ISO Problem: Decentralized Stochastic Control via Bidding Schemes

ISO问题:通过招标方案实现去中心化随机控制

Rahul Singh, P. R. Kumar, Le Xie

专题命中 Agent评测 :agent(abstract)

AI总结 本文研究了一个去中心化随机控制问题,通过招标方案协调发电和用电,无需代理分享系统模型、状态或效用函数。

Journal ref 53rd Annual Allerton Conference on Communication, Control, and Computing (Allerton), 2015, pp. 552-559

详情

展开后加载摘要…

URL PDF HTML 收藏
1804.08611 2026-06-04 eess.SY cs.SY 50%

Faster Response in Bounded-Update-Rate, Discrete-time Networks using Delayed Self-Reinforcement

在有限更新速率、离散时间网络中通过延迟自我强化实现更快响应

Santosh Devasia

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出了一种延迟自我强化方法,在不增加更新速率的情况下提高网络对刺激的响应速度,通过仿真验证该方法使响应速度提升了数量级。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏