arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 531 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 531 篇

2511.08202 2026-07-24 physics.soc-ph econ.GN q-fin.EC 版本更新 50%

Mean-Field Analytical Solution of the Mesa Boltzmann Wealth Model

梅萨玻尔兹曼财富模型的平均场解析解

Jiyuan Lyu

专题命中 Agent评测 :agent(abstract)

AI总结 研究梅萨玻尔兹曼财富模型的平均场版本,通过建立主方程和运用概率生成函数方法解析确定模型参数、推导稳态财富分布特性,数值模拟与理论吻合,为该模型提供解析基准供相关模拟参考。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04731 2026-07-23 cs.GT 版本更新 50%

Improved Approximation Guarantees for Groupwise Maximin Share Fairness

改进的群组最大最小份额公平性近似保证

Georgios Amanatidis, Anna Korfiati, Evangelos Markakis, Christodoulos Santorinaios

专题命中 Agent评测 :agent(abstract)

AI总结 针对可加性估值函数的不可分割商品公平分配问题,提出一种多项式时间算法,将群组最大最小份额(GMMS)的近似比改进为ϕ-1(ϕ≈1.618),并通过子实例分析证明该界渐近紧致。

Comments Accepted to the 19th International Symposium on Algorithmic Game Theory (SAGT 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30017 2026-07-23 math.PR 版本更新 50%

Conditional Probability Spaces and the Structure of Agreement

条件概率空间与一致性的结构

Erya Yang, Adam Brandenburger

专题命中 Agent评测 :agent(abstract)

AI总结 利用条件概率空间(Rényi, 1955)的框架,在一般条件下推导出Aumann(1976)的一致性定理,无需共同先验、信息划分、测度正性和知识算子等传统假设。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25824 2026-07-23 q-fin.MF 版本更新 50%

Mean-field game of mean-variance portfolio optimization with peer-based risk aversion

基于同伴相对风险厌恶的均值-方差投资组合管理的平均场博弈

Weilun Cheng, Zongxia Liang, Sheng Wang, Xiang Yu

专题命中 Agent评测 :agent(abstract)

AI总结 本文研究具有同伴相对风险厌恶的均值-方差投资组合管理的平均场博弈问题,通过平滑正则化和不动点论证证明了时间不一致平均场均衡的存在性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.14516 2026-07-23 cs.LO 版本更新 50%

Beyond the Spell: A Dynamic Logic Analysis of Misdirection

超越咒语:误导的动态逻辑分析

Benjamin Icard, Raul Fervari

专题命中 Agent评测 :agent(abstract)

AI总结 研究视觉误导,引入动态认知逻辑,既能表示对主体信念的言语误导,也能表示对主体观察的视觉误导,通过对“法式落物”建模说明逻辑动态性,还给出可靠完备公理系统并讨论相关特性。

Comments To appear in Journal of Applied Logics - IfCoLog Journal of Logics and their Applications, Volume 13, Number 4 (August 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.03793 2026-07-21 cs.GT 版本更新 50%

Honest Reporting in Scored Oversight: True-KL0 Property via the Prekopa Principle

评分监督中的诚实报告:通过普雷科帕原理的真KL0属性

Lauri Lovén

专题命中 Agent评测 :agent(abstract)

AI总结 研究评分激励机制中异构评分规则的真KL0属性,通过特定替换和对数凹性等工具证明,得出诚实报告是占优策略最优及相关定量结果,刻画了不同维度下真KL0属性的边界情况

Comments 30 pages. Manuscript prepared for Annals of Applied Probability. Certificate scripts and reference outputs archived at Zenodo, doi:10.5281/zenodo.21440507

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02101 2026-07-21 math.AP 版本更新 50%

A Mean-Field Game Model For Large-Scale Attrition in Attacker-Defender Systems

大规模攻击-防御系统中的均场博弈模型

Avetik Arakelyan, Tigran Bakaryan, Davit Alaverdyan, Naira Hovakimyan, Isaac Kaminer

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出一种新的均场博弈框架,用于保护一个或多个高价值目标,通过统计距离建模群体性消耗,分析攻击-防御互动的最优策略与人口分布演化。

Comments keywords: Mean-field games, attacker-defender systems, attrition modeling, optimal transport, autonomous defense

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04231 2026-07-21 physics.soc-ph cs.MA q-bio.PE 版本更新 50%

Where Do We Poop? City-Wide Simulation of Defecation Behavior for Wastewater-Based Epidemiology

我们在哪里排便?基于废水流行病学的城市范围排便行为模拟

Hossein Amiri, Akshay Deverakonda, Yuke Wang, Andreas Züfle

专题命中 Agent评测 :agent(abstract)

AI总结 研究基于现有生活模式模型,引入地理空间模拟框架,结合传染病模型,考虑人口流动、厕所使用等因素,模拟废水病原体负荷时空动态,以佐治亚州富尔顿县为例进行研究,展示其对废水监测等方面的支持作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11695 2026-07-21 physics.flu-dyn cs.CV eess.IV math.OC 版本更新 50%

Particle Image Velocimetry Refinement via Consensus ADMM for Active Fluid Control

基于共识交替方向乘子法的粒子图像测速细化用于主动流体控制

Alan Bonomi, Francesco Banelli, Antonio Terpin

机构 * ETH Zürich(苏黎世联邦理工学院)

专题命中 Agent评测 :agent(abstract)

AI总结 研究针对传统粒子图像测速法及机器学习方法在流量量化中的不足,提出将其作为多估计器融合问题,采用基于交替方向乘子法的共识框架,经实验验证该方法能提升性能,并成功应用于实际主动流体控制中。

Comments Accepted for presentation at, and publication in the proceedings of, the 2026 65th IEEE Conference on Decision and Control (CDC). Code available at https://github.com/antonioterpin/flowgym

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11058 2026-07-21 math.OC math.PR 版本更新 50%

Kernel Metrics and Learning for Borel MDPs: Identifiability and Adaptive Control

博雷尔马尔可夫决策过程的核度量与学习:可识别性与自适应控制

Omar Mrani-Zentar, Serdar Yüksel

专题命中 Agent评测 :agent(abstract)

AI总结 研究标准博雷尔空间下未知转移核的马尔可夫决策过程,通过建立核拓扑关系等进行正则性分析,给出贝叶斯和经验的可识别性结果,用于设计近最优自适应控制策略,解决无先验参数表示的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.13370 2026-07-21 math.OC 版本更新 50%

Group Steering: Approaches Based on Power Moments

群体转向:基于幂矩的方法

Guangyu Wu, Anders Lindquist

专题命中 Agent评测 :agent(abstract)

AI总结 研究一大群由离散时间渐近稳定一阶线性系统控制的智能体的转向问题,提出用幂矩表征其密度函数或占有测度,通过矩系统表示、凸优化等实现控制,终端密度收敛,仿真验证算法。

Comments 11 pages, 6 figures. Portions of this work have been accepted by the IFAC World Congress 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14438 2026-07-20 cs.GT 版本更新 50%

Compensation Design

补偿设计

Ioannis Anagnostides, Kshipra Bhawalkar, Christopher Liaw, Aranyak Mehta, Renato Paes Leme, Yifeng Teng, Grigoris Velegkas, Weiqiang Zheng

专题命中 Agent评测 :agent(abstract)

AI总结 研究分散环境中补偿设计问题,提出简单无视成本且匿名的边际贡献支付规则,证明其在大市场情形下能保证纯纳什均衡存在且PoA至多为\(2 + o_{\lambda}(1)\),还扩展到粗相关均衡等多种情况并给出相应结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03676 2026-07-20 physics.soc-ph cond-mat.stat-mech 版本更新 50%

Entropy Geometry and Condensation in Wealth Allocation

熵几何与财富分配中的凝结现象

Korak Biswas

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出了一种基于统计框架的财富分配模型,揭示了财富凝结现象的形成机制及开放系统中财富分配的动态平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03829 2026-07-20 physics.acc-ph hep-ex 版本更新 50%

First Experimental Demonstration of Reinforcement Learning-Based Tuning on the PSI Injector 2 Cyclotron

基于强化学习的PSI注入器2回旋加速器调谐的首次实验演示

M. Haj Tahar, W. Joho, E. Solodko, M. Bocchio, S. Marquie, M. Busch, A. Barchetti, J. Grillenberger, J. Snuverink, M. Schneider

专题命中 Agent评测 :agent(abstract)

AI总结 研究针对高功率质子回旋加速器束流调谐难题,开发基于机器学习的调谐框架,结合强化学习算法、实时诊断控制及加速器物理启发调整,经12天测试,实现多运行点调谐及策略泛化,是高功率回旋加速器强化学习辅助调谐的首次演示。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16495 2026-07-20 eess.SP 版本更新 50%

Performance Evaluation of High Power Microwave Systems Against UAVs A Probabilistic Antenna Propagation Framework with Sensitivity Analysis

高功率微波系统对无人机的性能评估:具有灵敏度分析的概率天线传播框架

Muhammad Khalil, Ke Wang, Jinho Choi

专题命中 Agent评测 :planning(abstract)

AI总结 研究高功率微波系统对无人机性能,提出含随机目标运动等因素的概率框架,耦合多种模型得出相关统计量,分析各因素影响,预测不同目标效能概率,支持系统规模确定、权衡分析及任务规划。

Comments 9

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08667 2026-07-17 cs.CR 版本更新 50%

X-rated Compliance Theater: An Empirical Evaluation of European Age Verification Systems in Adult Websites

X级合规剧场:欧洲成人网站年龄验证系统的实证评估

Simone Lavermicocca, Michele Carminati, Stefano Longari

专题命中 Agent评测 :workflow(abstract)

AI总结 本文首次实证评估欧洲成人网站强制部署的年龄验证机制,发现其在低成本攻击下存在系统性安全漏洞,并提出了缓解隐私与安全风险的设计方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15571 2026-07-17 cs.CC cs.LO math-ph math.CT math.MP 版本更新 50%

Thermodynamic Limits of Proof

物理计数的计算复杂性

Tristan Simas

专题命中 Agent评测 :agent(abstract)

AI总结 研究物理计数的计算复杂性,提出决策商 Q 作为最小抽象,并证明多个复杂性理论结果。

Comments Main PDF: 35 pages, 4 tables. Supplementary: 26 pages, 2 tables. Lean 4 release artifact available at https://doi.org/10.5281/zenodo.18140965

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15280 2026-07-17 cs.HC 版本更新 50%

Supporting Multimodal Data Interaction on Refreshable Tactile Displays: An Architecture to Combine Touch and Conversational AI

在可刷新触觉显示器上支持多模态数据交互:一种将触觉与对话式AI结合的架构

Samuel Reinders, Munazza Zaib, Matthew Butler, Bongshin Lee, Ingrid Zukerman, Lizhen Qu, Kim Marriott

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出了一种结合触觉与对话式AI的架构,用于在可刷新触觉显示器上实现多模态数据交互,通过融合触觉输入与语音语言,提升视障人士的数据可视化体验。

Comments Accepted to be presented at IEEE PacificVis 2026; Best Paper Award (VisNotes track); Replacement: external DOI added

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12477 2026-07-16 cs.CV 版本更新 50%

Self in Space: Benchmarking Self-Awareness and Spatial Cognition in UAV Embodied Intelligence

自我在空间中:无人机具身智能中的自我意识与空间认知基准测试

Zhishan Zou, Guoyan Sun, Zhiwei Wei, Jiancheng Pan, Yujie Li, Mugen Peng, Wenjia Xu

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Hunan Normal University(湖南师范大学)

专题命中 Agent评测 :agent(abstract)

AI总结 研究针对无人机具身智能中自我意识与空间认知问题,引入SIS - Bench基准,通过多维度层次评估,揭示现有模型局限,探索运动感知表征提升性能,强调自我意识重要性,提供新基准和实证依据。

Comments Website:https://choucisan.github.io/publications/self-in-space ; Code:https://github.com/IntelliSensing/Self-in-Space

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04390 2026-07-16 cs.DS 版本更新 50%

Free-Order Online Selection for k-Systems

k - 系统的自由顺序在线选择

Kristóf Bérczi, Vasilis Livanos, José A. Soto, Victor Verdugo

专题命中 Agent评测 :agent(abstract)

AI总结 研究k - 系统的自由顺序在线选择,引入二分图框架,利用核心引理为k - 拟阵交及k - 增长系统设计竞争算法,扩展到代理到达模型和多物品选择情况,还研究了k - 增长系统在k - 系统层次结构中的相关性质。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07579 2026-07-16 cs.GT 版本更新 50%

Dynamic Rental Games with Stagewise Individual Rationality

具有阶段个体理性的动态租赁博弈

Batya Berzack, Rotem Oshman, Inbal Talgam-Cohen

专题命中 Agent评测 :agent(abstract)

AI总结 研究租赁博弈这一单参数动态机制设计问题,探讨设计者利用代理人阶段个体理性的经济目标。表明最优租赁机制可建模为带卖方成本的动态拍卖,虽与经典拍卖不同,但给出了不同经济目标下最优机制的刻画及支付规则应用情况。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25431 2026-07-15 cs.GT 版本更新 50%

Strict Fairness at What Cost? Envy-Free Contracts with Subsidies

带有补贴的无嫉妒合同

Matteo Castiglioni, Junjie Chen, Yingkai Li

专题命中 Agent评测 :agent(abstract)

AI总结 提出带有补贴的无嫉妒合同(EFS)方案,通过额外提供代理人特定补贴,在恢复严格公平性的同时,将公平性代价从无界降低到紧的$n^{\Theta(n)}$界,并证明一般情况下的NP难解性和任务数恒定时的多项式时间算法。

Comments some improvements

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19201 2026-07-15 math.OC math.PR 版本更新 50%

Mean-field optimal control with stochastic leaders

具有随机领导者的平均场最优控制

Sebastian Zimper, Ana Djurdjevac, Carsten Hartmann, Christof Schütte, Nataša Djurdjevac Conrad

专题命中 Agent评测 :agent(abstract)

AI总结 研究大量随机代理受少量随机主导代理影响的系统,在追随者数量趋于无穷时的部分平均场极限。证明有限代理系统最优控制收敛到极限系统最优控制,还提出随机梯度下降算法近似平均场控制,以舆论动态模型为例说明理论结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07593 2026-07-15 cs.GT 版本更新 50%

Decision-Making Under Complete Uncertainty: You Will Not Regret Being Greedy

完全不确定性下的决策:贪婪无悔

Kristijan Atanasov, Frederik Mallmann-Trenn, Mehmet Mars Seven

专题命中 Agent评测 :agent(abstract)

AI总结 研究完全不确定性下贪婪策略的最坏情况后悔值,通过博弈论模型,先探讨等观察情况,后研究不同观察数量情况,建立上下界并分析其性质,最后经餐厅评论数据测试,验证贪婪策略理论与实证表现相符。

Comments Revised version. Strengthens the main theoretical results, adds results for heterogeneous numbers of observations, includes a correction to an auxiliary result, and updates the related literature. Title slightly revised

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09094 2026-07-14 physics.geo-ph 版本更新 50%

Artificial Intelligence for Subsurface Imaging Understanding: A Decade Review of Challenges, Methods, Benchmarks, and Outlook

CIG-Bench:AI驱动的地下成像理解的综合调查与基准

Yimin Dou, Xinming Wu, Hui Gao, Mingliang Liu, Tao Zhao, Zhi Zhong, Haibin Di, Min Jun Park, Robert G. Clapp, Zhixiang Guo, Long Han, Sergey Fomel

专题命中 Agent评测 :agent(abstract)

AI总结 本文系统回顾2015-2025年间652篇文献,将地下成像理解归纳为四大任务,总结三大挑战,并提出包含统一评估协议、预训练模型和混合数据集的社区基准CIG-Bench。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10465 2026-07-14 physics.plasm-ph physics.comp-ph 版本更新 50%

Integrated full pulse modeling for pellet injection in tokamaks: HPI2 model improvement and validation in WEST

托卡马克中 pellet 注入的集成全脉冲建模:HPI2 模型的改进与在 WEST 中的验证

A. Panera Alvarez, F. Koechl, J. Artaud, E. Geulin, B. Pégourié, E. Vergnaud, C. Bourdelle, S. Wiesen, the WEST Team

专题命中 Agent评测 :workflow(abstract)

AI总结 本文改进了 HPI2 模型,通过自洽的等离子体释放空间步长计算,提高了数值稳定性,并在 WEST 实验中验证了其预测能力,支持其在集成建模中的应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05196 2026-07-14 eess.SY cs.SY math.OC 版本更新 50%

Approximate Simulation-Based Verification of Compatibility of the Friedkin-Johnsen Model with Binary Observations

对Friedkin-Johnsen模型与二进制观测兼容性的近似模拟验证

Yu Xing, Aneesh Raghavan, Michael T. Schaub, Karl H. Johansson

专题命中 Agent评测 :agent(abstract)

AI总结 本文基于二进制观测研究意见动态的验证问题,通过近似模拟关系验证Friedkin-Johnsen模型在给定参数下能否生成观测二进制输出,通过抽象模型简化参数并验证一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05155 2026-07-14 math.OC math.PR q-fin.RM 版本更新 50%

Optimal Risk-Sharing Rules in Network-based Decentralized Insurance

网络化去中心化保险中的最优风险共享规则

Heather N. Fogarty, Sooie-Hoe Loke, Nicholas F. Marshall, Enrique A. Thomann

专题命中 Agent评测 :agent(abstract)

AI总结 本文研究了网络结构中代理人之间基于朋友关系的最优风险共享规则,通过图拉普拉斯算子建立了风险共享机制的数学模型。

Comments 24 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07018 2026-07-14 q-fin.ST q-fin.CP 版本更新 50%

The Extremity Premium: Sentiment Regimes and Adverse Selection in Cryptocurrency Markets

极端溢价:加密货币市场中的情绪制度与择优购买

Murad Farzulla

专题命中 Agent评测 :agent(abstract)

AI总结 研究发现情绪极端性在加密货币市场中驱动额外不确定性,通过情绪制度与择优购买机制产生极端溢价。

Comments 52 pages, 32 tables, 5 figures. Code and data: https://github.com/studiofarzulla/sentiment-microstructure-abm

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.20711 2026-07-14 cs.DS cs.GT 版本更新 50%

Online Selfish Load Balancing

在线自私负载均衡

Wenqian Wang, Chenyang Xu, Yuhao Zhang

专题命中 Agent评测 :agent(abstract)

AI总结 研究在线自私负载均衡问题,针对无关机器,证明现有m近似算法可在线实现;为相关机器设计首个期望真实且竞争比为O(log m)的在线机制,扩展后保证作业端真实,还将双边真实机制推广到ℓ_q范数变体。

Comments EC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏