arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 1135 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 1135 篇

2608.00517 2026-08-04 econ.TH 新提交 50%

Exact Budget Balance via Payment-Rule Ambiguity: Incentive Preservation, Transfer Capacity, and Participation

通过支付规则模糊性实现精确预算平衡:激励保持、转移能力与参与度

Hiroaki Odahara

专题命中 Agent评测 :agent(abstract)

AI总结 本文研究通过支付规则模糊性修复激励相容机制的支付侧以实现精确预算平衡,探讨了不同信息条件下的可行性、转移能力及参与度等问题。

Comments 54 pages, 1 figure; includes appendices and ancillary verification code

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01494 2026-08-04 q-fin.PM q-fin.RM 新提交 50%

Conformal Kelly: Conformal Prediction Intervals as the Scale in Fractional Kelly Position Sizing

共形凯利:将共形预测区间用作分数凯利头寸规模的尺度

Robert Jacob Ryan

专题命中 Agent评测 :agent(abstract)

AI总结 该研究提出将共形预测区间与分数凯利结合用于投资组合头寸规模确定,经6年测试表现优于被动基准,还引入风险控制优化回撤,相关配置经预注册和LLM智能体搜索验证。

Comments 30 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00917 2026-08-04 q-fin.MF 新提交 50%

Pro-rata mechanisms in groundwater markets

地下水市场中的按比例分配机制

Igor Cialenco, Michael Ludkovski, Gael Dimitri Tekam Fongouo

专题命中 Agent评测 :agent(abstract)

AI总结 本文针对地下水市场供需失衡问题,扩展已有价格形成模型提出按比例配给机制,结合外生限制、主从博弈场景展开理论分析与数值验证,还与多种非对称配给方案对比,为市场监管提供了工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01895 2026-08-04 cs.HC 新提交 50%

Emotional Expression in Persuasion by Quadruped Virtual Agents: Toward Cross-Species Design Patterns

四足虚拟智能体说服过程中的情感表达:迈向跨物种设计模式

Kaoru Sumi, Souki Osawa

专题命中 Agent评测 :agent(abstract)

AI总结 该研究开发了虚拟狗、猫、马智能体,对比不同行为条件后发现,四足虚拟智能体的说服效果更依赖情感表达等功能性线索,而非物种特有动作,为跨物种设计模式提供了依据。

Comments Preprint. 68 pages, 4 figures, 8 tables. Submitted to Frontiers in AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01693 2026-08-04 cs.GT 新提交 50%

Optimal Prior-Free Mechanisms for Consumer Surplus

无先验约束下的消费者剩余最优机制

Tomer Ezra

专题命中 Agent评测 :agent(abstract)

AI总结 该研究解决多维机制设计中剩余剩余最大化的最坏情况可近似性问题,提出普遍真实且事后个体理性的机制,得到最优最坏情况保证,解决相关开放问题并改进现有结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01157 2026-08-04 cs.CV 新提交 50%

InteracVid: Building a Real Interactive Audio-Visual Response Dataset from Live-Chat Videos

InteracVid:基于直播聊天视频构建真实交互式视听响应数据集

Chi Zhang, Haoyang Shi, Yueyi Liu, Zhaokun Yan, Yishu Yin, Yuhang Wu, Miao Liu

机构 * College of AI, Tsinghua University(清华大学人工智能学院)

专题命中 Agent评测 :planning(abstract)

AI总结 该研究提出首个开源大规模交互式视听数据集InteracVid,解决现有生成模型监督信号缺失问题,实验证实其可提升多模态助手的交互规划与响应生成性能,为交互式多模态生成提供关键基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00327 2026-08-04 math.OC 新提交 50%

Persistent Mean Tracking in Client--Server Open Networks

客户端-服务器开放网络中的持久均值跟踪

Amit Dutta, Fat-Hy Omar Rajab, Marcos M. Vasconcelos, Olugbenga M. Anubi

专题命中 Agent评测 :agent(abstract)

AI总结 针对开放客户端-服务器网络中瞬态智能体污染导致朴素平均法无法恢复持久均值的问题,提出两阶段估计框架,通过双层窗口识别与平滑滤波实现均值跟踪,经数值模拟验证有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00934 2026-08-04 gr-qc astro-ph.HE 新提交 50%

Unified remnant models for aligned-spin, precessing, and eccentric binary black hole mergers

非进动自旋、进动及偏心双黑洞并合的统一残余模型

Tousif Islam, Digvijay Wadekar, Gaurav Khanna

专题命中 Agent评测 :agent(abstract)

AI总结 该研究利用数值相对论等模拟数据,构建了适用于非进动、进动及偏心双黑洞并合残余性质的统一解析模型,精度优于现有模型,可通过gwModels包公开供相关领域应用。

Comments Models are available through https://github.com/tousifislam/gwModels/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29080 2026-08-03 econ.TH 新提交 50%

Rawlsian equity: a new notion of fairness for the assignment problem

罗尔斯式公平:分配问题的一种新公平概念

Özgün Ekici, Sinan Ertemel, M. Bumin Yenmez

专题命中 Agent评测 :agent(abstract)

AI总结 该研究提出用于不可分割对象分配的罗尔斯式公平概念,证明其分配集合与辅助市场稳定分配集合一致,主体提议的延迟接受算法可计算其主体最优元素,但无策略防卫的罗尔斯式公平规则。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29200 2026-08-03 cs.CV 新提交 50%

UltraSAM3: A Concept-Driven Foundation Model for Universal Ultrasound Image Segmentation

UltraSAM3:一种用于通用超声图像分割的概念驱动基础模型

Bo Xu, Quanhao Zhu, Rui Lin, Boling Zhu, Chenyuan Wang, Hongfei Lin, Feng Xia, Chenhua Ji

机构 * Dalian University of Technology Affiliated Center Hospital(大连大学附属中心医院)

专题命中 Agent评测 :agent(abstract)

AI总结 针对现有超声分割方法的任务局限或需专家视觉提示问题,提出概念驱动的UltraSAM3模型及指令引导智能体,在多基准测试中性能优于同类模型,提升了临床交互的实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27548 2026-07-31 econ.GN q-fin.EC 新提交 50%

Explaining the Macroeconomic Inertia Puzzle

解释宏观经济惯性之谜

Michael Cai

专题命中 Agent评测 :agent(abstract)

AI总结 本文通过将调查预期替代主体自身预期,结合嵌入不可观测成分模型的异质性主体一般均衡框架,解释了宏观经济惯性之谜,并指出惯性政策会延长传导滞后。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27743 2026-07-31 cs.GT 新提交 50%

Delegated Fair Division

委托式公平分配

Argyrios Deligkas, Michail Fasoulakis, Stavros D. Ioannidis, Alviona Mancho, Evangelos Markakis

专题命中 Agent评测 :agent(abstract)

AI总结 该研究针对委托式公平分配模型,区分两种信息结构并提供高效算法,生成同时满足中心与代理人层面基于嫉妒的公平性保证的分配方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26731 2026-07-30 cs.HC 新提交 50%

Affective Tools for Thought: Towards Shared Attention and Affective Reorienting in AI-Supported Thinking

面向情感化思维工具:实现AI辅助思维中的共享注意力与情感重定向

Yifu Liu, Raffaele Andrea Buono, Nadia Bianchi-Berthouze

专题命中 Agent评测 :agent(abstract)

AI总结 该研究针对现有思维工具对情感的片面认知,提出情感是认知的构成要素,明确情感化思维工具的两大障碍,给出三种设计策略并基于相关实证研究为未来设计提供启发。

Comments 4 pages, 2-column ACM format. Accepted to the CHI 2026 Workshop on Tools for Thought: Understanding, Protecting, and Augmenting Human Cognition with Generative AI, April 16, 2026, Barcelona, Spain. Workshop website: https://ai-tools-for-thought.github.io/workshop/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27039 2026-07-30 math.OC q-fin.MF 新提交 50%

Forcing and duality-corrected contracts for volatility control

用于波动率控制的强制型和对偶修正型合约

Alessandro Chiusolo, Emma Hubert, Dylan Possamaï, Nizar Touzi

专题命中 Agent评测 :agent(abstract)

AI总结 本文针对带漂移和波动率控制的连续时间委托代理问题,在指出现有方法最优性假设局限性的基础上,提出两类通用合约形式以修正对偶间隙,为波动率控制下的最优激励构建提供更通用方案。

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26438 2026-07-30 quant-ph 新提交 50%

Quantum Optical Reinforcement Learning via Spectrum-Resolved Hong-Ou-Mandel Interference

基于光谱分辨Hong-Ou-Mandel干涉的量子光学强化学习

Shaojun Wu, Jiahua Xu, Shan Jin, Zhen Yang, Yifang Xu, Chenglong You, Guangwei Deng, Luyan Sun, Chang-Ling Zou, Xiaoting Wang

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出光谱分辨Hong-Ou-Mandel干涉架构,构建光学Actor-Critic智能体,在5个连续控制基准任务中性能优于多层感知器基线,还成功实现Transmon量子比特可调耦合门的在线校准,保真度恢复效果优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25568 2026-07-29 cs.GT 新提交 50%

Network Reciprocity Shapes Evolutionary Cybersecurity Dynamics

网络互惠塑造进化网络安全动态

Adeela Bashir, Zia Ush Shamszaman, Zhao Song, The Anh Han

专题命中 Agent评测 :agent(abstract)

AI总结 研究人工智能辅助网络安全系统中群体结构对攻防动态的影响。提出混合角色进化博弈框架,结合随机进化分析与模拟。发现交互结构是关键决定因素,局部网络交互组织防御主体可提升网络长期弹性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25131 2026-07-29 cs.HC q-bio.NC 新提交 50%

Beyond the Post Hoc User Study: Modeling Visual Decision-Making with Active Inference

超越事后用户研究:用主动推理对视觉决策进行建模

Harrison J. Goldwyn, Graham Johnson, Christopher Ibarra, Lace Padilla, Kenny Gruchalla

专题命中 Agent评测 :agent(abstract)

AI总结 研究旨在填补可视化解释机制空白,用主动推理将认知理论转化为模拟。以柱状图平均估计任务为例实现两类主体,分析其易出现的偏差及产生的认知痕迹,为可视化解释机制假设提供框架,支持更优的计算机模拟评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24826 2026-07-29 cs.IR cs.MA 新提交 50%

Aethel: A Reproducible Graph-Retrieval Framework for Multi-Hop Financial Diligence

Aethel:用于多跳金融尽职调查的可重现图检索框架

Krish Sapru

专题命中 Agent评测 :agent(abstract)

AI总结 针对二级私募股权交易中财务披露信息综合难题,Aethel框架结合二分个性化PageRank图检索等技术,将语料库建模为实体-段落图。在多跳金融尽职调查任务中,该框架在特定数据集上有较好表现,优势依赖语料库规模和实体索引质量,且发布相关工件保证可重现性。

Comments 11 pages, 3 figures, 2 tables. Includes evaluations on MuSiQue, 2WikiMultiHopQA, and a 4,123-chunk financial-disclosure corpus. Code and evaluation artifacts are available for reproducibility

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25475 2026-07-29 physics.soc-ph nlin.AO q-bio.PE 新提交 50%

Coevolution of epidemic dynamics and network topology driven by disease fatality and waning immunity

由疾病致死率和免疫力下降驱动的流行病动力学与网络拓扑结构的共同演化

ThankGod I. S. Ikpe, Takayuki Hiraoka, Naoya Fujiwara

专题命中 Agent评测 :agent(abstract)

AI总结 研究流行病动力学与网络拓扑的相互作用,开发基于主体模型,发现模型会经历流行病转变,网络可能失去无标度特性,通过异质平均场近似验证结果,凸显网络演化在流行病模型中的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25458 2026-07-29 cs.SI cs.CY nlin.AO 新提交 50%

Resilience: Understand Breakdown, Foster Recovery, and Choose the Right Perspective

恢复力:理解崩溃、促进恢复并选择正确视角

Frank Schweitzer

专题命中 Agent评测 :agent(abstract)

AI总结 研究恢复力,区分两种系统动态,指出崩溃常自我造成且正反馈有正负作用。认为易变系统中恢复力是主体交互的涌现属性,需数据驱动方法,模型显示恢复力是稳健性与适应性的妥协,二阶解决方案更有前景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22885 2026-07-28 cs.CR 新提交 50%

ReCon: A Resource-Constrained Benchmark for LLM-Based Cybersecurity Compliance Across Ingestion and Retrieval Pipelines

ReCon:用于跨摄取和检索管道的基于大语言模型的网络安全合规性的资源受限基准测试

Rohit Negi, Rishik Jain, Soumyo V Chakarborty, Amit Negi, Sandeep K Shukla

专题命中 Agent评测 :agentic(abstract)

AI总结 研究政府、企业和机构网络安全合规问题,利用无需GPU和高内存的大语言模型进行合规检查任务基准测试,实验证明低资源大语言模型在政策文件合规检查中可提供良好一致性/准确性。

Comments 22 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22132 2026-07-27 cs.SI 新提交 50%

On the Fragility of Majority Illusions

论多数错觉的脆弱性

Maaike Venema-Los, Zoé Christoff, Serte Donderwinkel, Davide Grossi

专题命中 Agent评测 :agent(abstract)

AI总结 研究社交网络中多数错觉的脆弱性,通过考虑主体观点随时间变化的网络及规模增大的随机图序列两种情况,发现多数错觉在多数更新下会消失,且出现可能性趋于零。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21960 2026-07-27 cs.RO 新提交 50%

Adaptive Undulatory Locomotion of Snake-like Robots in Dynamic Viscous Environments via Deep Reinforcement Learning

通过深度强化学习实现蛇形机器人在动态粘性环境中的自适应波动运动

Tsuyoshi Kimoto, Akio Yamano, Kohei Honda, Takashi Iwasa

专题命中 Agent评测 :agent(abstract)

AI总结 研究蛇形机器人在动态粘性环境中的自适应运动,利用深度强化学习,通过非对称演员 - 评论家框架及特权信息提炼,使机器人获得非正弦自适应步态,提高推进速度和运输效率,突破传统控制极限。

Comments 23 pages, 6 figures. Submitted to a journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21630 2026-07-27 cs.NE 新提交 50%

Evolving Self-Organising Agents Without Fitness: Three Falsifiable Experiments from Constraint-Driven Selection to Developmental Encoding

无适应度的自组织智能体演化:从约束驱动选择到发育编码的三个可证伪实验

Anushka Sharma

专题命中 Agent评测 :agent(abstract)

AI总结 研究在无设计者指定适应度函数时生物发育进化动力学能否产生,通过Genesis平台进行三个实验周期,测试可证伪假设,得出约束驱动选择、智能体介导生态位构建及CPPN间接编码相关结果,还产生了诊断工具和协议。

Comments GECCO Companion '26 Workshop Paper (EvoSelf/ESO Workshop), July 13-17, 2026, San Jose, Costa Rica. 3 pages. ACM ISBN 979-8-4007-2488-6/2026/07

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21890 2026-07-27 math.OC 新提交 50%

Stackelberg Games with a Robust Leader

具有稳健领导者的斯塔克尔伯格博弈

Juan Li, Jianfeng Zhang, Zimu Zhu

专题命中 Agent评测 :agent(abstract)

AI总结 研究具有一个领导者和多个追随者的斯塔克尔伯格博弈,稳健领导者考虑最坏情况,通过弱形式将问题转化为零和博弈,利用HJB方程刻画,还指出委托代理问题是其特殊情况。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20782 2026-07-24 q-bio.TO 新提交 50%

A Bayesian-optimization framework coupling a multiphase PDE tumor model to efficiently design combination therapy schedules

一种将多相偏微分方程肿瘤模型耦合的贝叶斯优化框架,以有效设计联合治疗方案

Ioannis Lampropoulos, Yorgos Psarellis, Michail Kavousanakis

专题命中 Agent评测 :agent(abstract)

AI总结 研究如何设计联合癌症治疗方案,提出将多相偏微分方程肿瘤模拟器与贝叶斯优化框架耦合的方法,可在少量昂贵模拟中找到最优治疗方案,应用于三个临床场景,提供了可转移的设计优化方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21471 2026-07-24 cs.CV 新提交 50%

Future Rendering $\neq$ Future Surface: A Benchmark and Dataset for Dynamic Surface Reconstruction Beyond the Observed Window

未来渲染≠未来表面:超越观察窗口的动态表面重建基准和数据集

Yukun Shi, Minglun Gong

机构 * University of Guelph(圭尔夫大学)

专题命中 Agent评测 :planning(abstract)

AI总结 研究针对动态场景重建中未来表面重建缺乏标准基准的问题,引入FutureSurf基准和数据集,通过特定训练与评分方式评估方法,发现现有主干在受控运动及多个场景中有差距,且未来渲染质量与表面精度解耦。

Comments See https://github.com/Ricky-S/futuresurf

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21072 2026-07-24 cs.CV 新提交 50%

Show, Don't Tell: Evaluating Spatial Cognition in Generative Pixels Rather Than LLM Text

展示而非讲述:在生成像素而非语言模型文本中评估空间认知

Xu Wang, Kaixiang Yao, Miao Pan, Xiaohe Zhou, Xuanyu Liu, Wenqi Zhang, Xuhong Zhang

机构 * Zhejiang University(浙江大学)

专题命中 Agent评测 :agentic(abstract)

AI总结 研究图像生成模型空间认知评估问题,提出ProVisE框架及SpatialGen - Bench基准,通过统一设置评估相关模型,发现图像生成模型在像素空间直接外化答案时有竞争力,文本输出语言模型在组合空间推理中有优势,揭示了两者互补优势并建立测试平台。

Comments 36 pages, 14 figures. Project page: https://zju-omniai.github.io/ProVisE/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21046 2026-07-24 cs.GT 新提交 50%

Discrete Truthful Heterogeneous Two-Facility Location: The Line and Beyond

离散真实异构双设施选址:在线性图及其他图上的研究

Panagiotis Kanellopoulos, Alexandros A. Voudouris

专题命中 Agent评测 :agent(abstract)

AI总结 研究离散异构双设施选址的确定性防策略机制,针对线性图设计最优\(4/3\)近似机制填补比率差距,在线性图外为连通图设计\(2\)近似机制并证明\(K_{1,3}\)下界为\(3/2\)。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21215 2026-07-24 quant-ph 新提交 50%

Quantum Circuit Fragments and Link Products in Continuous Variables

连续变量中的量子电路片段与链接积

Amalina Lai, Graeme D. Berk, Minjeong Song, Mile Gu

专题命中 Agent评测 :agent(abstract)

AI总结 研究连续变量中的量子电路片段,引入相关链接积构建框架,在高斯区域简化形式体系,可从模块化组件构建非马尔可夫过程等,扩展量子梳工具包,为相关量子信息任务提供系统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏