arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 15686 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 15686 篇

2607.29546 2026-08-03 nlin.AO 新提交 78%

Agent-based dynamics of criminal propensity

基于智能体的犯罪倾向动力学

Daniel Holland, Abigail Saynor, Evelyn Svingen, Galane Luo

专题命中 Agent评测 :agent(title,abstract)

AI总结 该研究将进化犯罪学的RRM形式化为智能体动力学系统,扩展有界置信意见动力学并证明收敛条件,发现系统主导行为为持续振荡,揭示了不同环境感知下的群体倾向及两极分化机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28915 2026-08-03 physics.soc-ph cs.SI math-ph math.MP 新提交 78%

An agent-based model of the formation and evolution of common ground

基于智能体的共同基础形成与演化模型

Mengbin Ye, Wooseok Jung, Tony J. Mathew, Lorenzo Zino, Yoshihisa Kashima

专题命中 Agent评测 :agent(title,abstract)

AI总结 本研究开发智能体模型,通过蒙特卡洛模拟探究网络上智能体交互的共同基础形成与演化,揭示不同交互情境会导致全球共同基础形成、分裂或完全丧失等现象,凸显数学模型研究文化动态微宏观关联的潜力。

Comments Submission for a journal paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28186 2026-07-31 cs.CV 新提交 78%

Think with Extra-Image: A Farmland Segmentation Agent Driven by Spatio-Temporal Information Gain

借助图像外信息思考:由时空信息增益驱动的农田分割智能体

Haiyang Wu, Weiliang Mu, Zhuofei Du, Dandan Zhong, Kaijie Shi, Haifeng Li, Chao Tao

专题命中 Agent评测 :agent(title,abstract)

AI总结 该研究针对现有农田遥感图像分割范式的不足,提出动态分割智能体FarmSeeker,构建支持推理查询的全球高分辨率基准GSFS-Bench,其分割性能比现有方法更稳定。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24822 2026-07-29 cs.IR 新提交 78%

A Position Paper on Recommender Systems in the Era of Autonomous Agents

关于自主智能体时代推荐系统的立场文件

Aixin Sun

专题命中 Agent评测 :autonomous agent(title,abstract)

AI总结 探讨自主智能体时代推荐系统范式转变,回顾以人类为中心研究见解,将智能体视为独立助手,描述三方互动,指出转变带来新机会与评估等方面独特挑战。

Comments Accepted to the ACM RecSys 2026 Main Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22610 2026-07-29 cs.HC 78%

Everything Counts: The Managed Omnirelevance of Speech in Human-Voice Agent Interaction

一切都有价值:人类与语音代理互动中语音的受控全相关性

Damien Rudaz, Mathias Broth, Jakub Mlynar

专题命中 Agent评测 :agent(title,abstract)

AI总结 研究探讨了人类与语音代理互动中语音的全相关性问题,分析了人类如何管理代理的轮流发言行为,以及技术进步对这一现象的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22939 2026-07-28 eess.AS 新提交 78%

Speech Entrainment in Multi-Party Conversations with a Digital Agent

多方对话中与数字代理的语音同步

Nicholas Mehlman, Kaitlin Zareno, Kleanthis Avramidis, Anfeng Xu, Shrikanth Narayanan

专题命中 Agent评测 :agent(title,abstract)

AI总结 研究人类群体与数字代理多方互动中的语音同步效应,通过收集含成人及家庭会话的独特数据集,考虑多种同步特征,发现个体局部与人同步,全局及与代理的同步有限且依群体而异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10265 2026-07-28 cs.DB 版本更新 78%

TGMS: An Agent-Native Bi-Temporal Graph Management System

TGMS:一种原生代理双时态图管理系统

Xiaofei Zhang

专题命中 Agent评测 :agent(title,abstract)

AI总结 研究针对时态图问题中LLM代理常失败的情况,提出双时态属性图管理系统TGMS,将13个运算符作为代理工具,LLM规划调用,系统计算,能分离有效时间与事务时间,在基准测试中表现优异,开源代码等。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22188 2026-07-27 cs.MA 新提交 78%

Draining the Energy Commons: Self-Defeating Over-Appropriation as a Coordination Failure in Agentic LLM Collectives

耗尽能源共享池:自我挫败的过度占用作为智能体大语言模型集体中的协调失败

Marcantonio Bracale Syrnicov, Federico Pierucci, Matteo Prandi, Marcello Galisai, Piercosma Bisconti, Francesco Giarrusso, Daniele Nardi

专题命中 Agent评测 :agentic(title);agent(abstract)

AI总结 研究大语言模型智能体在共享可再生能源储备时的协调失败问题,通过让四个同系列智能体自博弈,改变储备再生率,发现它们在需求超阈值时过度占用致自我挫败,实际消耗类似更不耐烦的开放访问基准,孤立响应评估会忽略此系统层面协调失败。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20845 2026-07-24 math.OC 新提交 78%

Mean field and N-agent games for optimal relative consumption-investment with jump risk and common noise

具有跳跃风险和共同噪声的最优相对消费-投资的平均场和N-主体博弈

Yiming Jiang, Fuxing Li, Yawei Wei, Zimeng Zheng

专题命中 Agent评测 :agent(title,abstract)

AI总结 研究N主体博弈中的最优消费-投资问题,利用随机最大值原理刻画平均场均衡,通过数值实验说明结果及金融含义,还基于此构建N主体博弈的近似纳什均衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10535 2026-07-23 cs.HC 版本更新 78%

Exploring the Interplay Between Voice, Personality, and Gender in Human-Agent Interactions

探索语音、个性与性别在人机交互中的相互作用

Kai Alexander Hackney, Lucas Guarenti Zangari, Jhonathan Sora-Cardenas, Emmanuel Munoz, Sterling R. Kalogeras, Betsy DiSalvo, Pedro Guillermo Feijoo-Garcia

专题命中 Agent评测 :agent(title,abstract)

AI总结 研究探讨用户能否通过语音识别人工代理的外向性,并分析感知个性与用户-代理同步性之间的关系,发现女性语音在区分外向性上更有效,而男性语音则不一致。

Journal ref https://www.frontiersin.org/articles/10.3389/fcomp.2026.1855830

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18557 2026-07-22 physics.geo-ph 新提交 78%

AGENTS4GEOS: agentic platform for open-source multi-physics simulation

AGENTS4GEOS:用于开源多物理场模拟的智能体平台

Adriano M. A. Côrtes, Roberto M. Velho, Fernando A. Rochinha, Alvaro L. G. A. Coutinho, Mauricio Araya-Polo, Hervé Gross

专题命中 Agent评测 :agentic(title);agent(abstract)

AI总结 研究针对多物理场模拟计算需求及训练数据集瓶颈,提出基于模型上下文协议的Agents4GEOS智能体框架,借助52个领域感知工具及协调器,自动化日常任务,助力专家专注工作挑战。

Comments 14 pages, 11 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05197 2026-07-22 cs.HC cs.CY 78%

Ghosting the Machine: Stop Calling Human-Agent Relations Parasocial

让机器消失:停止将人与代理关系称为寄生关系

Jaime Banks

专题命中 Agent评测 :agent(title,abstract)

AI总结 本文指出将人类与对话代理关系称为寄生关系是误用,该术语原指单向、非辩证的虚构关系,导致对复杂现象的简化和误判,需重新认识人与代理的社会性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17347 2026-07-21 cs.IR 新提交 78%

Adapting Embedding Models for Agent Capability Retrieval

使嵌入模型适应智能体能力检索

Tingwei Chen, Yunxiao Shi, Zhengdong Chu, Qingsong Wen, Min Xu

专题命中 Agent评测 :agent(title,abstract)

AI总结 研究如何让一般文本检索的现成模型适应智能体能力检索,通过微调三个模型在特定数据集上训练,测试其在未训练目录上的迁移能力,结果显示适应对两个目录均有帮助。

Comments Accepted for oral presentation at the AgentSearch Workshop, SIGIR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17214 2026-07-21 math.OC 新提交 78%

A Principal-Agent Mean-Field Game Model of Insurance with Risk Interdependence

具有风险相互依存性的保险委托-代理平均场博弈模型

Asaf Cohen, Ruolan He, Mingyan Liu

专题命中 Agent评测 :agent(title,abstract)

AI总结 研究道德风险、内生参与和战略风险相互依存下的保险合同设计问题,用异质平均场博弈近似战略互动,建立下层均衡存在性与唯一性,嵌入上层优化问题,证明相关均衡存在,扩展到有限合同菜单,表明多合同筛选可提高委托人预期收益。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13987 2026-07-16 cs.CR 新提交 78%

Agent Skill Security: Threat Models, Attacks, Defenses, and Evaluation

智能体技能安全:威胁模型、攻击、防御与评估

Sanket Badhe, Priyanka Tiwari

专题命中 Agent评测 :agent(title,abstract)

AI总结 研究智能体可复用技能安全,提出SkillSec-Eval框架,刻画技能生命周期并开发威胁分类法,通过对327个真实技能实证评估,发现多阶段有漏洞,强调需进行生命周期感知安全分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09420 2026-07-13 q-bio.PE 新提交 78%

PesTwin: A modular agent-based framework for pest and vector population control

PesTwin:一种用于害虫和病媒种群控制的基于模块化代理的框架

Andrea De Antoni, Giovanni Iacca, Andrea Pugliese, Anna Strampelli, Gerard Terradas, Matteo Rucco, Andrew Hammond

专题命中 Agent评测 :agent(title,abstract)

AI总结 针对基因控制技术建模工具滞后问题,提出PesTwin框架,可跨物种等模拟基因控制技术,捕捉多种因素。经与实验室数据验证后可扩展到田间场景,能在基因控制系统实际应用前进行模拟测试,助力相关决策,缩短研发到应用路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07584 2026-07-09 cs.NI 新提交 78%

PHaul: A PPO-based forwarding agent for Sub6 enhanced Integrated Access and Backhaul networks

PHaul:一种用于Sub6增强型综合接入与回传网络的基于近端策略优化(PPO)的转发代理

Jorge Pueyo, Daniel Camps-Mur and, Miguel Catalan-Cid

专题命中 Agent评测 :agent(title,abstract)

AI总结 研究Sub6增强型IAB网络的转发问题,提出PHaul,结合离线启发式算法与基于PPO的在线DRL代理,利用网络数字孪生采样更新映射,相比替代算法,能提升吞吐量效率和公平性,且对拓扑差异有鲁棒性。

Journal ref IEEE Transactions on Network and Service Management, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06118 2026-07-08 cs.CV cs.MM 新提交 78%

WebRetriever: A Large-Scale Comprehensive Benchmark for Efficient Web Agent Evaluation

WebRetriever:用于高效网络智能体评估的大规模综合基准测试

Wei Dong, Tianyu Fu, Zhe Yu, Hanning Wang, Anyang Su, Zhizhou Fang, Yuyang Chen, Shuo Wang, Minghui Wu, Ping Jiang, Zhen Lei, Chenxu Zhao

机构 * Mininglamp Technology(旷视科技) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所综合技术集成中心)

专题命中 Agent评测 :agent(title,abstract)

AI总结 针对现有网络智能体评估基准测试的局限,提出WebRetriever这一大规模综合基准测试,涵盖多领域网站和任务。采用NavEval框架及三个评估协议,实验揭示不同协议性能差异,为网络智能体研发提供细粒度见解和严谨基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23212 2026-07-08 cond-mat.dis-nn cond-mat.stat-mech nlin.AO 版本更新 78%

Replication and Information Extraction in a Minimal Agent-Environment Model

最小化智能体 - 环境模型中的复制与信息提取

Sebastiano Ariosto, Jerome Garnier-Brun, Luca Saglietti, Davide Straziota

专题命中 Agent评测 :agent(title,abstract)

AI总结 研究在无明确指导或奖励下从数据提取信息的问题,通过对分类规则施加简单性偏差,利用统计力学工具刻画自发学习相变,扩展到智能体群体后发现交互可重塑学习相边界,开辟仅通过标签交换的分散学习途径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19073 2026-07-07 cs.CV 新提交 78%

Taming I2V models for Image HOI Editing: A Cognitive Benchmark and Agentic Self-Correcting Framework

驯服I2V模型用于图像HOI编辑:认知基准与智能体自校正框架

Jiayi Gao, Qingchao Chen, Yuxin Peng, Yang Liu

机构 * Wangxuan Institute of Computer Technology, Peking University, Beijing, China(王轩计算机技术研究所,北京大学,北京,中国) National Institute of Health Data Science, Peking University, Beijing, China(国家健康数据科学研究院,北京大学,北京,中国)

专题命中 Agent评测 :agentic(title,abstract)

AI总结 提出HOI-Edit基准和SCPE框架,利用I2V模型的时间生成能力进行动态人-物交互编辑,通过自校正提示迭代优化,实现与SOTA竞争的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00304 2026-07-02 cs.LG cs.AI cs.CL 新提交 78%

Mapping the Evaluation Frontier: An Empirical Survey of the Bias-Reliability Tradeoff Across Eleven Evaluator-Agent Conditions

映射评估前沿:跨11种评估器-智能体条件的偏差-可靠性权衡的实证调查

Zewen Liu

专题命中 Agent评测 :agent(title);分类 cs.AI、cs.CL、cs.LG

AI总结 通过扩展至11种评估条件,实证验证了LLM评估系统中评估器耦合、策略多样性与小样本测量可靠性之间的权衡,并发布了标准化基准数据集。

Comments 5 pages, 1 figure, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31613 2026-07-01 cs.CV cs.RO 新提交 78%

Robust Autonomous UAV Landing on Maritime Platforms via Multimodal Agentic AI and Active Wave Compensation

基于多模态智能体AI和主动波浪补偿的自主无人机稳健海上平台着陆

Francisco S. Neves, Pedro N. Pereira, Raul D. S. G. Campilho, Andry M. Pinto

机构 * Fundação Para a Ciência e a Tecnologia(葡萄牙科学技术基金会)

专题命中 Agent评测 :agentic(title);agent(abstract)

AI总结 提出一种解耦的多飞行器着陆框架,利用双深度强化学习智能体(SAC和模态RL)实现无人机在海上平台的稳健着陆,在15次试验中达到100%成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15917 2026-07-01 cs.CV 版本更新 78%

Making Image Editing Easier via Adaptive Task Reformulation with Agentic Executions

通过具有代理执行的自适应任务重构使图像编辑更易于实现

Bo Zhao, Kairui Guo, Runnan Du, Haiyang Sun, Pengshan Wang, Huan Yang, Kun Gai, Yixin Cao, Wei Ji

机构 * Nanjing University(南京大学) Beijing Institute of Technology(北京理工大学) College of Artificial Intelligence, China University of Petroleum (Beijing)(中国石油大学(北京)人工智能学院) Beijing University of Posts and Telecommunications(北京邮电大学) Fudan University(复旦大学)

专题命中 Agent评测 :agentic(title);agent(abstract)

AI总结 本文提出通过自适应任务重构框架提升图像编辑性能,通过代理分析和反馈优化任务描述,改进编辑效果,尤其在复杂案例中表现显著。

Comments 9pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29850 2026-06-30 cs.CV 78%

Efficient Visual Pointing for Embodied AI:Agent-Driven Data Synthesis, Cross-Block Attention, and Iterative Correction

面向具身AI的高效视觉指代:智能体驱动数据合成、跨块注意力与迭代校正

Zijian Hong, Qi Lv, Yuxiang Xie, Jianming Xing, Xiang Deng, Weili Guan, Liqiang Nie

机构 * Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))

专题命中 Agent评测 :agent(title,abstract)

AI总结 提出PointArena 2026解决方案,通过智能体驱动数据合成、确定性可操控数据流水线、跨块注意力与迭代校正模块,实现77.2%总体准确率,排名第二。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28779 2026-06-30 cs.HC 78%

Telephony Voice Agent for Banking Services

银行服务的电话语音代理

Nitya Dhagat, Vipul K. Dabhi, Harshadkumar B. Prajapati, Zankhana J. Barad

专题命中 Agent评测 :agent(title,abstract)

AI总结 提出基于Google Dialogflow CX的语音AI银行系统,支持余额查询、交易记录、卡激活等核心功能,并通过高并发和噪声测试验证其可扩展性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04160 2026-06-29 cs.GT 版本更新 78%

Representation theorems for actual and alpha powers over two-agent general concurrent game frames

关于双智能体一般并发博弈框架中实际权力和α权力的表示定理

Zixuan Chen, Fengkui Ju, Thomas Agotnes

专题命中 Agent评测 :agent(title,abstract)

AI总结 本文针对双智能体一般并发博弈框架,证明了实际权力和α权力的八种类型分别可由八类邻域框架表示,推广了已有结果,并指出双智能体实际权力刻画无法推广到任意有限智能体集合。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26074 2026-06-25 cs.GT 新提交 78%

Strategyproof Facility Location and Committee Selection with Mixed Max and Sum Agent Types

混合最大和求和代理类型的策略性设施选址与委员会选择

Yue Gruszecki, Elliot Anshelevich

专题命中 Agent评测 :agent(title,abstract)

AI总结 针对代理具有最大型或求和型成本函数的策略性设施选址问题,设计确定性策略证明机制,并证明在代理类型私有但位置已知时近似比为(3-2/k),在位置私有且位于直线度量时近似比为3。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23070 2026-06-23 q-fin.TR 新提交 78%

Mitigating Adverse Selection in Concentrated Liquidity AMMs with Dynamic Fees: An Agent-Based Model Approach

缓解集中流动性AMM中的逆向选择:基于动态费用的代理建模方法

Daniele Maria Di Nosse, Fabrizio Lillo

专题命中 Agent评测 :agent(title,abstract)

AI总结 针对Uniswap v3等集中流动性AMM中流动性提供者面临的逆向选择成本,提出基于波动率和订单流毒性的动态费用机制,通过代理建模验证其可补偿损失而非直接降低损失。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23408 2026-06-23 math.OC cs.NA math.NA 新提交 78%

Finite difference methods for a continuous-time heterogeneous agent model with recursive utility

具有递归效用的连续时间异质主体模型的有限差分方法

Yves Achdou, Qing Tang

专题命中 Agent评测 :agent(title,abstract)

AI总结 针对Epstein-Zin递归效用下的连续时间异质主体模型,提出Howard-Newton和Howard-Tarski-Kantorovich算法求解离散化的HJB方程,证明算法收敛性及解的存在性,并给出先验误差估计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17128 2026-06-19 cs.AR 新提交 78%

Shift-Left High-Level Synthesis Verification via Knowledge-Augmented LLM Agent

通过知识增强的LLM智能体实现左移高层次综合验证

Zhihan Xiao, Hongbing Lang, Zhe Zhao, Luke Ztz Hu, Songping Mai

专题命中 Agent评测 :agent(title,abstract)

AI总结 提出一种知识增强的智能体驱动左移验证框架,通过双层级一致性检查、符号执行和HLS验证知识图谱,在综合前自动验证C与HLS-C的功能一致性,覆盖率达98.26%。

详情

展开后加载摘要…

URL PDF HTML 收藏