arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 15704 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 15704 篇

2606.23070 2026-06-23 q-fin.TR 新提交 78%

Mitigating Adverse Selection in Concentrated Liquidity AMMs with Dynamic Fees: An Agent-Based Model Approach

缓解集中流动性AMM中的逆向选择:基于动态费用的代理建模方法

Daniele Maria Di Nosse, Fabrizio Lillo

专题命中 Agent评测 :agent(title,abstract)

AI总结 针对Uniswap v3等集中流动性AMM中流动性提供者面临的逆向选择成本,提出基于波动率和订单流毒性的动态费用机制,通过代理建模验证其可补偿损失而非直接降低损失。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23408 2026-06-23 math.OC cs.NA math.NA 新提交 78%

Finite difference methods for a continuous-time heterogeneous agent model with recursive utility

具有递归效用的连续时间异质主体模型的有限差分方法

Yves Achdou, Qing Tang

专题命中 Agent评测 :agent(title,abstract)

AI总结 针对Epstein-Zin递归效用下的连续时间异质主体模型,提出Howard-Newton和Howard-Tarski-Kantorovich算法求解离散化的HJB方程,证明算法收敛性及解的存在性,并给出先验误差估计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17128 2026-06-19 cs.AR 新提交 78%

Shift-Left High-Level Synthesis Verification via Knowledge-Augmented LLM Agent

通过知识增强的LLM智能体实现左移高层次综合验证

Zhihan Xiao, Hongbing Lang, Zhe Zhao, Luke Ztz Hu, Songping Mai

专题命中 Agent评测 :agent(title,abstract)

AI总结 提出一种知识增强的智能体驱动左移验证框架,通过双层级一致性检查、符号执行和HLS验证知识图谱,在综合前自动验证C与HLS-C的功能一致性,覆盖率达98.26%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18591 2026-06-18 cs.CV 新提交 78%

Bridging Creative Intent and Visual Quality: Creator-Driven Recurrent Video Generation with Agentic Feedback Loops

桥接创意意图与视觉质量:基于创作者驱动的循环视频生成与代理反馈循环

Denis Savytski, Aiden Lei, Heding Liu, Warren Yang, Sihan Liang, Alexander Liu, Zhe Zhao

机构 * University of California, Davis(加州大学戴维斯分校) The Harker School(哈克学校) Basis Independent Silicon Valley(硅谷贝斯独立学校) Saratoga High(萨拉托加高中)

专题命中 Agent评测 :agentic(title);agent(abstract)

AI总结 提出CHIEF框架,通过人类-AI协作的迭代视频精炼,结合创作者驱动和代理主观反馈,提升长视频的叙事连贯性与创意方向。

Comments Accepted to the Workshop on Human-AI Co-Creativity at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18121 2026-06-17 cs.MA cs.IT math.IT 新提交 78%

On the Reliability of Networks of AI Agents: Density Evolution, Stopping Sets, and Architecture Optimization

AI代理网络的可靠性:密度演化、停止集与架构优化

Ehsan Aghazadeh, Hossein Pishro-Nik

专题命中 Agent评测 :AI agent(title);agent(abstract)

AI总结 将多代理AI系统建模为稀疏图上的消息传递,扩展LDPC编码的密度演化理论,分析三种擦除失效模式,并证明密度演化定理以预测未解决子声明的渐近比例。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13749 2026-06-15 cs.MA 新提交 78%

Large Language Models as Supervised Extraction Assistants: Lowering the Barrier to Documentation Standard Adoption in Agent-Based Modelling

大型语言模型作为监督式提取助手:降低基于智能体建模中文档标准采纳的门槛

Peer-Olaf Siebers, Christopher Frantz

专题命中 Agent评测 :agent(title,abstract)

AI总结 本研究探索利用大型语言模型(LLMs)辅助自动化ABM文档标准(如RAT-RS)的采纳,通过四个LLMs从已发表论文中提取报告,发现LLMs在描述性任务上表现可靠,但在解释性和评估性任务上存在局限,并提出了何时依赖LLM、何时需要人工监督的实用启发式方法。

Comments 17 pages, accepted for publication at the Social Simulation Conference 2026, see https://www.durham.ac.uk/research/institutes-and-centres/research-methods/social-simulation-conference-2026/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14331 2026-06-15 physics.soc-ph cond-mat.stat-mech econ.GN q-fin.EC 新提交 78%

Wealth Inequality and Planetary Boundaries in a Stylized Agent-Based Model

一个基于主体的风格化模型中的财富不平等与行星边界

Thomas Valade, Michael Benzaquen, Matthieu Cristelli, Stanislao Gualdi, Pierre Lenders

专题命中 Agent评测 :agent(title,abstract)

AI总结 通过构建异质主体模型,研究财富不平等如何阻碍绿色转型,发现超过一定阈值后经济锁定在棕色状态,并评估了不同财政政策的效果。

Comments 26 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03636 2026-06-15 cs.GT 版本更新 78%

Causal Mirage Equilibrium in Agentic Machine Intelligence

生成式机器智能中的因果幻象均衡

Hamidou Tembine

专题命中 Agent评测 :agentic(title);agent(abstract)

AI总结 针对生成式机器智能中语义表征与物理现实脱钩的问题,提出风险敏感平均场型因果幻象均衡(CME),证明其存在性并揭示内生强化主导时非因果状态的稳定分岔。

Comments 10 pages, 1 figure. References double-checked manually

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13639 2026-06-12 cs.MA 新提交 78%

Tuning Agent-Based Predator-Prey Models Toward Lotka-Volterra Dynamics

将基于智能体的捕食者-猎物模型调谐至洛特卡-沃尔泰拉动力学

Corinna Mandl, Siddharth Chaturvedi, Marcel van Gerven

专题命中 Agent评测 :agent(title,abstract)

AI总结 研究通过调整环境与种群参数,使基于智能体的捕食者-猎物模型产生类似洛特卡-沃尔泰拉方程的周期性振荡,并利用基于特征的损失函数优化参数。

Comments 12 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10546 2026-06-11 cs.MA 版本更新 78%

SkillAxe: Sharpening LLM-Authored Agent Skills Through Evaluation-Guided Self-Refinement

SkillAxe: 通过评估引导的自我精炼提升LLM编写的智能体技能

Srishti Gautam, Arjun Radhakrishna, Sumit Gulwani

专题命中 Agent评测 :agent(title,abstract)

AI总结 提出SkillAxe框架,通过无监督评估引导LLM自我诊断和精炼技能,在SkillsBench上提升通过率28%,缩小与人类技能的差距47-67%。

Comments 9 pages, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.10271 2026-06-11 cs.CR cs.CE 78%

Agent-based Model of Initial Token Allocations: Evaluating Wealth Concentration in Fair Launches

基于代理的初始代币分配模型:评估公平发行中的财富集中

Joaquin Delgado Fernandez, Tom Barbereau, Orestis Papageorgiou

专题命中 Agent评测 :agent(title,abstract)

AI总结 本文通过基于代理的模型研究公平发行后代币集中问题,发现无论分配方式如何,代币流动性导致集中现象持续存在。

Journal ref ACM Trans. Manage. Inf. Syst. 15, 1 (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09375 2026-06-09 physics.soc-ph 新提交 78%

An Agent-Based Model for Migration Decision-Making Under Higher Frequency of Extreme Climate Events

极端气候事件频率增加下的迁移决策基于智能体的模型

Valentina Antonaccio Guedes, Rafael Prieto-Curiel

专题命中 Agent评测 :agent(title,abstract)

AI总结 构建基于智能体的模型,通过感知风险、迁移愿望和迁移能力的共同演化,揭示气候冲击如何非线性地影响迁移决策,并导致脆弱群体陷入困境。

Comments 44 pages including appendix, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08701 2026-06-09 cs.MA cs.CY cs.SI 新提交 78%

Is Telehealth Better Used to Treat Patients or Help Other Physicians Treat Patients? An Agent-Based Modeling Study of Healthcare Provision

远程医疗更适合用于治疗患者还是帮助其他医生治疗患者?基于智能体的医疗服务提供模型研究

Michael Chary

专题命中 Agent评测 :agent(title,abstract)

AI总结 通过基于智能体建模,研究远程医疗在医学毒理学中的效果,发现医生间远程医疗可改善患者健康且不增加系统利用,而医患远程医疗增加成本但无临床改善。

Comments Presented at HICSS 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22097 2026-06-09 cs.SE cs.AI cs.CL cs.CR 版本更新 78%

SecureVibeBench: Benchmarking Secure Vibe Coding of AI Agents via Reconstructing Vulnerability-Introducing Scenarios

SecureVibeBench: 通过重建引入漏洞的场景来基准测试AI代理的安全振动编码

Junkai Chen, Huihui Huang, Yunbo Lyu, Junwen An, Jieke Shi, Chengran Yang, Ting Zhang, Haoye Tian, Yikun Li, Zhenhao Li, Xin Zhou, Xing Hu, David Lo

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 Agent评测 :AI agent(title);分类 cs.AI、cs.CL、cs.SE

AI总结 本文提出SecureVibeBench,一个包含105个C/C++安全编码任务的基准测试,旨在评估AI代理在真实场景中生成安全代码的能力,发现现有方法在评估人类与AI代理对比时的不足。

Comments ACL 2026 Main Conference. Our code and data are on https://github.com/iCSawyer/SecureVibeBench

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16095 2026-06-09 cs.HC 版本更新 78%

GroupEnvoy: A Conversational Agent Speaking for the Outgroup to Foster Intergroup Relations

GroupEnvoy: 代表外群体发言以促进群体间关系的对话代理

Koken Hata, Rintaro Chujo, Reina Takamatsu, Wenzhen Xu, Yukino Baba

专题命中 Agent评测 :agent(title,abstract)

AI总结 提出基于群体间接触理论的文本对话代理GroupEnvoy,通过在内群体讨论中代表外群体视角,并评估其相比被动暴露在减少焦虑、提升观点采择等方面的效果。

Comments 18 pages, 5 figures, accepted to ACM CUI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07344 2026-06-08 physics.soc-ph 新提交 78%

From Boundary Crossings to Global Connectivity: A Minimal Mechanism in Structured Agent-Based Landscapes

从边界穿越到全局连通:结构化基于智能体景观中的最小机制

Fabio Nelli

专题命中 Agent评测 :agent(title,abstract)

AI总结 研究局部移动性异质性如何在结构化智能体系统中通过边界介导产生全局重构,发现少量探索性智能体即可在随机游走下实现景观连通,无需优化或目标导向行为。

Comments 26 pages, 6 figures, 3 supplementary figures. Source code and replication package publicly available via CoMSES and Zenodo

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05732 2026-06-05 physics.geo-ph 78%

Preparing for the Next Carrington: Spatiotemporal Agent-Based Modeling for Safeguarding Satellite Infrastructure Under Extreme Space Weather Disturbances

为下一次卡林顿事件做准备:基于时空智能体的极端空间天气扰动下卫星基础设施保护建模

Rushil Kukreja, Edward J. Oughton, Phillip M. Cunio, Richard Linares

专题命中 Agent评测 :agent(title,abstract)

AI总结 本研究开发了一种新型时空智能体模型,用于预测极端空间天气对卫星的影响,并提供实时机动建议,以保护卫星基础设施。

详情

展开后加载摘要…

URL PDF HTML 收藏
1703.10639 2026-06-04 econ.GN q-fin.EC 78%

Agent-Based Model Calibration using Machine Learning Surrogates

基于机器学习的代理模型校准

Francesco Lamperti, Andrea Roventini, Amir Sani

专题命中 Agent评测 :agent(title,abstract)

AI总结 本文提出结合监督学习和智能采样构建代理模型代理元模型,以加快参数空间探索和校准,应用于资产定价和内生增长模型,展示机器学习代理在复杂参数空间中的高效探索能力。

Comments 32 pages, 19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1602.01271 2026-06-04 econ.GN q-fin.EC 78%

On the parameter identifiability problem in Agent Based economical models

关于基于代理的经济模型中参数可识别性问题

Di Molfetta Giuseppe

专题命中 Agent评测 :agent(title,abstract)

AI总结 本文研究了基于代理的经济模型中参数可识别性问题,比较了DSGE与ABM在结构参数可识别性上的差异,并探讨了数值协议在检验ergodic和markovian经济系统全局可识别性时的局限性。

Comments Master 2 Recherche dissertation in Economie Theorique et Empirique, Universite Paris 1 Pantheon - Sorbonne and Supervised by Jean-Bernard Chatelain (Director) and Antoine Mandel (Co-Director)

详情

展开后加载摘要…

URL PDF HTML 收藏
1503.05416 2026-06-04 math.OC econ.GN math.PR q-fin.EC 78%

The Principal-Agent Problem With Time Inconsistent Utility Functions

具有时间不一致效用函数的委托-代理问题

Boualem Djehiche, Peter Helgesson

专题命中 Agent评测 :agent(title,abstract)

AI总结 本文研究了允许时间不一致效用函数的连续时间委托-代理问题,提出利用FBSDEs的Pontryagin最大原理结果来刻画最优合同,通过线性二次例子展示了方法。

Comments arXiv admin note: substantial text overlap with arXiv:1410.6392

详情

展开后加载摘要…

URL PDF HTML 收藏
1404.7199 2026-06-04 math.NA cs.NA 78%

On the acceleration of spatially distributed agent-based computations: a patch dynamics scheme

关于空间分布式代理计算加速:一种补丁动力学方案

Ping Liu, Giovanni Samaey, C. William Gear, Ioannis G. Kevrekidis

专题命中 Agent评测 :agent(title,abstract)

AI总结 本文提出一种基于有限体积的保守补丁动力学方案,用于加速空间分布式代理计算,应用于金融市场代理模型,显示其在空间和时间上均显著降低计算成本。

Comments 19 pages and 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03168 2026-06-03 cs.CV 78%

JAVEDIT: Joint Audio-Visual Instruction-Guided Video Editing with Agentic Data Curation

JAVEDIT: 联合音频-视觉指令引导视频编辑与智能体数据策展

Yinan Chen, Chuming Lin, Zhennan Chen, Yuxiang Zeng, Junwei Zhu, Yali Bi, Xijie Huang, Chengming Xu, Donghao Luo, Zhucun Xue, Xiaobin Hu, Chengjie Wang, Yong Liu, Jiangning Zhang, Shuicheng Yan

机构 * Zhejiang University(浙江大学) Tencent Youtu Lab(腾讯优图实验室) Nanjing University(南京大学) University of Auckland(奥克兰大学) Fudan University(复旦大学) National University of Singapore(新加坡国立大学)

专题命中 Agent评测 :agentic(title);agent(abstract)

AI总结 针对联合音频-视觉编辑缺乏数据集和基准的问题,提出首个大规模高质量数据集JAVEdit-100k、基准JAVEditBench以及基线模型JAVEdit,在六项指标中五项超越所有基线。

Comments Equal contributions from first two authors. Project page: https://ryanchenyn.github.io/projects/JAVEdit Code: https://github.com/RyanChenYN/JAVEdit Dataset: https://huggingface.co/datasets/Coraxor/JAVEdit-100k

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30915 2026-06-03 cs.CV 78%

DiTTo: Scalable Order-aware All-in-One Image Restoration Agent

DiTTo: 可扩展的排序感知全能图像修复智能体

Seungho Choi, Jihyong Oh

机构 * CMLab, Chung-Ang University(Chung-Ang 大学 CMLab) David S. Hippocampus Department of Computer Science Cranberry-Lemon University(Cranberry-Lemon 大学 计算机科学系 Hippocampus 教授)

专题命中 Agent评测 :agent(title,abstract)

AI总结 提出DiTTo框架,通过模拟器高效构建最优修复轨迹数据集,并采用排序感知对齐实现修复专家的即插即用扩展,在多退化图像修复中达到最优性能。

Comments Please visit our project page at https://cmlab-korea.github.io/DiTTo/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00053 2026-06-02 cs.RO 78%

VLAMotor: Test-Guided Enhancement of Vision-Language-Action Models via Agent-BasedData Synthesis

VLAMotor: 通过基于智能体的数据合成实现视觉-语言-动作模型的测试引导增强

Zeqin Liao, Peifan Ren, Zixu Gao, Hongyu Gong, Lianyu Hu, Wenbing Tang, Yuhong Nan, Zibin Zheng, Yang Liu

机构 * School of computing and data science, Nanyang Technological University(计算与数据科学学院,南洋理工大学) School of Software Engineering, Sun Yat-sen University(软件工程学院,中山大学) GuangDong Engineering Technology Research Center of Blockchain, China(区块链工程技术研发中心,中国) Northwest A&F University(西北农林科技大学)

专题命中 Agent评测 :agent(title,abstract)

AI总结 提出VLAMotor框架,通过距离感知测试暴露失败案例,并利用基于智能体的数据合成生成成功轨迹微调VLA模型,显著提升模型在仿真和真实环境中的成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.05256 2026-06-02 cs.SI cs.DM cs.MA q-bio.QM 78%

Social Network Analysis and Validation of an Agent-Based Model

基于智能体的模型的社会网络分析与验证

Karleigh Pine, Joel Klipfel, Jared Bennett, Nathaniel Bade, Christian Manasseh

专题命中 Agent评测 :agent(title,abstract)

AI总结 利用多种网络比较方法(包括基于热核渐近的新型图伪度量)跟踪基于智能体模型中的网络变化,并利用网络科学中的真实网络特征在缺乏经验数据时验证模型。

Comments 23 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30547 2026-06-01 cs.MA 78%

MATraM: A Multi-Activity Transport and Mobility Agent-Based Model for Activity Modifications

MATraM:一种用于活动修改的多活动交通与出行智能体模型

Yahya Gamal, Ricardo Colasanti, Gary Polhill, Tatsuya Mitomi, Esra Suel, Alison Heppenstall

专题命中 Agent评测 :agent(title,abstract)

AI总结 提出MATraM智能体模型,通过引入动态活动适应机制,克服传统活动基础交通模型依赖固定行程的局限,实现个体行为对交通系统动态的响应。

Comments 24 pages, 4 figures, 9 tables, working paper for a submission to MethodsX journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27067 2026-05-27 cs.CV 78%

BEAT: Rhythm-Elastic Alignment for Agentic Music-guided Movie Trailer Generation

BEAT: 节奏弹性对齐用于智能音乐引导的电影预告片生成

Yutong Wang, Yunke Wang, Xinyuan Chen, Chang Xu

机构 * The University of Sydney(悉尼大学) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 Agent评测 :agentic(title,abstract)

AI总结 提出BEAT框架,通过音乐-视觉对齐编码器MuVA和能量自适应动态规划算法Bar-DP,实现弹性多对一节奏对齐,用于端到端电影预告片生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26642 2026-05-27 cs.CV 78%

Adaptation-Free Heterogeneous Collaborative Perception with Unseen Agent Configurations

无适应异构协同感知:应对未见过的智能体配置

Hyunchul Bae, Heejin Ahn

机构 * School of Electrical Engineering(电气工程学院) Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院)

专题命中 Agent评测 :agent(title,abstract)

AI总结 提出ALF框架,通过将轻量级框级消息提升为自车兼容的辅助特征,实现与未见配置智能体的零适应协同感知,在V2X-Real上零样本评估中相对mAP@0.7提升35.91%,带宽仅需约9.6 Kbps。

Comments 9 pages main paper, 23 pages including references and appendix, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25007 2026-05-26 cs.IR 78%

Meta-Modal Agent: Sequential Evidence Routing for Missing-Modality Candidate Reranking

元模态智能体:面向缺失模态候选重排序的序列证据路由

Jinze Wang, Yangchen Zeng, Tiehua Zhang, Lu Zhang, Yuze Liu, Zhishu Shen, Jiong Jin, Zhu Sun

专题命中 Agent评测 :agent(title,abstract)

AI总结 提出元模态智能体(MMA),将缺失模态问题转化为序列证据路由任务,通过基于大语言模型的候选池重排序器,结合平衡缺失任务强化学习,在冷启动场景下显著提升推荐性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24729 2026-05-26 cs.HC 78%

"It Felt a Bit Eerie": Exploring Humanlike Interactions During Collaborative Writing with an Artificial Agent

"感觉有点诡异":与人工智能体协作写作中类人交互的探索

Michael Yin, Angela Chiang, Samuel Rhys Cox, Robert Xiao

专题命中 Agent评测 :agent(title,abstract)

AI总结 通过构建三种不同类人程度的AI辅助编辑器并开展用户研究,探讨协作的时间与视觉维度如何影响写作体验及人机社会连接。

Comments 29 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏