arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-27 至 2026-07-27 共收录 134 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 23 篇

2606.03159 2026-07-27 cs.CV cs.AI cs.RO 版本更新 57%

NVIDIA OmniDreams: Real-Time Generative World Model for Closed-Loop Autonomous Vehicle Simulation

NVIDIA OmniDreams:用于闭环自动驾驶仿真的实时生成式世界模型

NVIDIA, :, Aarti Basant, Amlan Kar, Despoina Paschalidou, Fangyin Wei, Francesco Ferroni, Guillermo Garcia Cobo, Haithem Turki, Huan Ling, Jaewoo Seo, James Lucas, Jay Zhangjie Wu, Jialiang Wang, Jonathan Lorraine, Jun Gao, Kai He, Katarina Tothova, Kevin Xie, Michał Tyszkiewicz, Qi Wu, Riccardo de Lutio, Ruilong Li, Sanja Fidler, Seung Wook Kim, Tianchang Shen, Tianshi Cao, Tobias Pfaff, William Lew, Xindi Wu, Xuanchi Ren, Yifan Lu, Yuxuan Zhang, Zan Gojcic, Zian Wang

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 提出OmniDreams,一个基于Cosmos扩散模型训练的基础生成式世界模型,通过自回归生成动作条件视频,实现闭环仿真中复杂长尾场景的实时合成,并验证其在策略模型训练中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04637 2026-07-27 cs.AI 版本更新 57%

Same World, Differently Given: History-Dependent Perceptual Reorganization in Artificial Agents

同一世界,不同给定:人工智能代理中的历史依赖性感知重组

Hongju Pae

机构 * Active Inference Institute(主动推理研究所)

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 本文提出了一种最小架构,通过反馈的慢视角潜在变量g实现感知重组,使相同观察在不同历史下编码不同,验证了适应性自调节在代理历史依赖性视角组织中的作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22132 2026-07-27 cs.SI 新提交 50%

On the Fragility of Majority Illusions

论多数错觉的脆弱性

Maaike Venema-Los, Zoé Christoff, Serte Donderwinkel, Davide Grossi

专题命中 Agent评测 :agent(abstract)

AI总结 研究社交网络中多数错觉的脆弱性,通过考虑主体观点随时间变化的网络及规模增大的随机图序列两种情况,发现多数错觉在多数更新下会消失,且出现可能性趋于零。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21960 2026-07-27 cs.RO 新提交 50%

Adaptive Undulatory Locomotion of Snake-like Robots in Dynamic Viscous Environments via Deep Reinforcement Learning

通过深度强化学习实现蛇形机器人在动态粘性环境中的自适应波动运动

Tsuyoshi Kimoto, Akio Yamano, Kohei Honda, Takashi Iwasa

专题命中 Agent评测 :agent(abstract)

AI总结 研究蛇形机器人在动态粘性环境中的自适应运动,利用深度强化学习,通过非对称演员 - 评论家框架及特权信息提炼,使机器人获得非正弦自适应步态,提高推进速度和运输效率,突破传统控制极限。

Comments 23 pages, 6 figures. Submitted to a journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21630 2026-07-27 cs.NE 新提交 50%

Evolving Self-Organising Agents Without Fitness: Three Falsifiable Experiments from Constraint-Driven Selection to Developmental Encoding

无适应度的自组织智能体演化:从约束驱动选择到发育编码的三个可证伪实验

Anushka Sharma

专题命中 Agent评测 :agent(abstract)

AI总结 研究在无设计者指定适应度函数时生物发育进化动力学能否产生,通过Genesis平台进行三个实验周期,测试可证伪假设,得出约束驱动选择、智能体介导生态位构建及CPPN间接编码相关结果,还产生了诊断工具和协议。

Comments GECCO Companion '26 Workshop Paper (EvoSelf/ESO Workshop), July 13-17, 2026, San Jose, Costa Rica. 3 pages. ACM ISBN 979-8-4007-2488-6/2026/07

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21890 2026-07-27 math.OC 新提交 50%

Stackelberg Games with a Robust Leader

具有稳健领导者的斯塔克尔伯格博弈

Juan Li, Jianfeng Zhang, Zimu Zhu

专题命中 Agent评测 :agent(abstract)

AI总结 研究具有一个领导者和多个追随者的斯塔克尔伯格博弈,稳健领导者考虑最坏情况,通过弱形式将问题转化为零和博弈,利用HJB方程刻画,还指出委托代理问题是其特殊情况。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19131 2026-07-27 cs.SI 版本更新 50%

Conspiracy Theory Rabbit Holes Emerge via Interacting Contagions

阴谋论兔子洞通过相互作用的传播出现

Fabian Tschofenig, Paul Vicinanza, Henrich Greve, Hayagreeva Rao, Douglas Guilbeault

专题命中 Agent评测 :agent(abstract)

AI总结 研究探讨人们陷入阴谋论兔子洞的原因,通过分析推文用序列风险模型等揭示阴谋论间相互作用及定居者效应,比较多种模型,发现传染病生态模型能重现相关动态,还表明防止阴谋论首次公开认可有重要作用。

Comments 49 pages, 13 figures, 5 tables, including supplementary appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10203 2026-07-27 quant-ph 50%

Topology-Aware Block Coordinate Descent for Qubit Frequency Allocation of Superconducting Quantum Processors

基于拓扑的块坐标下降法用于超导量子处理器的量子比特频率分配

Zheng Zhao, Weifeng Zhuang, Yanwu Gu, Peng Qian, Xiao Xiao, Dong E. Liu

专题命中 Agent评测 :workflow(abstract)

AI总结 本文提出一种基于拓扑的块坐标下降方法,用于超导量子处理器的量子比特频率分配,通过将顺序选择转化为序列依赖旅行商问题,实现高效的块排序,提升优化性能。

Comments 25 pages,6 figures

Journal ref Quantum Sci. Technol. 11 035023 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04842 2026-07-27 cs.NI 版本更新 50%

Intelligent resource allocation in wireless networks via deep reinforcement learning

通过深度强化学习实现无线网络中的智能资源分配

Marie Diane Iradukunda, Chabi F. Elégbédé, Yaé Ulrich Gaba

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出利用深度强化学习实现无线网络中智能资源分配,通过DQN智能体实现自适应功率控制,实验显示其在吞吐量和公平性方面优于传统方法。

Comments 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21446 2026-07-27 econ.TH 50%

Contrarian Incentives and Costly Social Learning

反众动机在社会学习中的作用

Vasilii Ivanik, Georgy Lukyanov

专题命中 Agent评测 :agent(abstract)

AI总结 本文研究了在反众动机影响下,社会学习中代理人如何通过获取私人信号来做出最优决策,并分析了反众强度对信息价值和决策影响的动态变化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.14288 2026-07-27 cs.GT 版本更新 50%

Popular Matchings under Preference Variation and an Algorithm for Popular Common Bases with Integral Comparison Margins

偏好变化下的流行匹配以及具有整数比较边际的流行公共基算法

Gergely Csáji

专题命中 Agent评测 :agent(abstract)

AI总结 研究匹配市场中偏好变化下的流行匹配与优势匹配,给出单边市场相关多项式时间算法及双边市场流行匹配NP难、优势匹配在部分情况下易处理的结论,核心方法是扩展原始对偶水平算法。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 其他Agent 3 篇

2607.21760 2026-07-27 cs.HC 新提交 78%

Bespoke Visual Assistance: What and How do Blind and Low-Vision People Create with Agentic Programming?

定制视觉辅助:盲人和低视力人群如何通过智能编程创建以及创建了什么?

Ellie Seehorn, Gene S-H Kim, Aziz Zeidieh, Ather Jammoa, Kun Lee, Aditi Shah, Jaylin Herskovitz, Anhong Guo, Venkatesh Potluri

专题命中 其他Agent :agentic(title,abstract)

AI总结 研究盲人和低视力人群如何用智能编程创建视觉辅助工具,通过与五位用户两阶段协同设计研究,使用ProgramAT工具,揭示创建策略与挑战,为未来智能编程环境提建议,助用户创建定制视觉辅助。

Comments 24 pages, 4 figures. To be presented at The 28th International ACM SIGACCESS Conference on Computers and Accessibility (ASSETS '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21612 2026-07-27 cs.AI cs.LG 新提交 62%

Procedural Knowledge Is Not Low-Rank: Why LoRA Fails to Internalize Multi-Step Procedures

过程性知识不是低秩的:为什么LoRA无法内化多步骤过程

Simon Dennis, Kevin Shabahang, Hao Guo, Rivaan Patil

机构 * University of Melbourne(墨尔本大学)

专题命中 其他Agent :agentic(abstract);分类 cs.AI、cs.LG

AI总结 研究发现对于过程性知识,LoRA在保持效率优势的秩上无法与完全微调匹配。通过实验表明在旅行预订等任务中LoRA配置失败,跨域复制也证实其普遍不佳,分析指出完全微调权重变化的有效秩高,LoRA难以企及,这是智能体应用的基本限制。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21625 2026-07-27 cs.AI 新提交 57%

Trajectory-Aware Retrieval Agents for Temporal Decision- Making

用于时间决策的轨迹感知检索代理

Jing Wang, Jie Shen, Xing Niu

机构 * Amazon(亚马逊)

专题命中 其他Agent :agentic(abstract);分类 cs.AI

AI总结 研究用大语言模型代理从长篇时间结构化文本中决策的问题,针对标准RAG丢弃时间结构缺陷,引入闭环代理框架TLM,其关键技术是LGCM,在医学问答、收益电话会议惊喜预测和隔夜股票缺口预测任务中表现出色。

详情

展开后加载摘要…

URL PDF HTML 收藏