arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-05 至 2026-08-05 共收录 218 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 52 篇

2608.02704 2026-08-05 cs.AI cs.LO q-bio.NC 新提交 57%

Predictive Set Theory: A Generative Framework for Cognitive Architecture with Operationalized Core Mechanisms

预测集合论:具有可操作核心机制的认知架构生成框架

Yiyang Yu

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文提出预测集合论(PST)这一形式生成框架,从第一性原理重构认知架构,解决经典认知问题,并确立其原创性与完整性。

Comments 103 pages. This preprint establishes the theoretical framework of Predictive Set Theory, providing a generative design specification for cognitive architecture. Comments welcome

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21644 2026-08-05 cs.LG cs.SY eess.SY 版本更新 57%

Toward Goal-Agnostic Joint-Embedding Predictive Control of Partial Differential Equations

迈向偏微分方程的目标无关联合嵌入预测控制

Jonathan Gallagher, Roberto Guglielmi

机构 * University of Waterloo(滑铁卢大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 该研究针对偏微分方程提出目标无关控制框架,基于联合嵌入预测架构,通过离线训练小型二维ViT编码器等,经模型预测路径积分控制器复用。在相关基准测试中,KE探测器规划提升奖励、降低误差,验证了潜在动力学与目标无关及校准可观测量用于状态控制的优势。

Comments Associated code will be open sourced alongside a later, updated submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21273 2026-08-05 cs.LG 版本更新 57%

The Dark Room in the Reward Channel: Dense Prediction Rewards Collapse GRPO-Trained LLM Agents -- and The Channel, Not the Content, Decides What Works

奖励通道中的暗室:密集预测奖励使GRPO训练的大语言模型智能体崩溃——以及实际有效的方法

Yu Wang

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 研究发现密集预测奖励在GRPO训练下会使大语言模型智能体崩溃,通过单因素消融定位原因,提出方差分布标准,还通过受控信号传递矩阵对比奖励通道和辅助损失通道,表明奖励通道至多中性,辅助损失通道有优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15065 2026-08-05 cs.RO cs.CV cs.LG 版本更新 57%

DriftWorld: Fast World Modeling through Drifting

DriftWorld:通过漂移实现快速世界建模

Susie Lu, Haonan Chen, Weirui Ye, Yilun Du

机构 * Massachusetts Institute of Technology(麻省理工学院) Harvard University(哈佛大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 研究针对预测性世界模型生成展开慢的问题,提出基于漂移生成模型的DriftWorld,训练时学习动作条件漂移以快速生成未来帧,在机器人操作基准测试中实现快速准确决策,还能作离线模拟器,性能优于基于扩散的基线。

Comments Website at https://susie-lu.github.io/driftworld/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20771 2026-08-05 q-bio.PE cs.LG 版本更新 57%

Cross-Country Learning for National Infectious Disease Forecasting Using European Data

基于欧洲数据的国家传染病预测的跨国家学习

Zacharias Komodromos, Kleanthis Malialis, Artemis Kontou, Panayiotis Kolios

机构 * KIOS Research and Innovation Center of Excellence(KIOS研究与创新中心)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出了一种基于欧洲多国数据的传染病预测方法,通过跨国家学习提升预测性能,尤其在数据有限时效果显著。

Comments 7 pages, 4 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12953 2026-08-05 cs.CV cs.AI cs.IR cs.MM 版本更新 57%

Epistemic-aware Vision-Language Foundation Model for Fetal Ultrasound Interpretation

具备知识意识的视觉-语言基础模型用于胎儿超声解读

Xiao He, Huangxuan Zhao, Guojia Wan, Jiancheng Pan, Yanxing Liu, Yong Luo, Juhua Liu, Yongchao Xu, Wei Zhou, Dacheng Tao, Bo Du

机构 * National Engineering Research Center for Multimedia Software, School of Computer Science, Wuhan University(国家多媒体软件工程技术研究中心,武汉大学计算机学院) College of Computing and Data Science, Nanyang Technological University(computing and Data Science学院,南洋理工大学)

专题命中 规划决策 :workflow(abstract);分类 cs.AI

AI总结 FetalMind通过Salient Epistemic Disentanglement方法,提升胎儿超声解读的准确性和效率,实现多视图图像推理和疾病诊断的高效处理。

Comments KDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03159 2026-08-05 cs.RO 新提交 50%

Accelerating Human-Aware Robot Trajectory Generation via Diffusion and Consistency Distillation

基于扩散模型与一致性蒸馏的人机感知机器人轨迹生成加速方法

Byeong-Il Ham, Hyun-Bin Kim, Kyung-Soo Kim

专题命中 规划决策 :planning(abstract)

AI总结 本研究针对人机交互场景下机器人轨迹生成的约束与效率问题,结合RRT/RRT*算法、扩散模型与一致性蒸馏技术,实现了快速、低加加速度的机器人轨迹生成。

Comments 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03155 2026-08-05 cs.RO 新提交 50%

POMDPs for Autonomous Science Exploration

用于自主科学探测的POMDP

Daniel Guirguis, Nathan Wallace, Hanna Kurniawati, Salah Sukkarieh

专题命中 规划决策 :planning(abstract)

AI总结 该研究提出SHM-POMDP模型,解决高维观测下POMDP规划融入科学表征的难题,在RockSample域和Cuprite地质探测任务中,其性能优于传统POMDP与信息论基线方法。

Comments 8 pages, 3 figures, 2 tables. Accepted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03084 2026-08-05 cs.CV 新提交 50%

SUV: Future Scene Understanding as Video Generation for End-to-End Driving

SUV:将未来场景理解建模为视频生成的端到端驾驶

Yibo Yuan, Jiacheng Fu, Jiangtong Zhu, Yi Li, Jianhua Han, Meng Tian, Zhuohan Liu, Zhiwei Xiong, Hang Xu, Jianwu Fang, Jianru Xue

专题命中 规划决策 :planning(abstract)

AI总结 SUV是将未来场景理解建模为视频生成的端到端驾驶框架,其在NAVSIM-v2和WOD-E2E基准上优于近期SOTA方法,实现了更优的轨迹规划性能。

Comments 16 pages, 5 figures. Code: https://github.com/ASH-2046/SUV

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02904 2026-08-05 cs.RO 新提交 50%

DeRP: An Algorithm for Self-Assembly of Power-Delivery Networks using Recursive Branching in Information-Limited Environments

DeRP:信息受限环境下使用递归分支的供电网络自组装算法

Mohammadali Rashidioun, Sangwoo Park, Petras Swissler

机构 * New Jersey Institute of Technology(新泽西理工学院) NJIT Grace Hopper AI Research Institute(NJIT格蕾丝·霍珀人工智能研究院)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出DeRP算法,使机器人群仅通过局部通信和方位感知自组装供电网络,其性能接近全局基准,可在传统基础设施部署困难的环境中实现自适应供电。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03208 2026-08-05 physics.ins-det physics.med-ph 新提交 50%

Spectacular - A Modular DAQ System for Microdosimetry

Spectacular——用于微剂量学的模块化数据采集系统

Matthias Knopf, Simon Waid, Daniel Radmanovac, Sebastian Onder, Richard Thalmeier, Peter Fischer, Stefan Gundacker, Claudio Verona, Edoardo Domenicone, Thomas Bergauer, Albert Hirtl

专题命中 规划决策 :planning(abstract)

AI总结 Spectacular是一款以Xilinx Zynq片上系统为核心的模块化DAQ系统,可优化微剂量学读出电子设备与传感器的测试,已在离子治疗设施中成功验证,助力微剂量学融入临床常规实践。

Comments Prepared for submission to JINST

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25242 2026-08-05 cs.CV 版本更新 50%

Medical world models in healthcare: foundations, applications, and challenges for trustworthy clinical translation

医疗保健中的医学世界模型:可信临床翻译的基础、应用与挑战

Zhaoyan Chen, Zhongxiu Cong, Zhuanfeng Jin, Wanshu Fan, Dongsheng Zhou, Qi Ai, Haifan Gong, Congyu Liao, Xiaofeng Liu, Cong Wang

机构 * National and Local Joint Engineering Laboratory of Computer Aided Design, School of Software Engineering, Dalian University(大连大学软件工程学院计算机辅助设计国家地方联合工程实验室) Department of Radiology, Xinhua Hospital Affiliated to Dalian University(大连大学附属新华医院放射科) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) University of California, San Francisco(加州大学旧金山分校) Yale University(耶鲁大学) The Hong Kong Polytechnic University(香港理工大学)

专题命中 规划决策 :planning(abstract)

AI总结 探讨医学世界模型在医疗保健中的应用,通过结构化综合定义其领域相关内容,围绕四种能力组织,涵盖多方面证据,虽有早期可行性证据,但受多种因素限制,临床翻译需多方面保障。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21145 2026-08-05 eess.SY cs.SY 版本更新 50%

Deep Reinforcement Learning for Adaptive Gain Tuning in Control of Teleoperation Manipulators with Joint Flexibility and Time-Varying Delays

具有关节灵活性和时变延迟的遥操作机器人控制中自适应增益调整的深度强化学习

Armin Attarzadeh, Mohammad Ali Ghaemifar, Alireza Khanzadeh, Soheil Ganjefar

专题命中 规划决策 :agent(abstract)

AI总结 针对含有关节灵活性和时变延迟的遥操作机器人控制问题,提出结合稳定P+d控制器与基于TD3算法的深度强化学习智能体的混合控制方法,可实时调整增益减少振动,为相关遥操作系统提供实用方案。

Comments 7 pages, 6 figures. Source code available at: https://github.com/ArminAttarzadeh/DRL-Controller-Gain-Tuner

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.07367 2026-08-05 cs.RO 版本更新 50%

Risk Occupancy: A New and Efficient Paradigm through Vehicle-Road-Cloud Collaboration

风险占用:一种通过车路云协同实现的新型高效范式

Jiaxing Chen, Wei Zhong, Bolin Gao, Yifei Liu, Hengduo Zou, Jiaxi Liu, Yanbo Lu, Jin Huang, Zhihua Zhong

专题命中 规划决策 :planning(abstract)

AI总结 该研究提出车路云协同下的四维风险占用感知范式,其效率优于3D-Occ,在初始制动速度8m/s时提升安全冗余、降低减速度,为智能网联汽车提供紧凑可解释的风险表示。

Comments 11 pages,10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1901.07353 2026-08-05 physics.ins-det 版本更新 50%

Small-Angle Scattering

小角散射

Sebastian Jaksch

专题命中 规划决策 :planning(abstract)

AI总结 本文介绍小角散射(SAS)的两种主要类型SAXS与SANS,涵盖其适用样品、科学应用、仪器设置、数据处理等内容,为SAS实验的规划与开展提供足够信息。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 多智能体 39 篇

2608.03735 2026-08-05 cs.MA cs.CL 新提交 92%

An Actionable Diagnosis of Multilingual, Multi-Agent Planning Failures

多语言多智能体规划失败的可操作诊断

Vikas Pahuja, Jonathan Brokman, Omer Hofman, Tamir Nizri, Daniel Vishna, Seraphina Goldfarb-Tarrant, Kelly Marchisio, Hisashi Kojima, Roman Vainshtein

专题命中 多智能体 :agent(title,abstract);planning(title,abstract);multi-agent(title,abstract);agentic(abstract)

AI总结 本研究针对多语言多智能体系统在非英语场景下的规划失败问题,提出规划-接地失败分类法,开发TART方法,在多语言任务中显著提升了现有系统的性能。

Comments 22 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01463 2026-08-05 cs.AI cs.MA 版本更新 90%

Where Reasoning Diverges: Localized Multi-Agent Debate for Multi-Hop Question Answering

推理分歧之处:本地化多智能体辩论

Weijun Gao, Xiang Ding, Haoyang Liu, Tiancheng Xing

机构 * The Chinese University of Hong Kong(香港中文大学) Nagoya University(名古屋大学) Institute of Science Tokyo(东京科学大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 针对多智能体辩论冗余交换完整推理轨迹的问题,提出LMAD协议,通过定位冲突并限制辩论范围,在十个骨干模型上实现宏平均评判准确率提升7.20个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12029 2026-08-05 cs.SE 版本更新 90%

Enhancing LLM Performance Through Debate: An Empirical Study on Multi-Agent Debate for Coding Tasks

通过辩论提升大语言模型性能:针对编码任务的多智能体辩论实证研究

Yong Jin Chun, Qihong Chen, Jiawei Li, Iftekhar Ahmed

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);autonomous agent(abstract);planning(abstract)

AI总结 本研究探究多智能体辩论(MAD)在软件工程四类编码任务上的有效性,适配NLP的MAD框架并提出两种变体,证实结构化辩论可提升LLM编码性能,凸显其协作协同效应。

Comments accepted to ACM Transactions on Software Engineering and Methodology (TOSEM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03648 2026-08-05 cs.MA 新提交 90%

Group Perspective Matters: Regulating Debate Relationships Can Mitigate Blind Conformity in Multi-Agent Debate

群体视角至关重要:调控辩论关系可缓解多智能体辩论中的盲目从众

Hao Wu, Shoucheng Song, Chang Yao, Haoyu Wang, Huaiyu Wan, Youfang Lin, Kai Lv

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 针对多智能体辩论中LLMs易盲目从众的问题,提出DEAR框架,通过动态调控辩论关系缓解该问题,实验显示其性能更优且token消耗显著降低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02915 2026-08-05 cs.AR cs.CL cs.SE 新提交 90%

LACE: Large Language Model Aided Multi-Agent Framework for Agile RISC-V Instruction Extension

LACE:用于敏捷RISC-V指令扩展的大语言模型辅助多智能体框架

Pingqing Zheng, Jiayin Qin, Fuqi Zhang, Zishen Wan, Shang Wu, Yu Cao, Caiwen Ding, Yang Katie Zhao

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);workflow(abstract);分类 cs.CL、cs.SE

AI总结 针对RISC-V指令扩展实现验证缓慢碎片化问题,提出LLM辅助多智能体框架LACE,可提升指令生成准确率并减少集成返工。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03339 2026-08-05 cs.AI 新提交 90%

Traceable Multi-Agent System for Knowledge-Based Forecasting

用于基于知识的预测的可追踪多智能体系统

Junhyeok Kang, Sangjun Han, Hyeokjun Choe, Soonyoung Lee

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);autonomous agent(abstract);分类 cs.AI

AI总结 本文提出可追踪多智能体预测演示系统TraceMAS,通过两类因果环图关联证据与预测,在原油价格预测中验证其可让自主智能体兼顾灵活性与过程可检查性。

Comments Accepted at KDD 2026 Workshop on Enterprise AI Agents (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03190 2026-08-05 cs.AI 新提交 89%

TumorBoard: Evidence-Grounded Multi-Agent Decision Support for Longitudinal Neuro-Oncology

TumorBoard:基于证据的多智能体纵向神经肿瘤学决策支持系统

Yantong Liu, Zheyu Zhang, Runpeng Liu, Mu Xitang, Seong-Yoon Shin, Hyun-Ae Lee

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract);分类 cs.AI

AI总结 TumorBoard是基于证据的多智能体纵向神经肿瘤学决策支持系统,经360例基准测试,其性能优于现有基线,安全管控模块可有效降低有害建议比例。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03166 2026-08-05 cs.AI 新提交 89%

Adversarial Stress Testing of Role-Playing Language Agents using Multi-Agent Evaluation

基于多智能体评估的角色扮演语言智能体的对抗性压力测试

Saqib Shouqi, Abdullah Nazly, Januki Wanniarachchi, Ravisha De Alwis

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本研究提出模块化多智能体平台,通过多轮对话对角色扮演语言智能体开展对抗性压力测试,揭示单策略测试无法发现的故障模式,相关成果作为开源平台发布以支持AI安全。

Comments 8 pages, 1 figure, 7 tables; accepted and presented at ADScAI Conference 2026, University of Moratuwa, Sri Lanka

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03076 2026-08-05 cs.AI 新提交 89%

AI Agent Economics: Can Autonomous Economic Behavior Emerge among AI Agents under Minimal External Conditions?

智能体经济学:在 minimal 外部条件下,AI 智能体间能否涌现出自发的经济行为?

Lingyun Zhang, Shang Shang

专题命中 多智能体 :agent(title,abstract);AI agent(title,abstract);multi-agent(abstract);分类 cs.AI

AI总结 该研究探究在无预设策略的情况下,AI 智能体能否涌现经济关系,通过两阶段框架在 GPT 和 DeepSeek 的六智能体世界验证,发现组织源于可执行权利与资源后果,为智能体机制治理审计提供依据。

Comments 8 pages, 4 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00747 2026-08-05 cs.RO cs.AI cs.CR cs.MA 版本更新 89%

When Prompts Control Robots: Prompt Injection Attacks in Multi-Agent Robotic Systems

当提示控制机器人时:多智能体机器人系统中的提示注入攻击

Neha Nagaraja, Amisha Bagari, Hayretdin Bahsi

机构 * School of Informatics, Computing, and Cyber Systems, Northern Arizona University(北亚利桑那大学信息学、计算与网络安全学院) Department of Software Science, Tallinn University of Technology(塔林理工大学软件科学系)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract);分类 cs.AI

AI总结 本文针对基于LLM的多智能体机器人系统,系统研究了直接和间接提示注入攻击的风险、传播特性及架构对攻击成功率的影响,是该领域的首项系统性研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03833 2026-08-05 cs.MA 新提交 89%

History Matters: Meta-policy Delegation with Heterogeneous Multi-agent Reinforcement Learning

历史至关重要:异构多智能体强化学习的元策略委托

Ziqing Lu, Avinash Reddy Mudireddy, Sarra Alqahtani, Weiyu Xu

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);AI agent(abstract)

AI总结 本文针对异构多智能体系统的资源受限任务委托问题,提出依赖交互历史的元策略委托框架与多维货币机制,基于多智能体强化学习实现高效协作与低成本任务完成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03779 2026-08-05 cs.CV 新提交 89%

AgenticVAU: Multi-Agent Explore-Verify Reasoning for Video Anomaly Understanding

AgenticVAU:用于视频异常理解的多智能体探索-验证推理框架

Yuxiang Duan, Huining Li, Ao Li, Shuai Feng, Lanju Kong, Ning Liu, Jian Zhang, Xingdong Sheng, Yuntao Du

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract)

AI总结 本文提出无需训练的多智能体框架AgenticVAU,通过四个专门智能体协作完成视频异常理解的探索-验证过程,在VAU-Bench数据集上优于零样本推理及强化学习基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03272 2026-08-05 cs.IR cs.CR cs.MA cs.SI 新提交 89%

Attacking and Defending Multi-Agent Collaborative Filtering Systems Through Connectivity

通过连通性对多智能体协同过滤系统发起攻击与防御

Anjun Hu, Hanting Xie, Saranya Govindan, Jas Kandola, Kurt Cutajar

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);agentic(abstract)

AI总结 本研究将MAS的攻击与防御方法适配到AgentCF框架下的智能体CF场景,表征连通性对攻防结果的影响,还探索了流行病启发指标用于CF配置的健壮性评估。

Comments 10 pages, 10 figures, 20th ACM Conference on Recommender Systems (RecSys '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03239 2026-08-05 cs.CL 新提交 88%

Relational Priors as Convergence Pressure in LLM-Based Multi-Agent Systems

关系先验作为基于大语言模型的多智能体系统中的收敛压力

Ming Shen, Chao Shang, Sadat Shahriar, Devang Kulshreshtha, Yi Zhang, Sandesh Swamy, Yanjun Qi

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.CL

AI总结 该研究将关系先验注入LLM-MAS提示中,发现其主要起收敛压力作用,正向性提升可促进智能体协调但未必提高准确性,建议按需使用而非默认添加。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17535 2026-08-05 cs.SE 版本更新 88%

AgentModernize: Preserving Business Logic in Legacy Modernization with Multi-Agent LLMs and Behavioral Specification Graphs

AgentModernize: 通过多智能体LLM和行为规范图在遗留系统现代化中保留业务逻辑

Sheikh Nazib Ahmed, Marnim Galib

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.SE

AI总结 本文提出AgentModernize框架,通过多智能体系统和行为规范图来保留业务逻辑,解决传统方法在遗留系统现代化中丢失隐含规则和交叉模块约束的问题,实验表明该方法在多个场景中表现优异。

Comments 10 pages, 8 tables, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏