arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-12 至 2026-08-12 共收录 210 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 61 篇

2608.10186 2026-08-12 cs.MA cs.AI cs.CY 新提交 57%

The Deliberative Deficit: An Empirical Critique of LLMs in Democratic Discourse

审议缺陷:对大型语言模型在民主讨论中的实证批判

Maurice Flechtner

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 该研究通过审议推理指数(DRI)评估1980次五智能体LLM运行,发现LLM群体讨论程序性质量与人类相当但主体间一致性提升小、视角多样性仅为人类的1/3,反转人类收敛模式,仅可作为人类推理的辅助工具而非自主审议智能体。

Comments 10 pages, archival publication at AIES 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10483 2026-08-12 cs.AI cond-mat.mtrl-sci 新提交 57%

Predicting Space Groups of Double Perovskites by LLM with Dynamic Few-Shot Learning

基于动态少样本学习的大语言模型预测双钙钛矿的空间群

Jongwon Park, Inhyo Lee, Junhyeong Lee, Seunghwa Ryu

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 该研究提出基于LLM智能体的DyRIS框架,通过动态少样本检索与规则引导推理,在不平衡双钙钛矿数据集上提升了空间群预测的整体及少数类性能,验证了领域知识与LLM结合的有效性。

Comments 46 pages, 6 figures, Supplementary Information included(24 pages)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00945 2026-08-12 cs.LG cs.CY 版本更新 57%

TS-Mob: Social and Geographical-Aware Time Series Foundation-Model Framework for Human Mobility Prediction

TS-Mob:面向人类移动性预测的社交与地理感知时间序列基础模型框架

Massimiliano Luca, Ciro Beneduce, Bruno Lepri

机构 * MobS Lab, Bruno Kessler Foundation(布鲁诺·凯瑟林基金会移动实验室) Department of Computer Science, University of Trento(特伦托大学计算机科学系)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 TS-Mob框架通过结合地理社交信号与天气协变量微调TimesFM模型,在多类移动性预测基准上显著优于各类基线,且在不同时间区间表现稳健。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10686 2026-08-12 eess.SP 新提交 50%

Optimal Measurement Point Selection for Radio Environment Maps: A Two-Stage Approach

无线电环境地图的最优测量点选择:一种两阶段方法

Bastian Perner, Friedemann Laue, Maximilian Lubke, Norman Franchi

专题命中 规划决策 :planning(abstract)

AI总结 针对无线电环境地图构建中测量点选择的时间成本约束挑战,提出两阶段框架,结合最优实验设计与组合优化,可减少测量点数量并提升地图精度,经实测数据验证有效。

Comments accepted at IEEE PIMRC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10252 2026-08-12 stat.ME stat.AP 新提交 50%

Joint return levels of maximum temperature and minimum relative humidity by combining copulas with an extreme value framework for bimodal data

结合Copula与适用于双峰数据的极值框架,分析最高气温与最小相对湿度的联合重现水平

Beatriz G da Cruz Albernaz, Cira E G Otiniano, Carolyne Soares de Brito, Fidel E C Morales, Enzo Porto Brasil

专题命中 规划决策 :planning(abstract)

AI总结 本研究结合Copula与适用于双峰数据的极值框架,分析巴西利亚最高气温与最小相对湿度的联合重现水平,为当地气候风险应对提供关键依据。

Comments 19 pages, 13 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11164 2026-08-12 cs.IR 新提交 50%

Role of Personality in Conversational Information Seeking

人格在对话式信息检索中的作用

Abdisalam Abukar, Junchen Fu, Chengli Zhai, Joemon M. Jose

专题命中 规划决策 :planning(abstract)

AI总结 本研究以大五人格为变量,开展受控被试内实验,发现助手人格与任务的交互作用影响对话式信息检索的信任与决策,助手人格需作为语境敏感的交互设计变量。

Comments Accepted by CIKM2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11076 2026-08-12 cs.CV 新提交 50%

Foundation Model-Enabled Efficient Data Sampling (FEEDS): A label-efficient training strategy for pan-cancer, multi-tracer PET/CT datasets

基于基础模型的高效数据采样(FEEDS):用于泛癌、多示踪剂PET/CT数据集的标签高效训练策略

Biratal Raj Wagle, Bashirul Azam Biswas, Grant Chau, Matthew E. Maeder, Muhammad Azeem Arshad, Michael S. Leapman, James B. Yu, Indrani Bhattacharya

机构 * Geisel School of Medicine at Dartmouth(达特茅斯盖泽尔医学院) Dartmouth Hitchcock Medical Center(达特茅斯-希区柯克医疗中心) Yale University(耶鲁大学)

专题命中 规划决策 :planning(abstract)

AI总结 该研究提出FEEDS策略,利用视觉基础模型嵌入选择信息性和多样性未标注病例,在减少70%标注负担时达到全标注训练性能,解决了PET/CT病灶分割的标签稀缺问题。

Comments Code is publicly available on https://github.com/Image-and-Multimodal-Data-Analytics/FEEDS

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10886 2026-08-12 cs.CV cs.RO 新提交 50%

GESTO: Human-Centric Spatio-Temporal Memory for Reasoning in Dynamic Scenes

GESTO:面向动态场景推理的以人为中心的时空记忆

Ermanno Bartoli, Buwei He, Dennis Rotondi, Sebastian Koch, Federico Tombari, Kai O. Arras, Patric Jensfelt, Yixi Cai, Iolanda Leite

机构 * KTH Royal Institute of Technology(瑞典皇家理工学院) University of Stuttgart(斯图加特大学) Max Planck Research School for Intelligent Systems(马克斯·普朗克智能系统研究所) Google Research(谷歌研究院) TU Munich(慕尼黑工业大学)

专题命中 规划决策 :agent(abstract)

AI总结 该研究提出GESTO时空记忆模型,结合4D场景图与人机交互、目标事件的两级结构,在基准测试中表现优异,可支撑动态人类环境下的以活动为中心的时空推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10838 2026-08-12 cs.CV 新提交 50%

PolyLayout: Hierarchical VLM-Guided Layout Generation Beyond Rectangular Rooms

PolyLayout:超越矩形房间的分层VLM引导布局生成

Yutong Jiang, Zahra Atashgahi, Carlos Soto Garcia Delgado, Ruben Brokkelkamp, Davide Zanutto, Efşan Sökmen, Shahin Shahkarami

机构 * IKEA Retail (Ingka Group)(宜家零售(英卡集团))

专题命中 规划决策 :planning(abstract)

AI总结 PolyLayout提出混合分层VLM引导框架,分三阶段生成非矩形房间布局,在生产数据和不规则拓扑上表现出高感知合理性、低延迟,填补了学术与实际应用的差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10454 2026-08-12 eess.SY cs.SY 新提交 50%

Nuclear fusion for AI: A pathway to power data centers sustainably

AI的核聚变:可持续为数据中心供电的途径

Layla Araiinejad, Vineet Jagadeesan Nair

专题命中 规划决策 :planning(abstract)

AI总结 该研究探讨核聚变能否为AI驱动型数据中心提供可持续电源,通过技术经济分析发现其适配数据中心需求,具备成本竞争力与可行性,应优先部署。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10173 2026-08-12 cs.CV 新提交 50%

DoseBridge: Denoising Diffusion Bridge Model for Dose Prediction in Lung Intensity-Modulated Proton Therapy

DoseBridge:用于肺调强质子治疗剂量预测的去噪扩散桥模型

Zerun Zhang, Xiaoda Cong, Xiangkun Xu, Peter Y. Chen, Xuanfeng Ding

机构 * Corewell Health William Beaumont University Hospital(Corewell Health William Beaumont大学医院)

专题命中 规划决策 :planning(abstract)

AI总结 研究针对肺调强质子治疗剂量预测问题,提出DoseBridge去噪扩散桥模型,融合CT与射野几何信息,在52例患者数据上的多项指标优于对比模型,为放疗剂量预测提供新方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10899 2026-08-12 math.OC 新提交 50%

Robust Unit Commitment in District Heating Networks: Chance-Constrained and CVaR Optimization Under Demand Uncertainty

区域供热网络中的鲁棒机组组合:需求不确定性下的机会约束与CVaR优化

Annika Buchholz, Janina Zittel, Thorsten Koch

专题命中 规划决策 :planning(abstract)

AI总结 针对区域供热网络热需求不确定性,本文将CC和CVaR优化适配到混合整数机组组合问题,结合贝叶斯模型生成的热需求预测分布,通过真实与合成数据评估了两种鲁棒优化方法的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10829 2026-08-12 physics.flu-dyn 新提交 50%

Deep reinforcement learning for separation control in turbulent wind-tunnel flow

用于湍流风洞流动分离控制的深度强化学习

Sofia Avdiiv, Andre Weiner, Ben Steinfurth

专题命中 规划决策 :agent(abstract)

AI总结 本研究将深度强化学习(DRL)用于单侧扩散器湍流风洞流动的主动分离控制,采用近端策略优化学习,实现了约53%的前向流动分数,优于常规开环控制,是识别鲁棒控制策略的高效工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08787 2026-08-12 eess.AS 版本更新 50%

Beyond Reconstruction: Full-Context Generative DiT for Music Generation

超越重构:用于音乐生成的全上下文生成式DiT

Yunjia Li, Menglin Wu, Junyu Dai, Xinyue Fan, Xiangang Li, Haoxu Wang, Jianwei Yu, Huaicheng Zhang, Han Zhao, Weiqin Li, Yufei Shi, Cheng Wen, Sitong Zhao, Qixi Zheng, Haina Zhu, Wei Li

专题命中 规划决策 :planning(abstract)

AI总结 该研究提出FullDiT模型,通过EMDC和4-CFG等技术解决混合音乐生成器的编解码器接口暴露偏差问题,其系统在多数自动指标上优于商业系统且在人工分析中排名前三。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08151 2026-08-12 eess.SY cs.SY 版本更新 50%

Cislunar Pursuit-Evasion Game on Periodic and Quasi-Periodic Orbits

周期与准周期轨道上的地月系追逐规避博弈

Quentin Rommel, Filippos Fotiadis, Cade Armstrong, Luke Peterson, Ufuk Topcu

专题命中 规划决策 :planning(abstract)

AI总结 研究地月系航天器的防御机动规划难题,将其建模为地月圆型限制性三体问题下的零和微分博弈,提出带约束的离散时间微分动态规划方法与共享时间正则化,验证了相位控制的优势及参考轨道几何的重要性。

Comments Initial submission to JCGD

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13272 2026-08-12 cs.CY 版本更新 50%

Cognitive Commons in the Age of Generative Intelligence: A Heterodox Appraisal of the Knowledge Erosion Hypothesis

认知公地的悲剧:超越人工智能导致的知识崩溃的集体智慧

Maher Kallel, Mohamed El Louadi

专题命中 规划决策 :agentic(abstract)

AI总结 研究Acemoglu等人关于智能代理人工智能致知识崩溃的模型,通过多方面评估提出五点批评,指出其价值在于识别认知公地悲剧这一负面外部性,还概述了努力弹性和知识公地研究议程。

Comments 12 pages, work-in-progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26087 2026-08-12 cs.CV 版本更新 50%

Easy3D-Labels: Supervising Semantic Occupancy Estimation with 3D Pseudo-Labels for Automotive Perception

Easy3D-Labels: 通过3D伪标签监督语义占用估计用于汽车感知

Seamie Hayes, Ganesh Sistu, Tim Brophy, Ciaran Eising

机构 * Department of Electronic and Computer Engineering, University of Limerick(利默里克大学电子与计算机工程系) Data Driven Computer Engineering Research Centre, University of Limerick(利默里克大学数据驱动计算机工程研究中心) SFI CRT Foundations in Data Science, University of Limerick(爱尔兰科学基金会数据科学基础研究中心,利默里克大学)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出Easy3D-Labels,利用Grounded-SAM和Metric3Dv2生成3D伪标签,提升汽车感知中语义占用估计的性能,实现mIoU和RayIoU显著提升。

Comments Accepted at IEEE OJVT

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08101 2026-08-12 q-bio.PE 版本更新 50%

From Stochastic Shocks to Macroscopic Tails: The Moyal Distribution as a Unified Framework for Epidemic Dynamics

从随机冲击到宏观尾部:Moyal分布作为流行病动态的统一框架

Jose de Jesus Bernal-Alvarado, David Delepine, Omar Rafael Ramirez-Guzman

专题命中 规划决策 :planning(abstract)

AI总结 本文提出基于Moyal分布的统一框架,通过微观碰撞过程描述病毒传播,揭示宏观社会摩擦的涌现属性,用于解释极端流行病事件。

Comments 19 pages, 8 figures, published in PHYS A: Statistical Mechanics and its appilcations

Journal ref published in PHYS A: Statistical Mechanics and its appilcations (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 多智能体 21 篇

2505.23399 2026-08-12 cs.AI 版本更新 91%

GAM-Agent: Game-Theoretic and Uncertainty-Aware Collaboration for Complex Visual Reasoning

GAM-Agent:面向复杂视觉推理的博弈论与感知不确定性感知协作框架

Jusheng Zhang, Yijia Fan, Wenjun Lin, Ruiqi Chen, Haoyi Jiang, Wenhao Chai, Jian Wang, Keze Wang

专题命中 多智能体 :agent(title,title_cn);multi-agent(abstract);分类 cs.AI

AI总结 该研究提出GAM-Agent博弈论多智能体框架,通过基础感知智能体与关键验证智能体的非零和博弈及不确定性感知协作,在四个视觉推理基准上显著提升了中小及强规模VLM的性能,为可靠可解释多模态推理提供了新路径。

Comments Accepted at NeurIPS 2025. Code available at https://github.com/jushengzhang/Gam-Agent

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10218 2026-08-12 cs.AI cs.CL 新提交 90%

Mind Viruses: Self-Propagating Ideas in Multi-Agent LLM Systems

思维病毒:多智能体大语言模型系统中的自传播思想

Vassilis Papadopoulos, McNair Shah, Sam Zimmerman, Jack Lindsey

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);AI agent(abstract);分类 cs.AI、cs.CL

AI总结 本研究提出多智能体LLM系统中的思维病毒概念,构建其进化算法模型,发现其传播受宿主模型等因素影响,添加系统警告可免疫,为设计更稳健的多智能体系统提供依据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11033 2026-08-12 cs.MA 新提交 89%

Who Are You Explaining To? A Multi-Agent System for Audience-Aware XAI Narratives

你在向谁解释?面向受众感知的XAI叙事多智能体系统

Francesco Musicco, Danilo Danese, Giuseppe Fasano, Angela Lombardi, Alberto Carlo Maria Mancino, Tommaso Di Noia

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract)

AI总结 针对现有XAI叙事无法适配不同受众的问题,提出XstrAI多智能体框架,结合三类LLM智能体与修正循环,在糖尿病、中风风险预测任务中,其叙事适配性与保真度优于多数基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10175 2026-08-12 cs.MA q-fin.PM 新提交 89%

Beyond Cash Flows: A Multi-Agent AI Framework for Valuing Clinical-Stage, Cross-Border Biotechnology

超越现金流:用于临床阶段跨境生物技术估值的多智能体AI框架

Yuhan Fang

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);agentic(abstract)

AI总结 本文针对临床阶段生物技术估值的现金流假设失效问题,提出多智能体AI框架,其含估值层、跨市场协调层与冲突融合机制,基于作者过往实践确立智能体投资系统设计原则。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10529 2026-08-12 cs.LG cs.AI 新提交 88%

Robust Multi-Agent Bandits with Heavy-Tailed Rewards and Information Asymmetry

具有重尾奖励和信息不对称的鲁棒多智能体多臂老虎机

Daphne Feng, Ricardo Parada, Lily Jiang, Sophia Yi, William Chang

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

AI总结 该研究针对重尾奖励和信息不对称的多智能体多臂老虎机问题,为三种信息不对称场景开发鲁棒分散式算法,通过实验验证了理论结果并阐明相关权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02035 2026-08-12 cs.RO cs.AI cs.IT cs.LG cs.MA math.IT 版本更新 88%

Bandwidth-Efficient Multi-Agent Communication through Information Bottleneck and Vector Quantization

通过信息瓶颈和向量量化实现带宽高效的多智能体通信

Ahmad Farooq, Kamran Iqbal

机构 * Department of Electrical and Computer Engineering, University of Arkansas at Little Rock(电气与计算机工程系,阿肯色大学小岩分校)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.LG

AI总结 本研究通过信息瓶颈与向量量化方法,实现多智能体通信的带宽高效优化,提升协调性能并减少带宽消耗。

Comments Accepted at IEEE ICRA 2026, Vienna, Austria. 8 pages, 4 figures, 4 tables. v2: replaces v1 with the accepted camera-ready version and corrects a typo in the bandwidth reduction (41.4% -> 71.4%) in the abstract, Sec. I, Fig. 2 caption, Sec. VI and Sec. VII. Sec. V-A and Table I (800 vs 2800 bits/episode) were already correct; no results or conclusions changed

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08605 2026-08-12 cs.AI 版本更新 88%

ForestBench: A Unified Graph Framework for Evaluating Multi-Agent Collaboration

ForestBench:用于评估多智能体协作的统一图框架

Guo Chen, Ziwen Li, Reed Li, Yu Lu, Haibo Shi, Bingbing Xu, Junjie Huang

机构 * Southwest University(西南大学) Tencent(腾讯) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 研究针对多智能体系统异构轨迹评估的问题,提出ForestBench框架,将MAS轨迹映射为统一协作图,筛选844个查询并预计算参考图,可快速评估MAS协作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07556 2026-08-12 cs.MA cs.AI 版本更新 88%

MasDrift: Benchmarking Authorization Preservation Across Multi-Agent Architectures

MasDrift:跨多智能体架构的授权保留基准测试

Zhuoning Xu, Xiucheng Zhang, Hanjun Luo, Yingbin Jin, Yinpeng Dong, Hanan Salam

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 MasDrift是含600项任务的多智能体授权保留基准,对比不同架构的任务完成与授权表现,发现集中式架构完成率更高但未授权操作更多,两种防御方法各有优劣,揭示了多智能体设计的集中化权衡。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10646 2026-08-12 cs.MA 新提交 88%

ASCon: A Direction-Aware Reciprocal Agent--Step Contextualization Model for Failure Attribution in Multi-Agent Systems

ASCon:面向多智能体系统故障归因的方向感知互惠智能体-步骤上下文模型

Shuyu Jiang, Yue Ran, Kaiyu Xu, Xingshu Chen, Yi Zhang, Hao Ren, Rui Tang, Tianwei Zhang

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 该研究针对多智能体系统故障归因中不同目标间证据依赖关注不足的问题,提出ASCon模型,通过方向感知图注意力等技术聚合轨迹证据,提升了故障智能体、步骤、模式的检测性能及域外归因能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07126 2026-08-12 cs.RO cs.AI cs.LG 版本更新 87%

RankFormer: A Propose-then-Select Transformer for Multi-Agent Multimodal Trajectory Prediction

自发现意图感知变换器用于多模态车辆轨迹预测

Diyi Liu, Zihan Niu, Tu Xu, Xingchen Zhang, Lishan Sun

专题命中 多智能体 :agent(title,abstract);multi-agent(title);分类 cs.AI、cs.LG

AI总结 本文提出一种基于Transformer的多模态车辆轨迹预测模型,通过分离空间模块和轨迹生成模块提升预测性能,并通过预测残差偏移学习有序轨迹。

Comments 11 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10509 2026-08-12 cs.AI cs.MA 新提交 86%

MAP-Graph: Provenance-Aware Shared Memory for Multi-Agent Workflows

MAP-Graph:面向多智能体工作流的溯源感知共享内存

Yiqi Wang, Zihao Yan, Jiaqi Zhang, Zhangkai Wu, Mingkai Zheng, Zequn Sun, Yanming Zhu, Taotao Cai

专题命中 多智能体 :agent(title,abstract);multi-agent(title);分类 cs.AI

AI总结 MAP-Graph是面向多智能体工作流的溯源感知共享内存层,通过类型化执行图追踪谱系并结合风险敏感门控,在2700个合成任务的基准测试中取得优异性能,可作为操作控制信号保障智能体工作流的安全与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10030 2026-08-12 cs.AI cs.MA 新提交 85%

Automating and Scaling Behavioral Scientific Research on AI Agents

自动化与规模化针对AI智能体的行为科学研究

Soo Yong Lee, Jongha Lee, Jaewan Chun, Hyunjin Hwang, Fanchen Bu, Ziv Ben-Zion, Taekwan Kim, Denny Borsboom, Jaemin Yoo, Kijung Shin

机构 * KAIST(韩国科学技术院) Yale(耶鲁大学) University of Haifa(海法大学) UCL(伦敦大学学院) UvA(阿姆斯特丹大学) SNU(首尔大学)

专题命中 多智能体 :AI agent(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 研究人员开发AEROBAT多智能体系统,自动化AI智能体行为科学研究流程,经实验验证其可生成测试假设、开展大量对照实验与模拟,能补充拓展人工研究。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏