arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-06-02 至 2026-06-02 共收录 432 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 144 篇

2606.01724 2026-06-02 stat.AP cs.NI 50%

Mapping the Storm: Geospatial Impacts of Severe Weather on LEO Network Performance

风暴映射:恶劣天气对低轨卫星网络性能的地理空间影响

Sina Ehsani, Bhanu Pallakonda, Pragyana K. Mishra

专题命中 规划决策 :planning(abstract)

AI总结 本研究利用超过87万终端小时的遥测数据,通过空间连接和时间对齐分析,揭示了雷暴等恶劣天气对Starlink低轨卫星网络性能的显著影响,超过55%的受影响终端出现严重降级,并提出了面向地理空间预测和天气感知网络规划的框架。

Comments 10 pages, 8 figures, presented at the proceedings of the 33rd ACM International Conference on Advances in Geographic Information Systems

Journal ref Proceedings of the 33rd ACM International Conference on Advances in Geographic Information Systems, pp. 163-172. 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01631 2026-06-02 cs.MM 50%

TimeLogic Challenge @ CVPR 2026: Strong MLLMs Meet Evidence-Seeking Agents for Temporal-Logic Video Question Answering

TimeLogic Challenge @ CVPR 2026: 强多模态大语言模型遇见面向时序逻辑视频问答的证据搜索智能体

Zhaoyang Xu, Xusheng He, Wei Liu, Zhenyang Li, Jianlong Wu

专题命中 规划决策 :agent(abstract)

AI总结 提出一种基于证据搜索智能体的无训练时序逻辑视频问答方法,通过多粒度采样工具包和分类引导策略,在TimeLogic测试集上达到77.13 AvgAcc。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01572 2026-06-02 eess.IV cs.CV 50%

PINNOCHIO: Physics-Informed Neural Network for Coupled Hyperelastic Interface-Volume Simulation in Orthognathic Surgery

PINNOCHIO: 用于正颌手术中耦合超弹性界面-体积模拟的物理信息神经网络

Jungwook Lee, Daeseung Kim, Kevin Gu, Zhangfeng Hu, Tianshu Kuang, Finn Hopeman, Michael A. K. Liebschner, Jaime Gateno, Pingkun Yan

机构 * Department of Biomedical Engineering and Center for Biotechnology and Interdisciplinary Studies, Rensselaer Polytechnic Institute(生物医学工程系和生物技术与跨学科研究中心,伦塞拉尔理工学院) Department of Oral and Maxillofacial Surgery, Houston Methodist Research Institute(口腔颌面外科系,休斯顿方法主义研究学院) Department of Neurosurgery, Baylor College of Medicine(神经外科系,贝勒医学院)

专题命中 规划决策 :planning(abstract)

AI总结 提出PINNOCHIO框架,通过混合顺序分解解耦不连续骨-软组织界面运动与连续体积超弹性变形,实现稳定训练和物理启发的模拟到真实适应策略,在40名患者队列中优于现有基线,解决了精度-效率权衡问题。

Comments This work has been submitted to MICCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01545 2026-06-02 cs.RO 50%

Hierarchical Object Representation for Spatial Robot Perception: Points, Meshes, and Superquadrics

用于空间机器人感知的层次化物体表示:点云、网格和超二次曲面

Ceng Zhang, Wan Su, Mohamed Samshad, Gregory S. Chirikjian, Rajat Talak

机构 * National University of Singapore (NUS)(新加坡国立大学) Mohamed bin Zayed University of Artificial Intelligence (MBZUAI)(穆罕默德·本·扎耶德人工智能大学)

专题命中 规划决策 :planning(abstract)

AI总结 提出一种层次化物体表示方法,从原始传感器数据逐步抽象为稠密网格和超二次曲面,用于高保真重建、鲁棒重定位和高效碰撞检测,并在室内外场景中验证其有效性。

Comments 18 pages, 5 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01367 2026-06-02 cs.RO cs.CV 50%

ActMVS: Active Scene Reconstruction with Monocular Multi-View Stereo

ActMVS:基于单目多视图立体的主动场景重建

Guo Pu, Yixuan Han, Zhouhui Lian

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学王轩计算机技术研究所)

专题命中 规划决策 :planning(abstract)

AI总结 提出ActMVS框架,通过视图因子图构建和全局深度优化,实现单目相机在线生成高质量、全局一致的密集深度图,支持机器人/UAV的主动场景重建与安全轨迹规划。

Comments ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01181 2026-06-02 eess.SP 50%

IO Pad Integrity in Energy-Efficient Neuromorphic Chips

节能神经形态芯片中的IO焊盘完整性

Arfan Ghani

专题命中 规划决策 :planning(abstract)

AI总结 本文探讨了I/O焊盘完整性对神经形态VLSI设计的影响,结合脉冲神经网络与数字硬件设计流程,强调早期I/O规划对提升系统能效和可靠性的关键作用。

Comments 30 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00941 2026-06-02 eess.SY cs.SY 50%

Power Grid Infrastructure for AI Data Centers

人工智能数据中心的电网基础设施

Amir Sajadi, Muhy Eddin Za'ter, Maria Vabson, Kyri Baker, Bri-Mathias Hodge

专题命中 规划决策 :planning(abstract)

AI总结 本文探讨了人工智能发展推动大型数据中心建设对电网规划与运行的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00669 2026-06-02 cs.CR 50%

NeuroLog: Reasoning You Can Audit -- Neuro-Symbolic Vulnerability Discovery via LLM Facts, Datalog, and SMT

NeuroLog: 可审计的推理——通过LLM事实、Datalog和SMT进行神经符号漏洞发现

Sanjay Rawat

专题命中 规划决策 :agent(abstract)

AI总结 提出NeuroLog流水线,结合LLM提取事实、Souffle规则组合和Z3后处理,实现无需构建的漏洞发现,并在多个真实项目中重新发现CVE级漏洞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00499 2026-06-02 cs.CV 50%

OptiWorld: Optimal Control for Video World Generation under Physical Constraints

OptiWorld: 物理约束下的视频世界生成最优控制

Yu Yuan, Jianhao Yuan, Xijun Wang, Daiqing Li, Liu He, Lu Ling, Stanley H. Chan

机构 * Purdue University(普渡大学) University of Oxford(牛津大学) SixteenMiles Labs(SixteenMiles 实验室)

专题命中 规划决策 :planning(abstract)

AI总结 提出OptiWorld框架,在推理时结合经典最优控制与视频生成,通过提取紧凑世界状态、规划最优轨迹并生成条件视频,实现符合物理约束的动态优化。

Comments Porject Page: https://yuyuanspace.com/OptiWorld/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00457 2026-06-02 cs.PF 50%

Maximizing Compute Capacity in AI Data Centers through Cooling, Energy Storage, and Computing Adaptation

通过冷却、储能和计算适配最大化AI数据中心计算容量

Shaolei Ren, Mohammad A. Islam, Adam Wierman

专题命中 规划决策 :planning(abstract)

AI总结 本文提出ComputeAmp框架,通过联合动态利用冷却、电池储能和计算适配,在有限站点功率预算下最大化计算容量,并讨论其机会、限制及算法挑战。

Comments 11 pages. A preliminary shorter version of this paper is published and presented as a poster at ACM e-Energy 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00449 2026-06-02 cs.RO 50%

ROG-Grasp: Root-Oriented Geometry for Robotic Grasping and Placement

ROG-Grasp:面向根部的几何方法用于机器人抓取与放置

Zijian An, Augustus Sroka, Ran Yang, Bill Cai, Satoru Eto, Brian Poon, Kelvin Cai, Shijie Geng, Feng Liu, Yiming Feng, Lifeng Zhou

机构 * Department of Electrical and Computer Engineering, Drexel University(德雷塞尔大学电气与计算机工程系) Virginia Seafood Agricultural Research and Extension Center, and Department of Biological Systems Engineering, Virginia Tech(弗吉尼亚理工学院生物系统工程系和弗吉尼亚海鲜农业研究与推广中心) Amazon Store Foundation AI (SFAI)(亚马逊商店基金会人工智能(SFAI))

专题命中 规划决策 :planning(abstract)

AI总结 提出基于根部表面几何的ROG-Grasp框架,通过RGB-D感知估计农产品朝向,结合YOLO检测器和点云平面拟合生成稳定抓取姿态,在番茄和洋葱实验中实现高成功率与快速执行。

Comments Comments: 7 pages, 6 figures. Video: https://youtu.be/Ir2UtGODdMo

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00359 2026-06-02 cs.CY 50%

Next-Billion AI Index: The compass for AI utility and adoption in the global majority

Next-Billion AI Index: 面向全球大多数人口的AI实用性与采用指南针

Ambrish Rawat, Jessica He, Subhabrata Majumdar, Claudio Pinhanez, Yann Le Beux, Satyapriya Krishna, Rahul Gupta, Rumman Chowdhury, Kush R. Varshney

专题命中 规划决策 :workflow(abstract)

AI总结 本文提出Next Billion AI Index (nexbax)诊断框架,通过经济可行性、运营可部署性和治理对齐三个主题下的10个维度,评估AI在下一个十亿用户环境中的实用性,并通过专家访谈验证其有效性。

Comments 13 pages, 1 figure, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00297 2026-06-02 eess.SY cs.RO cs.SY 50%

Predicted-Flow Control Barrier Functions for Real-Time Safe Optimal Control

预测流控制障碍函数用于实时安全最优控制

Amirsaeid Safari, Jesse B. Hoagg

机构 * Department of Mechanical and Aerospace Engineering, University of Kentucky(机械与航空航天工程系,肯塔基大学)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出预测流控制障碍函数(P-CBF),通过将CBF推广为预测流的泛函,结合终端候选和规划时间偏移,实现有限预测时域内的安全证书,并统一了有限时域积分成本优化与安全认证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00032 2026-06-02 cs.CY 50%

Metaverse in Smart Cities: Transforming Urban Life and Governance

智慧城市中的元宇宙:改变城市生活与治理

Ioanna Chatzopoulou, Paraskevi Tsoutsa, Panos Fitsilis

专题命中 规划决策 :planning(abstract)

AI总结 通过系统文献综述,研究元宇宙驱动的解决方案如何影响城市经济转型、治理、交通、可持续性和社会互动,并基于案例提出整合框架。

Comments 42 pages

Journal ref Metaverse. Metaverse, 6(4): 3744, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27590 2026-06-02 cs.CV cs.MM 50%

ForestHG-Trace: Traceable Long-Horizon Ecological Reasoning over Large-Scale Forest Scenes

ForestHG-Trace: 大规模森林场景下的可追踪长程生态推理

Zihang Cheng, Duanchu Wang, Cheng Li, Jing Huang, Huanzhao Fu, Di Wang

专题命中 规划决策 :agent(abstract)

AI总结 提出ForestHG-Trace框架,通过生态超图表示和LLM引导的确定性工具链,实现森林场景中可追踪的多步生态推理,并构建ForestTraceQA基准,显著提升长程生态问答的准确性和执行忠实度。

Comments It has theoretical flaws and experimental errors

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25195 2026-06-02 cs.CV 50%

Baton: Explicit Semantic Blueprints for Joint Video-Audio Generation

Baton: 用于联合视频-音频生成的显式语义蓝图

Shuyuan Tu, Qi Tian, Zihan Yang, Yue Wu, Xintong Han, Weijie Kong, Jiangfeng Xiong, Jian-Wei Zhang, Zhao Zhong, Liefeng Bo, Zuxuan Wu, Yu-Gang Jiang

机构 * Fudan University(复旦大学) Tencent Hunyuan(腾讯幻元)

专题命中 规划决策 :planning(abstract)

AI总结 提出Baton框架,通过VA-Planner生成语义对齐的模态感知规划令牌作为蓝图,注入扩散骨干以协调视频和音频去噪,解决现有方法因缺乏共享长期规划导致的跨模态对齐脆弱问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24881 2026-06-02 cs.RO 50%

Learning Transferable Motor Skills for Geometry-Aware Robotic Surface Tasks

面向几何感知的机器人表面任务的可迁移运动技能学习

Miroslav David, Karla Stepanova, Robert Babuska

机构 * Czech Institute of Informatics, Robotics, and Cybernetics(捷克信息学、机器人学与自动化研究所) Czech Technical University in Prague(布拉格捷克技术大学) Delft University of Technology(代尔夫特理工大学)

专题命中 规划决策 :planning(abstract)

AI总结 提出一种模块化框架,将几何运动规划与执行级专家行为解耦,通过可解释的原子运动规则和神经网络推断,实现跨几何形状的迁移学习。

Comments In: Workshop on Geometry in the Age of Data-Driven Robotics, ICRA 2026, Vienna, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
1802.04595 2026-06-02 econ.TH 50%

Measuring Information Burden: From Coalition-Based Reasoning to the Price System

衡量信息负担:从基于联盟的推理到价格体系

Shuige Liu

专题命中 规划决策 :agent(abstract)

AI总结 本文通过形式化框架衡量价格体系节省的信息量,证明在可转移效用博弈中,核心与一致同意等价所需的最小信息结构是每个联盟至少被其一个成员所知,且平均每代理信息负担随经济规模指数增长。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20823 2026-06-02 cs.CV 50%

RelWitness: Open-Vocabulary 3D Scene Graph Generation with Visual-Geometric Relation Witnesses

RelWitness: 基于视觉-几何关系见证者的开放词汇3D场景图生成

Minh Anh Nguyen, Quang Huy Tran, Bao Ngoc Le, Tuan Kiet Pham, Sui Yang Guang

机构 * Phenikaa University(费恩基亚大学)

专题命中 规划决策 :planning(abstract)

AI总结 提出RelWitness框架,通过视觉-几何关系见证者从不完整关系监督中生成开放词汇3D场景图,解决关系标注稀疏和词汇扩展问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14709 2026-06-02 cs.CV 50%

Breaking Dual Bottlenecks: Evolving Unified Multimodal Models into Self-Adaptive Interleaved Visual Reasoners

打破双重瓶颈:将统一多模态模型演化为自适应交错视觉推理器

Qingyang Liu, Bingjie Gao, Canmiao Fu, Zhipeng Huang, Chen Li, Feng Wang, Shuochen Chang, Shaobo Wang, Yali Wang, Keming Ye, Jiangtong Li, Li Niu

机构 * Tsinghua University(清华大学)

专题命中 规划决策 :planning(abstract)

AI总结 针对统一多模态模型在理解与生成之间的鸿沟导致的注意力纠缠和视觉细化瓶颈,提出一种自适应切换生成策略的框架,通过分层数据流水线和两阶段训练(SFT+RL)提升X2I任务性能。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19539 2026-06-02 physics.geo-ph 50%

Efficient Generation and Quality Screening of Visible Windows for Regional SAR Reconnaissance

区域SAR侦察中可见窗口的高效生成与质量筛选

Linhong Li, Qi Feng, Kebo Li, Yangang Liang

专题命中 规划决策 :planning(abstract)

AI总结 针对区域合成孔径雷达侦察,提出一种三阶段可见窗口生成与基于信号质量筛选的框架,通过粗角度带通、平面特征曲线包含测试和一维边界二分法高效生成几何可行窗口,并结合点目标仿真评估成像质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09529 2026-06-02 cs.CV 50%

RESBev: Making BEV Perception More Robust

RESBev:使BEV感知更加鲁棒

Lifeng Zhuo, Kefan Jin, Zhe Liu, Hesheng Wang

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 规划决策 :planning(abstract)

AI总结 提出RESBev,一种即插即用的鲁棒BEV感知方法,通过构建潜在世界模型学习时空相关性来预测干净BEV特征,从而在无需修改骨干网络的情况下增强对自然扰动和对抗攻击的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09292 2026-06-02 cs.RO cs.CV 50%

See, Plan, Rewind: Progress-Aware Vision-Language-Action Models for Robust Robotic Manipulation

看、规划、回退:面向鲁棒机器人操作的进度感知视觉-语言-动作模型

Tingjun Dai, Mingfei Han, Tingwen Du, Zhiheng Liu, Zihao Zhang, Zhihui Li, Salman Khan, Jun Yu, Xiaojun Chang

机构 * School of Information Science and Technology, University of Science and Technology of China(信息科学与技术学院,中国科学技术大学) University of Technology Sydney(新南威尔士大学) Department of Computer Vision, Mohamed Bin Zayed University of Artificial Intelligence(人工智能与计算机视觉系,Mohamed Bin Zayed人工智能大学) The University of Hong Kong(香港大学) Institute of AI for Industry, Chinese Academy of Sciences(产业人工智能研究所,中国科学院) School of Intelligent Science and Engineering, Harbin Institute of Technology (Shenzhen)(智能科学与工程学院,哈尔滨工业大学(深圳))

专题命中 规划决策 :planning(abstract)

AI总结 提出进度感知的视觉-语言-动作框架SPR,通过动态将语言指令映射为空间子目标序列,并利用闭环进度监控实现错误恢复,在LIBERO基准上提升5%性能,在LIBERO-Plus上展现最先进的鲁棒性。

Comments Suggested to CVPR Findings. https://tingjundai.github.io/SPRVLA/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00470 2026-06-02 cs.RO 50%

LAP: Fast LAtent Diffusion Planner for Autonomous Driving

LAP:面向自动驾驶的快速潜在扩散规划器

Jinhao Zhang, Wenlong Xia, Zhexuan Zhou, Haoming Song, Youmin Gong, Jie Mei

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 规划决策 :planning(abstract)

AI总结 提出LAP框架,在VAE学习的潜在空间中进行规划,通过单步去噪实现高质量规划,在nuPlan基准上达到学习型规划方法的最优闭环性能,推理速度提升高达10倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04192 2026-06-02 quant-ph 50%

AML-QKD: Adaptive Machine Learning Framework for Real-time Parameter Tuning in QKD

AML-QKD:用于QKD实时参数调优的自适应机器学习框架

Noureldin Mohamed, Jawaher Kaldari, Saif Al-Kuwari

专题命中 规划决策 :agent(abstract)

AI总结 提出AML-QKD框架,集成时间卷积网络和近端策略优化智能体,在BB84、E91和COW协议中实时调优参数以最大化安全密钥率并最小化量子比特错误率,仿真显示中位SKR提升14-25%,QBER从3.0%降至1.5%,并探索了量子强化学习在纠缠协议中的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22965 2026-06-02 cs.RO 50%

Self-Imitated Diffusion Policy for Efficient and Robust Visual Navigation

自模仿扩散策略用于高效鲁棒的视觉导航

Runhua Zhang, Junyi Hou, Changxu Cheng, Qiyi Chen, Tao Wang, Wuyue Zhao

机构 * Uni-Ubi Technology Co., Ltd.(Uni-Ubi技术有限公司) College of Control Science and Engineering, Zhejiang University(浙江大学控制科学与工程学院)

专题命中 规划决策 :planning(abstract)

AI总结 提出自模仿扩散策略(SIDP),通过奖励引导的自模仿机制和课程学习范式,减少对大量采样和后过滤的依赖,实现高效鲁棒的视觉导航。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17502 2026-06-02 cs.RO 50%

RynnVLA-002: A Unified Vision-Language-Action and World Model

RynnVLA-002: 统一的视觉-语言-动作与世界模型

Jun Cen, Siteng Huang, Yuqian Yuan, Kehan Li, Hangjie Yuan, Chaohui Yu, Bohan Hou, Yuming Jiang, Jiayan Guo, Xin Li, Hao Luo, Fan Wang, Deli Zhao, Hao Chen

机构 * DAMO Academy, Alibaba Group(达摩院,阿里巴巴集团) Hupan Lab(虎扑实验室) Zhejiang University(浙江大学)

专题命中 规划决策 :planning(abstract)

AI总结 提出统一视觉-语言-动作(VLA)与世界模型的框架RynnVLA-002,通过联合学习环境动态和动作规划,在仿真和真实机器人任务中显著提升成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15762 2026-06-02 stat.AP 50%

Incorporating estimands into meta-analyses of clinical trials

将估计目标纳入临床试验的荟萃分析

Antonio Remiro-Azócar, Pepa Polavieja, Emmanuelle Boutmy, Alessandro Ghiretti, Lise Lotte Nystrup Husemoen, Khadija Rerhou Rantell, Tatsiana Vaitsiakhovich, David M. Phillippo, Jay J. H. Park, Helle Lynggaard, Robert Bauer, Antonia Morga

专题命中 规划决策 :planning(abstract)

AI总结 提出一个实用框架,通过将估计目标纳入临床试验荟萃分析,系统识别和减轻定量异质性来源,提高汇总估计的适用性和外部有效性。

Comments 28 pages, 6 figures, 6 tables. Version accepted for publication by Research Synthesis Methods following minor revisions

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04074 2026-06-02 cs.RO 50%

Feedback Matters: Augmenting Autonomous Dissection with Visual and Topological Feedback

反馈至关重要:利用视觉和拓扑反馈增强自主解剖

Chung-Pang Wang, Changwei Chen, Xiao Liang, Soofiyan Atar, Florian Richter, Michael Yip

机构 * Department of Electrical and Computer Engineering, University of California San Diego(加州大学圣迭戈分校电气与计算机工程系)

专题命中 规划决策 :planning(abstract)

AI总结 提出一种反馈驱动的自主组织解剖框架,通过内窥镜图像推理拓扑变化、量化可见性并主动操控组织,结合规划与学习方法,显著提升手术自主性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07602 2026-06-02 stat.ME 50%

Adaptive clinical trial design with delayed treatment effects using elicited prior distributions

利用先验分布处理延迟治疗效应的自适应临床试验设计

James Salsbury, Jeremy Oakley, Steven Julious, Lisa Hampson

专题命中 规划决策 :planning(abstract)

AI总结 针对免疫肿瘤学等现代疗法中常见的延迟治疗效应,提出一种结合专家先验分布的自适应试验设计框架,通过中期分析指导早期停止决策,提高试验效率和稳健性。

详情

展开后加载摘要…

URL PDF HTML 收藏