arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 3072 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 946 篇

2511.12853 2026-07-07 eess.IV cs.CV 版本更新 50%

BrainNormalizer: Anatomy-Informed Pseudo-Healthy Brain Reconstruction from Tumor MRI via Edge-Guided ControlNet

BrainNormalizer:通过边缘引导控制网络从肿瘤MRI进行解剖学信息伪健康脑重建

Min Gu Kwak, Yeonju Lee, Hairong Wang, Kristin R. Swanson, Jing Li

机构 * University of Pittsburgh(匹兹堡大学) Georgia Institute of Technology(佐治亚理工学院) University of Texas at Austin(德克萨斯大学奥斯汀分校) Cedars-Sinai Medical Center(西德萨斯医疗中心) Mayo Clinic Arizona(梅奥诊所亚利桑那分部)

专题命中 规划决策 :planning(abstract)

AI总结 针对脑肿瘤致结构变形难区分肿瘤与解剖变异问题,提出BrainNormalizer框架,用两阶段训练学习解剖先验等,通过特定策略实现伪健康脑重建,实验表明其有优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02973 2026-07-07 econ.GN q-fin.EC 版本更新 50%

Earthquakes, floods, and fiscal resilience: Evidence from Croatia and Slovenia

地震、洪水与财政韧性:来自克罗地亚和斯洛文尼亚的证据

Luka Draganić, Leonarda Srdelić, Marwil J. Davila-Fernandez

专题命中 规划决策 :planning(abstract)

AI总结 研究克罗地亚和斯洛文尼亚严重自然灾害对公共债务可持续性的影响,用IMF工具,对比不同灾害配置下债务预测,还进行稳健性检验,强调灾前应构建财政韧性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13385 2026-07-07 cs.CY 版本更新 50%

pySpainMobility: Unlocking Spanish Open Mobility Data for Spatial Inequality Research

pySpainMobility:解锁用于空间不平等研究的西班牙开放出行数据

Ciro Beneduce, Tania Gullón Muñoz-Repiso, Bruno Lepri, Massimiliano Luca

专题命中 规划决策 :planning(abstract)

AI总结 研究利用pySpainMobility包自动化处理西班牙开放出行数据,通过该包构建特定收入的出行层,揭示了西班牙省际网络中收入分层的出行不平等及相关特征,展现出行数据结合工具可揭示空间不平等。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11907 2026-07-07 cs.RO 版本更新 50%

A Graph-Based Reinforcement Learning Approach with Frontier Potential Based Reward for Safe Cluttered Environment Exploration

一种基于前沿势奖励的基于图的强化学习方法用于安全杂乱环境探索

Gabriele Calzolari, Vidya Sumathy, Christoforos Kanellakis, George Nikolakopoulos

机构 * Department of Computer Science, Electrical and Space Engineering, Luleå University of Technology(计算机科学、电气与航天工程系,吕勒奥技术大学)

专题命中 规划决策 :agent(abstract)

AI总结 提出结合图神经网络探索贪心策略与安全护盾的方法,用近端策略优化算法训练网络,最大化探索效率并减少护盾干预,还提出奖励函数,能在杂乱环境高效安全探索。

Comments 6 pages, 4 figures, accepted at the 24th European Control Conference (ECC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13096 2026-07-03 math.GM 版本更新 50%

Complexity scaling and optimal policy degeneracy in quantum reinforcement learning via analytically solvable unitary-control-then-measure models

量子强化学习中复杂度缩放与最优策略退化研究:通过可解析的幺正控制后再测量模型

Andrea Cintio, Alessandro Michelangeli, Dmitrii Tsutskov

专题命中 规划决策 :agent(abstract)

AI总结 本文提出并分析了可解析的量子强化学习模型,通过幺正控制后再测量协议,研究了复杂度从指数级到幂律级的缩减及最优策略退化现象。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02444 2026-07-03 cs.DB 版本更新 50%

From Textual Columns to Query Plans: A Unified Relational-Semantic Execution Framework for Hybrid Query Processing

OmniTQA:一种面向半结构化数据的混合查询处理成本感知系统

Nima Shahbazi, Seiji Maekawa, Nikita Bhutani, Estevam Hruschka

专题命中 规划决策 :planning(abstract)

AI总结 OmniTQA通过整合LLM语义操作与传统关系运算符,提出了一种成本感知的混合查询处理框架,有效处理结构化与半结构化数据,提升复杂查询和大规模表的准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22032 2026-07-03 cs.CV 版本更新 50%

Drive-JEPA: Video JEPA Meets Multimodal Trajectory Distillation for End-to-End Driving

Drive-JEPA:视频JEPA结合多模态轨迹蒸馏实现端到端驾驶

Linhan Wang, Zichong Yang, Chen Bai, Guoxiang Zhang, Xiaotong Liu, Xiaoyin Zheng, Xiao-Xiao Long, Chang-Tien Lu, Cheng Lu

机构 * Virginia Tech(弗吉尼亚理工学院) Purdue University(普渡大学) XPENG Motors(小鹏汽车) Nanjing University(南京大学)

专题命中 规划决策 :planning(abstract)

AI总结 提出Drive-JEPA框架,结合视频联合嵌入预测架构(V-JEPA)与多模态轨迹蒸馏,通过自监督视频预训练和动量感知选择机制提升端到端驾驶的规划性能,在NAVSIM上达到新最优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12535 2026-07-02 cs.CR 版本更新 50%

Ghost in the Context: Policy-Carriage Integrity in LLM Agents

上下文中的幽灵:在决策时间装配中的政策承载失败测量

Igor Santos-Grueiro

专题命中 规划决策 :agent(abstract)

AI总结 本文研究了在决策时间装配过程中由于状态丢失、削弱或反弹导致的政策边界跨越问题,提出SafeContext控制层以缓解风险,并展示了其在不同模型上的效果。

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22055 2026-07-02 cs.GR cs.RO 版本更新 50%

MineRobot: An Actuator-Centered Kinematic Modeling and Solving Framework for Underground Mining Robots

MineRobot: 一种用于虚拟环境中地下采矿机器人运动学建模与求解的统一框架

Shengzhe Hou, Xinming Lu, Tianyu Zhang, Changqing Yan, Xingli Zhang

机构 * College of Computer Science and Engineering, Shandong University of Science and Technology(山东科技大学计算机科学与工程学院) Shandong Lionking Software Co., Ltd.(山东狮王软件有限公司) College of Intelligent Equipment, Shandong University of Science and Technology(山东科技大学智能装备学院)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出MineRobot框架,通过MRDF格式和拓扑处理流程,解决地下采矿机器人闭环运动学建模与实时求解问题,采用独立拓扑等价路径实现正逆运动学高效计算。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02114 2026-07-02 physics.soc-ph 版本更新 50%

AI-Driven Stabilization in Power Grids through Controlling Line Admittances

通过控制线路导纳实现电网的AI驱动稳定

Sangjoon Park, Hoyun Choi, Yongsun Lee, Seungchan Jo, Jürgen Kurths, B. Kahng

专题命中 规划决策 :planning(abstract)

AI总结 提出自适应导纳控制器(AAC)算法,通过实时调整导纳调节器位置稳定电网,在真实英国电网上显著降低频率偏差并快速恢复运行,同时降低系统复杂性和成本。

Comments 13 pages, 10 figures

Journal ref Chaos, Solitons & Fractals 210, Part 2, 118672 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30608 2026-07-01 cs.CV 版本更新 50%

UnfoldArt: Zero-Shot Recovery of Full Articulated 3D Objects from Text or Image

UnfoldArt: 从文本或图像零样本恢复完整关节式3D物体

Mohamed el Amine Boudjoghra, Ivan Laptev, Angela Dai

机构 * Technical University of Munich(慕尼黑工业大学) Mohamed Bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 规划决策 :agentic(abstract)

AI总结 提出首个辩论驱动代理方法,结合视觉语言模型和视频生成先验,从文本或图像零样本重建关节式3D物体的结构、运动与隐藏几何。

Comments Project page: https://aminebdj.github.io/unfoldart

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.02347 2026-07-01 cs.RO 版本更新 50%

ShapeGrasp: Simultaneous Visuo-Haptic Shape Completion and Grasping for Improved Robot Manipulation

ShapeGrasp: 同时进行视觉-触觉形状补全与抓取以改进机器人操作

Lukas Rustler, Matej Hoffmann

机构 * Czech Technical University in Prague(捷克布拉格技术大学)

专题命中 规划决策 :planning(abstract)

AI总结 提出ShapeGrasp迭代抓取与补全流程,结合隐式表面视觉-触觉形状补全与基于物理的抓取规划,从单RGB-D视图推断完整形状并生成候选抓取,利用抓取反馈更新形状,在真实机器人上实现高抓取成功率并改善3D形状重建质量。

Comments Submitted for peer review

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06887 2026-07-01 cs.RO 版本更新 50%

VertiAdaptor: Online Kinodynamics Adaptation for Vertically Challenging Terrain

VertiAdaptor: 针对垂直挑战地形的在线运动学动力学自适应

Tong Xu, Chenhui Pan, Aniket Datar, Xuesu Xiao

机构 * George Mason University(乔治梅森大学)

专题命中 规划决策 :planning(abstract)

AI总结 提出VertiAdaptor在线自适应框架,通过函数编码器融合高程与语义嵌入,实现地形感知的运动学动力学建模与规划,在仿真和实物平台上预测精度提升23.9%,自适应速度提高5倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15614 2026-07-01 cs.RO 版本更新 50%

AION: Aerial Indoor Object-Goal Navigation Using Dual-Policy Reinforcement Learning

AION: 基于双策略强化学习的空中室内目标导航

Zichen Yan, Yuchen Hou, Shenao Wang, Yichao Gao, Rui Huang, Lin Zhao

机构 * Department of Electrical and Computer Engineering, National University of Singapore(新加坡国立大学电子与计算机工程系)

专题命中 规划决策 :agent(abstract)

AI总结 提出AION,一种端到端双策略强化学习框架,解耦探索与目标到达行为,用于视觉空中目标导航,无需外部定位或全局地图,在AI2-THOR和IsaacSim中验证了优越性能。

Comments Accepted to IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14024 2026-07-01 quant-ph math.OC 版本更新 50%

Performance enhancing of hybrid quantum-classical Benders approach for MILP optimization

混合量子-经典Benders方法用于MILP优化的性能提升

Sergio López-Baños, Elisabeth Lobe, Ontje Lünsdorf, Oriol Raventós

专题命中 规划决策 :planning(abstract)

AI总结 提出一种硬件无关的Benders分解算法,通过量子退火器求解主问题、经典计算机求解子问题,并引入嵌入优化、保守割约束处理和启发式停止准则,在传输网络扩展规划问题上相比经典方法实现性能提升。

Comments 22 pages, 11 figures. Code available at https://gitlab.com/dlr-ve/esy/quacla

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18521 2026-07-01 cs.CV 版本更新 50%

Improved Immiscible Diffusion: Accelerate Diffusion Training by Reducing Its Miscibility

改进的不可混扩散:通过降低可混性加速扩散训练

Yiheng Li, Feng Liang, Dan Kondratyuk, Masayoshi Tomizuka, Kurt Keutzer, Chenfeng Xu

机构 * UC Berkeley(加州大学伯克利分校) UT Austin(德克萨斯大学奥斯汀分校)

专题命中 规划决策 :planning(abstract)

AI总结 提出通过降低任意层级的可混性来加速扩散模型训练,实现多种实现方式(如KNN噪声选择和图像缩放),在多种任务上获得高达4倍以上的训练加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21581 2026-06-26 cs.RO cs.CV 版本更新 50%

CogAD: Cognitive-Hierarchy Guided End-to-End Autonomous Driving

CogAD: 认知层次引导的端到端自动驾驶

Zhennan Wang, Jianing Teng, Canqun Xiang, Kangliang Chen, Xing Pan, Lu Deng, Weihao Gu

机构 * HAOMO.AI Technology Co., Ltd(HAOMO.AI技术有限公司)

专题命中 规划决策 :planning(abstract)

AI总结 提出CogAD模型,通过全局到局部的层次感知和意图条件多模态轨迹生成,模拟人类驾驶员的认知层次机制,在nuScenes和Bench2Drive上实现端到端规划的最优性能,尤其在长尾场景和复杂真实驾驶条件下表现优异。

Comments CVPR2026 Workshop on Autonomous Driving

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07414 2026-06-26 eess.SY cs.SY 版本更新 50%

Cost-Effective Design of Grid-tied Community Microgrid

并网社区微电网的成本效益设计

Moslem Uddin, Huadong Mo, Daoyi Dong

专题命中 规划决策 :planning(abstract)

AI总结 提出结合多目标优化与偏好深度强化学习的框架,平衡经济性、可靠性、效率和环境影响,设计出满足100%负荷、效率91.99%、碳排放降低95%、LCOE为0.208美元/kWh的微电网配置。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00287 2026-06-25 eess.SY cs.SY 版本更新 50%

From Net Load Modifiers to Firm Capacity: The Role of Distributed Energy Resources in Resource Adequacy

从净负荷调节器到可靠容量:分布式能源在资源充足性中的作用

Yujia Li, Alexandre Moreira, Miguel Heleno

专题命中 规划决策 :planning(abstract)

AI总结 本文综述了分布式能源(如屋顶光伏、电池、需求响应和电动汽车)在资源充足性框架中的容量认定路径,分析了加州、PJM等地区的规则耦合问题,并提出协调改革建议。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09036 2026-06-25 cs.RO 版本更新 50%

RoDyn: Taming Interactive Robot-Dynamic 2.5D World Model for Robotic Manipulation

RoDyn: 驯服交互式机器人动态2.5D世界模型用于机器人操作

Chuanrui Zhang, Zhengxian Wu, Guanxing Lu, Yansong Tang, Ziwei Wang

机构 * Nanyang Technological University, Singapore(南洋理工大学,新加坡) Tsinghua University, Beijing, China(清华大学,北京,中国)

专题命中 规划决策 :agent(abstract)

AI总结 提出RoDyn,一种几何感知的2.5D世界模型,通过机器人动态分词器和掩码引导自回归架构,在高效潜在空间中建模环境动态,提升生成保真度并显著改善下游强化学习和模仿学习性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05896 2026-06-24 cs.CV 版本更新 50%

Resonant Minds: Closed-Loop Social Avatars with Theory of Mind

共鸣心智:具备心智理论的闭环社交虚拟人

Jianxu Shangguan, Jing Xu, Hang Ye, Xiaoxuan Ma, Yizhou Wang, Jenq-Neng Hwang, Wentao Zhu

机构 * University of Washington(华盛顿大学) Peking University(北京大学) Carnegie Mellon University(卡内基梅隆大学) Eastern Institute of Technology, Ningbo(宁波工程技术学院)

专题命中 规划决策 :agent(abstract)

AI总结 提出一个闭环双智能体框架,通过整合感知、社会推理(基于心智理论)和多模态生成,实现具备社交智能的虚拟人,并在信息不对称数据集上取得优于全信息脚本模式的对话质量。

Comments Project page: https://resonantminds.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00588 2026-06-24 cs.CV 版本更新 50%

Response-Aware Multimodal Learning for Post-Treatment Visual Acuity Forecasting

响应感知的多模态学习用于治疗后视力预测

Phuoc-Nguyen Bui, Van-Vi Vo, Duc-Tai Le, Junghyun Bum, Van-Nguyen Pham, Ki-Young Kim, Seung-Young Yu, Hyunseung Choo

机构 * Research Convergence Institute(研究融合研究所) Sungkyunkwan University(全北大学) Dept. of AI Systems Engineering(人工智能系统工程系) Dept. of Ophthalmology(眼科系) Kyung Hee University Medical Center(庆熙大学医学院) Dept. of Electrical and Computer Engineering(电气与计算机工程系)

专题命中 规划决策 :planning(abstract)

AI总结 提出ReVA框架,利用基线与第1个月OCT影像及表格数据,通过多模态融合预测糖尿病性黄斑水肿患者抗VEGF治疗后3-24个月的视力轨迹。

Comments To appear in MICCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24731 2026-06-24 cs.CV 版本更新 50%

EchoFoley: Event-Centric Hierarchical Control for Video Grounded Creative Sound Generation

EchoFoley: 面向视频接地创意声音生成的事件中心层次化控制

Bingxuan Li, Yiming Cui, Yicheng He, Yiwei Wang, Shu Zhang, Longyin Wen, Yulei Niu

机构 * ByteDance Intelligent Creation(字节跳动智能创作) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of California, Merced(加州大学默塞德分校) University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 规划决策 :agentic(abstract)

AI总结 提出EchoFoley任务,通过事件级局部控制和层次化语义控制实现视频接地声音生成,构建EchoFoley-6k基准并设计EchoVidia框架,在可控性和感知质量上分别提升40.7%和12.5%。

Comments CVPR-2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.23480 2026-06-24 math.OC 版本更新 50%

A graph-based heuristic for the non-stationary stochastic lot-sizing problem under penalty costs

基于图的启发式算法求解带惩罚成本的非平稳随机批量问题

Xiyuan Ma, Roberto Rossi, Thomas Welsh Archibald

专题命中 规划决策 :planning(abstract)

AI总结 提出一种基于有向无环图的最短路径算法,通过松弛非负订单约束并采用重复增广过程解决不可行性,高效求解非平稳随机需求下的单物品批量问题。

Journal ref International Journal of Production Economics, Volume 299, 2026, 110112, ISSN 0925-5273

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24354 2026-06-23 cs.CV 版本更新 50%

SparseWorld: Enhancing End-to-End Autonomous Driving via World Models with Sparse Scene Representation

SparseWorld: 通过具有稀疏场景表示的世界模型增强端到端自动驾驶

Ruoyu Wang, Jingke Wang, Yukai Ma, Yuehao Huang, Shuangming Lei, Guanglin Xu, Aixue Ye, Yong Liu

机构 * Institute of Cyber-Systems and Control, Zhejiang University(浙江大学控制系统研究所) Labs, Huawei(华为2012实验室) State Key Laboratory of Industrial Control Technology(国家工业控制技术重点实验室)

专题命中 规划决策 :planning(abstract)

AI总结 提出SparseWorld,一种基于稀疏场景表示的轻量级世界模型,通过自回归预测未来地图元素和周围智能体,并利用预测结果优化下游运动预测和轨迹规划,在nuScenes数据集上实现0.05%的碰撞率,达到开放循环规划指标的最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14475 2026-06-23 cs.CV 版本更新 50%

GeoVista: Visually Grounded Active Perception for Vision-Language Understanding of Ultra-High-Resolution Remote Sensing Images

GeoVista: 用于超高清遥感理解的视觉引导主动感知

Jiashun Zhu, Ronghao Fu, Jiasen Hu, Jing Huang, Nachuan Xing, Bo Yang

机构 * College of Computer Science and Technology, Jilin University, China(吉林大学计算机科学与技术学院)

专题命中 规划决策 :planning(abstract)

AI总结 GeoVista提出一种基于规划的主动感知框架,通过构建全局探索计划和分支式局部检查,实现超高清遥感图像的高效解读,提升全局上下文理解与证据聚合效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12008 2026-06-23 hep-ex 版本更新 50%

A frontend ASIC for Microdosimetry

一种用于微剂量学的前端ASIC

Simon Waid, Matthias Knopf, Giulio Magrin, Albert Hirtl, Sebastian Onder, Stefan Gundacker, Daniel Radmanovac, Sandra Barna, Thomas Bergauer

专题命中 规划决策 :planning(abstract)

AI总结 本文提出一种用于微剂量学传感器的ASIC,旨在通过低噪声读出实现 LET 测量,支持低 LET 区域的质子谱分析及 delta 电子贡献研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09127 2026-06-23 cs.RO 版本更新 50%

IMPACT: An Implicit Active-Set Augmented Lagrangian for Fast Contact-Implicit Trajectory Optimization

IMPACT: 一种隐式主动集增广拉格朗日法用于快速接触-隐式轨迹优化

Jiayun Li, Dejian Gong, Georgia Chalvatzaki

机构 * PEARL Lab, Dept. of Computer Science, TU Darmstadt, Germany(图腾实验室,计算机科学系,图恩大学,德国) Hessian.AI, Darmstadt, Germany(海森AI,图恩,德国) Robotics Institute Germany (RIG)(德国机器人研究所(RIG))

专题命中 规划决策 :planning(abstract)

AI总结 本文提出IMPACT方法,通过隐式主动集策略解决接触约束下的轨迹优化问题,实现高效求解并提升控制质量。

Comments Accepted to Robotics: Science and Systems (RSS), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17362 2026-06-23 eess.SP 版本更新 50%

FARM: Foundational Aerial Radio Map for Intelligent Low-Altitude Networking

FARM:面向智能低空网络的基础空中无线电地图

Shijian Gao, Jiahui Liang, Yifeng Yuan, Wenlihan Lu, Guobin Shen, Liuqing Yang

专题命中 规划决策 :planning(abstract)

AI总结 提出FARM基础模型,利用掩码自编码器和扩散解码器,从高粒度全域数据集中构建高保真空中无线电地图,在水平与垂直维度均优于现有方法,并验证了真实场景的迁移能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05916 2026-06-23 cs.RO 版本更新 50%

Iterative Convex Optimization with Control Barrier Functions for Obstacle Avoidance among Polytopes

基于控制障碍函数的迭代凸优化在多面体障碍物规避中的应用

Shuo Liu, Zhe Huang, Calin A. Belta

机构 * Boston University(波士顿大学) University of Maryland(马里兰大学)

专题命中 规划决策 :planning(abstract)

AI总结 针对多面体机器人与障碍物的避碰问题,提出一种迭代凸MPC-DCBF框架,通过精确最近点计算导出支撑超平面构建线性DCBF约束,实现快速在线安全控制。

Comments 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏