arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-04-28 至 2026-04-28 共收录 245 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 72 篇

2604.23815 2026-04-28 cs.CL 57%

DRACULA: Hunting for the Actions Users Want Deep Research Agents to Execute

DRACULA:寻找用户想要的行动深度研究代理执行研究

Nishant Balepur, Malachi Hamada, Varsha Kishore, Sergey Feldman, Amanpreet Singh, Pao Siangliulue, Joseph Chee Chang, Rachel Rudinger, Eunsol Choi, Jordan Lee Boyd-Graber, Doug Downey, Aakanksha Naik

机构 * University of Maryland(马里兰大学) New York University(纽约大学) Allen Institute for Artificial Intelligence (Ai2)(人工智能研究院(Ai2))

专题命中 规划决策 :agent(abstract);分类 cs.CL

AI总结 DRACULA通过收集用户对中间行动的反馈,研究深度研究代理如何预测用户偏好行动,揭示了行动选择的可预测性及用户目标对行动执行的影响。

Comments In-progress Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23678 2026-04-28 cs.AI 57%

Transferable Human Mobility Network Reconstruction with neuroGravity

基于neuroGravity的人类移动网络重构

Jinming Yang, Shaoyu Huang, Zongyuan Huang, Yaohui Jin, Xiaokang Yang, Marta C. Gonzalez, Yanyan Xu

机构 * MoE Key Laboratory of Artificial Intelligence, AI Institute, Shanghai Jiao Tong University, Shanghai 200240, China(人工智能编译实验室,人工智能研究院,上海交通大学,上海 200240,中国) Data-Driven Management Decision Making Lab, Shanghai Jiao Tong University, Shanghai 200240, China(数据驱动管理决策实验室,上海交通大学,上海 200240,中国) Department of City and Regional Planning, University of California, Berkeley, CA 94720, USA(城市与区域规划系,加州大学伯克利分校,CA 94720,美国) Energy Technologies Area, Lawrence Berkeley National Laboratory, Berkeley, CA 94720, USA(能源技术领域,劳伦斯伯克利国家实验室,伯克利,CA 94720,美国) Department of Civil and Environmental Engineering, University of California, Berkeley, CA 94720, USA(土木与环境工程系,加州大学伯克利分校,CA 94720,美国)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文提出neuroGravity模型,通过城市设施和人口分布数据重构移动网络,揭示空间收入 segregation 对模型迁移的重要性,为资源有限地区提供低成本的移动流量代理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23563 2026-04-28 cs.CR cs.AI cs.IR 57%

CyberCane: Neuro-Symbolic RAG for Privacy-Preserving Phishing Detection with Formal Ontology Reasoning

CyberCane:基于形式本体推理的隐私保护钓鱼检测神经符号RAG

Safayat Bin Hakim, Aniqa Afzal, Qi Zhao, Vigna Majmundar, Pawel Sloboda, Houbing Herbert Song

机构 * University of Maryland, Baltimore County(马里兰大学巴尔的摩县分校) Bowie State University(鲍威州立大学)

专题命中 规划决策 :workflow(abstract);分类 cs.AI

AI总结 CyberCane结合确定性符号分析与隐私保护RAG,通过形式本体推理实现高召回率的钓鱼检测,在隐私保护和抗AI攻击方面表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07410 2026-04-28 cs.RO cs.AI 57%

Using Language Models as Closed-Loop High-Level Planners for Robotics Applications: A Brief Overview and Benchmarks

利用语言模型作为闭环高层规划器用于机器人应用:简要概述与基准测试

Hao Wang, Sathwik Karnik, Bea Lim, Somil Bansal

机构 * Ming Hsieh Department of Electrical and Computer Engineering, University of Southern California(南加州大学明希德电气与计算机工程系) Department of Aeronautics and Astronautics, Stanford University(斯坦福大学航空航天工程系) Department of Mechanical Engineering, Stanford University(斯坦福大学机械工程系)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文研究了语言模型在机器人闭环高层规划中的应用,探讨了控制时间跨度和预热启动对性能的影响,并通过实验提供改进建议。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21199 2026-04-28 cs.AI 57%

A Fano-Style Accuracy Upper Bound for LLM Single-Pass Reasoning in Multi-Hop QA

为LLM单步推理在多跳问答中的准确性设定一种Fano风格的上限

Kaiyang Wan, Lang Gao, Honglin Mu, Preslav Nakov, Yuxia Wang, Xiuying Chen

机构 * MBZUAI(马克斯·普朗克智能研究院) INSAIT(索菲亚大学)

专题命中 规划决策 :workflow(abstract);分类 cs.AI

AI总结 本文提出了一种Fano风格的准确性上限,用于分析LLM在多跳问答中的单步推理能力,通过容量感知的任务分解与主动剪枝,构建了InfoQA框架以提升性能和鲁棒性。

Comments 22 pages, 6 figures, ICLR 2026. Reported by MIT Technology Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23345 2026-04-28 cs.CL cs.HC 57%

Bridging Reasoning and Action: Hybrid LLM-RL Framework for Efficient Cross-Domain Task-Oriented Dialogue

连接推理与行动:一种高效的跨领域任务导向对话混合LLM-RL框架

Yangyang Zhao, Linfan Dai, Li Cai, Bowen Xing, Libo Qin

机构 * School of Computer Science and Technology, Changsha University of Science and Technology(长沙理工大学计算机科学与技术学院) School of Computer Science and Engineering, Central South University(中南大学计算机科学与工程学院) Institute of Computing and Intelligence, Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)计算与智能研究院) University of Science and Technology Beijing(北京科技大学) Text Computing and Cognitive Intelligence MOE Engineering Research Center, Guizhou University(贵州大学文字计算与智能认知MOE工程研究中心)

专题命中 规划决策 :planning(abstract);分类 cs.CL

AI总结 本文提出VLK-RL框架,通过结合LLM生成约束并验证以提升跨领域任务导向对话的推理与行动效率,实验表明其在长周期任务中表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23198 2026-04-28 cs.AI 57%

StoryTR: Narrative-Centric Video Temporal Retrieval with Theory of Mind Reasoning

StoryTR: 基于心智理论的叙事视频时序检索

Xuanyue Zhong, Yuqiang Xie, Guanqun Bi, Jiangping Yang, Guibin Chen

机构 * Department of Computer Science and Engineering, The Chinese University of Hong Kong, Hong Kong(香港中文大学计算机科学与工程系) SkyReels, Skywork AI(SkyReels与Skywork AI) Independent Researcher(独立研究者)

专题命中 规划决策 :agentic(abstract);分类 cs.AI

AI总结 StoryTR首次引入需要心智理论推理的视频时刻检索基准,通过生成包含8100个样本的叙事短视频数据集,验证了心智理论推理在视频理解中的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23127 2026-04-28 physics.geo-ph cs.LG stat.AP 57%

A Dynamic Learning Observatory Reveals the Rapid Salinization of Satkhira, Bangladesh

动态学习观测站揭示孟加拉国Satkhira地区的快速盐碱化

Showmitra Kumar Sarkar, Sai Ravela

机构 * Department of Urban and Regional Planning, Khulna University of Engineering and Technology(工程与技术大学城市与区域规划系) Earth, Atmospheric and Planetary Sciences, Massachusetts Institute of Technology(麻省理工学院地球、大气与行星科学系)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出基于机器学习的框架,利用实地观测与Landsat数据预测和映射土壤盐碱化,揭示Satkhira地区土壤盐碱化空间变异性和时间变化特征。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23072 2026-04-28 cs.AI 57%

Analytica: Soft Propositional Reasoning for Robust and Scalable LLM-Driven Analysis

分析:用于稳健和可扩展的LLM驱动分析的软命题推理

Junyan Cheng, Kyle Richardson, Peter Chin

机构 * Dartmouth College(达特茅斯学院) Allen Institute for AI(人工智能研究院)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 本文提出Analytica,一种基于软命题推理的新型代理架构,通过并行分治框架减少误差,提升LLM在金融、科学等领域的预测准确性与稳定性。

Comments ICLR 2026 Camera-ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22967 2026-04-28 stat.ML cs.LG 57%

Rethinking Trust Region Bayesian Optimization in High Dimensions

重新思考高维中的信任区域贝叶斯优化

Wei-Ting Tang, Joel A. Paulson

机构 * University of Wisconsin–Madison(威斯康星大学麦迪逊分校)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出AdaScale-TuRBO方法,通过动态调整GP长度尺度以解决高维优化中局部GP模型退化问题,提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22797 2026-04-28 eess.SY cs.LG cs.SY 57%

Hierarchical RL-MPC Control for Dynamic Wake Steering in Wind Farms

分层强化学习-模型预测控制用于风场动态涡流偏转

Marcus Binder Nilsen, Teodor Olof Benedict Åstrand, Tuhfe Göçmen, Pierre-Elouan Réthoré

机构 * Technical University of Denmark, Department of Wind and Energy Systems(丹麦技术大学,风能与能源系统系)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 本文提出分层框架结合强化学习与模型预测控制,通过RL学习补偿状态估计供MPC控制器使用,实现23%的功率增益并优于理想MPC,相比直接RL控制在安全性和稳定性上更优。

Comments This work has been submitted to IFAC for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04733 2026-04-28 cs.CV cs.AI 57%

Discovering Failure Modes in Vision-Language Models using RL

通过强化学习发现视觉-语言模型的失败模式

Kanishk Jain, Qian Yang, Shravan Nayak, Parisa Kordjamshidi, Nishanth Anand, Aishwarya Agrawal

机构 * Mila – Québec AI Institute(魁北克AI研究所) Université de Montréal(蒙特利尔大学) Michigan State University(密歇根州立大学) McGill University(麦吉尔大学) Canada CIFAR AI Chair(加拿大CIFAR人工智能主席)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 本文提出基于强化学习的框架,自动发现视觉-语言模型在特定数据分布上的失败模式,通过生成问题来识别模型在细粒度视觉细节和技能组合上的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01413 2026-04-28 cs.SE cs.MS math.OC 57%

GlycoPy: A CasADi-based Python Framework for Hierarchical Modeling, Optimization, and Control of Bioprocesses

GlycoPy:基于CasADi的Python框架,用于生物过程的分层建模、优化与控制

Yingjie Ma, Jing Guo, Richard D. Braatz

专题命中 规划决策 :workflow(abstract);分类 cs.SE

AI总结 本文提出GlycoPy框架,结合方程导向和面向对象建模与CasADi的符号计算能力,实现生物过程的分层建模、优化与控制,适用于大规模多尺度系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08425 2026-04-28 cs.LG cs.SY eess.SY 57%

HardFlow: Hard-Constrained Sampling for Flow-Matching Models via Trajectory Optimization

HardFlow: 通过轨迹优化实现流匹配模型的硬约束采样

Zeyang Li, Kaveh Alim, Navid Azizan

机构 * Massachusetts Institute of Technology(麻省理工学院)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出HardFlow框架,通过轨迹优化解决流匹配模型中硬约束采样问题,利用数值最优控制确保终端时间满足约束,并在统一框架下提升样本质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10945 2026-04-28 cs.CV cs.LG 57%

iWatchRoad: Scalable Detection and Geospatial Visualization of Potholes for Smart Cities

iWatchRoad:面向智能城市的可扩展坑洞检测与地理可视化系统

Rishi Raj Sahoo, Surbhi Saswati Mohanty, Subhankar Mishra

机构 * National Institute of Science Education and Research (NISER), An OCC of Homi Bhabha National Institute(国家科学教育研究所(NISER),霍米·巴哈瓦国家研究所的下属机构) Silicon University(硅大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出iWatchRoad系统,利用YOLO模型和自定义OCR模块实现印度道路坑洞的实时检测与GPS标记,通过OpenStreetMap进行可视化,提供政府兼容的维护规划数据。

Comments Accepted at ACM IKKD CODS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24483 2026-04-28 math.OC 50%

Scheduling and Routing in the Flexible Job Shop with Heterogeneous Transbots and Zoning: A Constraint Programming Approach

柔性作业车间中异构转机器人与分区的调度与路径规划:一种约束编程方法

Arnovi Moinuddin, El Mehdi Er Raqabi, Pascal Van Hentenryck

专题命中 规划决策 :planning(abstract)

AI总结 本文提出两种约束编程方法,整合生产调度与转机器人路径规划,解决柔性作业车间中异构转机器人运输和分区约束的复杂问题,通过书-放策略提高求解效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24384 2026-04-28 cs.RO 50%

Pedestrians play chicken with an autonomous vehicle

行人与自动驾驶车辆玩斗鸡游戏

Rakshit Soni, Charles Fox

机构 * School of Engineering and Physical Science, University of Lincoln(林肯大学工程与物理科学学院) CESI, CESI LINEACT(CESI及CESI LINEACT)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出基于博弈论的序列斗鸡模型,通过实验验证自动驾驶车辆在行人优先权下的决策机制,发现行人行为可通过低碰撞时间价值模型有效拟合。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18869 2026-04-28 math.CO math.GR math.NT 50%

Global Product Intersection Sets in Semigroups

半群中的全局乘积交集

Wouter van Doorn, Pietro Monticone, Quanyu Tang

专题命中 规划决策 :agent(abstract)

AI总结 本文研究了半群中乘积交集的性质,证明了当Q的大小大于等于2时,任何包含1的子集均可作为乘积交集出现,解决了Nathanson提出的问题。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11991 2026-04-28 cs.RO 50%

Complementarity by Construction: A Lie-Group Approach to Solving Quadratic Programs with Linear Complementarity Constraints

通过构造的互补性:一种李群方法用于求解带有线性互补性约束的二次规划

Arun L. Bishop, Micah I. Reich, Zachary Manchester

机构 * Robotics Institute, Carnegie Mellon University(机器人研究所,卡内基梅隆大学)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出利用李群结构解决带有线性互补性约束的二次规划问题,通过构造退化映射实现约束自洽,开发出开源求解器Marble,在多个基准问题中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24258 2026-04-28 astro-ph.IM 50%

SVOM Ground Support System

SVOM地面支持系统

Yurong Liu, Meng Bai, Mingyue Wei, Ke Feng, Boquan Li, Tai Hu

专题命中 规划决策 :planning(abstract)

AI总结 本文提出一种专为SVOM任务设计的地面支持系统,用于管理和处理变源监视任务的数据接收与预处理,支持任务规划和在轨操作。

Comments Accepted for publication in the SVOM special issue in Research in Astronomy and Astrophysics;8 pages,11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24242 2026-04-28 cs.RO 50%

OpenPodcar2: a robust, ROS2 vehicle for self-driving research

OpenPodcar2:一种稳健的ROS2车辆,用于自动驾驶研究

Rakshit Soni, Chris Waltham, Md Umar Ibrahim, Mark Crampton, Charles Fox

机构 * School of Engineering and Physical Science, University of Lincoln, UK(林肯大学工程与物理科学学院,英国)

专题命中 规划决策 :planning(abstract)

AI总结 OpenPodcar2是一种基于现成车辆的低成本开源自动驾驶平台,集成了ROS2接口和稳健电子设备,兼顾研究与实际应用,成本约7000美元,适用于最后一公里自动驾驶出租车服务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23863 2026-04-28 cs.RO cs.SY eess.SY 50%

Cooptimizing Safety and Performance Using Safety Value-Constrained Model Predictive Control

通过安全价值约束模型预测控制优化安全与性能

Hao Wang, Nam Nguyen, Armand Jordana, Ludovic Righetti, Somil Bansal

机构 * Ming Hsieh Department of Electrical and Computer Engineering, University of Southern California(南加州大学明希德电气与计算机工程系) Department of Aeronautics and Astronautics, Stanford University(斯坦福大学航空与航天系) Electrical and Computer Engineering Department, New York University(纽约大学电气与计算机工程系)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出基于安全价值函数的终端约束MPC方法,实现安全与性能的协同优化,通过仿真和硬件实验验证了其在约束满足和鲁棒性方面的改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.19053 2026-04-28 cs.DM 50%

Staff Scheduling for Demand-Responsive Services

按需服务人员调度

Debsankha Manik, Rico Raber

专题命中 规划决策 :planning(abstract)

AI总结 本文针对按需服务中人员调度问题,提出一种新方法,在考虑需求变化的情况下优化奖励函数,解决传统调度算法难以处理的动态约束问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23533 2026-04-28 eess.SP cs.NI 50%

PILOT: One Physics-Integrated Generation Framework to Unify 2D and 3D Radio Map Construction

PILOT:一个整合物理的生成框架,统一2D和3D无线电地图构建

Weiming Huang, Hao Sun, Junting Chen

专题命中 规划决策 :planning(abstract)

AI总结 PILOT通过整合物理模型,采用波前序列替代传统栅格扫描,提升2D和3D无线电地图构建的精度与效率,实现更低的NMSE和更快的推理速度。

Comments 13 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23524 2026-04-28 eess.SY cs.SY 50%

Physics-Aware LLM-Based Probabilistic Wind Power Scenario Generation under Extreme Icing Conditions

基于物理的LLM风力发电场景生成方法:极端覆冰条件下的概率建模

Lei Wang, Ying Zhang, Di Shi, Fei Ding

专题命中 规划决策 :planning(abstract)

AI总结 本文提出一种基于物理的LLM框架,用于在极端覆冰条件下生成风力发电场景,结合SCADA物理建模、多模态分词和因果Transformer架构,有效约束功率和爬坡限制,提升可再生能源电力系统的韧性评估。

Comments 5 pages, 3 figures, 3 tables. Accepted by the 2026 IEEE Power & Energy Society General Meeting

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22848 2026-04-28 cs.CV 50%

LunarDepthNet: Generation of Digital Elevation Models using Deep Learning and Monocular Satellite Images

月球深度网络:利用深度学习和单目卫星图像生成数字高程模型

Aaranay Aadi, Jai Gopal Singla, Amitabh, Nitant Dube, Praveen Kumar Shukla, Vijaypal Singh Dhaka

机构 * School of Computer Science and Engineering(计算机科学与工程学院) Space Applications Centre (SAC)(空间应用中心) Indian Space Research Organisation (ISRO)(印度空间研究组织) Department of IoT and Intelligent Systems(物联网与智能系统系) Department of Computer and Communication Engineering(计算机与通信工程系)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出LunarDepthNet,通过深度学习和单目卫星图像生成月球数字高程模型,采用UNet架构和EfficientNet编码器,结合定制层和联合损失函数,实现高精度的高程估计。

Comments Accepted by IEEE - 4th International Conference on Computer, Electronics, Electrical Engineering and their applications (IC2E3 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14406 2026-04-28 math.OC 50%

Empirical Evaluation of Policy-Based Reinforcement Learning for Dynamic Service Control in an M/M/1 Queue

基于M/M/1队列的动态服务控制中策略驱动强化学习的实证评估

Joseph Walton, Gabriel Nicolosi

专题命中 规划决策 :agent(abstract)

AI总结 本文评估了策略驱动强化学习在M/M/1队列动态服务控制中的表现,通过模拟环境对比REINFORCE、A2C和PPO算法的收敛速度、采样效率及策略质量。

Comments 6 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13476 2026-04-28 cs.RO cs.CV 50%

RobotPan: A 360$^\circ$ Surround-View Robotic Vision System for Embodied Perception

RobotPan:一种用于具身感知的360度全景机器人视觉系统

Jiahao Ma, Qiang Zhang, Peiran Liu, Zeran Su, Pihai Sun, Gang Han, Wen Zhao, Wei Cui, Zhang Zhang, Zhiyuan Xu, Renjing Xu, Jian Tang, Miaomiao Liu, Yijie Guo

机构 * Tiangong 3.0 humanoid platform(天宫3.0人形平台)

专题命中 规划决策 :workflow(abstract)

AI总结 本文提出RobotPan系统,通过六摄像头与LiDAR结合,实现360度全景视觉覆盖,采用统一球坐标表示和分层球体体素先验,实现高效实时渲染与重建,支持长时间序列处理,并发布多传感器数据集用于机器人导航与 manipulation。

Comments Project website: https://robotpan.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09944 2026-04-28 cs.DB 50%

PLOP: Cost-Based Placement of Semantic Operators in Hybrid Query Plans

PLOP:基于成本的语义运算符在混合查询计划中的放置

Qiuyang Mang, Yufan Xiang, Hangrui Zhou, Runyuan He, Jiaxiang Yu, Hanchen Li, Aditya Parameswaran, Alvin Cheung

专题命中 规划决策 :planning(abstract)

AI总结 PLOP通过等价保留的重写将混合语义-关系查询规划简化为语义过滤器放置,通过动态规划模型平衡LLM和关系成本,实现1.5倍速度提升和4.29倍成本降低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.14897 2026-04-28 cs.CV 50%

Seer: Language Instructed Video Prediction with Latent Diffusion Models

Seer:基于潜在扩散模型的语言指导视频预测

Xianfan Gu, Chuan Wen, Weirui Ye, Jiaming Song, Yang Gao

机构 * Shanghai Qi Zhi Institute(上海启智研究院) IIIS, Tsinghua University(清华大学人工智能研究院) Shanghai AI Lab(上海人工智能实验室) NVIDIA

专题命中 规划决策 :planning(abstract)

AI总结 Seer通过扩展预训练文本到图像扩散模型的时间轴,提出高效模型以实现文本条件视频预测,提升机器人未来预测能力,实验表明其在多个数据集上性能优越。

Comments 31 pages, 24 figures

详情

展开后加载摘要…

URL PDF HTML 收藏