arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-04-28 至 2026-04-28 共收录 245 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 72 篇

2604.23194 2026-04-28 cs.AI 79%

From Coarse to Fine: Self-Adaptive Hierarchical Planning for LLM Agents

从粗到细:为LLM代理设计的自适应分层规划

Haoran Tan, Zeyu Zhang, Chen Ma, Tianze Liu, Quanyu Dai, Xu Chen

机构 * Beijing Key Laboratory of Research on Large Models and Intelligent Governance(北京大模型与智能治理重点实验室) Engineering Research Center of Next-Generation Intelligent Search and Recommendation, MOE(下一代智能搜索与推荐工程技术研究中心,教育部) Gaoling School of Artificial, Renmin University of China(人大北京校区人工智能学院) Huawei Noah’s Ark Lab(华为诺亚实验室)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出AdaPlan-H,一种自适应分层规划机制,通过逐步细化策略提升复杂任务执行效率,减少过度规划,提供灵活高效的多步骤决策方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22868 2026-04-28 cs.CV cs.AI 79%

Probing Visual Planning in Image Editing Models

探测图像编辑模型中的视觉规划

Zhimu Zhou, Yanpeng Zhao, Qiuyu Liao, Bo Zhao, Xiaojian Ma

机构 * Shanghai Jiao Tong University(上海交通大学) Renmin University of China(中国人民大学) State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,BIGAI)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出EAR框架,通过抽象谜题和生成数据集AMAZE,评估图像编辑模型的视觉规划能力,发现模型在零样本设置下表现不佳,但微调后能有效泛化。

Comments Accepted to ES-Reasoning Workshop @ ICLR 2026. Our code is available at https://github.com/spatigen/amaze

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12890 2026-04-28 cs.CV cs.AI 79%

Towards Long-horizon Agentic Multimodal Search

面向长视界代理多模态搜索

Yifan Du, Zikang Liu, Jinbiao Peng, Jie Wu, Junyi Li, Jinyang Li, Wayne Xin Zhao, Ji-Rong Wen

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学 polled 智能学院) City University of Hong Kong(香港城市大学)

专题命中 规划决策 :agentic(title);agent(abstract);分类 cs.AI

AI总结 本文提出LMM-Searcher框架,通过文件化视觉表示和定制化图像加载工具,解决长视界多模态搜索中的信息管理与成本问题,实验证明其在长视界基准测试中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18563 2026-04-28 cs.AI cs.MA econ.TH 79%

Reasonably reasoning AI agents can avoid game-theoretic failures in zero-shot, provably

合理推理的AI代理可以在零样本情况下避免博弈论失败并得到证明

Enoch Hyunwook Kang

机构 * Foster School of Business, University of Washington(华盛顿大学福斯特商学院)

专题命中 规划决策 :AI agent(title,abstract);分类 cs.AI

AI总结 本文研究了AI代理在重复博弈中的稳定性,证明了基于贝叶斯后验采样的代理能趋近纳什均衡,且在未知收益情况下仍保持收敛性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21321 2026-04-28 cs.AI 79%

LLM-Assisted Op-Amp Behavioral-Level Design via Agentic Human-Mimicking Reasoning

通过代理人类模拟推理的LLM辅助运算放大器行为级设计

Zihao Chen, Ziyi Sun, Jiayin Wang, Ji Zhuang, Jinyi Shen, Xiaoyue Ke, Li Shang, Xuan Zeng, Fan Yang

机构 * State Key Laboratory of Integrated Chips and Systems(集成芯片与系统国家重点实验室)

专题命中 规划决策 :agentic(title);agent(abstract);分类 cs.AI

AI总结 本文提出White-Op框架,利用大语言模型代理的类人推理能力,实现运算放大器行为级参数设计,通过符号推理与数值求解分离方法,结合模拟验证和迭代优化,提升设计可解释性与电路功能保持性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24606 2026-04-28 cs.RO cs.SY eess.SY 78%

Hybrid A*-Based Reverse Path-Planning of a Vehicle with Trailer System

基于混合A*的带拖车车辆反向路径规划

Xincheng Cao, Haochong Chen, Bilin Aksun-Guvenc, Levent Guvenc, Brian Link, Peter J Richmond, Dokyung Yim, Shihong Fan, John Harber

机构 * Automated Driving Lab, Department of Mechanical and Aerospace Engineering, The Ohio State University(自动化驾驶实验室,机械与航空航天工程系,俄亥俄州立大学) Hyundai America Technical Center, Inc.(现代美国技术中心有限公司)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出一种改进的混合A*算法,用于解决带拖车车辆的反向停车路径规划问题,兼顾车辆-拖车系统和碰撞避障,通过适应性控制防止拖车翻转,并通过仿真验证有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.00951 2026-04-28 math.OC 78%

Flatness-based Quadcopter Trajectory Planning and Tracking with Continuous-time Safety Guarantees

基于平坦性的四旋翼轨迹规划与跟踪及连续时间安全保证

Victor Freire, Xiangru Xu

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出了一种凸优化框架,用于四旋翼轨迹规划与跟踪,通过B样条基函数和四旋翼的微分平坦性,构建二次锥规划以生成满足连续时间安全约束的最优轨迹,并通过二次规划保证轨迹跟踪的连续时间有界性。

Comments 16 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24264 2026-04-28 astro-ph.IM astro-ph.HE 78%

Alert Chain and Observation Planning for Ground Wide Angle Camera Network

地面宽视场相机网络的警报链与观测规划

Xu-hui Han, Pin-pin Zhang, Yu-jie Xiao, Li-ping Xin, Ruo-song Zhang, Lei Huang, Xiao-meng Lu, Hong-bo Cai, Yang Xu, Wen-long Dong, Hua-li Li, Ya-tong Zheng, Jian-yan Wei

专题命中 规划决策 :planning(title);workflow(abstract)

AI总结 本文提出了一种用于地面宽视场相机网络的自动化警报处理流程,通过整合FOCS和AOM系统实现多波段快速跟进观测,以发现伽马射线暴的光学对应物。

Comments Accepted for publication in the SVOM special issue in Research in Astronomy and Astrophysics, 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24107 2026-04-28 eess.SY cs.SY 78%

Optimal Planning and Control under Signal Temporal Logic Specifications

在信号时序逻辑规范下最优规划与控制

Zuodong Pan, Xu Fang, Wei Ren

专题命中 规划决策 :planning(title,abstract)

AI总结 本文研究非线性系统在信号时序逻辑规范下的规划与控制问题,通过分解任务生成局部路径并构造安全走廊,最终求解优化问题以获得满足规范的轨迹。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24067 2026-04-28 cs.DB 78%

DataClaw: An Autonomous Data Agent with Instant Messaging Integration

DataClaw: 一个集成即时通讯功能的自主数据代理

Huahang Li, Wentao Hu, Zhuoyue Wan, Chen Jason Zhang, Haoyang Li, Xiaoyong Wei

专题命中 规划决策 :agent(title,abstract)

AI总结 DataClaw通过集成即时通讯平台,使用户能通过自然语言请求自动执行数据分析任务,提供图表和报告,解决数据处理碎片化问题。

Comments 4 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24064 2026-04-28 cs.RO 78%

Trajectory Planning for an Articulated Commercial Vehicle using Model Predictive Contouring Control

使用模型预测轮廓控制的 articulated 商用车轨迹规划

A. J. Aertssen, R. G. M. Huisman, I. J. M. Besselink, J. Elfring, M. J. G. van de Molengraft

机构 * Department of Mechanical Engineering, Eindhoven University of Technology(埃因霍温理工大学机械工程系) Safety & Driver Controls Group, Vehicle Development, DAF Trucks N.V.(DAF卡车公司安全与驾驶控制组)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出了一种基于模型预测轮廓控制的 articulated 商用车轨迹规划方法,通过引入场景依赖的锚点权重和道路边界约束,解决了 articulated 商用车在正反向行驶中的导航问题。

Journal ref 2025 IEEE 28th International Conference on Intelligent Transportation Systems (ITSC) Gold Coast Australia 2025 pp. 421-427

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23140 2026-04-28 math.OC 78%

Green Manufacturing Capacity Planning by Integrating Distributionally Robust Optimization and Generative AI

通过整合分布鲁尼茨优化与生成式人工智能实现绿色制造能力规划

Xin Zhou, Zhengsong Lu, Bo Zeng, Na Geng

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出一种多工厂、多产能、多产品的两阶段分布鲁尼茨优化模型,结合数据驱动聚类技术构建不确定性集,并利用生成式人工智能提升计算效率和解的一致性,以应对绿色制造中需求和可再生能源生成的不确定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22977 2026-04-28 math.OC 78%

A Reinforcement-learning-based Column Generation Algorithm for Integrated Operating Room Planning and Scheduling

基于强化学习的列生成算法在整合手术室规划与排程中的应用

Mahdi Dolatkhah, Hossein Hashemi Doulabi, Walter Rei, Michel Gendreau

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出一种混合整数规划模型,结合强化学习和遗传算法改进列生成算法,用于解决手术室规划与排程问题,实验证明其在优化和鲁棒性方面优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24443 2026-04-28 cs.AI 77%

PhysNote: Self-Knowledge Notes for Evolvable Physical Reasoning in Vision-Language Model

PhysNote: 为视觉-语言模型中的可进化物理推理提供自我知识笔记

Sinin Zhang, Yunfei Xie, Yuxuan Cheng, Haoyu Zhang, Tong Zhang

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Rice University(里奇大学) City University of Hong Kong(香港城市大学) Fudan University(复旦大学)

专题命中 规划决策 :agent(abstract);agentic(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出PhysNote框架,通过自我生成的知识笔记提升视觉-语言模型在动态物理推理中的表现,实验显示其在PhysBench上达到56.68%的准确率,优于多智能体基线。

Comments 11 pages. Accepted by ICLR 2026 Workshop ES-Reasoning

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17590 2026-04-28 cs.AI cs.CL cs.CV cs.CY cs.LG 75%

MERIT: Modular Framework for Multimodal Misinformation Detection with Web-Grounded Reasoning

MERIT:基于网络基础推理的多模态虚假信息检测模块化框架

Mir Nafis Sharear Shopnil, Sharad Duwal, Abhishek Tyagi, Adiba Mahbub Proma

机构 * University of Rochester(罗切斯特大学)

专题命中 规划决策 :agent(abstract,abstract_cn);分类 cs.AI、cs.CL、cs.LG

AI总结 MERIT通过四个专用模块提升多模态虚假信息检测性能,采用GPT-4o-mini在MMFakeBench上取得81.65% F1得分,优于零样本基线,验证了其架构设计的有效性。

Comments 18 pages, 4 tables, 3 figures. Major revision with updated title, framing, methodology, experiments, and error analysis

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12120 2026-04-28 cs.AI 74%

Forecasting Commencing Enrolments Under Data Sparsity: A Zero-Shot Time Series Foundation Models Framework for Higher Education Planning

在数据稀疏条件下预测入学人数:一种用于高等教育规划的零样本时间序列基础模型框架

Jittarin Jetwiriyanon, Teo Susnjak, Surangika Ranathunga

机构 * School of Mathematical and Computational Sciences(数学与计算科学学院) Massey University(梅西大学) Albany, New Zealand(新西兰奥克兰)

专题命中 规划决策 :planning(title);分类 cs.AI

AI总结 本文探讨零样本时间序列基础模型在数据稀疏情况下对入学人数预测的可行性,通过对比经典方法验证其有效性,并提出可转移的预测协议。

Comments 30 pages, 5 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03768 2026-04-28 cs.AI cs.LG 73%

RL-Driven Sustainable Land-Use Allocation for the Lake Malawi Basin

基于强化学习的可持续土地利用分配:马拉维盆地

Ying Yao

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出基于深度强化学习的框架,用于优化马拉维盆地的土地利用分配以最大化生态系统服务价值,通过空间奖励塑造引导生态友好的土地利用模式。

Comments 9 pages, 11 figures; added baseline comparison under "Result" section; revised limitation and discussion

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01188 2026-04-28 cs.CL cs.AI 73%

ZoFia: Zero-Shot Fake News Detection with Entity-Guided Retrieval and Multi-LLM Interaction

ZoFia:基于实体引导检索和多LLM交互的零样本假新闻检测

Lvhua Wu, Xuefeng Jiang, Sheng Sun, Yan Lei, Tian Wen, Yuwei Wang, Min Liu

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出ZoFia框架,通过实体引导检索和多LLM交互解决假新闻检测中的知识截止和事实幻觉问题,实验表明其优于现有零样本基线和多数少样本方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24116 2026-04-28 cs.SE stat.AP 70%

Closing the Loop: A Software Framework for AI to Support Business Decision Making

闭环:一个支持商业决策制定的AI软件框架

Jeffrey Wong, Antoine Creux

专题命中 规划决策 :agent(abstract);AI agent(abstract);分类 cs.SE

AI总结 本文提出一个软件框架,通过数学简化和软件设计优化,提升AI在商业闭环中的学习与迭代效率,改进因果分析并增强实验效果预测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23821 2026-04-28 cond-mat.mtrl-sci cs.LG 70%

Accelerating Quantum Materials Characterization: Hybrid Active Learning for Autonomous Spin Wave Spectroscopy

加速量子材料表征:用于自主自旋波光谱的混合主动学习

William Ratcliff

机构 * NIST Center for Neutron Research(国家标准与技术研究院中子研究中心)

专题命中 规划决策 :planning(abstract);workflow(abstract);分类 cs.LG

AI总结 本文提出TAS-AI框架,通过分离检测、推断和细化任务,提升自旋波光谱的自主分析能力,展示了在不同模型下显著的效率提升。

Comments 47 pages, 13 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25562 2026-04-28 cs.LG cs.AI cs.CL 67%

Revisiting On-Policy Distillation: Empirical Failure Modes and Simple Fixes

重新审视在线策略蒸馏:经验性失败模式及简单修复

Yuqian Fu, Haohuan Huang, Kaiwen Jiang, Jiacai Liu, Zhuo Jiang, Yuanheng Zhu, Dongbin Zhao

机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems, CASIA(多模态人工智能系统国家重点实验室,中科院自动化所) School of Artificial Intelligence, UCAS(中国科学技术大学人工智能学院) Fudan University(复旦大学) Independent Researcher(独立研究者)

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文研究了在线策略蒸馏的失败模式,提出改进方法提升训练稳定性,实验显示改进方法在多个任务中提升性能19.8%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23460 2026-04-28 cs.AI cs.CL cs.LG 67%

Ulterior Motives: Detecting Misaligned Reasoning in Continuous Thought Models

隐秘动机:在连续思维模型中检测不一致的推理

Sharan Ramjee

机构 * Stanford University(斯坦福大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文研究了连续思维模型中如何检测不一致的推理,提出MoralChain基准测试,并通过双触发方法训练模型,揭示了潜在空间中不一致推理的存在及早期规划阶段的安全监控重要性。

Comments 15 pages with 2 figures

Journal ref International Conference on Learning Representations (ICLR) Latent & Implicit Thinking (LIT) Workshop 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13006 2026-04-28 cs.CL cs.AI 62%

One Token Away from Collapse: The Fragility of Instruction-Tuned Helpfulness

距离崩溃仅一步之遥:指令调制帮助性的脆弱性

Erfan Baghaei Potraghloo, Seyedarmin Azizi, Souvik Kundu, Massoud Pedram

机构 * University of Southern California(南加州大学) Intel AI(英特尔人工智能)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.CL

AI总结 研究探讨了指令调制大语言模型在简单约束下的帮助性稳定性,发现其在词汇约束下响应质量显著下降,揭示了指令调制对表面模板的依赖性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21648 2026-04-28 cs.LG cs.AI 62%

Variance-Aware Prior-Based Tree Policies for Monte Carlo Tree Search

基于方差意识的先验优先级树策略用于蒙特卡洛树搜索

Maximilian Weichart

机构 * University of Tübingen(图宾根大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出Inverse-RPO方法,系统推导出基于先验的UCT策略,通过引入方差估计提升搜索效率,实验表明其在多个基准上优于PUCT且无额外计算成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18398 2026-04-28 cs.CL cs.AI 62%

AlphaContext: An Evolutionary Tree-based Psychometric Context Generator for Creativity Assessment

AlphaContext:一种基于进化树的心理测量情境生成器用于创造力评估

Yixuan Wang, Yue Huang, Hong Qian, Yunzhao Wei, Yifei Ding, Wenkai Wang, Zhi Liu, Zhongjing Huang, Aimin Zhou, Jiajun Guo

机构 * East China Normal University(东华大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.CL

AI总结 AlphaContext通过进化树方法生成高质量的情境,提升创造力评估的准确性与多样性,实验显示在六个质量指标上平均提升8%。

Comments Accepted by ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19889 2026-04-28 cs.LG cs.AI math.OC 62%

From Optimization to Prediction: Transformer-Based Path-Flow Estimation to the Traffic Assignment Problem

从优化到预测:基于Transformer的路径-流量估计到交通分配问题

Mostafa Ameli, Sulthana Shams, Van Anh Le, Alexander Skabardonis

机构 * Institute of Transportation Studies, University of California, Berkeley, USA(加州大学伯克利分校交通研究学院)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出基于Transformer的深度学习方法,直接预测交通均衡路径流量,提升大规模网络计算效率和预测精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24320 2026-04-28 cs.CL 57%

DPEPO: Diverse Parallel Exploration Policy Optimization for LLM-based Agents

DPEPO:基于大语言模型代理的多样化并行探索策略优化

Junshuo Zhang, Chengrui Huang, Feng Guo, Zihan Li, Ke Shi, Menghua Jiang, Jiguo Yu, Shuo Shang, Shen Gao

机构 * University of Electronic Science and Technology of China(电子科技大学) DiDi(滴滴)

专题命中 规划决策 :agent(abstract);分类 cs.CL

AI总结 本文提出DPEPO算法,通过并行探索提升大语言模型代理在复杂任务中的性能,实验表明其在ALFWorld和ScienceWorld上达到最先进的成功率。

Comments Accepted by ACL 2026 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21421 2026-04-28 cs.RO cs.AI 57%

HyReach: Vision-Guided Hybrid Manipulator Reaching in Unseen Cluttered Environments

HyReach:基于视觉的混合机械臂在未见的杂乱环境中实现稳健的开放世界物体抓取

Shivani Kamtikar, Kendall Koe, Justin Wasserman, Samhita Marri, Benjamin Walt, Naveen Kumar Uppalapati, Girish Krishnan, Girish Chowdhary

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Skild AI

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文提出一种实时混合刚柔连续机械臂系统,通过视觉感知与3D场景重建结合形状感知运动规划,实现鲁棒的开放世界物体抓取,实验表明在杂乱环境中误差低于2厘米。

Comments 8 pages, 5 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.20642 2026-04-28 cs.LG stat.ML 57%

Learning Under Moral Hazard with Instrumental Regression and Generalized Method of Moments

在存在道德风险下学习:利用工具回归和广义矩估计法

Shiliang Zuo

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 本文研究了多任务委托-代理合同设计问题,利用工具回归和广义矩估计法估计有效合同,并给出了最优合同形状的统一性特征。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24143 2026-04-28 cs.LG 57%

Machine-Learning-Based Classification of Radio Frequency Building Loss

基于机器学习的无线电频率建筑损耗分类

Jiayi Tan, Neelabhro Roy, James Gross, Rohit Chandra, Tsao-Tsen Chen

机构 * GPP-compliant networks(3GPP兼容网络) public building information(公开建筑信息)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出基于机器学习的无线电频率建筑损耗分类框架,结合 crowdsourced 用户设备数据与公开建筑信息,通过监督与半监督学习提升预测精度与置信度,实现更高效的室内无线网络优化。

Comments Accepted as a short paper in International Conference on Telecommunications (ICT) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏