arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-03-06 至 2026-03-06 共收录 138 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 54 篇

2506.07915 2026-03-06 cs.AI cs.CL cs.SY eess.SY 62%

A Signal Contract for Online Language Grounding and Discovery in Decision-Making

在线语言 grounding 与决策制定中的语言发现信号契约

Dimitris Panagopoulos, Adolfo Perrusquia, Weisi Guo

机构 * Faculty of Engineering and Applied Science, Cranfield University(工程与应用科学学院,克兰菲尔德大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.CL

AI总结 LUCIFER 通过信号契约实现在线语言 grounding,提升决策安全性和信息收集效率,需结合两者才能达成最佳效果。

Comments 10 pages, 4 Figures, 4 Tables, submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10117 2026-03-06 cs.LG cs.CL 62%

Learning Virtual Machine Scheduling in Cloud Computing through Language Agents

通过语言代理学习云计算中的虚拟机调度

JieHao Wu, Ziwei Wang, Junjie Sheng, Wenhao Li, Xiangfeng Wang, Jun Luo

机构 * School of Computer Science and Technology, East China Normal University(东华大学计算机科学与技术学院) Antai College of Economics and Management, Shanghai Jiao Tong University(上海交通大学安泰经济管理学院) School of Computer Science and Technology, Tongji University(同济大学计算机科学与技术学院) Key Laboratory of Mathematics and Engineering Applications, MoE, East China Normal University(教育部数学与工程应用重点实验室)

专题命中 规划决策 :agent(abstract);分类 cs.CL、cs.LG

AI总结 本文提出MiCo框架,通过语言代理解决云计算中的虚拟机调度问题,实现高效动态调度并验证其在大规模场景中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05418 2026-03-06 q-bio.NC cs.AI 57%

The Spatial and Temporal Resolution of Motor Intention in Multi-Target Prediction

多目标预测中运动意图的空间和时间分辨率

Marie Dominique Schmidt, Ioannis Iossifidis

机构 * Ruhr West University of Applied Science(鲁尔西部应用科学大学) Institute of Computer Science(计算机科学学院) Ruhr-University Bochum(博德姆鲁尔大学) Institute for Neural Computation(神经计算研究所)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本研究通过多通道肌电信号分析,提出结合数据驱动分割与深度学习的方法,实现对运动意图的高精度预测,为自适应康复系统提供新的计算方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03512 2026-03-06 cs.CY cs.AI 57%

Baseline Performance of AI Tools in Classifying Cognitive Demand of Mathematical Tasks

AI工具在分类数学任务认知需求中的基准性能

Danielle S. Fox, Brenda L. Robles, Elizabeth DiPietro Brovey, Christian D. Schunn

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 研究评估了AI工具在分类数学任务认知需求的准确性,发现通用工具与教育专用工具均存在显著误差,需改进提示工程和工具开发。

Comments 30 pages, 2 tables, 5 appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13306 2026-03-06 cs.AI cs.CV 57%

DAP: A Discrete-token Autoregressive Planner for Autonomous Driving

DAP:一种用于自动驾驶的离散令牌自回归规划器

Bowen Ye, Bin Zhang, Hang Zhao

机构 * Shanghai Qi Zhi Institute IIIS, Tsinghua University(上海启智研究院 IIIS,清华大学) Shanghai Jiaotong University(上海交通大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 DAP是一种基于离散令牌自回归的自动驾驶规划器,通过联合预测鸟瞰图语义和自身轨迹,实现高效且全面的表示学习,从而在开环和闭环指标上均取得优异性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05113 2026-03-06 cs.LG cs.RO 57%

Decoupling Task and Behavior: A Two-Stage Reward Curriculum in Reinforcement Learning for Robotics

分离任务与行为:一种强化学习中的两阶段奖励课程

Kilian Freitag, Knut Åkesson, Morteza Haghir Chehreghani

机构 * Chalmers University of Technology(查尔姆斯理工大学) Gothenburg University(哥德堡大学)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 本文提出了一种两阶段奖励课程方法,通过分离任务目标与行为术语,提升机器人强化学习中奖励函数设计的有效性和稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04996 2026-03-06 cs.CL 57%

HiFlow: Hierarchical Feedback-Driven Optimization for Constrained Long-Form Text Generation

HiFlow:用于受约束长文本生成的分层反馈驱动优化

Yifan Zhu, Guanting Chen, Bing Wei, Haoran Luo

专题命中 规划决策 :planning(abstract);分类 cs.CL

AI总结 HiFlow通过分层反馈驱动优化框架,解决长文本生成中受约束的优化问题,提升生成质量与约束满足能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04868 2026-03-06 cs.AI 57%

K-Gen: A Multimodal Language-Conditioned Approach for Interpretable Keypoint-Guided Trajectory Generation

K-Gen:一种多模态语言条件方法用于可解释的关键点引导轨迹生成

Mingxuan Mu, Guo Yang, Lei Chen, Ping Wu, Jianxun Cui

机构 * Harbin Institute of Technology Chongqing Research Inst. of HIT(哈尔滨工业大学重庆研究院) Changan Automobile Co., Ltd Chongqing, China(长安汽车有限公司重庆)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 K-Gen通过多模态语言模型结合关键点引导方法,提升自动驾驶轨迹生成的可解释性和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04466 2026-03-06 cs.RO cs.LG 57%

Act-Observe-Rewrite: Multimodal Coding Agents as In-Context Policy Learners for Robot Manipulation

动作-观察-重写:多模态编码代理作为机器人操作的上下文政策学习者

Vaishak Kumar

机构 * General Bionix, Inc.(通用生物交叉公司)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 AOR框架通过生成可执行代码使机器人操作策略学习无需演示或奖励工程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23974 2026-03-06 cs.AI 57%

Pessimistic Auxiliary Policy for Offline Reinforcement Learning

悲观辅助策略用于离线强化学习

Fan Zhang, Baoru Huang, Xin Zhang

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 本文提出悲观辅助策略以提升离线强化学习的效果,通过最大化Q函数的下界来减少近似误差并缓解误差累积。

Comments Withdrawn due to a crucial mistake

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03604 2026-03-06 cs.AI 57%

Interleaved Tool-Call Reasoning for Protein Function Understanding

交错工具调用推理用于蛋白质功能理解

Chuanliu Fan, Zicheng Ma, Huanran Meng, Aijia Zhang, Wenjie Du, Jun Zhang, Yi Qin Gao, Ziqiang Cao, Guohong Fu

机构 * School of Computer Science and Technology, Soochow University(苏州大学计算机科学与技术学院) Institute of Artificial Intelligence, Soochow University(苏州大学人工智能研究院) Changping Laboratory(昌平实验室) School of Software Engineering, USTC(中国科学技术大学软件学院)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 PFUA通过整合领域特定工具和可验证中间证据,提高了蛋白质功能预测的性能,平均提升达103%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21033 2026-03-06 cs.AI 57%

Towards Trustworthy Legal AI through LLM Agents and Formal Reasoning

通过LLM代理和形式推理实现可信的法律AI

Linze Chen, Yufan Cai, Zhe Hou, Jin Song Dong

机构 * National University of Singapore(国立新加坡大学) Griffith University(格里菲斯大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 L4L通过LLM代理与形式推理实现法律AI的可信性,通过四个阶段确保法律推理的逻辑性和可验证性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14599 2026-03-06 cs.CV cs.AI 57%

CCSD: Cross-Modal Compositional Self-Distillation for Robust Brain Tumor Segmentation with Missing Modalities

CCSD:跨模态组合自蒸馏用于缺失模态的鲁棒脑肿瘤分割

Dongqing Xie, Yonghuang Wu, Zisheng Ai, Jun Min, Zhencun Jiang, Shaojin Geng, Lei Wang

机构 * Shanghai Research Institute for Intelligent Autonomous Systems, Tongji University(上海智能自主系统研究院,同济大学) College of Biomedical Engineering, Fudan University(生物医学工程学院,复旦大学) School of Medicine, Tongji University(医学院,同济大学) College of Information Engineering, China Jiliang University(信息工程学院,中国嘉兴大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 CCSD通过跨模态组合自蒸馏方法,提升在缺失模态下的脑肿瘤分割鲁棒性与泛化能力。

Comments 29 pages, 5 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16688 2026-03-06 cs.CV cs.AI 57%

Pursuing Minimal Sufficiency in Spatial Reasoning

追求空间推理的最小充分性

Yejie Guo, Yunzhong Hou, Wufei Ma, Meng Tang, Ming-Hsuan Yang

机构 * Shanghai Jiao Tong University(上海交通大学) Beijing Institute of Technology(北京理工大学) Johns Hopkins University(约翰霍普金斯大学) University of California Merced(加州大学默塞德分校)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 本文提出 MSSR 框架,通过构建最小充分集提升视觉-语言模型的空间推理能力,实现充分性与最小性的平衡,取得最佳性能并生成可解释的推理路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23036 2026-03-06 cs.LG cs.SY eess.SY 57%

Parameter Stress Analysis in Reinforcement Learning: Applying Synaptic Filtering to Policy Networks

强化学习中的参数应力分析:将突触过滤应用于策略网络

Zain ul Abdeen, Ming Jin

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 本文提出通过突触过滤方法分析强化学习策略的参数鲁棒性,揭示抗脆弱参数对策略性能的提升作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08264 2026-03-06 cs.RO cs.AI 57%

Automatic Curriculum Learning for Driving Scenarios: Towards Robust and Efficient Reinforcement Learning

自动驾驶场景的自动课程学习:迈向更鲁棒和高效的强化学习

Ahmed Abouelazm, Tim Weinstein, Tim Joseph, Philip Schörner, J. Marius Zöllner

机构 * FZI Research Center for Information Technology(弗赖堡信息科技研究中心) Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 本文提出了一种自动课程学习框架,通过动态生成适应性复杂的驾驶场景,提升强化学习在自动驾驶中的鲁棒性和效率。

Comments Accepted in the 36th IEEE Intelligent Vehicles Symposium (IV 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05312 2026-03-06 cs.RO 50%

UltraDexGrasp: Learning Universal Dexterous Grasping for Bimanual Robots with Synthetic Data

UltraDexGrasp: 为双臂机器人学习通用灵巧抓取

Sizhe Yang, Yiman Xie, Zhixuan Liang, Yang Tian, Jia Zeng, Dahua Lin, Jiangmiao Pang

机构 * Shanghai AI Laboratory(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学) Zhejiang University(浙江大学) The University of Hong Kong(香港大学) Peking University(北京大学)

专题命中 规划决策 :planning(abstract)

AI总结 UltraDexGrasp通过合成数据训练出高效抓取策略,实现双臂机器人在多种物体上的高成功率抓取。

Comments Published at International Conference on Robotics and Automation (ICRA) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05227 2026-03-06 physics.soc-ph cs.CY 50%

The role of spatial scales in assessing urban mobility models

空间尺度在评估城市流动性模型中的作用

Rakhi Manohar Mepparambath, Hoai Nguyen Huynh

专题命中 规划决策 :planning(abstract)

AI总结 本文研究了空间尺度对城市流动性模型性能的影响,发现访问模型在多数情况下表现更优,但在某些尺度下表现最差,揭示了城市结构的空间组织。

Comments Accepted for the World Conference on Transport Research (WCTR) 2026 https://www.wctr2026.fr/submission-review

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05203 2026-03-06 cs.CG 50%

Reconfiguration of Squares Using a Constant Number of Moves Each

使用固定次数移动重新配置正方形

Thijs van der Horst, Maarten Löffler, Tim Ophelders, Tom Peters

专题命中 规划决策 :planning(abstract)

AI总结 研究通过固定次数移动重新配置正方形机器人,证明在多数情况下问题仍为NP难,除非正方形大小为单位或问题无标记。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05108 2026-03-06 cs.RO 50%

GaussTwin: Unified Simulation and Correction with Gaussian Splatting for Robotic Digital Twins

GaussTwin: 基于高斯点播的统一仿真与校正用于机器人数字孪生

Yichen Cai, Paul Jansonnie, Cristiana de Farias, Oleg Arenz, Jan Peters

机构 * Intelligent Autonomous Systems Lab, Technical University of Darmstadt(德累斯顿技术大学智能自主系统实验室) German Research Center for AI (DFKI), SAIROL(德国人工智能研究中心(DFKI)SAIROL) Robotics Institute Germany (RIG)(德国机器人研究所) NAVER LABS Europe(NAVER LABS欧洲)

专题命中 规划决策 :planning(abstract)

AI总结 GaussTwin通过结合物理仿真与高斯点播技术,实现了稳定且真实的数字孪生,提升了机器人操作的跟踪精度和鲁棒性,并支持闭环交互与学习。

Comments 8 pages, 4 figures, 3 tables, ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04959 2026-03-06 cs.HC 50%

Beyond Advocacy: A Design Space for Replication-Related Studies

超越倡导:复制相关研究的设计空间

Yiheng Liang, Kim Marriott, Helen C. Purchase

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种多维设计空间框架,用于系统分析和规划复制研究的设计决策,通过四个维度和三个比较层次,支持复制实验的回顾与前瞻规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04947 2026-03-06 cs.CV 50%

Adaptive Prototype-based Interpretable Grading of Prostate Cancer

自适应原型基于的前列腺癌可解释分级

Riddhasree Bhattacharyya, Pallabi Dutta, Sushmita Mitra

机构 * Machine Intelligence Unit, Indian Statistical Institute, Kolkata 700108(机器智能单元,印度统计研究所,科希马700108)

专题命中 规划决策 :workflow(abstract)

AI总结 本文提出了一种基于原型的弱监督框架,用于从组织病理学图像中可解释地对前列腺癌进行分级,通过预训练、原型感知损失函数和动态剪枝机制提升可解释性和诊断准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04914 2026-03-06 cs.RO cs.SY eess.SY math.OC 50%

U-OBCA: Uncertainty-Aware Optimization-Based Collision Avoidance via Wasserstein Distributionally Robust Chance Constraints

基于不确定性优化的碰撞避免:通过Wasserstein分布鲁棒机会约束

Zehao Wang, Yuxuan Tang, Han Zhang, Jingchuan Wang, Weidong Chen

机构 * School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(自动化与智能感知学院,上海交通大学) Institute of Medical Robotics, Shanghai Jiao Tong University(医学机器人研究所,上海交通大学) Key Laboratory of System Control and Information Processing, Ministry of Education of China(教育部系统控制与信息处理重点实验室) Shanghai Engineering Research Center of Intelligent Control and Management, Shanghai(智能控制与管理上海工程研究中心)

专题命中 规划决策 :planning(abstract)

AI总结 U-OBCA通过引入Wasserstein分布鲁棒机会约束,提升机器人在狭窄环境中的导航效率和轨迹规划的保守性

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04695 2026-03-06 cs.RO 50%

Selecting Spots by Explicitly Predicting Intention from Motion History Improves Performance in Autonomous Parking

通过显式预测意图来选择斑点提高了自动驾驶停车的性能

Long Kiu Chung, David Isele, Faizan M. Tariq, Sangjae Bae, Shreyas Kousik, Jovin D'sa

机构 * Honda Research Institute (HRI)(本田研究机构) Georgia Institute of Technology(佐治亚理工学院)

专题命中 规划决策 :agent(abstract)

AI总结 本文提出了一种通过显式预测意图来选择停车位的自动驾驶停车方法,提高了停车任务的预测准确性、社会接受度和任务完成度。

Comments 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04058 2026-03-06 cs.CV 50%

TumorFlow: Physics-Guided Longitudinal MRI Synthesis of Glioblastoma Growth

TumorFlow: 基于物理的纵向MRI合成胶质瘤生长

Valentin Biller, Niklas Bubeck, Lucas Zimmer, Ayhan Can Erdur, Sandeep Nagar, Anke Meyer-Baese, Daniel Rückert, Benedikt Wiestler, Jonas Weidner

机构 * Technical University of Munich (TUM), Germany(慕尼黑技术大学(TUM)) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心) AI for Image-Guided Diagnosis and Therapy(图像引导诊断与治疗的AI) Chair for AI in Healthcare and Medicine, TUM and TUM University Hospital, Munich, Germany(医疗与医学中的AI主任,慕尼黑技术大学及慕尼黑大学医院)

专题命中 规划决策 :planning(abstract)

AI总结 TumorFlow通过结合生物物理模型和生成模型,实现胶质瘤纵向MRI的合成,提供可解释的肿瘤生长估计和可控的合成数据生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22091 2026-03-06 cs.CV 50%

Learning to Drive is a Free Gift: Large-Scale Label-Free Autonomy Pretraining from Unposed In-The-Wild Videos

学习驾驶是免费礼物:从未经处理的现实视频中进行大规模无标签自主性预训练

Matthew Strong, Wei-Jer Chang, Quentin Herau, Jiezhi Yang, Yihan Hu, Chensheng Peng, Wei Zhan

机构 * Applied Intuition Stanford University(斯坦福大学) UC Berkeley(加州大学伯克利分校)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出一种无标签、教师引导的框架,通过未经处理的现实视频学习自动驾驶表示,无需姿态、标签或LiDAR,实现高效的自动驾驶感知和规划。

Comments Accepted at CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01780 2026-03-06 cs.CV cs.RO 50%

DDP-WM: Disentangled Dynamics Prediction for Efficient World Models

DDP-WM:用于高效世界模型的解耦动态预测

Shicheng Yin, Kaixuan Yin, Weixing Chen, Yang Liu, Guanbin Li, Liang Lin

机构 * School of Computer Science and Engineering, Sun Yat-sen University, Guangzhou, China(计算机科学与工程学院,中山大学,广州,中国) X-Era AI Lab(X-Era人工智能实验室)

专题命中 规划决策 :planning(abstract)

AI总结 DDP-WM通过解耦动态预测原理,提升世界模型的效率与性能,适用于导航、桌面操作及复杂交互任务。

Comments Efficient and high-fidelity world model. Code is available at https://hcplab-sysu.github.io/DDP-WM

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13183 2026-03-06 cs.RO cs.SY eess.SY 50%

Efficient Path Generation with Curvature Guarantees by Mollification

通过 mollification 实现具有曲率保证的高效路径生成

Alfredo González-Calvin, Juan F. Jiménez, Héctor García de Marina

机构 * Department of Computer Architecture and Automation, Faculty of Physics, Complutense University of Madrid(计算机架构与自动化系,物理学院,马德里康普顿斯大学) Department of Computer Engineering, Automation, and Robotics (ICAR) & Institute of Mathematics (IMAG), University of Granada(计算机工程、自动化与机器人系(ICAR)及数学研究所(IMAG),格拉纳达大学)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出通过 mollification 方法高效生成具有曲率保证的路径,提升移动机器人路径规划的实时性和可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11368 2026-03-06 cs.DS 50%

An $O(n\log n)$ Algorithm for Single-Item Lot Sizing with a One-Breakpoint All-Units Discount and Non-Increasing Prices

一个具有单件订货量折扣和非递增价格的O(n log n)算法

Kleitos Papadopoulos

专题命中 规划决策 :planning(abstract)

AI总结 本文提出一个O(n log n)算法,解决具有单件订货量折扣和非递增价格的单件订货问题,改进了传统算法的时间复杂度。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 多智能体 21 篇

2511.03153 2026-03-06 cs.SE cs.AI 90%

RefAgent: A Multi-agent LLM-based Framework for Automatic Software Refactoring

RefAgent:一种基于大型语言模型的多智能体框架,用于自动软件重构

Khouloud Oueslati, Maxime Lamothe, Foutse Khomh

机构 * Polytechnique Montreal(蒙特利尔大学)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);planning(abstract);分类 cs.AI、cs.SE

AI总结 RefAgent是一种基于多智能体的LLM框架,用于自动化软件重构,通过自我反思和工具调用能力提升重构效率和代码质量。

详情

展开后加载摘要…

URL PDF HTML 收藏