arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-03-13 至 2026-03-13 共收录 130 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 53 篇

2603.11781 2026-03-13 cs.AI cs.CL cs.MA 73%

From Debate to Deliberation: Structured Collective Reasoning with Typed Epistemic Acts

从辩论到 deliberation:基于类型化认知行为的结构化集体推理

Sunil Prakash

机构 * Indian School of Business(印度管理学院)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出DCI框架,通过结构化集体推理提升复杂任务决策质量,但指出其成本较高,需在过程问责性与效率间权衡。

Comments 26 pages, 6 tables, 2 figures, 2 listings

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11137 2026-03-13 cs.LG cs.CL 73%

Scaling Reasoning Efficiently via Relaxed On-Policy Distillation

通过放松的在线策略蒸馏高效扩展推理能力

Jongwoo Ko, Sara Abdali, Young Jin Kim, Tianyi Chen, Pashmina Cameron

专题命中 规划决策 :tool-use(abstract);agentic(abstract);分类 cs.CL、cs.LG

AI总结 REOPOLD通过放松在线策略蒸馏的约束,提升模型训练效率和推理扩展能力,尤其在视觉推理任务中表现突出。

Comments Code will be available soon

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11554 2026-03-13 cs.CV cs.AI cs.RO 70%

MANSION: Multi-floor lANguage-to-3D Scene generatIOn for loNg-horizon tasks

MANSION: 多楼层语言到3D场景生成用于长周期任务

Lirong Che, Shuo Wen, Shan Huang, Chuang Wang, Yuzhe Yang, Gregory Dudek, Xueqian Wang, Jian Su

机构 * Tsinghua University(清华大学) AgiBot McGill University, MILA - Quebec AI Institute(麦吉尔大学,魁北克人工智能研究所)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.AI

AI总结 MANSION是首个多楼层语言驱动的3D场景生成框架,能生成真实可导航的建筑环境,支持跨楼层长周期任务的开发与评估,同时配套发布MansionWorld数据集和任务语义编辑代理,为空间推理和规划提供关键测试平台。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09151 2026-03-13 cs.AI 70%

Deep Tabular Research via Continual Experience-Driven Execution

通过持续经验驱动执行进行深度表格研究

Junnan Dong, Chuang Zhou, Zheng Yuan, Yifei Yu, Qiufeng Wang, Yinghui Li, Siyu An, Di Yin, Xing Sun, Feiyue Huang

专题命中 规划决策 :planning(abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出深度表格研究(DTR)框架,通过闭环决策过程解决复杂表格分析问题,利用分层元图和期望感知策略实现持续优化,验证了战略规划与低层执行分离的重要性。

Comments 23 pages, 6 tables, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12266 2026-03-13 cs.CV 67%

MM-CondChain: A Programmatically Verified Benchmark for Visually Grounded Deep Compositional Reasoning

MM-CondChain: 一种可编程验证的视觉基础深度组合推理基准

Haozhan Shen, Shilin Yan, Hongwei Xue, Shuaiqi Lu, Xiaojun Tang, Guannan Zhang, Tiancheng Zhao, Jianwei Yin

专题命中 规划决策 :workflow(abstract);agentic(abstract)

AI总结 MM-CondChain提出了一种可编程验证的视觉基础深度组合推理基准,通过多层推理链评估多模态大语言模型在复杂视觉任务中的表现,实验表明深度组合推理仍是重大挑战。

Comments Project Page: https://accio-lab.github.io/MM-CondChain

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11948 2026-03-13 cs.NI 67%

Kraken*: Architecting Generative, Semantic, and Goal-Oriented Network Management for 6G Wireless Systems

Kraken*:为6G无线系统构建生成、语义和目标导向的网络管理

Ian F. Akyildiz, Tuğçe Bilen

专题命中 规划决策 :agent(abstract);multi-agent(abstract)

AI总结 Kraken*通过整合语义通信、生成式推理和目标导向优化,为6G无线系统提供生成、语义和目标导向的网络管理架构,推动向知识原生6G系统演进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07654 2026-03-13 cs.RO 67%

Time as a Control Dimension in Robot Learning

时间作为机器人学习中的控制维度

Yinsen Jia, Boyuan Chen

机构 * Department of Electrical and Computer Engineering, Duke University(杜克大学电气与计算机工程系) Department of Mechanical Engineering and Materials Science, Duke University(杜克大学机械工程与材料科学系) Department of Computer Science, Duke University(杜克大学计算机科学系)

专题命中 规划决策 :agent(abstract);multi-agent(abstract)

AI总结 本文提出时间感知策略学习框架,将时间作为机器人行为的控制维度,通过时间信号调节策略执行策略,提升效率、鲁棒性和可控性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12038 2026-03-13 cs.LG cs.AI 62%

Slow-Fast Inference: Training-Free Inference Acceleration via Within-Sentence Support Stability

慢-快推理:通过句内支持稳定性实现无需训练的推理加速

Xingyu Xie, Zhaochen Yu, Yue Liao, Tao Wang, Kim-Chuan Toh, Shuicheng Yan

机构 * National University of Singapore(新加坡国立大学) ByteDance(字节跳动)

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.LG

AI总结 SFI通过利用句内支持稳定性,将生成过程分为快速低成本步骤和偶尔的密集注意力慢步骤,从而提高解码吞吐量并保持质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20823 2026-03-13 cs.CV cs.AI cs.LG 62%

RefTr: Recurrent Refinement of Confluent Trajectories for 3D Vascular Tree Centerlines

RefTr: 基于连通轨迹的3D血管树中心线递归细化

Roman Naeem, David Hagerman, Jennifer Alvén, Fredrik Kahl

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 RefTr通过递归细化连通轨迹生成3D血管树中心线,采用Transformer架构提升精度并减少参数,实验显示其在性能、速度和参数数量上均优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06214 2026-03-13 cs.CL cs.AI math-ph math.MP quant-ph 62%

Can Theoretical Physics Research Benefit from Language Agents?

理论物理研究能否从语言代理中受益?

Sirui Lu, Zhijing Jin, Terry Jingchen Zhang, Pavel Kos, J. Ignacio Cirac, Bernhard Schölkopf

专题命中 规划决策 :AI agent(abstract);分类 cs.AI、cs.CL

AI总结 本文探讨了语言代理在理论物理研究中的潜力,指出需专门训练和工具支持,以实现多模态数据处理、物理假设提出和理论验证的AI代理。

Comments 8+2 pages + references

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08848 2026-03-13 cs.NI cs.AI cs.LG 62%

RouteNet-Gauss: Hardware-Enhanced Network Modeling with Machine Learning

RouteNet-Gauss:利用机器学习的硬件增强网络建模

Carlos Güemes-Palau, Miquel Ferriol-Galmés, Jordi Paillisse-Vilanova, Albert López-Brescó, Pere Barlet-Ros, Albert Cabellos-Aparicio

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 RouteNet-Gauss通过结合测试床网络与机器学习模型,利用硬件加速提升网络仿真效率和准确性,减少预测误差达95%,推理速度提升488倍,支持动态构建模块化架构和时间聚合性能估计。

Comments This article has been accepted for publication in IEEE Transactions on Networking. This is the author's version which has not been fully edited, content may change prior to final publication. Citation information: DOI 10.1109/TON.2026.3668972 \c{opyright} 2026 IEEE. All rights reserved. Personal use is permitted, permission from IEEE must be obtained for all other uses

Journal ref IEEE Transactions on Networking. 34 (2026) 3840-3853

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11757 2026-03-13 cs.LG cs.AI stat.ML 62%

Exploiting Expertise of Non-Expert and Diverse Agents in Social Bandit Learning: A Free Energy Approach

利用非专家和多样智能体的专长进行社会老虎机学习:一种自由能方法

Erfan Mirzaei, Seyed Pooya Shariatpanahi, Alireza Tavakoli, Reshad Hosseini, Majid Nili Ahmadabadi

机构 * Cognitive Systems Lab., School of Electrical and Computer Engineering, College of Engineering, University of Tehran(认知系统实验室,电气与计算机工程学院,工程学院,塔里班大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种基于自由能的社会老虎机学习算法,通过评估其他代理的专长水平来提升学习效果,同时在各种场景中保持对数遗憾。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11400 2026-03-13 cs.RO cs.AI cs.LG 62%

Deployment-Time Reliability of Learned Robot Policies

部署时学习机器人策略的可靠性

Christopher Agia

机构 * STANFORD UNIVERSITY(斯坦福大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文研究了如何通过部署时机制提升学习机器人策略的可靠性,提出运行时监控、数据驱动的可解释性框架及长周期任务执行方法,以应对部署中的分布偏移、误差叠加和复杂依赖性问题。

Comments Stanford University PhD dissertation, 2026. 182 pages, 37 figures. Available from Stanford Digital Repository

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11904 2026-03-13 cs.SE 57%

A Collaborative and Pattern-Based Training Approach to Knowledge Acquisition and Decision-Making During the Design of Software Architectures Courses: A Case Study

一种基于协作和模式的训练方法用于软件架构课程设计中的知识获取与决策制定:一个案例研究

Wilson Libardo Pantoja Yepez, Luis Mariano Bibbo, Julio Ariel Hurtado Alegría

专题命中 规划决策 :planning(abstract);分类 cs.SE

AI总结 本文提出了一种基于协作和模式的训练方法,用于软件架构课程设计中的知识获取与决策制定,通过案例研究展示了如何通过训练模式提升学生能力。

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11520 2026-03-13 cs.CV cs.AI 57%

FBCIR: Balancing Cross-Modal Focuses in Composed Image Retrieval

FBCIR: 在组合图像检索中平衡跨模态聚焦

Chenchen Zhao, Jianhuan Zhuo, Muxi Chen, Zhaohua Zhang, Wenyu Jiang, Tianwen Jiang, Qiuyong Xiao, Jihong Zhang, Qiang Xu

专题命中 规划决策 :workflow(abstract);分类 cs.AI

AI总结 本文提出FBCIR方法,通过分析CIR模型中的聚焦不平衡问题,提出数据增强工作流程以提升模型在挑战性场景下的性能。

Comments 20 pages, 5 figures, 15 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11110 2026-03-13 cs.RO cs.AI 57%

ResWM: Residual-Action World Model for Visual RL

ResWM:基于视觉强化学习的残差动作世界模型

Jseen Zhang, Gabriel Adineera, Jinzhou Tan, Jinoh Kim

机构 * University of California, San Diego(加州大学圣地亚哥分校) Texas A&M University-Commerce(德克萨斯A&M大学-科摩斯)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 ResWM通过将控制变量从绝对动作转换为残差动作,提升了视觉强化学习中世界模型的预测能力和稳定性,实现了更高效的样本利用和更平滑的控制策略。

Comments Submit KDD2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19281 2026-03-13 cs.AI 57%

Limited Reasoning Space: The cage of long-horizon reasoning in LLMs

有限推理空间:LLMs中长视图推理的牢笼

Zhenyu Li, Guanlin Wu, Cheems Wang, Yongqiang Zhao

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文提出Halo框架,通过熵驱动的双控制器实现可控推理,解决LLM长视图任务中的推理限制问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20299 2026-03-13 cs.RO cs.AI cs.CV 57%

KnowVal: A Knowledge-Augmented and Value-Guided Autonomous Driving System

KnowVal: 一种知识增强且价值引导的自动驾驶系统

Zhongyu Xia, Wenhao Chen, Yongtao Wang, Ming-Hsuan Yang

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学王学苑计算机技术研究所) University of California, Merced(加州大学默塞德分校)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 KnowVal通过整合开放世界感知与知识检索,构建驾驶知识图谱并训练价值模型,实现价值对齐的自动驾驶系统,提升了规划性能并降低了碰撞率。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06002 2026-03-13 cs.RO cs.AI 57%

POrTAL: Plan-Orchestrated Tree Assembly for Lookahead

POrTAL: 面向前瞻的计划-协调树组装

Evan Conway, David Porfirio, David Chan, Mark Roberts, Laura M. Hiatt

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 POrTAL是一种结合FF-Replan和POMCP优势的轻量级概率规划算法,通过高效规划在有限计算资源下实现更优的最终计划长度。

Comments Submitted to IROS 26

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26489 2026-03-13 cs.CV cs.LG eess.SP 57%

Contrastive Diffusion Guidance for Spatial Inverse Problems

对比扩散引导用于空间逆问题

Sattwik Basu, Chaitanya Amballa, Zhongweiyang Xu, Jorge Vančo Sampedro, Srihari Nelakuditi, Romit Roy Choudhury

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of South Carolina(南卡罗来纳大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出CoGuide模型,通过对比学习在平滑嵌入空间中近似似然分数,以解决空间逆问题中的非可微前向算子挑战,实现更稳定的去噪和更稳健的重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20681 2026-03-13 cs.RO cs.AI cs.CV 57%

Efficient Construction of Implicit Surface Models From a Single Image for Motion Generation

从单张图像高效构建隐式表面模型用于运动生成

Wei-Teng Chu, Tianyi Zhang, Matthew Johnson-Roberson, Weiming Zhi

机构 * Department of Electrical Engineering, Stanford University, USA(美国斯坦福大学电气工程系) Aurora Innovation, USA(美国Aurora Innovation公司) School of Computer Science, The University of Sydney, Australia(澳大利亚悉尼大学计算机科学学院) Australian Centre for Robotics, The University of Sydney, Australia(澳大利亚悉尼大学机器人中心) College of Connected Computing, Vanderbilt University, USA(美国范德比尔特大学连接计算学院)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文提出FINS框架,通过单张图像高效重建高保真表面和SDF场,提升机器人运动生成的效率和精度。

Comments 9 pages, 6 figures, 2026 IEEE International Conference on Robotics and Automation (ICRA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18607 2026-03-13 cs.AI 57%

From Entity-Centric to Goal-Oriented Graphs: Enhancing LLM Knowledge Retrieval in Minecraft

从以实体为中心到以目标为导向的图:增强Minecraft中的LLM知识检索

Jonathan Leung, Yongjie Wang, Zhiqi Shen

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文提出目标导向图(GoG)框架,通过构建目标依赖关系图提升LLM在Minecraft中的步骤推理能力,实验表明其优于GraphRAG等方法。

Comments Accepted at Knowledge-Based Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00622 2026-03-13 cs.RO cs.CV cs.LG 57%

Inference-Time Enhancement of Generative Robot Policies via Predictive World Modeling

生成式预测控制:通过预测世界建模增强推理时间的机器人策略

Han Qi, Haocheng Yin, Aris Zhu, Yilun Du, Heng Yang

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 GPC通过预测世界建模在推理时间提升机器人策略,结合生成先验与前瞻性预测,实现测试时间适应,优于行为克隆并与其他基线方法相媲美。

Comments Acceptance to IEEE Robotics and Automation Letters. Website: https://computationalrobotics.seas.harvard.edu/GPC

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12195 2026-03-13 cs.CR 50%

Privacy in ERP Systems: Behavioral Models of Developers and Consultants

ERP系统中的隐私:开发者和顾问的行为模型

Alicia Pang, Katsiaryna Labunets, Olga Gadyatskaya

专题命中 规划决策 :planning(abstract)

AI总结 本文研究了ERP系统中开发者和顾问的隐私行为模型,通过主题分析揭示其隐私意识,以促进更合适的隐私实践。

Comments This paper was presented at the 20th International Conference on Risks and Security of Internet and Systems (CRISIS'2025) and will appear in its post-proceedings. This is authors' copy

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11980 2026-03-13 cs.RO 50%

Learning Visuomotor Policy for Multi-Robot Laser Tag Game

多机器人激光对抗游戏的视觉运动策略学习

Kai Li, Shiyu Zhao

专题命中 规划决策 :agent(abstract)

AI总结 本文提出了一种端到端的视觉运动策略,通过多智能体强化学习训练教师策略并蒸馏知识,以提升多机器人激光对抗游戏中的命中精度和碰撞避免性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11963 2026-03-13 cs.RO 50%

Energy Prediction on Sloping Ground for Quadruped Robots

四足机器人在斜坡地面的能量预测

Mohamed Ounally, Cyrille Pierre, Johann Laconte

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种基于机载传感器的四足机器人斜坡地面能耗模型,通过实地验证展示了能耗与坡度角及航向的关系,支持路径级能量预测。

Comments Presented at 3D-Advice (Advanced 3D Vision for Complex Environments) Workshop, ECMR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21884 2026-03-13 cs.RO 50%

Scalable Surface-Based Manipulation Through Modularity and Inter-Module Object Transfer

通过模块化和模块间物体转移实现可扩展的表面操控

Pratik Ingle, Jørn Lambertsen, Kasper Støy, Andres Faina

机构 * IT University(丹麦技术大学)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种多模块柔软操控平台,通过模块间物体转移和共享边界驱动实现亚厘米级定位,同时减少驱动器数量并降低模块间干扰,为食品加工和物流等应用提供可扩展的柔软操控解决方案。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11920 2026-03-13 cs.NI 50%

The Network That Thinks: Kraken* and the Dawn of Cognitive 6G

会思考的网络:Kraken* 与认知6G的黎明

Ian F. Akyildiz, Tuğçe Bilen

专题命中 规划决策 :agent(abstract)

AI总结 Kraken是一种面向6G的智能网络架构,通过语义通信、生成推理和目标优化实现集体智能,提升自动驾驶、XR服务和基础设施监控的效率与响应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11551 2026-03-13 cs.HC cs.CV cs.GR 50%

Shadowless Projection Mapping for Tabletop Workspaces with Synthetic Aperture Projector

无阴影的投影映射用于桌面工作区的合成孔径投影机

Takahiro Okamoto, Masaki Takeuchi, Masataka Sawayama, Daisuke Iwai

机构 * Graduate School of Engineering Science, The University of Osaka(大阪大学工学研究科) Graduate School of Information Science and Technology, Hokkaido University and Prometech CG Research(北海道大学信息科学与技术研究生院及Prometech CG研究所)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种无延迟、无阴影的桌面工作区投影映射系统,通过密集布置的投影机实现高分辨率投影,同时开发了离线模糊补偿方法以减少子像素错位影响,并定义了‘投影感’概念以优化PM设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11528 2026-03-13 cs.CY 50%

Highly Autonomous Cyber-Capable Agents: Anticipating Capabilities, Tactics, and Strategic Implications

高度自主的网络能力代理:预见能力、战术与战略影响

Jam Kraprayoon, Shaun Ee, Brianna Rosen, Yohan Matthew, Aditya Singh, Christopher Covino, Asher Brass Gershovich

专题命中 规划决策 :agent(abstract)

AI总结 本报告探讨了高度自主的网络能力代理的概念、核心战术及战略影响,并提出七项政策建议以应对由此带来的安全挑战。

Comments 159 pages

详情

展开后加载摘要…

URL PDF HTML 收藏