arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-03-03 至 2026-03-03 共收录 299 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 103 篇

2602.23239 2026-03-03 cs.AI cs.CY 57%

Agency and Architectural Limits: Why Optimization-Based Systems Cannot Be Norm-Responsive

代理与架构限制:为何基于优化的系统无法回应规范

Radha Sarma

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 本文指出基于优化的系统无法回应规范,提出真正的代理性需要不可比较的边界和否定性回应机制,揭示了优化与规范治理的不兼容性及由此引发的收敛危机。

Comments About 10,600 words in all (includes ~1000 words of literature and ~2400 words of Appendices). Under journal review

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05606 2026-03-03 cs.CV cs.CL 57%

Uni-cot: Towards Unified Chain-of-Thought Reasoning Across Text and Vision

Uni-cot: 向跨文本和视觉的统一链式推理迈进

Luozheng Qin, Jia Gong, Yuqing Sun, Tianjiao Li, Mengping Yang, Xiaomeng Yang, Chao Qu, Zhiyu Tan, Hao Li

机构 * Shanghai Academy of AI for Science(上海人工智能科学研究院) Fudan University(复旦大学) Nanyang Technological University(南洋理工大学)

专题命中 规划决策 :planning(abstract);分类 cs.CL

AI总结 Uni-CoT通过统一的链式推理框架实现跨文本和视觉的连贯多模态推理,采用宏级和微级推理范式,提升多模态推理的效率和性能。

Comments Accepted by ICLR 2026, Project Page: https://sais-fuxi.github.io/projects/uni-cot/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22050 2026-03-03 cs.CL 57%

DeepSieve: Information Sieving via LLM-as-a-Knowledge-Router

DeepSieve: 通过LLM作为知识路由器实现信息筛分

Minghao Guo, Qingcheng Zeng, Xujiang Zhao, Yanchi Liu, Wenchao Yu, Mengnan Du, Haifeng Chen, Wei Cheng

机构 * Rutgers University(罗格斯大学) Northwestern University(西北大学) NEC Laboratories America(NEC美国实验室) NJIT(新泽西理工学院)

专题命中 规划决策 :agentic(abstract);分类 cs.CL

AI总结 DeepSieve通过LLM作为知识路由器实现信息筛分,提升多跳问答任务的推理深度、检索精度和可解释性。

Comments Accepted by EACL Findings 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16004 2026-03-03 quant-ph cs.LG 57%

Minor Embedding for Quantum Annealing with Reinforcement Learning

量子退火中的强化学习用于次要嵌入

Riccardo Nembrini, Maurizio Ferrari Dacrema, Paolo Cremonesi

机构 * Politecnico di Milano(米兰理工大学)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 本文提出了一种基于强化学习的量子退火次要嵌入方法,利用近端策略优化智能体在不同硬件拓扑上高效生成有效嵌入。

Journal ref Quantum Machine Intelligence, 8, 15 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19965 2026-03-03 cs.AI 57%

Adaptive Location Hierarchy Learning for Long-Tailed Mobility Prediction

自适应位置层级学习用于长尾移动预测

Yu Wang, Junshu Dai, Yuchen Ying, Hanyang Yuan, Zunlei Feng, Tongya Zheng, Mingli Song

机构 * Zhejiang University(浙江大学) Hangzhou City University(杭州市大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 ALOHA通过自适应层级学习缓解长尾移动预测偏差,提升多种模型的预测性能达16.59%。

Comments Accepted by WWW 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00974 2026-03-03 cs.LG cs.SY eess.SY 57%

Intent-Context Synergy Reinforcement Learning for Autonomous UAV Decision-Making in Air Combat

意图-上下文协同强化学习用于空中作战中自主无人机决策

Jiahao Fu, Feng Yang

机构 * National Elite Institute of Engineering,Northwestern Polytechnical University(西北工业大学工程精英学院) School of Automation, Northwestern Polytechnical University(西北工业大学自动化学院)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出意图-上下文协同强化学习框架,通过意图预测模块和上下文分析协同机制,提升无人机在动态对抗环境中的自主决策能力与任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00686 2026-03-03 cs.CL 57%

RAVEL: Reasoning Agents for Validating and Evaluating LLM Text Synthesis

RAVEL: 用于验证和评估大语言模型文本合成的推理代理

Andrew Zhuoer Feng, Cunxiang Wang, Yu Luo, Bosi Wen, Yidong Wang, Lin Fan, Yilin Zhou, Zikang Wang, Wenbo Yu, Lindong Wu, Hongning Wang, Minlie Huang

专题命中 规划决策 :agentic(abstract);分类 cs.CL

AI总结 RAVEL通过引入智能体框架和C3EBench基准,评估LLM在文本合成中的推理能力,发现推理能力比生成能力更重要。

Comments 35 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07233 2026-03-03 cs.CL 57%

LAD-RAG: Layout-aware Dynamic RAG for Visually-Rich Document Understanding

LAD-RAG:面向视觉丰富文档的布局感知动态RAG

Zhivar Sourati, Zheng Wang, Marianne Menglin Liu, Yazhe Hu, Mengqing Guo, Sujeeth Bharadwaj, Kyu Han, Tao Sheng, Sujith Ravi, Morteza Dehghani, Dan Roth

专题命中 规划决策 :agent(abstract);分类 cs.CL

AI总结 LAD-RAG通过构建布局感知的文档图和动态检索机制,提升视觉丰富文档的检索与问答性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00144 2026-03-03 cs.CV cs.AI 57%

Disentangled Hierarchical VAE for 3D Human-Human Interaction Generation

解耦层次变分自编码器用于3D人-人交互生成

Zichen Geng, Zeeshan Hayder, Bo Miao, Jian Liu, Wei Liu, Ajmal Mian

机构 * Department of CSSE, The University of Western Australia(西澳大学计算机科学与工程系) Data61, CSIRO(澳大利亚联邦科学工业研究组织Data61部门) Australian Institute for Machine Learning, The University of Adelaide(澳大利亚阿德莱德大学人工智能研究所) NERC-RVC, Hunan University(湖南大学NERC-RVC部门)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 本文提出DHVAE,通过解耦层次变分自编码器生成结构化且可控的3D人-人交互,提升运动保真度和物理合理性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01700 2026-03-03 cs.RO 50%

TacMamba: A Tactile History Compression Adapter Bridging Fast Reflexes and Slow VLA Reasoning

TacMamba: 一种连接快速反射与慢速VLA推理的触觉历史压缩适配器

Zhenan Wang, Yanzhe Wang, Meixuan Ren, Peng Li, Yang Liu, Yifei Nie, Limin Long, Yun Ye, Xiaofeng Wang, Zhen Zhu, Huixu Dong

机构 * Zhejiang University(浙江大学) GigaAI Harbin Institute of Technology(哈尔滨工业大学)

专题命中 规划决策 :planning(abstract)

AI总结 TacMamba通过触觉历史压缩器和双阶段训练策略,实现高频率触觉数据与低频视觉推理的高效融合,提升实时任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01560 2026-03-03 cs.RO 50%

(hu)Man vs. Machine: In the Future of Motorsport, can Autonomous Vehicles Compete?

人与机器:在赛车未来中,自动驾驶车辆能竞争吗?

Armand Amaritei, Amber-Lily Blackadder, Sebastian Donnelly, Lora Hernandez, James Vine, Alexander Rast, Matthias Rolf, Andrew Bradley

机构 * Autonomous Driving and Intelligent Transport Group, Oxford Brookes University, UK(自主驾驶与智能交通组,奥克斯伯里大学,英国) School of Engineering, Computing & Mathematics, Oxford Brookes University, UK(工程、计算与数学学院,奥克斯伯里大学,英国) Artificial Intelligence, Data Analysis and Systems Institute, Oxford Brookes University, UK(人工智能、数据分析与系统研究所,奥克斯伯里大学,英国)

专题命中 规划决策 :planning(abstract)

AI总结 本文探讨自动驾驶车辆与人类在赛车未来中的竞争可能性,分析技术性能与挑战,提出未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01517 2026-03-03 cs.AR cs.RO 50%

RoboGPU: Accelerating GPU Collision Detection for Robotics

RoboGPU:加速机器人中的GPU碰撞检测

Lufei Liu, Liwei Xue, Youssef Mohammed, Jocelyn Zhao, Yuan Hsi Chou, Tor M. Aamodt

机构 * University of British Columbia(不列颠哥伦比亚大学)

专题命中 规划决策 :planning(abstract)

AI总结 RoboGPU 通过改进 GPU 的光线追踪加速器单元,显著提升了机器人碰撞检测的速度,同时适用于其他机器人任务,兼顾性能与灵活性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01063 2026-03-03 cs.CV 50%

Unleashing VLA Potentials in Autonomous Driving via Explicit Learning from Failures

通过从失败中显式学习解锁VLA在自动驾驶中的潜力

Yuechen Luo, Qimao Chen, Fang Li, Shaoqing Xu, Jaxin Liu, Ziying Song, Zhi-xin Yang, Fuxi Wen

机构 * Tsinghua University(清华大学) University of Macau(澳门大学) Beijing Jiaotong University(北京交通大学)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出ELF-VLA框架,通过显式学习失败来提升自动驾驶中VLA模型的性能,实现关键场景的解决并取得SOTA效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23658 2026-03-03 cs.ET cs.HC 50%

Critical Infrastructure in the Multi-Cloud Strategy: Use of Cloud Computing in SMEs

多云战略中的关键基础设施:中小企业中云计算的使用

Ruwan Nagahawatta, Sachithra Lokuge, Matthew Warren, Scott Salzman

专题命中 规划决策 :planning(abstract)

AI总结 本文研究了中小企业在关键基础设施领域使用云计算的情况,揭示了其部署模式及风险,并为相关企业和政策制定者提供参考。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04366 2026-03-03 cs.HC cs.MM 50%

Towards Aligning Multimodal LLMs with Human Experts: A Focus on Parent-Child Interaction

向人类专家对齐多模态大语言模型:聚焦亲子互动

Weiyan Shi, Kenny Tsu Wei Choo

专题命中 规划决策 :workflow(abstract)

AI总结 本文探讨了如何通过两阶段提示方法使多模态大语言模型更有效地对齐语言治疗师在分析亲子互动中的联合注意,揭示了观察层与判断层对齐的差异及挑战。

Comments Accepted at CHI 2026 Full Papers

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23721 2026-03-03 cs.RO 50%

DA-MMP: Learning Coordinated and Accurate Throwing with Dynamics-Aware Motion Manifold Primitives

DA-MMP:学习协调且准确的投掷动作:动态感知的运动流形原语

Chi Chu, Huazhe Xu

机构 * Shanghai Qi Zhi Institute(上海启智研究院) Institute for Interdisciplinary Information Sciences, Tsinghua University(清华大学交叉信息研究院)

专题命中 规划决策 :planning(abstract)

AI总结 DA-MMP通过动态感知的运动流形原语,实现了高协调性投掷动作的生成,优于人类专家并能推广至新目标。

Comments Accepted to ICRA 2026. Project page: https://cc299792458.github.io/da-mmp/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19551 2026-03-03 eess.SY cs.SY eess.SP 50%

Customising Electricity Contracts at Scale with Large Language Models

利用大语言模型大规模定制电力合同

Jochen L. Cremer

专题命中 规划决策 :planning(abstract)

AI总结 本文利用大语言模型大规模定制电力合同,解决电网约束下的自动化合同设计问题,提升电网规划和客户管理效率。

Comments 14 pages, 21 figures

Journal ref IEEE Transactions on Power Systems, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11917 2026-03-03 cs.RO 50%

OneTwoVLA: A Unified Vision-Language-Action Model with Adaptive Reasoning

OneTwoVLA:一种具有自适应推理能力的统一视觉-语言-动作模型

Fanqi Lin, Ruiqian Nai, Yingdong Hu, Jiacheng You, Junming Zhao, Yang Gao

机构 * Tsinghua University(清华大学) Shanghai Qi Zhi Institute(上海启智研究院)

专题命中 规划决策 :planning(abstract)

AI总结 OneTwoVLA通过自适应推理机制实现视觉-语言-动作统一,提升机器人在复杂任务中的规划、交互与执行能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00948 2026-03-03 cs.RO 50%

HierKick: Hierarchical Reinforcement Learning for Vision-Guided Soccer Robot Control

HierKick:基于分层强化学习的视觉引导足球机器人控制

Yizhi Chen, Zheng Zhang, Zhanxiang Cao, Yihe Chen, Shengcheng Fu, Liyun Yan, Yang Zhang, Jiali Liu, Haoyang Li, Yue Gao

机构 * Tongji University(同济大学) Shanghai Innovation Institute(上海创新研究院) Shanghai Jiao Tong University(上海交通大学) Jiangxi University of Finance(江西财经大学) East China Normal University(华东师范大学)

专题命中 规划决策 :planning(abstract)

AI总结 HierKick通过双频分层强化学习框架,结合视觉检测与任务选择,实现足球机器人多时间尺度决策控制,提升复杂环境下的任务成功率。

Comments 15 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00913 2026-03-03 cs.RO 50%

Minimalist Compliance Control

极简合规控制

Haochen Shi, Songbo Hu, Yifan Hou, Weizhuo Wang, Karen Liu, Shuran Song

专题命中 规划决策 :planning(abstract)

AI总结 极简合规控制通过仅使用电机电流或电压信号实现无需力传感器的合规控制,适用于多种机器人和规划方法。

Comments Project website: https://minimalist-compliance-control.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00871 2026-03-03 cs.RO 50%

Hippo: High-performance Interior-Point and Projection-based Solver for Generic Constrained Trajectory Optimization

Hippo: 高性能内点法和投影求解器用于通用约束轨迹优化

Haizhou Zhao, Ludovic Righetti, Majid Khadiv

机构 * Tandon School of Engineering, New York University(纽约大学Tandon工程学院) Munich Institute of Robotics and Machine Intelligence (MIRMI), Technical University of Munich (TUM)(慕尼黑机器人与智能机器研究所(MIRMI),慕尼黑技术大学)

专题命中 规划决策 :planning(abstract)

AI总结 Hippo是一种高效的求解器,通过内点法和投影方法处理约束轨迹优化问题,适用于复杂机器人任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00847 2026-03-03 cs.HC 50%

Constructing Everyday Well-Being: Insights from God-Saeng for Personal Informatics

构建日常幸福:来自God-Saeng的个人信息化洞察

Inhwa Song, Kwangyoung Lee, Janghee Cho, Amon Rapp, Hwajung Hong

专题命中 规划决策 :planning(abstract)

AI总结 研究通过分析韩国God-Saeng现象,探讨个人信息化系统如何通过数据化和社交文化背景帮助用户平衡日常幸福中的矛盾。

Comments 12 pages, 4 figures. To appear in CHI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00732 2026-03-03 cs.RO cs.CV 50%

UniHM: Unified Dexterous Hand Manipulation with Vision Language Model

UniHM: 一体化的视觉语言模型用于统一的灵巧手操作

Zhenhao Zhang, Jiaxin Liu, Ye Shi, Jingya Wang

机构 * ShanghaiTech University(上海科技大学) InstAdapt

专题命中 规划决策 :planning(abstract)

AI总结 UniHM通过统一的视觉语言模型实现灵巧手操作,利用开放词汇指令提升泛化能力和物理可行性。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00553 2026-03-03 math.ST stat.TH 50%

Minimax Simple Bayes Estimators of a Normal Variance

最小最大简单贝叶斯方差估计器

Yuzo Maruyama

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种简洁的贝叶斯估计器,解决了正态方差在熵损失下的最小最大性问题,提供了闭式结果。

Comments 6 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00503 2026-03-03 cs.CV 50%

M$^2$: Dual-Memory Augmentation for Long-Horizon Web Agents via Trajectory Summarization and Insight Retrieval

M$^2$: 通过轨迹摘要和洞察检索实现长 horizon 网络代理的双记忆增强

Dawei Yan, Haokui Zhang, Guangda Huzhang, Yang Li, Yibo Wang, Qing-Guo Chen, Zhao Xu, Weihua Luo, Ying Li, Wei Dong, Chunhua Shen

机构 * Northwestern Polytechnical University, Xi'an, China(西北工业大学) AI Business, Alibaba Group, Hangzhou, China(阿里云人工智能业务) Xi'an University of Architecture(西安建筑科技大学) Zhejiang University, Hangzhou, China(浙江大学)

专题命中 规划决策 :agent(abstract)

AI总结 M$^2$通过双记忆机制提升长 horizon 网络代理的上下文效率和决策鲁棒性,实现更高成功率和更低计算成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00319 2026-03-03 cs.RO cs.SY eess.SY 50%

Modeling PWM-Time-SOC Interaction in a Simulated Robot

在模拟机器人中建模PWM-时间-SOC交互

Vidyut Pradeep, Shirantha Welikala

机构 * South Brunswick High School(南布兰伍德高中) Stevens Institute of Technology(史蒂文斯理工学院)

专题命中 规划决策 :planning(abstract)

AI总结 本研究通过结合物理模型与数据信息,开发了一个预测模拟机器人中SOC耗尽与PWM占空比和时间关系的非线性模型,用于能量感知规划和实际应用扩展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06267 2026-03-03 cs.RO 50%

Robust Differentiable Collision Detection for General Objects

鲁棒可微碰撞检测用于通用物体

Jiayi Chen, Wei Zhao, Liangwang Ruan, Baoquan Chen, He Wang

机构 * Peking University(北京大学) Galbot Tsinghua University(清华大学) The Hong Kong Polytechnic University(香港理工大学)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种鲁棒且高效的可微碰撞检测框架,支持凸和凹物体,通过基于距离的随机平滑、自适应采样和等价梯度传输提升梯度计算的鲁棒性和信息性,并在复杂网格上实现了显著的性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22339 2026-03-03 cs.CV 50%

CircuitSense: A Hierarchical MLLM Benchmark Bridging Visual Comprehension and Symbolic Reasoning in Engineering Design Process

CircuitSense: 一种层次化的MLLM基准,连接视觉理解和符号推理在工程设计过程

Arman Akbari, Jian Gao, Yifei Zou, Mei Yang, Jinru Duan, Dmitrii Torbunov, Yanzhi Wang, Yihui Ren, Xuan Zhang

机构 * Northeastern University(东北大学) Brookhaven National Laboratory(布鲁克海文国家实验室)

专题命中 规划决策 :workflow(abstract)

AI总结 CircuitSense提出一个层次化基准,评估工程设计中视觉理解与符号推理的能力,揭示闭源模型在符号推导上的不足,强调数学理解对电路综合的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11617 2026-03-03 cs.RO 50%

AssemMate: Graph-Based LLM for Robotic Assembly Assistance

AssemMate:基于图的LLM用于机器人装配辅助

Qi Zheng, Chaoran Zhang, Zijian Liang, EnTe Lin, Shubo Cui, Qinghongbing Xie, Zhaobo Xu, Long Zeng

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University, Shenzhen, China(清华大学深圳国际研究生院,清华大学,深圳,中国)

专题命中 规划决策 :planning(abstract)

AI总结 AssemMate是一种基于图的LLM,通过知识图谱问答和视觉增强策略提升机器人装配任务的精度和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14362 2026-03-03 cs.CV 50%

DeepEyes: Incentivizing "Thinking with Images" via Reinforcement Learning

DeepEyes: 通过强化学习激励'图像思考'

Ziwei Zheng, Michael Yang, Jack Hong, Chenxiao Zhao, Guohai Xu, Le Yang, Chao Shen, Xing Yu

机构 * Xiaohongshu Inc.(小红书公司) Xi’an Jiaotong University(西安交通大学)

专题命中 规划决策 :agent(abstract)

AI总结 DeepEyes通过强化学习实现图像引导的推理,无需预训练数据,提升多模态任务性能。

Comments Accepted by ICLR2026. Ziwei, Michael, Jack, and Chenxiao are equal-contribution. The list order is random

详情

展开后加载摘要…

URL PDF HTML 收藏