arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 11027 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 11027 篇

2606.30613 2026-06-30 cs.RO 78%

Sequential Planning via Anchored Robotic Keypoints

基于锚定机器人关键点的顺序规划

Bryce Grant, Aryeh Rothenberg, Logan Senning, Zonghe Chua, Zach Patterson, Peng Wang

机构 * Department of Electrical, Computer, and Systems Engineering(电气、计算机与系统工程系) Department of Mechanical and Aerospace Engineering(机械与航空航天工程系)

专题命中 规划推理 :planning(title,abstract)

AI总结 提出SPARK,一种无训练神经符号操作系统,通过单一Gemini调用生成类型化行为树,结合SAM3的替代提示检测和恢复循环,在LIBERO-PRO上达到43.7%,超越CaP-Agent0和VLA基线。

Comments 29 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28981 2026-06-30 cs.CY 78%

Bad company corrupts good morals: Understanding and Measuring Narrative-Induced Moral Reasoning Degradation in LLMs

坏公司败坏好道德:理解与衡量叙事引发的LLM道德推理退化

Wanying Yu, Boyang Ma, Zhibo Eric Sun, Minghui Xu, Yue Zhang

专题命中 规划推理 :reasoning(title,abstract)

AI总结 本研究提出BreakingBad框架,系统衡量负面叙事沉浸对LLM道德推理、行为及部署风险的影响,发现叙事暴露导致道德准确率下降12%-31%,且退化具有结构性,第一人称叙事影响更强,并传播至实际部署场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28566 2026-06-30 cs.IR 78%

R$^2$-Searcher: Calibrating Retrieval and Reasoning Boundaries for Agentic Search

R$^2$-Searcher:校准智能搜索中的检索与推理边界

Sheng Zhang, Junyi Li, Wenlin Zhang, Xiaowei Qian, Yichao Wang, Yingyi Zhang, Maolin Wang, Yong Liu, Xiangyu Zhao

专题命中 规划推理 :reasoning(title,abstract)

AI总结 提出R$^2$-Searcher框架,通过细粒度查询令牌引导的证据建模和检索后反思,校准检索与推理边界,在多跳问答基准上显著优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09620 2026-06-30 cs.RO cs.SY eess.SY 新提交 78%

Motion planning for hundreds of floating robots

数百个浮动机器人的运动规划

Jan Kamm, Antonio Terpin, Raffaello D'Andrea, Aswin Ramachandran

机构 * Institute for Dynamic Systems and Control, ETH Zürich(苏黎世联邦理工学院动态系统与控制研究所)

专题命中 规划推理 :planning(title,abstract)

AI总结 针对大型浮动机器人编队的无碰撞运动规划问题,提出一种可扩展的流水线方法,通过碰撞图分解为独立子问题并行求解,在500个机器人仿真和实际演示中验证了有效性。

Comments Accepted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07913 2026-06-30 cs.RO quant-ph 78%

Multi-Agent Route Planning as a QUBO Problem

多智能体路径规划作为QUBO问题

Renáta Rusnáková, Martin Chovanec, Juraj Gazda

机构 * Department of Computers and Informatics, Faculty of Electrical Engineering and Informatics, Technical University of Košice(科希策技术大学电气工程与信息学院计算机与信息学系)

专题命中 规划推理 :planning(title,abstract)

AI总结 本文将多智能体路径规划问题建模为QUBO问题,通过证明其NP难性并推导出编码路线效用奖励和配对重叠惩罚的二次无约束二进制优化公式,探讨了覆盖与重叠的权衡策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25509 2026-06-25 cs.RO cs.CV 新提交 78%

ASSCG: Just-Right Gating over Chattering for Fast-Slow LLM Planning in Autonomous Driving

ASSCG:自动驾驶中快慢LLM规划的恰到好处门控

Sining Ang, Yuan Chen, Liu Haiyan, Xuanyao Mao, Jason Bao, Xuliang, Bingchuan Sun, Yan Wang

机构 * Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院) Department of Automation, University of Science and Technology of China(中国科学技术大学自动化系) Beijing University of Aeronautics and Astronautics(北京航空航天大学) Lenovo Group Limited(联想集团)

专题命中 规划推理 :planning(title,abstract)

AI总结 提出自适应慢系统控制门(ASSCG),通过帧级查询/缓存/丢弃决策优化快慢规划器调用,结合RWKV骨干网络和GRPO风格强化学习,在nuPlan和NAVSIM上分别提升性能并降低延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25484 2026-06-25 cs.CY econ.GN q-fin.EC stat.AP 新提交 78%

From Causal Discovery to Implementation: An Agentic AI Framework for E-Scooter Mobility Hub Planning Across 29 German Cities

从因果发现到实施:面向29个德国城市的电动滑板车出行枢纽规划的智能体AI框架

Meng Jin, Melanie Handrich, Simone Martinenz, Nicholas Hoeser, Ziyue Li

专题命中 规划推理 :planning(title,abstract)

AI总结 提出一个三阶段智能体AI框架,利用29个德国城市的公共GBFS数据构建因果模板库,通过LLM驱动的因果发现揭示城市类型与集群类型对热点需求的因果驱动差异,并在海尔布隆指导两个枢纽站点建设。

Comments 32 Pages, Submitted to Transportation Research Part D: Transport and Environment. Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07306 2026-06-25 cs.HC 版本更新 78%

Seeing the Reasoning: How LLM Rationales Influence User Trust and Decision-Making in Factual Verification Tasks

看见推理:LLM 推理如何影响用户在事实核查任务中的信任与决策

Xin Sun, Shu Wei, Jos A Bosch, Isao Echizen, Saku Sugawara, Abdallah El Ali

专题命中 规划推理 :reasoning(title,abstract)

AI总结 通过在线实验(N=68)操纵LLM推理的呈现格式、正确性和确定性框架,发现正确推理和确定性线索提升信任与决策采纳,不确定性线索降低,而呈现格式无显著影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24101 2026-06-24 cs.RO cs.CV 新提交 78%

NavWM: A Unified Navigation World Model for Foresight-Driven Planning

NavWM:一种用于前瞻性规划的统一导航世界模型

Yanghong Mei, Longteng Guo, Ming-Ming Yu, Guiyu Zhao, Xingjian He, Jing Liu

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Beihang University(北京航空航天大学) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)

专题命中 规划推理 :planning(title);reasoning(abstract)

AI总结 提出NavWM统一导航世界模型,通过潜在世界令牌提取几何与语义先验,结合锚点多模态轨迹预测框架生成多样化动作空间,利用视觉前瞻评估最优路径,在多种机器人数据集上显著提升未来状态生成与零样本导航成功率。

Comments 13 pages, 5 figures, accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20922 2026-06-23 cs.CR 新提交 78%

Think Twice Before You Act: Protecting LLM Agents Against Tool Description Poisoning via Isolated Planning

三思而后行:通过隔离规划保护LLM代理免受工具描述投毒攻击

Shanghao Shi, Xiao Wang, Chaoyu Zhang, Hao Li, Wenjing Lou, Thomas Hou, Yevgeniy Vorobeychik, Chongjie Zhang, Ning Zhang

专题命中 规划推理 :planning(title,abstract)

AI总结 提出Tool-Guard系统级防御,通过隔离规划机制将可疑工具调用隔离到受感染列表,阻断投毒描述持续影响,在AgentDojo和ASB基准上显著降低攻击成功率并保持任务效用。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14445 2026-06-23 cs.CL cs.AI cs.HC cs.LG 版本更新 78%

Tell Me: An LLM-powered Mental Well-being Assistant with RAG, Synthetic Dialogue Generation, and Agentic Planning

Tell Me:基于LLM的心理健康助手,集成RAG、合成对话生成与智能体规划

Trishala Jayesh Ahalpara

机构 * Fujitsu Research of America(富士通美国研究)

专题命中 规划推理 :planning(title);分类 cs.CL、cs.AI、cs.LG

AI总结 提出Tell Me系统,利用大语言模型通过RAG实现个性化对话、合成客户-治疗师对话生成以及智能体规划生成自我护理计划,旨在提供可及的心理支持而非替代专业治疗。

Comments 8 pages, 2 figures, 1 Table. Submitted to the Computation and Language (cs.CL) category. Uses the ACL-style template. Code and demo will be released at: https://github.com/trystine/Tell_Me_Mental_Wellbeing_System

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03882 2026-06-23 cs.HC 版本更新 78%

JumpStarter: Human-AI Planning with Task-Structured Context Curation

JumpStarter:基于任务结构化上下文策展的人机协作规划

Xuanming Zhang, Sitong Wang, Jenny Ma, Alyssa Hwang, Zhou Yu, Lydia B. Chilton

专题命中 规划推理 :planning(title,abstract)

AI总结 提出JumpStarter系统,通过任务结构化上下文策展框架动态分解目标、限定上下文范围,实现细粒度个性化与复用,用户研究显示规划质量显著优于ChatGPT。

Comments 29 pages, 20 Figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.14145 2026-06-23 cs.RO cs.MA 78%

Multi-Agent Motion Planning with Bézier Curve Optimization under Kinodynamic Constraints

多智能体运动规划中的贝塞尔曲线优化在动力学约束下

Jingtian Yan, Jiaoyang Li

机构 * IEEE Robotics and Automation Letters(IEEE机器人与自动化 letters)

专题命中 规划推理 :planning(title,abstract)

AI总结 本文提出PSB规划器,通过考虑智能体的动力学约束,生成平滑的速度剖面,提升多智能体路径规划的效率与实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19214 2026-06-18 econ.GN q-fin.EC 新提交 78%

Testing Centralized and Polycentric Computational Planning

测试集中式和多中心计算规划

Ricardo Alonzo Fernández Salguero

专题命中 规划推理 :planning(title,abstract)

AI总结 本文提出一个可复现的合成基准,在模拟经济中比较计算规划者、基于代理的市场和混合元市场,发现规划者福利损失更低,但结果受设计选择影响,主要贡献是方法论而非意识形态。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18633 2026-06-18 cs.MA 新提交 78%

PersonalPlan: Planning Multi-Agent Systems for Personalized Programming Learning

PersonalPlan: 面向个性化编程学习的多智能体系统规划

Zhiyuan Wen, Jiannong Cao, Peng Gao, Haochen Shi, Wengpan Kuan, Bo Yuan, Xiuxiu Qi

专题命中 规划推理 :planning(title,abstract)

AI总结 提出PersonalPlan,一种两阶段多智能体规划器,通过分层SFT和奖励自适应GRPO生成可执行、个性化且具有教学支架的计划,在MAP-PPL数据集上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18516 2026-06-18 cs.RO 新提交 78%

Task Allocation and Motion Planning in Dynamic, Cluttered Environments via CBBA and Graphs of Convex Sets

动态杂乱环境下的任务分配与运动规划:基于CBBA与凸集图

Matthew D. Osburn, Cameron K. Peterson, John L. Salmon

机构 * Electrical and Computer Engineering(电气与计算机工程系) Mechanical Engineering(机械工程系)

专题命中 规划推理 :planning(title,abstract)

AI总结 针对动态杂乱环境中的多智能体任务规划,提出结合凸集图(GCS)进行轨迹优化与共识捆绑算法(CBBA)进行分布式任务分配的方法,实现安全高效的轨迹规划和任务协调。

Comments 15 pages single column, 10 figures, AIAA-Scitech 2027 Submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16386 2026-06-16 cs.GT 新提交 78%

Game-Theoretic Multi-Agent Reinforcement Learning for Swarm Trajectory Planning in Low-Altitude Wireless Networks

低空无线网络中基于博弈论的多智能体强化学习群体轨迹规划

Nguyen Duc Minh Quang, Ruoxi Chong, Zhiqiang Wei, Chang Liu, Derrick Wing Kwan Ng

专题命中 规划推理 :planning(title,abstract)

AI总结 针对低空无线网络中多无人机在多小区基站下因资源块分配导致的轨迹耦合问题,提出合作随机拥塞博弈模型和CTDE-MAPPO算法,实现通信与任务联合优化。

Comments Submitted to IEEE/CIC ICCC 2026 in Wuhan

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15838 2026-06-16 cs.IR 新提交 78%

Intelligent Multimodal Retrieval and Reasoning for Geospatial Knowledge Discovery on the I-GUIDE Platform

面向I-GUIDE平台地理空间知识发现的智能多模态检索与推理

Yunfan Kang, Erick Li, Furqan Baig, Wei Hu, Alexander Michels, Anand Padmanabhan, Shaowen Wang

专题命中 规划推理 :reasoning(title,abstract)

AI总结 提出I-GUIDE Smart Search系统,结合多模态索引与知识图谱的迭代RAG管道,实现地理空间异构数据的语义检索、图谱溯源和对话合成,在单A100部署下支持约100并发用户,提升检索覆盖与答案质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06637 2026-06-16 cs.CV 版本更新 78%

CLAD: Constrained Latent Action Diffusion for Vision-Language Procedure Planning

CLAD: 面向视觉-语言程序规划的约束潜在动作扩散模型

Lei Shi, Andreas Bulling

机构 * Machine Perception and Interaction group, Örebro University(机器感知与交互组,奥雷布罗大学) Collaborative Artificial Intelligence group, University of Stuttgart(协作人工智能组,斯图加特大学)

专题命中 规划推理 :planning(title,abstract)

AI总结 提出CLAD模型,利用变分自编码器学习动作和观测的潜在表示作为约束,引导扩散模型生成动作,在三个数据集上大幅超越现有方法。

Comments Accepted at RO-MAN 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13861 2026-06-15 cs.CV 新提交 78%

Temporal Backtracking Search for Test-time Generative Video Reasoning

时间回溯搜索:测试时生成式视频推理

Sejoon Jun, Zheng Ding, Huangyuan Su, Weirui Ye, Yilun Du

机构 * Northeastern University(东北大学) Independent Researcher(独立研究者) Harvard & Kempner(哈佛大学与肯普纳研究所) MIT(麻省理工学院)

专题命中 规划推理 :reasoning(title,abstract)

AI总结 提出时间回溯搜索(TBS),通过将搜索空间转移到时间轴,在扩散过程中定位失败点并回溯重启,显著提升视频模型在测试时的推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12579 2026-06-12 cs.RO 新提交 78%

G-MAPP: GPU-accelerated Multi-Agent Planning and Perception for Reactive Motion Generation

G-MAPP: 基于GPU加速的多智能体规划与感知用于反应式运动生成

Tanmay Bishnoi, Riddhiman Laha, Tobias Löw, Jose Alex Chandy, Luis F. C. Figueredo, Sami Haddadin

机构 * Department of Electrical, Computer, and Biomedical Engineering, Toronto Metropolitan University(多伦多都会大学电气、计算机与生物医学工程系) Munich Institute of Robotics and Machine Intelligence (MIRMI), Technical University of Munich (TUM)(慕尼黑工业大学慕尼黑机器人与机器智能研究所) Institute for Experiential Robotics, Northeastern University(东北大学体验式机器人研究所) Idiap Research Institute(Idiap 研究所) EPFL(瑞士联邦理工学院洛桑) CHART Group at the School of Computer Science, University of Nottingham(诺丁汉大学计算机科学学院 CHART 小组) Mohamed bin Zayed University of Artificial Intelligence (MBZUAI)(穆罕默德·本·扎耶德人工智能大学)

专题命中 规划推理 :planning(title,abstract)

AI总结 提出GPU加速的框架,通过并行状态探索和紧密耦合感知-动作循环,实现非结构化环境中的实时反应式运动生成,在7自由度机器人上达到5倍加速并成功避障。

Comments The implementation is available at: https://github.com/chart-research/g-mapp

Journal ref IEEE Robotics and Automation Letters, vol. 11, no. 6, pp. 7516-7523, June 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11009 2026-06-12 cs.HC 版本更新 78%

From Planning to Revision: How AI Writing Support at Different Stages Alters Ownership

从规划到修订:不同阶段的人工智能写作支持如何改变所有权感

Katy Ilonka Gero, Tao Long, Carly Schnitzler, Paramveer Dhillon

专题命中 规划推理 :planning(title,abstract)

AI总结 研究AI写作支持在规划、起草和修订阶段对作者所有权感的影响,发现任何AI辅助都会降低所有权感,但规划阶段影响最小,起草阶段影响最大,且AI贡献的文本和想法越多,所有权感越低。

Journal ref In Designing Interactive Systems Conference (DIS 26). June 13-17, 2026, Singapore, Singapore

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10323 2026-06-10 cs.CR 新提交 78%

Semantic Multi-Agent Intrusion Detection for IoT:Zero-Day and Adversarial Threats with Risk-Aware Reasoning

面向物联网的语义多智能体入侵检测:零日与对抗威胁的风险感知推理

Saeid Jamshidi

专题命中 规划推理 :reasoning(title,abstract)

AI总结 提出一种结合语义嵌入与多阶段概率决策融合的语义多智能体入侵检测系统,通过四个智能体协作实现零日攻击和对抗攻击的高效检测,在多个真实物联网数据集上达到95.9%检测准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07920 2026-06-10 math.OC 版本更新 78%

Combining Reinforcement Learning with Arc-search Interior-Point Method for Path Planning

结合强化学习与弧搜索内点法的路径规划

Yaguang Yang, Qiang Le, Isaac E. Weintraub

专题命中 规划推理 :planning(title,abstract)

AI总结 提出一种结合强化学习与弧搜索内点法的框架,利用强化学习的实时决策能力和弧搜索内点法的优化性能,实现障碍物环境下的高效路径规划。

Comments 15 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08738 2026-06-09 cs.NI cs.RO 新提交 78%

Systems-Level Planning and Coordination of Truck-Drone Collaborative Delivery Networks

卡车-无人机协同配送网络的系统级规划与协调

Didem Cicek, Burak Kantarci

机构 * School of Electrical Engineering and Computer Science at the University of Ottawa(渥太华大学电气工程与计算机科学学院)

专题命中 规划推理 :planning(title,abstract)

AI总结 针对城市最后一英里配送,提出分层规划与协调框架,通过任务编排与智能体同步,实现卡车-无人机协同配送,相比纯卡车模式,总配送时间减少42.4%,能耗降低44.2%。

Comments 6 pages, 4 figures, Accepted to 2026 IEEE HPSR on Network Architectures and Intelligence for Smart Mobility and Autonomous Systems (TRAVERSAL)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08231 2026-06-09 cs.CV 新提交 78%

Test-Time Scaling in Multimodal Foundation Models: A Comprehensive Survey of Generation and Reasoning

多模态基础模型中的测试时扩展:生成与推理的综合调查

Cong Wan, Ying He, Zhongzhan Huang, Hefeng Wu

机构 * Sun Yat-sen University(中山大学)

专题命中 规划推理 :reasoning(title,abstract)

AI总结 本文首次系统综述多模态基础模型中的测试时扩展(TTS)方法,提出统一分类框架(采样、反馈、搜索三类),总结应用与基准,并讨论未来方向。

Comments Accepted by ACL 2026, Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08135 2026-06-09 cs.SE 新提交 78%

TICoder: A Repository-Level Code Generation Framework with Test-Driven Planning and Implementation-Aware Reuse

TICoder: 一种具有测试驱动规划和实现感知复用的仓库级代码生成框架

Siyu Nan, Yaling Luo, Jian Wang, Neng Zhang, Bing Li

专题命中 规划推理 :planning(title,abstract)

AI总结 提出TICoder框架,通过测试驱动迭代规划机制和实现感知代码复用策略,解决仓库级代码生成中的依赖和上下文限制问题,在多个基准上平均提升11.52%。

Comments 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07855 2026-06-09 cs.RO math.OC 新提交 78%

Path Planning Using Deep Deterministic Policy Gradient: A Reinforcement Learning Approach

使用深度确定性策略梯度的路径规划:一种强化学习方法

Qiang Le, Yaguang Yang, Isaac E. Weintraub

机构 * Hampton University(汉普顿大学) Air Force Research Laboratory(空军研究实验室)

专题命中 规划推理 :planning(title,abstract)

AI总结 提出基于深度确定性策略梯度的路径规划方法,将威胁建模为圆形禁行区,通过奖励函数引导智能体学习从状态到动作的映射,找到最大安全起始点集,相比传统最优控制方法速度更快,适用于实时应用。

Comments 14 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10048 2026-06-09 cs.IR 版本更新 78%

HARPO: Hierarchical Agentic Reasoning for User-Aligned Conversational Recommendation

HARPO:面向用户对齐的对话推荐的分层代理推理

Subham Raj, Aman Vaibhav Jha, Mayank Anand, Sriparna Saha

专题命中 规划推理 :reasoning(title,abstract)

AI总结 HARPO通过分层代理推理框架优化多维推荐质量,结合上下文依赖的偏好学习、 deliberative树搜索和领域无关的推理抽象,提升推荐质量与用户对齐性。

Comments Accepted at the Annual Meeting of the Association for Computational Linguistics (ACL 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07486 2026-06-08 eess.SY cs.SY 新提交 78%

OPENPATH: A Supervisor--Specialist Agent System for Personalized, Accessible, and Multi-stop Urban Trip Planning

OPENPATH: 一种用于个性化、无障碍和多站点城市出行规划的监督-专家智能体系统

Ziyang Xiong, He Zong, Zhiyuan Xue, Manxi Wu

专题命中 规划推理 :planning(title,abstract)

AI总结 提出监督-专家多智能体系统OPENPATH,结合LLM解析自然语言与经典算法优化路径,支持个性化偏好、多站点规划和无障碍需求,并用于城市尺度无障碍分析。

详情

展开后加载摘要…

URL PDF HTML 收藏