arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 10960 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 10960 篇

2509.15737 2025-09-22 cs.RO cs.SY eess.SY 88%

SMART: Scalable Multi-Agent Reasoning and Trajectory Planning in Dense Environments

Heye Huang, Yibin Yang, Wang Chen, Tiantian Chen, Xiaopeng Li, Sikai Chen

机构 * Department of Civil and Environmental Engineering University of Wisconsin-Madison(威斯康星大学麦迪逊分校土木与环境工程系) School of Vehicle and Mobility, Tsinghua University(清华大学车辆与移动性学院) Department of Civil Engineering, The University of Hong Kong(香港大学土木工程系)

专题命中 规划推理 :reasoning(title,abstract);planning(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20014 2025-08-28 cs.MA 88%

CataractSurg-80K: Knowledge-Driven Benchmarking for Structured Reasoning in Ophthalmic Surgery Planning

Yang Meng, Zewen Pan, Yandi Lu, Ruobing Huang, Yanfeng Liao, Jiarui Yang

专题命中 规划推理 :reasoning(title,abstract);planning(title,abstract)

Comments 18 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12974 2025-08-05 cs.CV cs.RO 88%

Exploring 3D Reasoning-Driven Planning: From Implicit Human Intentions to Route-Aware Activity Planning

Xueying Jiang, Wenhao Li, Xiaoqin Zhang, Ling Shao, Shijian Lu

专题命中 规划推理 :reasoning(title,abstract);planning(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05360 2025-05-09 cs.RO 88%

DSDrive: Distilling Large Language Model for Lightweight End-to-End Autonomous Driving with Unified Reasoning and Planning

Wenru Liu, Pei Liu, Jun Ma

机构 * The Hong Kong University of Science and Technology(香港科技大学)

专题命中 规划推理 :reasoning(title,abstract);planning(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.02035 2024-12-23 cs.RO cs.CV 88%

A Modern Take on Visual Relationship Reasoning for Grasp Planning

Paolo Rabino, Tatiana Tommasi

专题命中 规划推理 :reasoning(title,abstract);planning(title,abstract)

Comments Accepted at IEEE RAL - in press

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09407 2024-10-15 cs.CL cs.AI cs.LG 88%

CAMPHOR: Collaborative Agents for Multi-input Planning and High-Order Reasoning On Device

Yicheng Fu, Raviteja Anantha, Jianpeng Cheng

专题命中 规划推理 :reasoning(title,abstract);planning(title);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.09353 2023-11-17 cs.RO 88%

Flexible and Adaptive Manufacturing by Complementing Knowledge Representation, Reasoning and Planning with Reinforcement Learning

Matthias Mayr, Faseeh Ahmad, Volker Krueger

专题命中 规划推理 :reasoning(title,abstract);planning(title,abstract)

Comments 3 pages, 2 figures. Presented at the IROS 2023 Workshop on Robotics & AI in Future Factory

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.12490 2021-09-28 cs.RO 88%

Anytime Game-Theoretic Planning with Active Reasoning About Humans' Latent States for Human-Centered Robots

Ran Tian, Liting Sun, Masayoshi Tomizuka, David Isele

专题命中 规划推理 :reasoning(title,abstract);planning(title,abstract)

Comments Presented at ICRA 2021

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14252 2026-07-17 cs.RO cs.AI cs.CL 新提交 87%

MEMORA: Embodied Action Memory from Egocentric Videos for Reasoning and Planning

MEMORA:基于自我中心视频的具身动作记忆用于推理与规划

Zihao Yu, Xiu Yuan, Chongjie Zhang

专题命中 规划推理 :planning(title,abstract);reasoning(title);分类 cs.CL、cs.AI

AI总结 研究针对长期机器人规划中对具身经验记忆的需求,提出MEMORA方法,通过形成-巩固-检索生命周期及四种类型存储实现具身动作记忆,经实验评估取得良好结果,能为机器人规划提供记忆上下文。

Comments 43 pages, 9 figures. Oral presentation at the Robotics: Science and Systems 2026 Workshop on Foundation Models for Robot Planning (FM4RoboPlan)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10964 2026-08-12 cs.CV cs.AI 新提交 87%

CARE: Confidence-Aware Reasoning for Reliable Medical VQA

CARE:用于可靠医学视觉问答的置信感知推理

Yuetian Du, Yucheng Wang, Zhenyuan Chen, Luyuan Chen, Rongyu Zhang, Jinjian Zhang, Wei Zhou, Zhijie Xu, Ming Kong, Zhan Zhou, Jie Liu, Qiang Zhu

机构 * Ant Group(蚂蚁集团) University of Michigan(密歇根大学) City University of Hong Kong(香港城市大学)

专题命中 规划推理 :reasoning(title,abstract);CoT(abstract,abstract_cn);chain-of-thought(abstract);分类 cs.AI

AI总结 该研究针对医学多模态大语言模型的置信度校准问题,提出CARE框架,通过双阶段流程优化准确率与校准度,在三个医学VQA基准上取得最优性能,为临床决策支持提供可信基础。

Comments Accepted by MICCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03538 2026-08-11 cs.LG 版本更新 87%

Online Learnability of Chain-of-Thought Verifiers: Soundness and Completeness Trade-offs

链式思维验证器的在线可学习性:正确性与完备性的权衡

Maria-Florina Balcan, Avrim Blum, Kiriaki Fragkia, Zhiyuan Li, Dravyansh Sharma

机构 * Carnegie Mellon University(卡内基梅隆大学) Toyota Technological Institute at Chicago(芝加哥丰田技术研究所) Northwestern University(西北大学)

专题命中 规划推理 :chain-of-thought(title,abstract);reasoning(abstract);planning(abstract);verifier(abstract)

AI总结 本文提出一种在线学习框架,用于学习链式思维验证器,通过检查解决方案的正确性,解决生成器与验证器之间的反馈循环导致的分布偏移问题,并引入新的Littlestone维度扩展以优化验证器的学习。

Comments The abstract has been abridged due to arXiv length constraints

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28357 2026-06-30 cs.IR cs.AI 87%

ReasonRec: A Reasoning-Augmented Multimodal Agent for Unified Recommendation

ReasonRec: 一种用于统一推荐的推理增强多模态智能体

Yihua Zhang, Mingfu Liang, Jiyan Yang, Rong Jin, Wen-Yen Chen, Yiping Han, Huayu Li, Buyun Zhang, Liang Luo, Frank Shyu, Luke Simon, Sijia Liu, Tianlong Chen, Xi Liu

机构 * Meta AI Michigan State University(密歇根州立大学) The University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)

专题命中 规划推理 :reasoning(title,abstract);CoT(abstract,abstract_cn);planning(abstract);分类 cs.AI

AI总结 提出ReasonRec,一种基于三阶段显式推理管道的多模态推荐智能体,通过推理感知视觉指令调优、证据-视野课程学习和不确定性引导委派机制,在五个数据集上实现排名指标相对提升超30%,推理延迟降低35%。

Comments The 64th Annual Meeting of the Association for Computational Linguistics (ACL 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05859 2026-06-05 cs.CL 87%

TARPO: Token-Wise Latent-Explicit Reasoning via Action-Routing Policy Optimization

TARPO:通过动作路由策略优化的逐令牌隐式-显式推理

Liting Zhang, Shiwan Zhao, Xuyang Zhao, Zichen Xu, Jianye Wang, Qicheng Li

机构 * TMCC, College of Computer Science, Nankai University, Tianjin, China(TMCC,计算机科学学院,南开大学,天津,中国)

专题命中 规划推理 :reasoning(title,abstract);CoT(abstract,abstract_cn);chain-of-thought(abstract);分类 cs.CL

AI总结 提出TARPO框架,通过动作路由策略优化在每一步自适应切换离散令牌生成和连续隐式推理,以解决隐式推理中连续表示限制策略探索的问题,实验表明其优于现有显式和隐式推理基线。

Comments 18 pages, 12 figures. Code available at https://github.com/NKU-LITI/TARPO-master

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27906 2026-05-28 cs.AI 87%

Reasoning Matters: Mitigate Hallucination in Multimodal Large Reasoning Models via Reasoning-Conditioned Preference Optimization

推理至关重要:通过推理条件偏好优化减轻多模态大型推理模型中的幻觉

Jiawei Kong, Hao Fang, Shunxiang Liao, Jinyu Li, Bin Chen, Hao Wu, Shu-Tao Xia, Min Zhang

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院,清华大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学深圳)

专题命中 规划推理 :reasoning(title,abstract);CoT(abstract,abstract_cn);chain-of-thought(abstract);分类 cs.AI

AI总结 提出推理条件直接偏好优化(RC-DPO)方法,通过将思维链作为答案生成的条件并对比不同思维链下的偏好,结合蒙特卡洛树搜索和注意力引导的思维链剪枝生成偏好数据,有效减轻多模态大型推理模型中的幻觉。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25603 2026-05-26 cs.AI 87%

Detecting Unfaithful Chain-of-Thought via Circuit-Guided Internal-External Discrepancy

通过电路引导的内外不一致性检测不忠实的思维链

Xu Shen, Zhen Tan, Song Wang, Pingjun Hong, Rui Miao, Xin Wang, Tianlong Chen

机构 * Jilin University(吉林大学) University of Central Florida(中央佛罗里达大学) Arizona State University(亚利桑那州立大学) University of Vienna(维也纳大学) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)

专题命中 规划推理 :chain-of-thought(title,abstract);CoT(abstract,abstract_cn);reasoning(abstract);分类 cs.AI

AI总结 提出CIE-Scorer框架,通过追踪句子级电路并利用Fused Gromov-Wasserstein距离度量内部与外部推理图的不一致性,实现实例级思维链不忠实检测,在FaithCoT-Bench上取得最优性能并降低电路构建成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09252 2026-05-22 cs.CL 87%

LLM Agents Already Know When to Call Tools -- Even Without Reasoning

LLM Agents Already Know When to Call Tools -- Even Without Reasoning

Chung-En Sun, Linbo Liu, Ge Yan, Zimo Wang, Tsui-Wei Weng

机构 * University of California, San Diego(加州大学圣地亚哥分校)

专题命中 规划推理 :reasoning(title,title_cn);分类 cs.CL

AI总结 本文提出When2Tool基准,通过18个环境研究工具调用的必要性,发现模型已能识别何时需要调用工具,但生成时未能有效利用此知识,提出Probe&Prefill方法显著减少工具调用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05818 2026-03-09 cs.CL 87%

RouteGoT: Node-Adaptive Routing for Cost-Efficient Graph of Thoughts Reasoning

RouteGoT: 用于图状思维推理的节点自适应路由

Yuhang Liu, Ruijie Wang, Yunlong Chu, Bing Hao, Yumeng Lin, Shengzhong Liu, Minglai Shao

机构 * School of New Media and Communication, Tianjin University(新媒体与传播学院,天津大学) School of Computer Science and Engineering, Beihang University(计算机科学与工程学院,北航) Shanghai Jiao Tong University(上海交通大学)

专题命中 规划推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);planning(abstract)

AI总结 RouteGoT通过节点自适应路由框架提升图状思维推理的效率与准确性,实现性能与成本的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03900 2026-02-05 cs.AI 87%

Knowledge Model Prompting Increases LLM Performance on Planning Tasks

知识模型提示增强了LLM在规划任务上的性能

Erik Goh, John Kos, Ashok Goel

机构 * School of Interactive Computing(交互计算学院) Georgia Institute of Technology(佐治亚理工学院)

专题命中 规划推理 :planning(title,abstract);reasoning(abstract);chain-of-thought(abstract);CoT(abstract)

AI总结 TMK框架通过显式任务分解和因果推理提升LLM在规划任务中的性能,使其在复杂符号任务中达到97.3%的准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21598 2026-01-30 cs.AI 87%

Beyond Imitation: Reinforcement Learning for Active Latent Planning

超越模仿:用于主动潜在规划的强化学习

Zhi Zheng, Wee Sun Lee

机构 * School of Computing, National University of Singapore, Singapore(计算学院,新加坡国立大学)

专题命中 规划推理 :planning(title,abstract);reasoning(abstract);chain-of-thought(abstract);CoT(abstract)

AI总结 本文提出ATP-Latent方法,通过主动规划和强化学习优化潜在空间,提升链式推理的准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16635 2025-11-21 cs.CV cs.CL 87%

SurvAgent: Hierarchical CoT-Enhanced Case Banking and Dichotomy-Based Multi-Agent System for Multimodal Survival Prediction

SurvAgent: 基于层次化CoT增强的案例库与二元多智能体系统用于多模态生存预测

Guolin Huang, Wenting Chen, Jiaqi Yang, Xinheng Lyu, Xiaoling Luo, Sen Yang, Xiaohan Xing, Linlin Shen

机构 * Shenzhen University(深圳大学) Stanford University(斯坦福大学) University of Nottingham Ningbo China(诺丁汉大学宁波分校) Ant Group(蚂蚁集团)

专题命中 规划推理 :CoT(title,abstract);reasoning(abstract);chain-of-thought(abstract);planning(abstract)

AI总结 SurvAgent通过层次化CoT增强的多智能体系统,整合多模态数据,提升生存预测的可解释性与准确性。

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09062 2025-10-13 cs.CL 87%

ReFIne: A Framework for Trustworthy Large Reasoning Models with Reliability, Faithfulness, and Interpretability

Chung-En Sun, Ge Yan, Akshay Kulkarni, Tsui-Wei Weng

机构 * University of California San Diego(加州大学圣地亚哥分校)

专题命中 规划推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);planning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05754 2025-07-09 cs.RO cs.AI 87%

LeAD: The LLM Enhanced Planning System Converged with End-to-end Autonomous Driving

Yuhang Zhang, Jiaqi Liu, Chengkai Xu, Peng Hang, Jian Sun

机构 * College of Transportation, Tongji University(同济大学交通运输学院)

专题命中 规划推理 :planning(title,abstract);reasoning(abstract);chain-of-thought(abstract);CoT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03673 2025-06-05 cs.AI 87%

Reason from Future: Reverse Thought Chain Enhances LLM Reasoning

Yinlong Xu, Yanzhao Zheng, Shuoshuo Sun, Shuaihan Huang, Baohua Dong, Hangcheng Zhu, Ruohui Huang, Gang Yu, Hongxia Xu, Jian Wu

机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) Alibaba Group(阿里巴巴集团) State Key Laboratory of Transvascular Implantation Devices and TIDRI(血管植入设备国家重点实验室) Liangzhu Laboratory and WeDoctor Cloud(良渚实验室和WeDoctor云) Zhejiang Key Laboratory of Medical Imaging Artificial Intelligence(浙江医学影像人工智能重点实验室)

专题命中 规划推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);planning(abstract)

Comments Accepted by ACL 2025 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04447 2025-04-14 cs.AI cs.CV 87%

EgoPlan-Bench2: A Benchmark for Multimodal Large Language Model Planning in Real-World Scenarios

Lu Qiu, Yi Chen, Yuying Ge, Yixiao Ge, Ying Shan, Xihui Liu

专题命中 规划推理 :planning(title,abstract);reasoning(abstract);chain-of-thought(abstract);CoT(abstract)

Comments Code & data are available at: https://qiulu66.github.io/egoplanbench2/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12365 2026-06-16 cs.IR cs.AI cs.CL 87%

TaoSR1: The Thinking Model for E-commerce Relevance Search

TaoSR1:电商相关性搜索的思考模型

Chenhe Dong, Shaowei Yao, Pengkun Jiao, Jianhui Yang, Yiming Jin, Zerui Huang, Xiaojiang Zhou, Dan Ou, Haihong Tang, Bo Zheng

机构 * Taobao & Tmall Group of Alibaba(淘宝与天猫集团)

专题命中 规划推理 :CoT(summary_cn,abstract);reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI

AI总结 本文提出TaoSR1框架,通过CoT引导的监督微调、离线采样与DPO优化,解决电商搜索中相关性预测的推理误差与幻觉问题,实现高效部署。

Journal ref KDD '26: Proceedings of the 32nd ACM SIGKDD Conference on Knowledge Discovery and Data Mining V.2, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21734 2026-05-26 cs.CL cs.AI 87%

Asking LLMs to Verify First is Almost Free Lunch

先让LLMs验证几乎是免费的午餐

Shiguang Wu, Quanming Yao

机构 * Department of Electonic Engineering(电子工程系)

专题命中 规划推理 :CoT(summary_cn,abstract);reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI

AI总结 提出Verification-First (VF)策略,通过先验证候选答案再生成解决方案,以低计算开销提升推理能力,并扩展为Iter-VF迭代方法,在多个基准上优于标准CoT和现有TTS策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17273 2025-07-24 cs.LG cs.AI 87%

Leveraging Knowledge Graphs and LLM Reasoning to Identify Operational Bottlenecks for Warehouse Planning Assistance

Rishi Parekh, Saisubramaniam Gopalakrishnan, Zishan Ahmad, Anirudh Deodhar

机构 * Quantiphi

专题命中 规划推理 :reasoning(title,abstract);planning(title);分类 cs.AI、cs.LG

Comments 12 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12135 2025-05-20 cs.AI cs.CL 87%

LLM-BABYBENCH: Understanding and Evaluating Grounded Planning and Reasoning in LLMs

Omar Choukrani, Idriss Malek, Daniil Orel, Zhuohan Xie, Zangir Iklassov, Martin Takáč, Salem Lahlou

机构 * MBZUAI(穆萨高等教育机构)

专题命中 规划推理 :reasoning(title,abstract);planning(title);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13723 2025-02-20 cs.CL cs.AI 87%

Direct Value Optimization: Improving Chain-of-Thought Reasoning in LLMs with Refined Values

Hongbo Zhang, Han Cui, Guangsheng Bao, Linyi Yang, Jun Wang, Yue Zhang

专题命中 规划推理 :reasoning(title,abstract);chain-of-thought(title);分类 cs.CL、cs.AI

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.06458 2024-11-06 cs.AI cs.CL 87%

Towards Autonomous Agents: Adaptive-planning, Reasoning, and Acting in Language Models

Abhishek Dutta, Yen-Che Hsiao

专题命中 规划推理 :reasoning(title);planning(title);self-correction(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏