arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 11017 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 11017 篇

2601.21212 2026-01-30 cs.AI cs.CY 79%

Intelli-Planner: Towards Customized Urban Planning via Large Language Model Empowered Reinforcement Learning

Intelli-Planner: 通过大型语言模型赋能的强化学习实现定制化城市规划

Xixian Yong, Peilin Sun, Zihe Wang, Xiao Zhou

机构 * Gaoling School of Artificial Intelligence\ University of China Beijing China Gaoling School of Artificial Intelligence\ University of China

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 Intelli-Planner通过结合深度强化学习与大型语言模型,实现定制化城市规划,提升规划方案的参与度和满意度。

Comments The Web Conference 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21113 2026-01-30 cs.AI cs.MA 79%

Planner-Auditor Twin: Agentic Discharge Planning with FHIR-Based LLM Planning, Guideline Recall, Optional Caching and Self-Improvement

计划-审核双胞胎:基于FHIR的LLM计划、指南回忆、可选缓存和自我改进的代理出院计划

Kaiyuan Wu, Aditya Nagori, Rishikesan Kamaleswaran

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 基于FHIR的LLM计划与审核框架,通过自我改进和缓存优化,提升临床出院计划的安全性和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20676 2026-01-29 cs.CL 79%

Efficient Multimodal Planning Agent for Visual Question-Answering

高效的多模态规划代理用于视觉问答

Zhuo Chen, Xinyu Geng, Xinyu Wang, Yong Jiang, Zhen Zhang, Pengjun Xie, Kewei Tu

机构 * ShanghaiTech University(上海科技大学) Alibaba Tongyi Lab(阿里云通义实验室)

专题命中 规划推理 :planning(title,abstract);分类 cs.CL

AI总结 本文提出了一种高效的多模态规划代理,通过动态分解mRAG流程,提升视觉问答任务的效率和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20021 2026-01-29 cs.AI 79%

Fuzzy Categorical Planning: Autonomous Goal Satisfaction with Graded Semantic Constraints

模糊分类规划:具有分级语义约束的自主目标满足

Shuhui Qu

机构 * Stanford University(斯坦福大学)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 FCP通过引入模糊度量和Lukasiewicz t-范数提升自然语言规划中模糊约束的处理能力,有效应对多步骤计划中的质量退化问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17346 2026-01-27 cs.AI 79%

Multi-Agent Learning Path Planning via LLMs

通过大型语言模型进行多智能体学习路径规划

Haoxin Xu, Changyong Qi, Tong Liu, Bohao Zhang, Anna He, Bingqian Jiang, Longwei Zheng, Xiaoqing Gu

机构 * Shanghai International Studies University(上海国际 Studies 大学) East China Normal University(华东师范大学) Huaiyin Normal University(淮阴师范学院) City University of Macau(澳门城市大学)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 本研究提出基于LLMs的多智能体学习路径规划框架,通过角色与规则协作机制提升学习路径的透明性与可解释性,实验表明其在路径质量、知识一致性及认知负荷匹配方面优于传统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11056 2026-01-27 cs.IR cs.AI 79%

From Reasoning LLMs to BERT: A Two-Stage Distillation Framework for Search Relevance

从推理LLM到BERT:一种两阶段蒸馏框架用于搜索相关性

Runze Xia, Yupeng Ji, Yuxi Zhou, Haodong Liu, Teng Zhang, Piji Li

机构 * Researcher(研究者)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文提出一种两阶段蒸馏框架,通过领域适应教师模型和对比推理自蒸馏方法,提升搜索相关性预测的效率和效果。

Comments TheWebConf 2026 Industry

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16480 2026-01-26 cs.CL 79%

TL-GRPO: Turn-Level RL for Reasoning-Guided Iterative Optimization

TL-GRPO:基于回合的强化学习用于推理引导的迭代优化

Peiji Li, Linyang Li, Handa Sun, Wenjin Mai, Yongkang Chen, Xiaozhe Li, Yue Shen, Yichuan Ma, Yiliu Sun, Jiaxi Cao, Zhishu He, Bo Wang, Xiaoqing Zheng, Zhaori Bi, Xipeng Qiu, Qipeng Guo, Kai Chen, Dahua Lin

机构 * Fudan University(复旦大学) Shanghai AI Laboratory(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL

AI总结 TL-GRPO通过回合级分组采样优化解决迭代优化任务中的轨迹级强化学习问题,实现更精细的优化效果。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.11833 2026-01-23 cs.AI 79%

Thought of Search: Planning with Language Models Through The Lens of Efficiency

思考搜索:通过效率的视角进行语言模型规划

Michael Katz, Harsha Kokel, Kavitha Srinivas, Shirin Sohrabi

机构 * David S. Hippocampus Department of Computer Science(戴维·S·海马科斯学院计算机科学系) Cranberry-Lemon University(Cranberry-Lemon大学) IBM Research(IBM研究院)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 本文提出了一种高效且保持正确性和完备性的LLM规划方法,通过解决四个代表性搜索问题展示其有效性,并呼吁研究社区关注效率与正确性的平衡。

Comments Accepted at NeurIPS 2024, https://papers.nips.cc/paper_files/paper/2024/hash/fa080fe0f218871faec1d8ba20e491d5-Abstract-Conference.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14560 2026-01-22 cs.CL 79%

Rewarding How Models Think Pedagogically: Integrating Pedagogical Reasoning and Thinking Rewards for LLMs in Education

奖励模型如何思考:在教育中整合教学推理和思考奖励

Unggi Lee, Jiyeong Bae, Jaehyeon Park, Haeun Park, Taejun Park, Younghoon Jeon, Sungmin Cho, Junbo Koh, Yeil Jeong, Gyeonggeon Lee

机构 * Chosun University(昌原大学) Korea University(韩国大学) Seoul National University(首尔国立大学) Korea Institute for Curriculum and Evaluation(韩国课程与评价研究院) Upstage Indiana University Bloomington(印第安纳大学布卢明顿分校) Nanyang Technological University(南洋理工大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL

AI总结 本文提出PedagogicalRL-Thinking框架,通过教学推理提示和思考奖励方法,提升LLM在教育场景中的教学推理能力和结构化决策能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14091 2026-01-21 cs.RO cs.AI 79%

Zero-shot adaptable task planning for autonomous construction robots: a comparative study of lightweight single and multi-AI agent systems

零样本适应性任务规划用于自主建造机器人:轻量级单 agent 和多 agent 系统的比较研究

Hossein Naderi, Alireza Shojaei, Lifu Huang, Philip Agee, Kereshmeh Afsari, Abiola Akanmu

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 本研究通过比较轻量级单 agent 和多 agent 系统,探索了零样本适应性任务规划在自主建造机器人中的应用,展示了四 agent 团队在效率和成本上的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13533 2026-01-21 cs.AI 79%

Reasoning While Recommending: Entropy-Guided Latent Reasoning in Generative Re-ranking Models

在推荐中推理:生成重排序模型中的熵引导潜在推理

Changshuo Zhang

机构 * Individual Author(独立研究者)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 EGLR模型通过在推荐过程中引入熵引导的潜在推理机制,解决了生成重排序中动态熵变化的问题,提升了探索-利用的平衡能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12740 2026-01-21 cs.HC cs.AI 79%

TreeWriter: AI-Assisted Hierarchical Planning and Writing for Long-Form Documents

TreeWriter: 人工智能辅助的长篇文档分层规划与写作

Zijian Zhang, Fangshi Du, Xingjian Liu, Pan Chen, Oliver Huang, Runlong Ye, Michael Liut, Alán Aspuru-Guzik

机构 * Department of Computer Science, University of Toronto, Sandford Fleming Building, 10 King’s College Road, ON M5S 3G4, Toronto, Canada Vector Institute for Artificial Intelligence, 661 University Ave. Suite 710, ON M5G 1M1, Toronto, Canada Department of Chemistry, University of Toronto, Lash Miller Chemical Laboratories, 80 St. George Street, ON M5S 3H6, Toronto, Canada Department of Mathematical Computational Sciences, University of Toronto Mississauga, 3359 Mississauga Road, Deerfield Hall, ON L5L 1C6, Mississauga, Canada Department of Materials Science \& Engineering, University of Toronto, 184 College St., M5S 3E4, Toronto, Canada Department of Chemical Engineering \& Applied Chemistry, University of Toronto, 200 College St. ON M5S 3E5, Toronto, Canada Acceleration Consortium, 700 University Ave., M7A 2S4, Toronto, Canada Canadian Institute for Advanced Research (CIFAR), 661 University Ave., M5G 1M1, Toronto, Canada NVIDIA, 431 King St W \#6th, M5V 1K4, Toronto, Canada

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 TreeWriter通过分层结构和集成AI支持,提升长文档写作中的创意发展和用户控制能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12141 2026-01-21 cs.AI 79%

TIDE: A Trace-Informed Depth-First Exploration for Planning with Temporally Extended Goals

TIDE: 一种基于轨迹的深度优先探索用于具有时间扩展目标的规划

Yuliia Suprun, Khen Elimelech, Lydia E. Kavraki, Moshe Y. Vardi

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 TIDE通过分解时间问题为可达-避免子问题,结合成本驱动启发式方法,提升时间扩展目标规划的效率和完整性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11528 2026-01-21 cs.DB cs.AI 79%

Knowledge Graph Construction for Stock Markets with LLM-Based Explainable Reasoning

基于大语言模型的可解释推理的股票市场知识图谱构建

Cheonsol Lee, Youngsang Jeong, Jeongyeol Shin, Huiju Kim, Jidong Kim

机构 * Hana Institute of Technology, Hana TI(hana技术研究所) TelePIX Co., Ltd.(telepix公司) Qraft Technologies(qraft技术公司)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文提出基于大语言模型的可解释推理方法,构建股票市场知识图谱以捕捉复杂关系,提升投资分析与决策支持能力。

Comments 6 pages, 3 figures, CIKM 2025 Workshop - Advances in Financial AI: Innovations, Risk, and Responsibility in the Era of LLMs

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10342 2026-01-16 cs.AI 79%

C-GRASP: Clinically-Grounded Reasoning for Affective Signal Processing

C-GRASP:基于临床的感知信号处理推理

Cheng Lin Cheng, Ting Chuan Lin, Chai Kai Chang

机构 * Department of Physics National Central University(物理系国立中央大学) Center for Education National Central University(教育中心国立中央大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 C-GRASP通过临床基础推理提升情感信号处理的准确性与临床一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10222 2026-01-16 cs.AI 79%

Compartmentalised Agentic Reasoning for Clinical NLI

临床自然语言推理中的 compartmentalised agentic 推理

Maël Jullien, Lei Xu, Marco Valentino, André Freitas

机构 * Department of Computer Science, University of Manchester, UK(曼彻斯特大学计算机科学系) National Biomarker Centre, CRUK-MI, University of Manchester, UK(曼彻斯特大学国家生物标记中心) Idiap Research Institute, Switzerland(日内瓦IDIAP研究所) School of Computer Science, University of Sheffield, UK(谢菲尔德大学计算机科学系) École Polytechnique Fédérale de Lausanne (EPFL), Switzerland(洛桑联邦理工学院(EPFL))

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 CARENLI 通过 compartmentalisation 和验证提升临床自然语言推理的准确率,从 23% 提高到 57%

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09215 2026-01-15 cs.CL 79%

UserLM-R1: Modeling Human Reasoning in User Language Models with Multi-Reward Reinforcement Learning

UserLM-R1: 通过多奖励强化学习建模人类推理在用户语言模型中的应用

Feng Zhang, Shijia Li, Chunmao Zhang, Zhanyu Ma, Jun Xu, Jiuchong Gao, Jinghua Hao, Renqing He, Jingwen Xu, Han Liu

机构 * Meituan(美团) Peking University(北京大学) Beijing University of Posts and Telecommunications(北京邮电大学) University of Chinese Academy of Sciences(中国科学院大学) Dalian University of Technology(大连理工大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL

AI总结 UserLM-R1通过多奖励强化学习和动态目标驱动策略,提升用户语言模型在跨领域和对抗性场景中的推理与策略能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08621 2026-01-14 cs.CL 79%

GraphSearch: Agentic Search-Augmented Reasoning for Zero-Shot Graph Learning

GraphSearch: 基于代理的搜索增强推理用于零样本图学习

Jiajin Liu, Yuanfu Sun, Dongzhe Fan, Qiaoyu Tan

机构 * Department of Computer Science, New York University (Shanghai)(计算机科学系,纽约大学(上海))

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL

AI总结 GraphSearch通过图感知查询规划器和检索器实现零样本图学习,无需任务特定微调,提升图结构推理效率。

Comments 16 pages, 5 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17108 2026-01-14 cs.AI 79%

Structured Debate Improves Corporate Credit Reasoning in Financial AI

结构化辩论提升金融AI中的企业信用推理

Yoonjin Lee, Munhee Kim, Hanbi Choi, Juhyeon Park, Seungho Lyoo, Woojin Park

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 结构化辩论系统在金融AI中通过提升企业信用推理的严谨性和实用性,展示了更深入的分析能力,尽管计算时间较长。

Comments 18 pages, 4 figures, 2 algorithms, 2 tables, 4 appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12992 2026-01-14 cs.RO cs.CL cs.CV cs.MA 79%

UNCAP: Uncertainty-Guided Neurosymbolic Planning Using Natural Language Communication for Cooperative Autonomous Vehicles

UNCAP:基于自然语言通信的不确定性引导神经符号规划

Neel P. Bhatt, Po-han Li, Kushagra Gupta, Rohan Siva, Daniel Milan, Alexander T. Hogue, Sandeep P. Chinchali, David Fridovich-Keil, Zhangyang Wang, Ufuk Topcu

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 规划推理 :planning(title,abstract);分类 cs.CL

AI总结 UNCAP通过自然语言通信和不确定性引导方法,提升多车辆协同自动驾驶系统的可扩展性和安全性。

Journal ref AAMAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06562 2026-01-13 cs.LG 79%

Mosaic: Unlocking Long-Context Inference for Diffusion LLMs via Global Memory Planning and Dynamic Peak Taming

Mosaic: 通过全局内存规划和动态峰值镇压解锁扩散语言模型的长上下文推理

Liang Zheng, Bowen Shi, Yitao Hu, Jiawei Zhang, Ruofan Li, Sheng Chen, Wenxin Li, Keqiu Li

机构 * Tianjin University, China(天津大学)

专题命中 规划推理 :planning(title,abstract);分类 cs.LG

AI总结 Mosaic通过全局内存规划和动态峰值镇压,提升扩散语言模型的长上下文推理能力,实现内存效率和推理长度的显著提升。

Comments 11 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06164 2026-01-13 cs.SE cs.AI 79%

Contract2Plan: Verified Contract-Grounded Retrieval-Augmented Optimization for BOM-Aware Procurement and Multi-Echelon Inventory Planning

Contract2Plan: 一种基于合同的验证性检索增强优化方法用于BOM感知采购和多层级库存规划

Sahil Agarwal

机构 * Independent Researcher(独立研究者)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 Contract2Plan通过验证性检索增强优化方法,解决合同条款与BOM耦合导致的采购和库存规划问题,确保计划的可行性与合规性。

Comments 22 pages, 5 figures, 4 tables, 1 algorithm

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06062 2026-01-13 cs.CY cs.AI cs.HC 79%

From Values to Frameworks: A Qualitative Study of Ethical Reasoning in Agentic AI Practitioners

从价值到框架:关于代理AI从业者伦理推理的定性研究

Theodore Roberts, Bahram Zarrin

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文通过定性研究揭示代理AI从业者在伦理推理中的三种框架:用户、设计和伦理,强调需管理这些框架以确保伦理结果。

Comments 10 pages, 2 charts, 1 heatmap

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.03811 2026-01-12 cs.AI 79%

Rethinking Supply Chain Planning: A Generative Paradigm

重新思考供应链规划:一种生成范式

Jiaheng Yin, Yongzhi Qi, Jianshen Zhang, Dongyang Geng, Zhengyu Chen, Hao Hu, Wei Qi, Zuo-Jun Max Shen

机构 * Tsinghua University, Beijing, China(清华大学) JD.com, Beijing, China(京东) Faculty of Engineering and Faculty of Business and Economics, The University of Hong Kong, China(香港大学工程学院和商学院) College of Engineering, University of California, Berkeley, CA, USA(加州大学伯克利分校工程学院)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 本文提出一种基于生成式人工智能的供应链规划范式,通过智能代理框架提升规划准确性与库存率,实现动态需求下的适应性协调。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01022 2026-01-12 cs.AI cs.MA cs.RO 79%

Symbolic Planning and Multi-Agent Path Finding in Extremely Dense Environments with Unassigned Agents

符号规划与在极度密集环境中无分配代理的多智能体路径寻找

Bo Fu, Zhe Chen, Rahul Chandan, Alex Barbosa, Michael Caldara, Joey Durham, Federico Pecora

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 本文提出五种基于搜索的算法,用于解决在极度密集环境中无分配代理的多智能体路径寻找问题,通过图搜索方法高效生成重新排列计划。

Comments AAAI Conference on Artificial Intelligence (AAAI-26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04699 2026-01-09 cs.RO cs.AI 79%

SeqWalker: Sequential-Horizon Vision-and-Language Navigation with Hierarchical Planning

SeqWalker: 基于分层规划的序列地平线视觉-语言导航

Zebin Han, Xudong Wang, Baichen Liu, Qi Lyu, Zhenduo Shang, Jiahua Dong, Lianqing Liu, Zhi Han

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 SeqWalker通过分层规划框架解决多任务视觉-语言导航中的信息过载问题,通过高层规划减少认知负荷,低层规划利用指令逻辑结构校正轨迹误差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04668 2026-01-09 cs.RO cs.AI 79%

Optimizing Path Planning using Deep Reinforcement Learning for UGVs in Precision Agriculture

利用深度强化学习优化无人机在精准农业中的路径规划

Laukik Patade, Rohan Rane, Sandeep Pillai

机构 * Sardar Patel Institute of Technology(萨达尔·帕特尔技术学院)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 本研究利用深度强化学习优化无人机在精准农业中的路径规划,通过DDPG和TD3算法在动态环境中实现高成功率的导航。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03948 2026-01-09 cs.AI q-fin.TR 79%

Trade-R1: Bridging Verifiable Rewards to Stochastic Environments via Process-Level Reasoning Verification

Trade-R1: 通过过程级推理验证弥合可验证奖励与随机环境

Rui Sun, Yifan Sun, Sheng Xu, Li Zhao, Jing Li, Daxin Jiang, Cheng Hua, Zuo Bai

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 Trade-R1通过过程级推理验证,将可验证奖励与随机金融环境连接,减少奖励黑客问题,DSR在跨市场泛化中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03687 2026-01-08 cs.AI 79%

Personalized Medication Planning via Direct Domain Modeling and LLM-Generated Heuristics

通过直接领域建模和LLM生成的启发式方法实现个性化药物规划

Yonatan Vernik, Alexander Tuisov, David Izhaki, Hana Weitman, Gal A. Kaminka, Alexander Shleyfman

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 本文通过直接领域建模和LLM生成的启发式方法,提升了个性化药物规划的规模和效率,支持更接近临床应用的实践。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19500 2026-01-07 cs.RO cs.LG 79%

RobotDiffuse: Diffusion-Based Motion Planning for Redundant Manipulators with the ROP Obstacle Avoidance Dataset

RobotDiffuse: 基于扩散模型的冗余机械臂运动规划与ROP障碍避让数据集

Xudong Mou, Xiaohan Zhang, Tiejun Wang, Tianyu Wo, Cangbai Xu, Ningbo Gu, Rui Wang, Xudong Liu

机构 * School of Computer Science and Engineering, Beihang University, Beijing, China(北京航空航天大学计算机科学与工程学院) School of Software, Beihang University, Beijing, China(北京航空航天大学软件学院) Hangzhou Innovation Institute, Beihang University, Hangzhou, China(北京航空航天大学杭州创新研究院)

专题命中 规划推理 :planning(title,abstract);分类 cs.LG

AI总结 RobotDiffuse通过扩散模型实现冗余机械臂运动规划,结合物理约束与点云编码器,并发布ROP数据集提升障碍避让性能。

详情

展开后加载摘要…

URL PDF HTML 收藏