arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-03-02 至 2026-03-02 共收录 22 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 22 篇

2512.22939 2026-03-02 cs.CV 89%

ColaVLA: Leveraging Cognitive Latent Reasoning for Hierarchical Parallel Trajectory Planning in Autonomous Driving

ColaVLA: 借助认知潜在推理实现自动驾驶中的分层并行轨迹规划

Qihang Peng, Xuesong Chen, Chenye Yang, Shaoshuai Shi, Hongsheng Li

机构 * Tsinghua University(清华大学) CUHK MMLab(香港中文大学MMLab) Voyager Research, Didi Chuxing(Voyager Research,滴滴出行)

专题命中 规划推理 :reasoning(title,abstract);planning(title,abstract);chain-of-thought(abstract)

AI总结 ColaVLA通过统一视觉-语言-动作框架,解决自动驾驶中轨迹规划的效率与准确性问题,实现高效、安全的多尺度轨迹生成。

Comments CVPR2026(Main Conference). Project page: https://pqh22.github.io/projects/ColaVLA/index.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23668 2026-03-02 cs.AI cs.SY eess.SY 83%

PseudoAct: Leveraging Pseudocode Synthesis for Flexible Planning and Action Control in Large Language Model Agents

PseudoAct: 通过伪代码合成实现大型语言模型代理的灵活规划与动作控制

Yihan, Wen, Xin Chen

机构 * Department of Electrical and Computer Engineering, Texas A&M University(电气与计算机工程系,德克萨斯A&M大学)

专题命中 规划推理 :planning(title,abstract);reasoning(abstract);分类 cs.AI

AI总结 PseudoAct通过伪代码合成实现LLM代理的灵活规划与动作控制,提升长时决策效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.24172 2026-03-02 cs.CL cs.AI 81%

ArgLLM-App: An Interactive System for Argumentative Reasoning with Large Language Models

ArgLLM-App:基于大语言模型的论证推理交互系统

Adam Dejl, Deniz Gorur, Francesca Toni

机构 * Imperial College London(伦敦帝国学院)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 ArgLLM-App是一个基于大语言模型的论证推理交互系统,通过可视化解释和用户交互实现决策的可解释性和可挑战性。

Comments AAMAS 2026 Demonstration Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17049 2026-03-02 cs.AI cs.HC cs.RO 79%

IntentCUA: Learning Intent-level Representations for Skill Abstraction and Multi-Agent Planning in Computer-Use Agents

IntentCUA: 学习意图级表示以实现技能抽象和多智能体规划在计算机使用代理中

Seoyoung Lee, Seobin Yoon, Seongbeen Lee, Yoojung Chun, Dayoung Park, Doyeon Kim, Joo Yong Sim

机构 * Sookmyung Women's University(首尔女子大学)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 IntentCUA通过意图级表示和多智能体协作提升桌面自动化效率与稳定性。

Comments 12 pages, 9 figures, AAMAS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03632 2026-03-02 cs.AI 79%

MITS: Enhanced Tree Search Reasoning for LLMs via Pointwise Mutual Information

MITS: 通过点互信息增强大语言模型的树搜索推理

Jiaxi Li, Yucheng Shi, Xiao Huang, Jin Lu, Ninghao Liu

机构 * University of Georgia(佐治亚大学) The Hong Kong Polytechnic University(香港理工大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 MITS通过点互信息引导树搜索推理,提升大语言模型的推理性能和效率。

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25249 2026-03-02 cs.RO cs.AI 79%

BEV-VLM: Trajectory Planning via Unified BEV Abstraction

BEV-VLM:通过统一的鸟瞰抽象进行轨迹规划

Guancheng Chen, Sheng Yang, Tong Zhan, Jian Wang

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 BEV-VLM通过统一的BEV抽象与VLMs实现高精度轨迹规划,实验显示其在准确性上比现有方法提升53.1%并实现无碰撞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23577 2026-03-02 cs.CL 79%

Multi-Agent Causal Reasoning for Suicide Ideation Detection Through Online Conversations

多智能体因果推理用于通过在线对话检测自杀念头

Jun Li, Xiangmeng Wang, Haoyang Li, Yifei Yan, Shijie Zhang, Hong Va Leong, Ling Feng, Nancy Xiaonan Yu, Qing Li

机构 * The Hong Kong Polytechnic University, Hong Kong, China(香港理工大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL

AI总结 本文提出多智能体因果推理框架,通过扩展用户互动和减轻隐藏偏见来提高在线对话中自杀念头检测的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06940 2026-03-02 cs.DB cs.AI 70%

VISTA: Knowledge-Driven Vessel Trajectory Imputation with Repair Provenance

VISTA: 基于知识的船舶轨迹补全与修复溯源

Hengyu Liu, Tianyi Li, Haoyu Wang, Kristian Torp, Tiancheng Zhang, Yushuai Li, Christian S. Jensen

机构 * Department of Computer Science, Aalborg University, Denmark(计算机科学系,奥胡斯大学,丹麦) School of Computer Science and Engineering, Northeastern University, Shenyang, China(计算机科学与工程学院,东北大学,沈阳,中国)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 VISTA通过基于知识的可解释方法实现船舶轨迹补全,生成修复溯源以提升下游决策的可信度和效率。

Comments 24 pages, 14 figures, 4 algorithms, 8 tables. Code available at https://github.com/hyLiu1994/VISTA

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23876 2026-03-02 cs.AI cs.LG 62%

RF-Agent: Automated Reward Function Design via Language Agent Tree Search

RF-Agent: 通过语言代理树搜索实现自动奖励函数设计

Ning Gao, Xiuhui Zhang, Xingyu Jiang, Mukang You, Mohan Zhang, Yue Deng

机构 * Beihang University(北航大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 RF-Agent通过语言代理树搜索实现自动奖励函数设计,利用蒙特卡洛树搜索和LLMs的上下文推理能力,提升低层控制任务的奖励函数设计效率和效果。

Comments 39 pages, 9 tables, 11 figures, Project page see https://github.com/deng-ai-lab/RF-Agent

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19919 2026-03-02 cs.CL cs.LG 62%

Janus-Q: End-to-End Event-Driven Trading via Hierarchical-Gated Reward Modeling

Janus-Q:通过分层门控奖励建模实现端到端的事件驱动交易

Xiang Li, Zikai Wei, Yiyan Qi, Wanyun Zhou, Xiang Liu, Penglei Sun, Jian Guo, Yongqi Zhang, Xiaowen Chu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) International Digital Economy Academy(国际数字经济学院)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL、cs.LG

AI总结 Janus-Q通过分层门控奖励模型实现端到端事件驱动交易,提升金融新闻事件作为主要决策单元,提高交易决策的稳定性和盈利能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.24097 2026-03-02 cs.AI 57%

Bi-level RL-Heuristic Optimization for Real-world Winter Road Maintenance

双层强化学习启发式优化用于现实世界冬季道路维护

Yue Xie, Zizhen Xu, William Beazley, Fumiya Iida

机构 * School of Science, Loughborough University, UK(洛辛厄姆大学科学学院) Department of Engineering, University of Cambridge, UK(剑桥大学工程系) National Highways, 199 Wharfside St, Birmingham B1 1RN, UK(国家公路局)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本研究提出双层强化学习优化方法,用于高效解决现实世界冬季道路维护中的大规模路由问题,实现资源优化与排放降低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23719 2026-03-02 cs.RO cs.AI 57%

SAGE-LLM: Towards Safe and Generalizable LLM Controller with Fuzzy-CBF Verification and Graph-Structured Knowledge Retrieval for UAV Decision

SAGE-LLM:面向安全且可泛化的LLM控制器,结合模糊-CBF验证和图结构知识检索用于无人机决策

Wenzhe Zhao, Yang Zhao, Ganchao Liu, Zhiyu Jiang, Dandan Ma, Zihao Li, Xuelong Li

机构 * School of Artificial Intelligence, OPtics and ElectroNics (iOPEN), Northwestern Polytechnical University, Xi’an 710072, China(人工智能学院、光学与电子学(iOPEN)、西北工业大学,西安 710072,中国) Institute of Artificial Intelligence (TeleAI), China Telecom, China(人工智能研究所(TeleAI)、中国电信,中国)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 SAGE-LLM通过模糊-CBF验证和图结构知识检索,提升无人机决策的安全性和泛化能力,无需在线训练即可在复杂环境中保持性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22675 2026-03-02 cs.CL 57%

Search More, Think Less: Rethinking Long-Horizon Agentic Search for Efficiency and Generalization

搜索更多,思考更少:重新思考长周期代理搜索以提高效率和泛化能力

Qianben Chen, Tianrui Qin, King Zhu, Qiexiang Wang, Chengjun Yu, Shu Xu, Jiaqi Wu, Jiayu Zhang, Xinpeng Liu, Xin Gui, Jingyi Cao, Piaohong Wang, Dingfeng Shi, He Zhu, Tiannan Wang, Yuqing Wang, Maojia Song, Tianyu Zheng, Ge Zhang, Jian Yang, Jiaheng Liu, Minghao Liu, Yuchen Eleanor Jiang, Wangchunshu Zhou

专题命中 规划推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出SMTL框架,通过并行证据获取提升长周期代理搜索的效率与泛化能力,在多个基准测试中取得优异成绩。

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21746 2026-03-02 cs.AI 57%

fEDM+: A Risk-Based Fuzzy Ethical Decision Making Framework with Principle-Level Explainability and Pluralistic Validation

fEDM+: 基于风险的模糊伦理决策框架及其原则级可解释性与多元验证

Abeer Dyoub, Francesca A. Lisi

机构 * Dept. of Informatics, University of Bari ``Aldo Moro'', Bari, Italy(信息学院,巴里阿尔多·莫罗大学) Centro Interdipartimentale di Logica e Applicazioni (CILA), University of Bari ``Aldo Moro'', Bari, Italy(逻辑与应用跨部门中心(CILA),巴里阿尔多·莫罗大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 fEDM+通过引入可解释性模块和多元验证框架,提升伦理决策的可解释性和鲁棒性,适用于伦理敏感AI系统的监督与治理。

Comments correcting captions of figures 7 and 8 and some other minor errors

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17192 2026-03-02 cs.CL 57%

Paper2Code: Automating Code Generation from Scientific Papers in Machine Learning

Paper2Code: 从科学论文自动生成机器学习代码

Minju Seo, Jinheon Baek, Seongyun Lee, Sung Ju Hwang

机构 * KAIST(韩国科学技术院) LG AI Research(LG人工智能研究所)

专题命中 规划推理 :planning(abstract);分类 cs.CL

AI总结 Paper2Code通过多代理LLM框架自动生成机器学习论文的高质量代码实现,有效提升代码生成效率和准确性。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03472 2026-03-02 cs.RO cs.AI cs.MA 57%

Destination-to-Chutes Task Mapping Optimization for Multi-Robot Coordination in Robotic Sorting Systems

多机器人协同中的目的地到传送口任务映射优化

Yulun Zhang, Alexandre O. G. Barbosa, Federico Pecora, Jiaoyang Li

机构 * Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出基于进化算法和混合整数线性规划的任务映射优化方法,用于提升多机器人分拣系统的吞吐量。

Comments Accepted to IEEE International Symposium on Multi-Robot and Multi-Agent Systems (MRS) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.16162 2026-03-02 cs.MA cs.AI 57%

Scaling Lifelong Multi-Agent Path Finding to More Realistic Settings: Research Challenges and Opportunities

将终身多智能体路径寻找扩展到更现实的场景:研究挑战与机遇

He Jiang, Yulun Zhang, Rishi Veerapaneni, Jiaoyang Li

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文探讨了将终身多智能体路径寻找扩展到现实场景中的三个研究挑战及未来发展方向。

Comments Accepted to Symposium on Combinatorial Search (SoCS), 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.24241 2026-03-02 cs.IR cs.HC 50%

UXSim: Towards a Hybrid User Search Simulation

UXSim: 向混合用户搜索模拟迈进

Saber Zerhoudi, Michael Granitzer

专题命中 规划推理 :reasoning(abstract)

AI总结 UXSim 通过整合传统模拟器与适应性 LLM 代理,提供更准确的用户行为模拟和可解释的验证方法。

Journal ref Proceedings of the 34th ACM International Conference on Information and Knowledge Management (CIKM '25), November 10--14, 2025, Seoul, Republic of Korea

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.24087 2026-03-02 physics.comp-ph astro-ph.IM hep-ex physics.soc-ph 50%

Shaping the Digital Future of ErUM Research: Sustainability & Ethics

塑造ErUM研究的数字未来:可持续性与伦理

Luca Di Bella, Jan Bürger, Markus Demleitner, Torsten Enßlin, Johannes Erdmann, Martin Erdmann, Benjamin Fischer, Martin Gasthuber, Gabriele Gramelsberger, Wolfgang Gründinger, Prateek Gupta, Johannes Hartl, Maximilian Horzela, Vijay Kartik, Stefan Krischer, Eva Kröll, Thomas Kuhr, Katharina Kürschner, Inga Lakomiec, Valerie Lang, Kristin Lohwasser, Thomas Metcalf, Martin Möller, Saskia Nagel, Susanne Pfalzner, Rebecca Redlin, Christopher Schrader, Kathrin Schulz, Markus Schumacher, Kilian Schwarz, Fabian Sigler, Dwayne Spiteri, Achim Stahl, Judith Steinfeld, Wim Vanderbauwhede, Cyrus Walther, Angela Warkentin, Peter Wissmann, Eoin Woods

专题命中 规划推理 :planning(abstract)

AI总结 该报告探讨了ErUM研究在可持续性和伦理方面的数字化未来,强调通过技术措施、教育支持和社区倡议实现可持续的计算和数据实践。

Comments 32 pages, no figures, report for workshop "Shaping the Digital Future of ErUM Research: Sustainability & Ethics", 28 July to 1 August 2025, Aachen, Germany, see https://indico.desy.de/event/47133/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23648 2026-03-02 cs.RO 50%

FAVLA: A Force-Adaptive Fast-Slow VLA model for Contact-Rich Robotic Manipulation

FAVLA:一种力适应的快速-慢速VLA模型用于接触丰富的机械臂操作

Yao Li, Peiyuan Tang, Wuyang Zhang, Chengyang Zhu, Yifan Duan, Weikai Shi, Xiaodong Zhang, Zijiang Yang, Jianmin Ji, Yanyong Zhang

机构 * University of Science and Technology of China(中国科学技术大学) Xi'an Jiaotong University(西安交通大学) Central South University(中南大学)

专题命中 规划推理 :planning(abstract)

AI总结 FAVLA通过解耦慢感知规划与快速接触感知控制,提升接触丰富任务中的反应性和成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23623 2026-03-02 cs.NI 50%

Toward E2E Intelligence in 6G Networks: An AI Agent-Based RAN-CN Converged Intelligence Framework

迈向6G网络的端到端智能:一种基于AI代理的RAN-CN融合智能框架

Youbin Han, Haneul Ko, Namseok Ko, Tarik Taleb, Yan Chen

专题命中 规划推理 :reasoning(abstract)

AI总结 本文提出一种基于AI代理的RAN-CN融合智能框架,利用大语言模型和ReAct范式,实现跨域网络的统一智能控制,提升网络适应性和泛化能力。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23109 2026-03-02 cs.RO 50%

Towards Intelligible Human-Robot Interaction: An Active Inference Approach to Occluded Pedestrian Scenarios

迈向可解释的人机交互:一种主动推断方法用于遮挡行人场景

Kai Chen, Yuyao Huang, Guang Chen

机构 * Tongji University(同济大学)

专题命中 规划推理 :planning(abstract)

AI总结 本文提出基于主动推断的方法,用于解决遮挡行人场景中的安全挑战,通过结合 RBPF 和 CEM 增强的 MPPI 控制器,实现可解释的人机交互。

Comments 14 pages, 6 figures, Proceedings of the 2026 ACM/IEEE International Conference on Human-Robot Interaction (HRI'26)

详情

展开后加载摘要…

URL PDF HTML 收藏