arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 11017 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 11017 篇

2602.22638 2026-06-11 cs.AI 版本更新 79%

MobilityBench: A Benchmark for Evaluating Route-Planning Agents in Real-World Mobility Scenarios

MobilityBench:用于评估真实世界移动场景中路径规划智能体的基准

Zhiheng Song, Jingshuai Zhang, Chuan Qin, Chao Wang, Chao Chen, Longfei Xu, Kaikui Liu, Xiangxiang Chu, Hengshu Zhu

机构 * Computer Network Information Center, Chinese Academy of Sciences(中国科学院计算机网络信息中心) AMAP, Alibaba Group(阿里集团AMAP) Alibaba Group(阿里集团)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 提出MobilityBench基准,通过确定性API重放沙箱和多维评估协议,系统评估基于LLM的路径规划智能体,发现现有模型在偏好约束路径规划上表现不佳。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10532 2026-06-10 cs.AI 新提交 79%

ActiveMem: Distributed Active Memory for Long-Horizon LLM Reasoning

ActiveMem: 用于长程LLM推理的分布式主动记忆

Yunhan Jiang, Wenbin Duan, Shasha Guo, Liang Pang, Xiaoqian Sun, Huawei Shen

机构 * State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所人工智能安全国家重点实验室) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 提出ActiveMem框架,将记忆从核心推理中解耦,通过分布式主动记忆系统积累语义要点,在长程推理任务中实现高精度和低开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09837 2026-06-10 cs.HC cs.AI 新提交 79%

Self-EmoQ: Plutchik-Guided Value-based Planning to Drive Streaming Emotional TTS

Self-EmoQ: 基于Plutchik引导的价值规划驱动流式情感TTS

Yue Zhao, Hongyan Li, Yong Chen, Luo Ji

机构 * Geely AI Lab(地平线人工智能实验室)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 提出一种情感规划框架,通过强化学习训练LLM模块,在文本生成前确定情感,以驱动流式TTS,结合Plutchik情感理论进行混合奖励,实验表明在情感确定和响应质量上优于基线。

Comments Accepted to ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09251 2026-06-09 cs.CL 新提交 79%

TruthSplit: Operationalizing Conditional Validity in Arguments Through Multi-Perspective Reasoning

TruthSplit:通过多视角推理实现论证中的条件有效性操作化

Benjamin Stieger, Maximilian Terberger, Thomas Huber, Christina Niklaus

机构 * University of St. Gallen(圣加仑大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL

AI总结 提出TruthSplit系统,通过三层自然语言推理和结构化世界观档案,实现基于不同视角的论证条件有效性分析,识别价值冲突与假设差异。

Comments Demo paper. To appear at ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08596 2026-06-09 cs.AI cs.HC 新提交 79%

Distilling LLM Reasoning into an Interpretable Policy Tree for Human-AI Collaboration

将LLM推理蒸馏为可解释的策略树用于人机协作

Beiwen Zhang, Yongheng Liang, Guowei Zou, Haitao Wang, Hejun Wu

机构 * Sun Yat-sen University(中山大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 提出Co-pi-tree方法,通过将大语言模型推理蒸馏为可执行策略树,在Overcooked-AI中平均奖励提升35.4%,同时减少77.7%的LLM查询和97.1%的测试延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08310 2026-06-09 cs.AI cs.MA 新提交 79%

To Nuke or Not to Nuke: LLMs' (Missing) Ethical Reasoning and Actions in a High-Stakes Decision-Making Simulation

核弹还是和平:大语言模型在高风险决策模拟中的(缺失的)伦理推理与行动

John Chen, Sihan Cheng, Can Gurkan, H M Abdul Fattah

机构 * University of Arizona(亚利桑那大学) Northwestern University(西北大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 研究LLM在复杂游戏《文明V》中自发升级核授权的现象,通过三种提示干预发现伦理推理未能可靠消除升级,识别出三种失败路径,强调需在复杂决策上下文中测试伦理推理的自发性和行为有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02802 2026-06-09 cs.AI 版本更新 79%

ChatHealthAI: Aligning Electronic Health Record Representations with Large Language Models for Grounded Clinical Reasoning

ChatHealthAI: 将电子健康记录表示与大语言模型对齐以实现基于临床的推理

Bo-Hong Wang, Baicheng Peng, Ruilin Wang, Jun Bai, Ziyang Song, Yue Li

机构 * School of Computer Science, McGill University(麦吉尔大学计算机科学系) Mila - Quebec AI Institute(魁北克人工智能研究所)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 提出ChatHealthAI框架,通过任务感知重采样器将预训练的EHR基础模型的结构化表示与冻结的大语言模型语义空间对齐,实现可解释的临床推理并保持预测性能。

Comments Main paper with appendix, 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06684 2026-06-08 cs.LG 版本更新 79%

GraphWalker: Patient Analogy Meets Information Gain for Clinical Reasoning with Large Language Models

GraphWalker: 患者类比与信息增益结合用于大型语言模型的临床推理

Yue Fang, Weibin Liao, Yuxin Guo, Jiaran Gao, Hongxin Ding, Jinyang Zhang, Xinke Jiang, Zhibang Yang, Junfeng Zhao, Yasha Wang, Liantao Ma

机构 * School of Computer Science, Peking University, Beijing, China(北京大学计算机学院,北京,中国) National Engineering Research Center for Software Engineering, Peking University, Beijing, China(软件工程国家工程研究中心,北京大学,北京,中国)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.LG

AI总结 提出GraphWalker框架,通过联合数据驱动和模型驱动视角、发现患者队列以及采用懒惰贪心搜索,从电子健康记录中检索患者案例进行类比推理,无需参数更新即可提升临床推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05464 2026-06-05 cs.AI 79%

Step-by-Step Optimization-like Reasoning in LLMs over Expanding Search Spaces

大语言模型中在扩展搜索空间上的逐步优化类推理

Nicolás Astorga, Nabeel Seedat, Mihaela van der Schaar

机构 * University of Cambridge(剑桥大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文提出OPT*任务族,通过可验证奖励训练和搜索引导策略,提升LLM在扩展搜索空间中的逐步优化推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04505 2026-06-04 cs.AI 79%

Simulate, Reason, Decide: Scientific Reasoning with LLMs for Simulation-Driven Decision Making

模拟、推理、决策:基于科学推理的LLM驱动模拟决策

Yuhan Yang, Ruipu Li, Alexander Rodríguez

机构 * Computer Science and Engineering University of Michigan(计算机科学与工程大学密歇根大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 提出MechSim框架,通过神经符号推理使LLM能够推理科学模拟器的机制和假设,提升决策透明度和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09686 2026-06-04 cs.AI cs.CV 79%

Belief-Aware VLM Model for Human-like Reasoning

信念感知的VLM模型用于类人推理

Anshul Nayak, Shahil Shaik, Yue Wang

机构 * Mechanical Engineering Department, Clemson University(克莱姆森大学机械工程系)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 提出一种信念感知的视觉语言模型框架,通过检索式记忆和强化学习近似信念,提升长时程意图推理能力,在HD-EPIC等数据集上优于零样本基线。

Comments Accepted for publication at the IEEE International Conference on Robot and Human Interactive Communication (RO-MAN 2026). 6 pages, 3 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01672 2026-06-04 cs.CL 79%

Adaptive Information Control for Search-Augmented LLM Reasoning

面向搜索增强型大语言模型推理的自适应信息控制

Siheng Xiong, Oguzhan Gungordu, James C. Kerce, Faramarz Fekri

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL

AI总结 提出基于信息效用的自适应控制框架DeepControl,通过控制检索的广度与分辨率,提升搜索增强推理的性能与训练稳定性。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
1904.02341 2026-06-04 cs.RO cs.AI cs.SY eess.SY 79%

Online Risk-Bounded Motion Planning for Autonomous Vehicles in Dynamic Environments

在线风险受限的自主车辆动态环境中的运动规划

Xin Huang, Sungkweon Hong, Andreas Hofmann, Brian C. Williams

机构 * MIT Computer Science and Artificial Intelligence Laboratory(麻省理工学院计算机科学与人工智能实验室)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 本文提出了一种在线风险受限的运动规划方法,通过结合意图识别算法和POMDP求解器,生成安全高效的路径规划方案,尤其在无保护左转和变道等复杂环境中表现更优。

Comments Accepted at ICAPS'19. 10 pages, 6 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
1311.4527 2026-06-04 cs.AI cs.DC cs.MA cs.RO cs.SY eess.SY 79%

A message-passing algorithm for multi-agent trajectory planning

多智能体轨迹规划的消息传递算法

Jose Bento, Nate Derbinsky, Javier Alonso-Mora, Jonathan Yedidia

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 本文提出基于改进交替方向乘子法的新型算法,用于计算多智能体的无碰撞全局轨迹,具有自然并行化和易整合不同成本函数的优点。

Comments In Advances in Neural Information Processing Systems (NIPS), 2013. Demo video available at http://www.youtube.com/watch?v=yuGCkVT8Bew

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02438 2026-06-02 cs.AI 79%

LLM-Evolved Pattern Generators for Optimal Classical Planning

LLM演化模式生成器用于最优经典规划

Windy Phung, Dominik Drexler, Arnaud Lequen, Jendrik Seipp

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 提出首个通过LLM驱动的进化程序合成学习可容许启发式函数的方法,用于最优经典规划,结合饱和成本分区保证A*搜索的最优性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01094 2026-06-02 cs.AI 79%

CAREAgent: Clinical Agent with Structured Reasoning and Tool-Integrated for Order Generation

CAREAgent: 具有结构化推理和工具集成的临床智能体用于医嘱生成

Ruihui Hou, Ziyue Huai, Chennuo Zhang, Ziyan Liu, Siran Zhao, Yao Yu, Jie Zhai, Tong Ruan

机构 * East China University of Science and Technology, Shanghai, China(东华大学上海科学技术学院) Zhongshan Hospital, Fudan University, Shanghai, China(复旦大学中山医院)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 提出CAREAgent,通过两阶段推理数据构建和监督微调与强化学习,生成细粒度临床医嘱,在ClinicalBench上F1提升5.05%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00240 2026-06-02 cs.AI cs.MA 79%

MindZero: Learning Online Mental Reasoning With Zero Annotations

MindZero:零标注的在线心智推理学习

Shunchi Zhang, Jin Lu, Chuanyang Jin, Yichao Zhou, Zhining Zhang, Tianmin Shu

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 提出MindZero框架,通过自监督强化学习训练多模态大语言模型,实现高效鲁棒的在线心智推理,无需显式心智状态标注。

Comments ICML 2026. Website: https://scai.cs.jhu.edu/MindZero

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02845 2026-06-02 cs.RO cs.AI 79%

SPARC: Spatial-Aware Path Planning via Attentive Agent Communication

SPARC: 通过注意力智能体通信实现空间感知路径规划

Sayang Mu, Xiangyu Wu, Bo An

机构 * Nanyang Technological University(南洋理工大学)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 提出关系增强多头注意力(RMHA)机制,通过嵌入曼哈顿距离到注意力权重计算,优先处理空间邻近机器人的消息,在40x40网格上从8机器人零样本泛化到128机器人时,在30%障碍密度下实现约75%成功率,超越基线25个百分点以上。

Comments The manuscript is being withdrawn at the request of the first author for the purpose of revising content and re-uploading a revised version with updated data/figures/text . The revised manuscript will be resubmitted to arXiv promptly with the same author list and research theme

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11460 2026-06-02 cs.RO cs.LG 79%

Semantic-Geometric Task Representations for Bimanual Manipulation from Human Demonstrations to Robot Action Planning

面向双臂操作的语义-几何任务表示:从人类示范到机器人动作规划

Franziska Herbert, Vignesh Prasad, Han Liu, Dorothea Koert, Georgia Chalvatzaki

机构 * Interactive Robot Perception & Learning (PEARL) Lab, Computer Science Dept., TU Darmstadt, Germany(图腾大学达姆施塔特分校计算机科学系交互机器人感知与学习实验室) Hessian.AI, Darmstadt, Germany(黑森人工智能公司) Robotics Institute Germany (RIG)(德国机器人研究所) Interactive AI Algorithms & Cognitive Models for Human-AI Interaction (IKIDA), Computer Science Dept., TU Darmstadt, Germany(人机交互的交互人工智能算法与认知模型(IKIDA),图腾大学达姆施塔特分校计算机科学系) Center for Cognitive Science, TU Darmstadt, Germany(图腾大学达姆施塔特分校认知科学中心)

专题命中 规划推理 :planning(title);reasoning(abstract);分类 cs.LG

AI总结 提出一种语义-几何图任务表示,通过消息传递神经网络编码器和Transformer解码器联合编码对象身份、语义关系和运动历史,实现从人类示范中学习结构化任务表示,并支持跨实体迁移和双臂操作规划。

Comments 9 pages, 7 figures, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.09953 2026-06-02 cs.RO cs.AI 79%

DAG-Plan: Generating Directed Acyclic Dependency Graphs for Dual-Arm Cooperative Planning

DAG-Plan:生成有向无环依赖图用于双臂协作规划

Zeyu Gao, Yao Mu, Jinye Qu, Mengkang Hu, Shijia Peng, Chengkai Hou, Lingyue Guo, Ping Luo, Shanghang Zhang, Yanfeng Lu

机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences (CASIA)(多模态人工智能系统国家重点实验室,自动化研究所,中国科学院(CASIA)) School of Artificial Intelligence, University of Chinese Academy of Sciences (UCAS)(中国科学院大学人工智能学院) School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院) State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(多媒体信息处理国家重点实验室,北京大学计算机科学学院) Department of Computer Science, The University of Hong Kong(香港大学计算机科学系) OpenGVLab, Shanghai AI Laboratory(上海人工智能实验室,OpenGVLab)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 提出DAG-Plan框架,首次使用有向无环图作为双臂协调的核心表示,通过一次LLM解析生成结构化DAG,实现自适应并行执行,在双臂厨房基准测试中成功率提升48%,执行效率提升84.1%。

Comments ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31492 2026-06-01 cs.AI 79%

LinTree: Improving LLM Reasoning with Explicitly Structured Search Histories

LinTree: 通过显式结构化搜索历史提升LLM推理能力

Liwei Kang, Yee Whye Teh, Wee Sun Lee

机构 * National University of Singapore(新加坡国立大学) University of Oxford(牛津大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 针对LLM推理中隐式搜索树导致性能不佳的问题,提出LinTree方法,通过添加父指针显式表示线性化树结构,在Blocks World、网格导航和Sokoban任务中提升了任务性能和搜索效率。

Comments 16 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00068 2026-06-01 cs.CY cs.AI 79%

The Global Landscape of Environmental AI Regulation: From the Cost of Reasoning to a Right to Green AI

环境AI监管的全球格局:从推理成本到绿色AI权利

Kai Ebert, Boris Gamazaychikov, Philipp Hacker, Sasha Luccioni

机构 * European University Viadrina(欧洲维德林大学) Sustainable AI Group(可持续AI小组)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文通过实证证据、全球监管地图和政策建议,揭示了生成式AI日益增长的环境成本,并提出模型级透明度、用户选择权和国际协调的三管齐下应对方案。

Comments 23 pages, 1 table, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11944 2026-05-29 cs.RO cs.AI 79%

A Review of Learning-Based Motion Planning: Toward a Data-Driven Optimal Control Approach

基于学习的运动规划综述:迈向数据驱动的最优控制方法

Jia Hu, Yang Chang, Haoran Wang

机构 * College of Transportation Key Laboratory of Road and Traffic Engineering of the Ministry of Education(交通运输学院 道路交通工程教育部重点实验室) Institute for Advanced Study(先进研究院) Tongji University(同济大学)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 本文系统综述了数据驱动最优控制范式,通过融合最优控制的理论保证与机器学习的自适应能力,为自动驾驶运动规划提供了三维实现路线图,并指出了四个未来研究方向。

Comments 44 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28862 2026-05-29 cs.LG q-bio.QM 79%

Molecular Lead Optimization via Agentic Tool Planning

通过智能体工具规划进行分子先导优化

Lingxiao Li, Haobo Zhang, Ruohao Fan, Bin Chen, Jiayu Zhou

机构 * University of Michigan(密歇根大学) University of California, Davis(加州大学戴维斯分校) Michigan State University(密歇根州立大学)

专题命中 规划推理 :planning(title);reasoning(abstract);分类 cs.LG

AI总结 提出TRACE,一种轨迹感知的LLM推理智能体,将先导优化建模为序列决策问题,通过工具选择实现结构约束下的前瞻性分子优化,在ADMET任务中优于基线。

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07707 2026-05-29 cs.AI 79%

Hierarchical Task Network Planning with LLM-Generated Heuristics

基于LLM生成启发式的层次任务网络规划

Felipe Meneguzzi, Alexandre Buchweitz, Augusto B. Corrêa, Victor Scherer Putrich, André Grahl Pereira

机构 * University of Aberdeen, UK(爱丁堡大学(英国)) PUCRS, Brazil(巴西普埃布拉联邦大学) University of Oxford, UK(牛津大学(英国)) Saarland University, Germany(萨尔大学(德国)) Universidade Federal do Rio Grande do Sul, Brazil(巴西里约格兰德 do 南大学)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 研究利用大语言模型为层次任务网络规划生成搜索启发式,通过Pytrich规划器在六个基准领域评估,结果表明LLM生成的启发式在覆盖度上接近最优HTN规划器,并在83%的共享问题上显著减少搜索开销。

Comments 9 pages, 3 figures; submitted to NeurIPS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17176 2026-05-29 eess.SY cs.AI cs.SY math.OC 79%

Intent-aligned Autonomous Spacecraft Guidance via Reasoning Models

通过推理模型实现意图对齐的自主航天器制导

Yuji Takubo, Simone D'Amico

机构 * Stanford University(斯坦福大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 提出一种通过行为序列和航点约束将高层推理与安全轨迹优化相结合的意图对齐航天器制导框架,在近距离操作场景中实现了超过90%的SCP收敛率,并比启发式决策高出1.5倍的满足顶级意图优先性能标准的轨迹生成率。

Comments Accepted for Computer Vision and Pattern Recognition Conference (CVPR) 2026, AI4Space Workshop (4-page Short paper). 9 pages, 3 figures (including supplementary materials)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28699 2026-05-28 cs.AI 79%

TRACER: Turn-level Regret Matching with Inner Reinforcement Credit for Cooperative Multi-LLM Reasoning

TRACER: 基于内部强化信用与轮次级遗憾匹配的多LLM协作推理

Chusen Li, Zhou Liu, Shuigeng Zhou, Wentao Zhang

机构 * Fudan University(复旦大学) Zhongguancun Academy(中关村学院) Academy for Advanced Interdisciplinary Studies, Peking University(北京大学先进交叉学科研究院)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 提出TRACER框架,通过控制器-遗憾层和生成-信用层分别学习发言时机与内容,解决多智能体强化学习中的稀疏奖励、搭便车和固定协议振荡问题,实现数学收敛的协作推理。

Comments 25 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28666 2026-05-28 cs.AI 79%

An LLM-Based Assistance System for Intuitive and Flexible Capability-Based Planning

基于LLM的直观灵活能力规划辅助系统

Luis Miguel Vieira da Silva, Nicolas König, Felix Gehlhoff

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 提出一种混合辅助系统,将基于能力的形式化SMT规划与LLM自然语言交互层结合,通过人机协同实现规划解释与知识模型自适应,提升工业自动化中能力规划的可访问性和灵活性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28070 2026-05-28 cs.AI 79%

Bridging the Detection-to-Abstention Gap in Reasoning Models under Insufficient Information

弥合推理模型在信息不足情况下的检测到弃权差距

Renjie Gu, Jiaxu Li, Yihao Wang, Yun Yue, Hansong Xiao, Yefei Chen, Yuan Wang, Chunxiao Guo, Pei Wei, Jinjie Gu, Yixin Cao

机构 * Fudan University(复旦大学) Ant Group(蚂蚁集团) Zhejiang University(浙江大学) Tsinghua University(清华大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 针对推理模型在信息不足时无法有效弃权的问题,提出Judge-Then-Solve(JTS)轨迹级推理控制框架,通过可回答性判断和强化学习训练,显著提升可靠弃权率并减少不必要的推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26333 2026-05-27 cs.AI 79%

Managing Uncertainty in LLM-Generated Procedural Knowledge for Virtual Laboratory Planning

管理虚拟实验室规划中LLM生成程序性知识的不确定性

Polychronis Karpodinis, Dimitris Kalles

机构 * School of Science and Technology, Hellenic Open University(希腊开放大学科学与技术学院)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 针对LLM生成实验程序存在的不确定性,提出一个原型框架,通过结构化领域表示和不确定的状态转移样本提取候选程序规则,转化为显式约束并修复不确定步骤,以提升虚拟实验室规划的可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏