arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-07-14 至 2026-07-14 共收录 46 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 46 篇

2607.11529 2026-07-14 cs.CV 新提交 89%

Parse, Search, and Confirmation: Training-Free Aerial Vision-and-Dialog Navigation with Chain-of-Thought Reasoning and Structured Spatial Memory

解析、搜索与确认:基于思维链推理和结构化空间记忆的免训练空中视觉与对话导航

Yu Qi, Hongyu Li, Shaofei Huang, Tianrui Hui, Yaxiong Wang, Lechao Cheng, Zhun Zhong, Si Liu, Meng Wang

机构 * School of Computer Science and Information Engineering, Hefei University of Technology(合肥工业大学计算机与信息工程学院) Jianghuai Advance Technology Center(江淮先进技术中心) Anhui Provincial Key Laboratory of Humanoid Robots(安徽省人形机器人重点实验室) School of Artificial Intelligence, Beihang University(北京航空航天大学人工智能学院) University of Macau(澳门大学)

专题命中 规划推理 :reasoning(title,abstract);chain-of-thought(title,abstract);CoT(abstract)

AI总结 研究免训练环境下的空中视觉与对话导航任务,提出PSC - AVDN框架,结合解析 - 搜索 - 确认推理管道与结构化空间记忆,整合多种空间线索,在免训练设置中取得新的最优性能。

Comments 10 pages, 4 figures. Accepted to CVPR 2026

Journal ref Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2026, pp. 23859-23868

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05933 2026-07-14 eess.AS 版本更新 86%

Speech World Model: Causal State-Action Planning with Explicit Reasoning for Speech

语音世界模型:基于显式推理的语音因果状态-动作规划

Xuanru Zhou, Jiachen Lian, Henry Hong, Xinyi Yang, Gopala Anumanchipalli

专题命中 规划推理 :reasoning(title,abstract);planning(title)

AI总结 研究旨在改进语音语言模型推理弱的问题,采用模块化视角和世界模型观点,将语音理解分解为四个模块通过因果图通信,建立认知状态搜索空间,实现显式推理,让语音理解更透明可控。

Comments Accepted to 2026 ICLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10994 2026-07-14 cs.LG 新提交 85%

A Multi-Agent Framework for Zero-Dimensional Reduced-Order Model Planning

用于零维降阶模型规划的多智能体框架

Bingteng Sun, Hao Yin, Yiling Chen, Renjie Xiao, Lei Xie, Shanyou Wang, Ruonan Wang, Shubao Chen, Qingzong Xu, Lin Lu, Qiang Du, Junqiang Zhu

机构 * Institute of Engineering Thermophysics, Chinese Academy of Sciences(中国科学院工程热物理研究所) National Key Laboratory of Science and Technology on Advanced Light-duty Gas-turbine(先进轻型燃气轮机技术重点实验室) University of Chinese Academy of Sciences(中国科学院大学) Qingdao Institute of Aeronautical Technology(青岛航空技术研究院) Nanjing Future Energy System Research Institute(南京未来能源系统研究院)

专题命中 规划推理 :planning(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.LG

AI总结 本文针对复杂零维降阶模型规划中依赖人工、传统方法局限等问题,提出多智能体架构Z-COPA,其核心是专用图表示法,将规划转化为图结构优化问题,经多基准测试验证,该框架性能卓越且打破传统范式,提供新规划技术方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11197 2026-07-14 cs.AI 新提交 84%

What We Talk About When We Talk About LLM Planning: Evidence for Two Distinct Planning Abilities

当我们谈论大语言模型规划时我们在谈论什么:两种不同规划能力的证据

Sukai Huang, Chenyuan Zhang, Fucai Ke, Zhixi Cai, Naim Rastgoo, Gholamreza Haffari, Hamid Rezatofighi

机构 * Faculty of Information Technology, Monash University(莫纳什大学信息技术学院)

专题命中 规划推理 :planning(title,abstract);reasoning(abstract,comments);分类 cs.AI

AI总结 研究大语言模型规划任务性能差异原因,通过在ACPBench-Hard上评估多个模型家族,应用多维项目反应理论模型,发现操作推理和结构枚举两个塑造规划性能的维度,推动大语言模型规划的能力层面评估。

Comments 19 pages. Keywords: Reasoning, Automated Planning, Item Responses Theory, LLMs as Planner Research Area: NLP and Symbolic Reasoning Research Area Keywords: neurosymbolic, planning in agents, symbolic reasoning Contribution Types: Model analysis & interpretability

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06205 2026-07-14 cs.CL cs.AI 版本更新 84%

Tool-MCoT: Tool Augmented Multimodal Chain-of-Thought for Content Safety Moderation

Tool-MCoT:用于内容安全审核的工具增强多模态链式思维

Shutong Zhang, Dylan Zhou, Yinxiao Liu, Yang Yang, Huiwen Luo, Wenfei Zou

机构 * Stanford University(斯坦福大学) Google(谷歌) Google DeepMind(谷歌DeepMind)

专题命中 规划推理 :chain-of-thought(title,abstract);reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文提出Tool-MCoT,一种基于工具增强的多模态链式思维模型,用于提升内容安全审核的效率与准确性,通过训练小语言模型以有效利用外部工具进行推理和决策。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09790 2026-07-14 cs.AI cs.CY 新提交 83%

Semantic Drift and the Stability of Operator Control in Reasoning-Class Decision Support Systems

语义漂移与推理类决策支持系统中操作员控制的稳定性

M. L. Kaluzhsky, V. A. Efirov

机构 * Omsk State Technical University(鄂木斯克国立技术大学)

专题命中 规划推理 :reasoning(title,abstract);logical reasoning(abstract);分类 cs.AI

AI总结 研究新一代人机混合决策支持系统中操作员控制稳定性问题,通过实验验证推理LLMs语义漂移现象,提出人机界面交互数学模型及控制稳定性系数,在认知组理论范式下捕捉临界点,给出相关工程建议。

Comments 5 pages, 1 figure, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10336 2026-07-14 cs.RO cs.CV 新提交 82%

PrismAD: Decoupled Planning via Semantic Mixture-of-Planners for End-to-End Autonomous Driving

PrismAD:通过语义规划器混合实现端到端自动驾驶的解耦规划

Kang Ding, Zhigui Lin, Hongsong Wang, Jie Gui, Qi Liu, Zhe Wang, Luqi Tang, Lei He

机构 * School of Vehicle and Mobility, Tsinghua University(清华大学车辆与运载学院) State Key Laboratory of Intelligent Green Vehicle and Mobility, Tsinghua University(清华大学智能绿色车辆与出行国家重点实验室) School of Cyberspace Security, Southeast University(东南大学网络空间安全学院) School of Computer Science and Engineering, Southeast University(东南大学计算机科学与工程学院) School of Automotive Engineering, Wuhan University of Technology(武汉理工大学汽车工程学院) SAIC GM Wuling Automobile Co., Ltd.(上汽通用五菱汽车股份有限公司)

专题命中 规划推理 :planning(title,abstract);reasoning(abstract)

AI总结 研究针对自动驾驶规划器耦合问题,提出PrismAD框架,将场景令牌分组,用独立规划专家学习专门表示,语义感知路由器聚合预测,引入稀疏top-$K$激活,实验证明该框架性能具竞争力。

Comments 8 pages,5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11358 2026-07-14 cs.CL 新提交 79%

RefineEvo: Planning-Guided Heuristic Evolution with Bidirectional Experience

RefineEvo:基于双向经验的规划引导启发式进化

Yang Wu, Junran Pan, Yifan Zhang, Ning Xu, Fanshuo Zeng, Jian Cheng

机构 * C$^2$DL, Institute of Automation, Chinese Academy of Sciences(C2DL,自动化研究所,中国科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences, Beijing(人工智能学院,中国科学院大学,北京) University of Chinese Academy of Sciences, Nanjing(中国科学院大学,南京)

专题命中 规划推理 :planning(title,abstract);分类 cs.CL

AI总结 针对自动启发式设计中基于LLM方法的不足,提出RefineEvo框架,通过规划器和反射器,结合双向经验池动态调度进化算子,在经典组合优化基准测试中表现出色,提升了解质量和令牌效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10651 2026-07-14 cs.AI 新提交 79%

Embark Now: User Demand Oriented Framework for Multi-day Urban Travel Itinerary Planning

即刻出发:面向多日城市旅行行程规划的用户需求导向框架

Rongbo Qi, Yaqi Zhang, Shijun Yan, Xuemeng Liu, Xiangrui Cai, Chunyao Song

机构 * Jiangxi Normal University(江西师范大学)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 针对大城市多日旅行行程规划难题,提出集成大语言模型与增强GRASP算法的框架,经实验验证其在行程质量和计算效率上显著优于现有方法,能动态满足多样用户需求。

Comments 37 pages, 16 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10630 2026-07-14 cs.RO cs.AI 新提交 79%

World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning

作为对手的世界模型:用于鲁棒运动规划的多智能体自我博弈微调

Tong Nie, Yuewen Mei, Junlin He, Yihong Tang, Jian Sun, Wei Ma

机构 * The Hong Kong Polytechnic University(香港理工大学) Tongji University(同济大学) McGill University(麦吉尔大学) Mila-Quebec AI Institute(米拉-魁北克人工智能研究所)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 研究在密集交通中自动驾驶车辆鲁棒运动规划问题,提出对抗世界建模(AWM)框架,通过多智能体自我博弈微调,引入解耦求解器,经实验验证该方法能生成可转移对抗交互,使规划器在多种场景有竞争力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10411 2026-07-14 cs.SE cs.AI 新提交 79%

Mitigating LLM Sycophancy in Code Smell Detection Using Evidence-Guided Reasoning Prompts

使用证据引导推理提示减轻代码异味检测中的大语言模型谄媚现象

Istiaq Ahmed Fahad, Kamruzzaman Asif, Md. Nurul Ahad Tawhid

机构 * Institute of Information Technology(信息科技研究所) University of Dhaka(达卡大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 研究基于LLM的代码异味检测中谄媚偏差问题,通过MLCQ数据集评估不同提示框架影响,发现模型对提示变化敏感。提出证据引导去偏提示策略,降低决策不稳定性,提高鲁棒性,为解决该问题提供有效方法。

Comments 11 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10438 2026-07-14 cs.RO cs.NI 新提交 78%

Large Language Model Enhanced Differentiable Trajectory Planning for IoT-Enabled Autonomous Driving

用于物联网支持的自动驾驶的大语言模型增强可微轨迹规划

Shihao Zhang, Jing Yang, Ziyu Song, Zheng Lin, Sunil Prajapat, Zhaochen Xia, Hemant Ghayvat, Haitao Ding, Lip Yee Por, Ashok Kumar Das

机构 * State Key Laboratory of Automotive Simulation and Control, Jilin University(吉林大学汽车仿真与控制国家重点实验室) Center of Research for Cyber Security and Network (CSNET), Faculty of Computer Science and Information Technology, Universiti Malaya(马来西亚大学计算机科学与信息技术学院网络安全与网络研究中心) Interdisciplinary Centre for Security, Reliability and Trust (SnT), University of Luxembourg(卢森堡大学安全、可靠性与信任跨学科中心) IMT, Department of Humanities and Technology, Roskilde University(罗斯基勒大学人文与技术系IMT) Center for Security, Theory and Algorithmic Research, International Institute of Information Technology(国际信息技术研究所安全、理论与算法研究中心) Department of Computer Science and Engineering, College of Informatics, Korea University(韩国大学信息学院计算机科学与工程系)

专题命中 规划推理 :planning(title,abstract)

AI总结 针对物联网支持的自动驾驶规划问题,提出大语言模型增强可微轨迹规划框架。通过以周围智能体为中心的数据增强、复杂度感知的语义增强模块及可微优化模块,提升规划效果,在相关基准测试中取得高分,验证了在线部署和实时闭环执行能力。

Comments 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10437 2026-07-14 cs.RO 新提交 78%

Interleaved POMDP Planning for Multi-Object Search in Unknown Multi-Room Household Environments

未知多房间家庭环境中多目标搜索的交错部分可观测马尔可夫决策过程规划

Ruochu Yang, Ziyi Xia, Huibo Zhang, Yatong Han, Yiming Zhao, Yingke Li, Fumin Zhang, Yorai Wardi, Mengxue Hou

机构 * Georgia Institute of Technology(佐治亚理工学院) The Hong Kong University of Science and Technology(香港科技大学) Ising AI(伊辛人工智能公司) MIT(麻省理工学院) Notre Dame University(圣母大学)

专题命中 规划推理 :planning(title,abstract)

AI总结 研究未知多房间家庭环境下多目标搜索问题,提出Inter-POMDP算法,通过高级POUCT规划器与低级运动规划器相互作用,平衡规划质量与效率,相比基线方法减少碰撞、导航步数及检测次数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10120 2026-07-14 cs.CV 新提交 78%

WeaveEarth: Structured Evidence Construction and Reasoning for Training-Free UHR Remote Sensing Understanding

WeaveEarth:用于免训练超高分辨率遥感理解的结构化证据构建与推理

Xianzhi Ma, Shujun Wang, Xiaohan Li, Hao Liu, Changhua Pei, Jianhui li

机构 * School of Frontier Sciences, Nanjing University(南京大学前沿科学学院) Computer Network Information Center, Chinese Academy of Sciences(中国科学院计算机网络信息中心)

专题命中 规划推理 :reasoning(title,abstract)

AI总结 针对UHR遥感图像理解,提出免训练框架WeaveEarth,通过全局感知证据构建选最小支持证据集,经结构化证据推理增强VLM全局-局部联合推理能力,在多基准测试中表现优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09962 2026-07-14 cs.RO 新提交 78%

Task Planning for Mobile Manipulation in Retail Stores using Foundation Models with Iterative Re-planning

使用具有迭代重新规划的基础模型进行零售商店中的移动操作任务规划

Vismay Vakharia, Sanjana Garai, Rolif Lima, Nijil George, Vighnesh Vatsal, Kaushik Das

机构 * TCS Research, Tata Consultancy Services Ltd.(塔塔咨询服务公司TCS研究院)

专题命中 规划推理 :planning(title,abstract)

AI总结 研究零售场景补货问题,利用大语言模型和视觉语言模型,结合定制移动操作平台、用户驱动提示及反馈迭代重新规划方法纠错,在模拟环境验证端到端系统,为零售自动化提供了新的任务规划方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17527 2026-07-14 cs.RO 版本更新 78%

Safer Trajectory Planning with CBF-guided Diffusion Model for Unmanned Aerial Vehicles

基于CBF引导扩散模型的无人机安全轨迹规划

Peiwen Yang, Shiyu Bai, Weisong Wen, Yixin Gao, Jiahao Hu

专题命中 规划推理 :planning(title,abstract)

AI总结 本文提出AeroTrajGen框架,通过CBF引导采样提升扩散模型在无人机轨迹生成中的安全性与敏捷性,减少碰撞率94.7%。

Comments Some equations need to be checked

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.17071 2026-07-14 eess.SY cs.RO cs.SY 78%

Path Planning for a Cooperative Navigation Aid Vehicle to Assist Multiple Agents Sequentially

为协助多个智能体依次导航的协作导航辅助车路径规划

Artur Wolek

机构 * Department of Mechanical Engineering(机械工程系) Engineering Science, University of North Carolina at Charlotte(工程科学,北卡罗来纳大学夏洛特分校)

专题命中 规划推理 :planning(title,abstract)

AI总结 本文提出了一种贪心算法,用于规划协作导航辅助车路径,以依次协助多个智能体并减少导航不确定性。

Comments 6 pages

Journal ref IFAC-PapersOnLine 58 (20), 133-138, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11678 2026-07-14 cs.CL 版本更新 77%

Can AI Reason Like an Urban Planner? Benchmarking Large Language Models Against Professional Judgment

AI能像城市规划师一样推理吗?基于专业判断的大语言模型基准测试

Yijie Deng, He Zhu, Wen Wang, Junyou Su, Minxin Chen, Wenjia Zhang

机构 * School of Architecture and Urban Planning, Shenzhen University(深圳大学建筑与城市规划学院) Shenzhen Key Laboratory of Urban Spatial Information and Intelligent Modeling(深圳市城市空间信息与智能建模重点实验室) Department of Urban Planning and Design, The University of Hong Kong(香港大学城市规划与设计系)

专题命中 规划推理 :planning(abstract,abstract_cn);reasoning(abstract);分类 cs.CL

AI总结 提出UPBench框架,通过4×5知识支柱与认知水平矩阵评估25个LLM,发现模型在分析任务上优于事实回忆和综合判断,揭示了规划知识的制度依赖性。

Comments This paper has been withdrawn by the authors because the current version requires substantial revision and further validation before it can be considered a reliable representation of the work

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10795 2026-07-14 cs.AI cs.CL 新提交 73%

STEC: Evidence Compression for Deep Search in Open-domain Multi-Hop QA

STEC:开放域多跳问答中深度搜索的证据压缩

Xinkang Li, Rong Jiang, Xin Song, Ye Wang, Yue Han, Changjian Li

机构 * National University of Defense Technology(国防科技大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))

专题命中 规划推理 :reasoning(abstract);verifier(abstract);分类 cs.CL、cs.AI

AI总结 研究开放域多跳问答中最终答案选择难题,提出STEC证据压缩框架从候选集选答案。通过答案级证据压缩和证据引导的答案验证机制,将选择从原始轨迹比较转为候选级证据比较,实验显示其性能最佳。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11324 2026-07-14 cs.RO cs.AI cs.LG 版本更新 73%

Embodied-R1.5: Evolving Physical Intelligence via Embodied Foundation Models

Embodied-R1.5:通过具身基础模型演化物理智能

Yifu Yuan, Yaoting Huang, Xianze Yao, Yutong Li, Shuoheng Zhang, Linqi Han, Pengyi Li, Jiangeng Sun, Wenting Jia, Zhao Zhang, Yuhao Liu, Ruihao Liao, Yucheng Hu, Qiyu Wu, Yuxiao Li, Zibin Dong, Fei Ni, Yan Zheng, Shuyang Gu, Yi Ma, Hongyao Tang, Han Hu, Jianye Hao

机构 * Tianjin University(天津大学) Tencent Hunyuan(腾讯混元)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI、cs.LG

AI总结 提出统一具身基础模型Embodied-R1.5,通过自动化数据管道和多任务平衡强化学习,在8B参数下实现24项基准中16项最优,并支持微调为VLA模型。

Comments Embodied R1.5 technical report. Project page: https://embodied-r.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11503 2026-07-14 q-bio.NC cs.AI cs.GT 版本更新 70%

People use fast and flat simulation to reason about new games

人们使用快速且扁平的模拟来对新游戏进行推理

Katherine M. Collins, Cedegao E. Zhang, Lionel Wong, Mauricio Barba da Costa, Graham Todd, Adrian Weller, Samuel J. Cheyette, Thomas L. Griffiths, Joshua B. Tenenbaum

机构 * Massachusetts Institute of Technology(麻省理工学院) Princeton University(普林斯顿大学) University of Cambridge(剑桥大学) Stanford University(斯坦福大学) New York University(纽约大学) The Alan Turing Institute(艾伦·图灵研究所)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 研究人们对新游戏的推理,通过超千名参与者和121种新棋盘游戏的研究,发现人们玩新游戏或评估时具系统性和适应性理性,用“直观玩家”模型解释,为新问题应对及类人AI系统设计提供见解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10987 2026-07-14 cs.DC 新提交 67%

[AAFLOW+] Stateful Operator Abstraction with Zero-Copy Distributed KV Cache Orchestration for Multi-Agent Workflows

[AAFLOW+] 用于多智能体工作流的具有零拷贝分布式键值缓存编排的有状态算子抽象

Arup Kumar Sarker, Alexander James Halpern, Mills Staylor, Aymen Alsaadi, Gregor von Laszewski, Yue Cheng, Shantenu Jha, Geoffrey Fox

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 研究多智能体语言模型系统文本中心问题,提出AAFLOW+扩展,构建通信感知图并提供多种算子,实现零拷贝执行,通过分析成本模型验证,大幅降低TTFT、计算成本、键值内存并提高吞吐量,提升多智能体系统效率

Comments 21 pages, 10 Figures, 12 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09756 2026-07-14 cs.RO 新提交 67%

LLM-Centric Agentic AI for UAV Swarms: Architecture, Enabling Technologies, and Open Problems

用于无人机群的以大语言模型为中心的智能体人工智能:架构、使能技术及开放问题

Yousef Emami, Rahim Taheri, Mohammadhossein Homaei, Muhammad Atif Ur Rehman, Mohammad Shojafar

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 研究针对无人机群实际部署受限问题,提出以大语言模型为中心的智能体人工智能LAUS,回顾相关使能技术,分析威胁,确定包括抗幻觉推理等在内的开放研究挑战。

Comments 8 pages, 4 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25917 2026-07-14 cs.AI cs.CL cs.LG 版本更新 67%

Recursive Multi-Agent Systems

递归多智能体系统

Jiaru Zou, Rui Pan, Ruizhong Qiu, Pan Lu, Shizhe Diao, Jindong Jiang, Hanghang Tong, Tong Zhang, Markus J. Buehler, Jingrui He, James Zou

机构 * UIUC(伊利诺伊大学香槟分校) Stanford University(斯坦福大学) NVIDIA(英伟达) MIT(麻省理工学院)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出递归多智能体框架RecursiveMAS,通过递归计算提升多智能体协作效率,实验证明其在多个基准测试中准确率提升8.3%,推理速度提升1.2-2.4倍,token使用减少34.6%-75.6%。

Comments Project Website: https://recursivemas.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14551 2026-07-14 cs.RO 版本更新 67%

Replanning Human-Robot Collaborative Tasks with Vision-Language Models via Semantic and Physical Dual-Correction

通过语义和物理双校正利用视觉语言模型重新规划人机协作任务

Taichi Kato, Takuya Kiyokawa, Namiko Saito, Kensuke Harada

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 本文提出一种通过语义和物理双校正机制提升人机协作任务中机器人重新规划能力的框架,结合视觉语言模型与物理反馈纠正,提高任务执行的成功率和可行性。

Comments 20 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10720 2026-07-14 cs.AI cs.LG cs.MA 新提交 62%

WattCouncil: Context-Aware Household Energy Scenario Generation With Governed LLMs

瓦特委员会:基于受治理大语言模型的情境感知家庭能源情景生成

Mohannad Takrouri, Nicolas M. Cuadrado A., Martin Takáč

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 针对智能电网因数据受限发展受阻的问题,提出瓦特委员会框架,利用基于大语言模型的代理,在文化、时间和物理等约束下生成家庭能源情景,经实验评估及消融研究验证了其有效性和一致性。

Comments 11 pages, 5 figures

Journal ref The 13th ACM International Conference on Systems for Energy-Efficient Buildings, Cities, and Transportation (BuildSys 26), June 22-25, 2026, Banff, AB, Canada. ACM, New York, NY, USA, 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10588 2026-07-14 cs.AI cs.CL 新提交 62%

Constraint-Aware Hierarchical Search for Regulation-Driven Fine-Grained Classification

用于规则驱动的细粒度分类的约束感知层次搜索

Siyu Wang, Wei Tan, Lulu Chen

机构 * Gusu Laboratory of Materials(姑苏材料实验室) Chongqing Institute of Engineering(重庆工程学院) Suzhou Digital China Wuxin Intelligent Technology Co., Ltd.(苏州神州数码五新智能科技有限公司)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 针对规则驱动的细粒度分类任务,现有方法存在不足。本文构建基准数据集,提出约束感知层次搜索框架,将监管文件转换为可搜索树,只检索有效局部候选节点,实验证明该方法准确率高且能提供可解释决策路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10555 2026-07-14 cs.IR cs.AI cs.CL 新提交 62%

Tool-Adaptive LLM Reranker

工具自适应语言模型重排器

Zichuan Liu, Ruijin Hua

专题命中 规划推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 研究针对生成式大语言模型在复杂查询时的事实幻觉及重排延迟问题,提出TALRanker框架,将相关性评分形式化为马尔可夫决策过程,经两阶段训练优化,在检索基准上性能领先,兼顾吞吐量与准确性。

Comments 12 pages, 7 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11433 2026-07-14 cs.AI 新提交 57%

Omni-Decision: A Progressive Evidence-State Agent System for Omni-Modal QA

全决策:一种用于全模态问答的渐进式证据状态智能体系统

Ming Ma, Yi Zhu, Yiran Zhong, Feida Zhu, Weigao Sun, Junhan Shi, Lingrui Mei, Tianming Yang, Steven Hoi

机构 * Institute of Neuroscience, Chinese Academy of Sciences(中国科学院神经科学研究所) University of Chinese Academy of Sciences(中国科学院大学) Tongyi Lab, Alibaba Group(阿里巴巴集团通义实验室) Tsinghua University(清华大学) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 研究全模态问答中证据分散问题,提出全决策系统,将问答转化为证据闭合过程,维护结构化证据状态,通过确定性状态更新处理异构观察,提升了准确率,验证了证据状态控制在多步证据寻求中的作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11084 2026-07-14 cs.AI 新提交 57%

NVAITC AI Scientist: A Governed End-to-End Research System -- A Hypertension GWAS Case Study

NVAITC人工智能科学家:一个受治理的端到端研究系统——以高血压全基因组关联研究为例

Eddie Huang, Ken Liao, Iven Fu, Yang-Hsien Lin, Chao-Shun Zhan, Andy Liao, Virginia Chen, Johnson Sun, Pika Wang, Richard Huang, Jiun-Cheng Jiang, Ting-Yuan Liu, Hsing-Fang Lu, Ray Y. Lee, Chi-Chou Liao, Simon See, Fuu-Jen Tsai

机构 * Department of Medical Research, China Medical University Hospital(中国医药大学附设医院医学研究部) Master Program for Digital Health Innovation, China Medical University(中国医药大学数字健康创新硕士项目) Laboratory for Statistical and Translational Genetics, RIKEN Center for Integrative Medical Sciences(理化学研究所综合医学科学中心统计与转化遗传学实验室) AI-Driven Genomic Medicine and Drug Discovery Lab, China Medical University Hospital(中国医药大学附设医院人工智能驱动的基因组医学与药物发现实验室)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 研究以高血压GWAS为例,介绍受治理的端到端智能研究系统NAIS,其集成多种功能。通过真实数据验证,NAIS能支持生物医学发现,规划队列提取等,重现高血压基因座,在药物性肝损伤预测中也有成果,可产生与专家主导流程相当的输出。

Comments 22 pages, 6 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏