arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 2211 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 461 篇

2602.11522 2026-08-10 cs.HC 版本更新 50%

Asymmetric Trust Effects of Corrective AI in Expert Advisory Workflows under Epistemic Dependence

人工智能参与对专家咨询工作流中信任的影响

Dennis Kim, Roya Daneshi, Bruce Draper, Sarath Sreedharan

专题命中 规划推理 :planning(abstract)

AI总结 研究探讨人工智能在专家咨询工作流中对用户信任的影响,发现人类专家使用AI的方式会影响用户对专业知识的信任。

Comments Revised version. Accepted to AIES 2026. Includes technical appendices and additional analyses

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08892 2026-08-07 cs.GT cs.MA 版本更新 50%

Offline Nash Solvers Meet Online Tree Search in Multi-Agent Games on Graphs

离线纳什求解器与在线树搜索在图上多智能体博弈中的结合

Mukesh Kumar, Yue Guan, Panagiotis Tsiotras

专题命中 规划推理 :planning(abstract)

AI总结 多智能体追逃博弈计算纳什均衡策略有挑战,本文提出原始引导树搜索框架PGTS,结合离线精确纳什均衡计算与在线树搜索,实验表明其显著优于现有基线,在多种图拓扑上对对手保持稳健性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09207 2026-08-06 cs.DC 版本更新 50%

Bidirectional Resource Scheduling for Disaggregated and Asynchronous RL Post-Training

用于解耦和异步强化学习后训练的双向资源调度

Zhiqiang Tan, Maoxin Wang, Sijie Wang, Yiming Yin, Qiang Wang, Xiaowen Chu, Shaohuai Shi

专题命中 规划推理 :reasoning(abstract)

AI总结 本文针对不同RL设置和工作负载下资源常空闲的问题,提出BiDiRL架构,通过开发热切换运行时、基于时间性能建模的规划器及双向调度器,减少资源空闲,在32-GPU测试平台上显著提高RL训练吞吐量。

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13981 2026-08-05 cs.CR 版本更新 50%

VirtualCrime: Evaluating the Criminal Potential and Agentic Behaviors of Large Language Models via Sandbox Simulation

VirtualCrime: 通过沙盒模拟评估大语言模型的犯罪潜力

Yilin Tang, Yu Wang, Lanlan Qiu, Wenchang Gao, Yunfei Ma, Baicheng Chen, Tianxing He

专题命中 规划推理 :planning(abstract)

AI总结 本文提出VirtualCrime框架,通过三代理系统评估大语言模型的犯罪能力,设计40种多样化的犯罪任务,并评估8种强大的LLM,发现模型在犯罪过程中生成详细计划并执行智能犯罪过程,但有时会采取严重行动伤害NPC。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29009 2026-08-04 cs.RO 版本更新 50%

D-VLC: Decentralized Vision-Language Collaboration for Heterogeneous Embodied Multi-Robot Systems in Unknown Environments

D-VLC:面向未知环境中异构具身多机器人系统的去中心化视觉-语言协作框架

Yuan Zhou, Ruitong Lin, Shen Wang, Weiqi Gai, Mo Zhu, Xin Zhou, Yuze Wu, Fei Gao

专题命中 规划推理 :reasoning(abstract)

AI总结 本文提出D-VLC框架,结合去中心化异步推理等技术,让通用VLM生成机器人特定动作,多场景实验显示其任务成功率超70%,完成时间较几何贪心基线最多缩短55.8%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01788 2026-08-04 cs.SE 版本更新 50%

KRCA: An Efficient Root Cause Analysis System in Hyper-scale Microservice Systems via Agentic AI

KRCA:一种基于智能体AI的超大规模微服务系统高效根因分析系统

Jiamin Jiang, Jingfei Feng, Yu Luo, Qingliang Zhang, Yongqian Sun, Wenwei Gu, Shenglin Zhang, Tianyu Cui, Yao Wu, Jielong Huang, Nan Qi, Dan Pei

专题命中 规划推理 :reasoning(abstract)

AI总结 提出KRCA系统,通过多阶段流水线(API级钻取、骨架因果图、记忆增强多智能体框架)实现超大规模微服务的高效根因定位与故障分类,AC@1达0.88和0.79,诊断时间减少77.3%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26613 2026-08-04 cs.DB 版本更新 50%

EcoTable: Cost-effective Table Integration in Data Lakes for Natural Language Queries

EcoTable: 数据湖中面向自然语言查询的经济高效的表集成

Yuhui Wang, Jinqi Liu, Chengliang Chai, Hangyu Zhao, Yuhao Deng, Yuyu Luo, Xin Tang, Ye Yuan, Guoren Wang, Fengjin Wang, Lei Cao

专题命中 规划推理 :reasoning(abstract)

AI总结 针对数据湖中表格格式多样导致ETL困难的问题,提出EcoTable框架,利用LLM的语义理解和复杂推理能力,通过图结构搜索和轻量级模型降低LLM调用成本,在4个基准数据集上准确率提升30%以上,成本降低5倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19846 2026-07-31 econ.GN q-fin.EC 版本更新 50%

What Capital After Labor? Forecasting the Talent ROI Transition in the Human-AI Era

劳动力之后是什么资本?预测人机时代的人才ROI转型

Kwan Soo Shin

专题命中 规划推理 :planning(abstract)

AI总结 针对AI增强打破劳动时间与贡献的会计关联,本文构建从时间到产出的人才ROI预测框架,核心定理为ROI反转,并利用韩国52小时工作制案例验证了前期压力信号,预测产出型企业在2032年TFP增长领先1.5-2.0个百分点。

Comments 86 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21714 2026-07-31 cs.SD cs.MM 版本更新 50%

MusicWeaver: Programmable Long-Form Music Generation with Provably Local Editing

MusicWeaver: 作曲家风格的结构编辑与分钟级连贯音乐生成

Xuanchen Wang, Heng Wang, Weidong Cai

机构 * The University of Sydney(悉尼大学)

专题命中 规划推理 :planning(abstract)

AI总结 MusicWeaver通过结构化计划和全局-局部扩散变换器实现作曲家风格的音乐生成与编辑,具备分钟级连贯性和高保真度。

Comments 15 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24536 2026-07-30 cs.HC 版本更新 50%

RemiAssist: A Therapist-Supporting System for Photo-Based Reminiscence Therapy in Dementia Care

RemiAssist:一种用于痴呆症护理中基于照片的回忆疗法的治疗师支持系统

Shuchang Xu, Minglong Tang, Junyan Mao, Xiaofu Jin, Wazeer Zulfikar, Yasith Samaradivakara, Jiayi Zhou, Huamin Qu, Yuling Sun, Pattie Maes

专题命中 规划推理 :planning(abstract)

AI总结 针对痴呆症护理中基于照片的回忆疗法忽视治疗师作用的问题,RemiAssist系统利用记忆图和情境感知引导策略,辅助治疗师进行规划与引导,提高了规划效率和对话时长,为个性化回忆疗法提供支持。

Comments Accepted to UIST 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16586 2026-07-30 cs.CV 版本更新 50%

LOCUS: Local Visual Cue Search for Enhancing Fine-Grained Perception in Multimodal Large Language Models

LOCUS: 局部视觉线索搜索增强多模态大语言模型的细粒度感知

Zhou Tao, Fang Zhang, Zewen Ding, Shida Wang, Xiaokun Sun, YongXiang Hua, Haoyu Cao, Linli Xu

机构 * University of Science and Technology of China(中国科学技术大学) State Key Laboratory of Cognitive Intelligence(认知智能国家重点实验室)

专题命中 规划推理 :reasoning(abstract)

AI总结 提出LOCUS训练框架,通过可验证的局部线索搜索代理任务,使MLLM内化细粒度证据选择,提升定位敏感视觉理解而不改变推理接口。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14029 2026-07-30 cs.CV 版本更新 50%

POINTS-Seeker: An Open Recipe for Multimodal Search Agents with Visual Memory Management

POINTS-Seeker:从零开始训练多模态代理搜索模型

Yikun Liu, Yuan Liu, Haicheng Wang, Zhongyin Zhao, Le Tian, Xiao Zhou, Jiangchao Yao, Yanfeng Wang, Weidi Xie

机构 * School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院) CMIC, Shanghai Jiao Tong University(上海交通大学CMIC) WeChat AI, Tencent(腾讯WeChat AI)

专题命中 规划推理 :planning(abstract)

AI总结 本文提出POINTS-Seeker模型,通过引入代理播种机制和V-Fold压缩方案,解决长周期交互中的证据检索问题,并在六个基准测试中超越现有模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09971 2026-07-30 cs.RO 版本更新 50%

TiPToP: A Modular Open-Vocabulary Robot Manipulation System That Plans

TiPToP:一种用于机器人操作的模块化开放式词汇规划系统

William Shen, Nishanth Kumar, Sahit Chintalapudi, Ryan Lindeborg, Jie Wang, Christopher Watson, Edward Hu, Jing Cao, Dinesh Jayaraman, Leslie Pack Kaelbling, Tomás Lozano-Pérez

专题命中 规划推理 :planning(abstract)

AI总结 TiPToP是一种模块化开放式词汇规划系统,结合预训练视觉模型与任务规划器,通过自然语言指令和RGB图像直接解决多步骤操作任务,实现实时高效的操作规划。

Comments Project website: https://tiptop-robot.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27176 2026-07-29 cs.CV 版本更新 50%

MEDIC-AD: Towards Medical Vision-Language Model's Clinical Intelligence

MEDIC-AD:迈向医疗视觉-语言模型的临床智能

Woohyeon Park, Jaeik Kim, Sunghwan Steve Cho, Pa Hong, Wookyoung Jeong, Yoojin Nam, Namjoon Kim, Ginny Y. Wong, Ka Chun Cheung, Jaeyoung Do

机构 * AIDAS Laboratory, Seoul National University(首尔大学AIDAS实验室) Samsung Changwon Hospital(三星昌原医院) Samsung Medical Center(三星医疗中心) NVIDIA, Santa Clara, USA(英伟达(美国圣克拉拉))

专题命中 规划推理 :reasoning(abstract)

AI总结 MEDIC-AD通过分阶段框架提升医疗视觉-语言模型在病变检测、症状跟踪和视觉可解释性方面的性能,实现临床应用中的最优表现。

Journal ref CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02295 2026-07-29 cs.RO 版本更新 50%

CycleVLA: Proactive Self-Correcting Vision-Language-Action Models via Subtask Backtracking and Minimum Bayes Risk Decoding

CycleVLA: 通过子任务回溯和最小贝叶斯风险解码实现的前瞻性自修正视觉-语言-动作模型

Chenyang Ma, Kai Lu, Guangyu Yang, Jiuming Liu, Shitong Xu, Bill Byrne, Ioannis Havoutis, Niki Trigoni, Andrew Markham

机构 * Department of Computer Science, University of Oxford(牛津大学计算机科学系) Department of Engineering, University of Cambridge(剑桥大学工程系)

专题命中 规划推理 :self-correction(abstract)

AI总结 CycleVLA通过子任务回溯和最小贝叶斯风险解码实现前瞻性自修正,提升视觉-语言-动作模型的故障预测与恢复能力

Comments Project Page: https://dannymcy.github.io/cyclevla/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19182 2026-07-28 cs.DC 版本更新 50%

ARBITER: Guarded Agentic Control for SLO-Oriented Kubernetes Remediation

ARBITER:面向服务水平目标的Kubernetes修复的受保护代理控制

Pooyan Habibi, Alberto Leon-Garcia

专题命中 规划推理 :planning(abstract)

AI总结 研究在Kubernetes微服务上维护SLO的难题,提出ARBITER受保护控制平面,构建因果资源图等,分离规划与执行,支持多种规划方式。通过实验评估其在选择修复操作和下游目标等方面的效果,展示了优于HPA/仅资源控制的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09113 2026-07-28 eess.SP 版本更新 50%

Redefining Digital Twins as Predictive Decision Engines for AI-Native Wireless Networks

迈向智能无线网络:生成式AI与数字孪生的协同

Afan Ali, Ali Arshad Nasir, Naveed Iqbal, Daniel Benevides da Costa

专题命中 规划推理 :reasoning(abstract)

AI总结 提出一种生成式AI赋能的数字孪生框架,通过实时同步信道、移动性、流量和能量信息,实现系统级主动优化,在无人机辅助非地面网络场景中节能约69.2%。

Comments 7 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08274 2026-07-28 cs.MA 版本更新 50%

Toward Human-Centered Multi-Agent Systems: Integrating Cognition, Culture, Values, and Cooperation in AI Agents

迈向以人为中心的多智能体系统:在AI智能体中整合认知、文化、价值观与合作

Safia Baloch, Rahemeen Khan

专题命中 规划推理 :planning(abstract)

AI总结 本文综述了从认知科学、文化对齐、价值学习到多智能体协调的研究,指出现有系统缺乏整合认知、文化、价值观和社会行为的统一框架,并提出了构建文化感知、价值对齐、认知基础与合作的多智能体系统的方向。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09995 2026-07-28 cs.CE 版本更新 50%

QuantHarness: Price-Driven Multi-Agent LLMs for High-Frequency Trading

QuantHarness:用于高频交易的价格驱动多智能体大语言模型

Fei Xiong, Xiang Zhang, Aosong Feng, Siqi Sun, Chenyu You

专题命中 规划推理 :reasoning(abstract)

AI总结 研究针对高频交易需求,引入QuantHarness多智能体LLM框架,将交易分解为四个智能体,利用结构化信号与LLM推理结合,经多金融工具实验验证,该框架在多指标上优于基线方法,为高频金融市场实时决策提供可行路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19321 2026-07-24 cs.NE 版本更新 50%

Learning to Sample in Variable Neighborhood Search Algorithm for Urban Cable Routing Optimization

城市电缆路由优化的可变邻域搜索算法中的采样学习

Wei Liu, Rui Wang, Chenhui Lin, Kaiwen Li, Wenhua Li, Tao Zhang

专题命中 规划推理 :planning(abstract)

AI总结 针对城市电缆路由优化这一大规模双层组合优化问题,提出学习辅助可变邻域搜索(L-VNS)算法,该算法集成四个关键组件,经实验验证其相比其他方法有优越性,能有效降低建设成本,且具有有效性和鲁棒性。

Comments Accepted by Swarm and Evolutionary Computation

Journal ref Swarm and Evolutionary Computation; Volume 106, June 2026, 102432

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06925 2026-07-22 cs.RO cs.GT 版本更新 50%

Strategizing at Speed: A Learned Model Predictive Game for Multi-Agent Drone Racing

高速策略化:多无人机竞速的学习型模型预测博弈

Andrei-Carlo Papuc, Lasse Peters, Sihao Sun, Laura Ferranti, Javier Alonso-Mora

机构 * Department of Cognitive Robotics, Delft University of Technology(认知机器人学系,代尔夫特理工大学)

专题命中 规划推理 :planning(abstract)

AI总结 针对多无人机竞速中策略深度与计算延迟的权衡问题,提出一种学习型模型预测博弈(LMPG)方法,通过摊销模型预测博弈计算来降低延迟,在仿真和硬件实验中优于模型预测博弈和模型预测控制。

Journal ref IEEE Robotics and Automation Letters, vol. 11, no. 8, pp. 9056-9063, Aug. 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17049 2026-07-22 cs.SE cs.RO 版本更新 50%

Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots

评估具有视觉语言动作能力的机器人的不确定性和质量

Pablo Valle, Chengjie Lu, Shaukat Ali, Aitor Arrieta

机构 * Mondragon University(蒙dragon大学) Simula Research Laboratory(Simula研究实验室)

专题命中 规划推理 :planning(abstract)

AI总结 研究针对具有视觉语言动作能力的机器人,采用八个不确定性指标和五个质量指标,通过大规模实证研究评估其有效性,发现部分指标与人类评估有相关性且能区分任务执行质量,挑战了仅依赖成功率的评估做法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13458 2026-07-21 cs.NI 版本更新 50%

From Traditional Automation to Embodied Wireless Intelligence: Vision-Language-Action Empowered Physics-Aware Communication Networks

从传统自动化到具身无线智能:视觉-语言-动作赋能的物理感知通信网络

Genze Jiang, Kezhi Wang, Xiaomin Chen, Yizhou Huang

专题命中 规划推理 :reasoning(abstract)

AI总结 提出具身智能基站(eBS)范式,采用视觉-语言-动作(VLA)流水线,使基站具备环境感知、因果物理推理和物理感知动作生成能力,实现从规则自动化到具身智能的转变。

Comments submitted for possible jounal publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07939 2026-07-21 cs.CY 版本更新 50%

The atomic structure of work: a micro-action instrument reveals two-pole AI occupational exposure and its decade-scale polar inversion

稳定几何,反转两极:AI职业替代性的双极结构及其十年尺度反转

Shuyao Gao, Minghao Huang

专题命中 规划推理 :planning(abstract)

AI总结 通过多智能体LLM流水线将O*NET活动分解为微动作,发现职业替代性呈双极结构(物理操作与规划设计为两极),且过去十年间两极高低顺序已反转。

Comments v2: major revision, retitled (v1: "Stable Geometry, Reversing Poles"). Adds an independent blind three-annotator validation study (construct kappa = 0.90; encoder-vs-human kappa = 0.63), a vintage-matched O*NET 18.1 reprojection, a demographic overlay, and recalibrated claims throughout. 27 pages; Supplementary Information (29 pages) in ancillary files. Dataset: doi:10.5281/zenodo.21395792

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09581 2026-07-20 cs.CV cs.SD 版本更新 50%

Wan-Dancer: A Hierarchical Framework for Minute-scale Coherent Music-to-Dance Generation

万舞者:一种用于分钟级连贯音乐到舞蹈生成的分层框架

Mingyang Huang, Peng Zhang, Li Hu, Guangyuan Wang, Ruoshi Zhang, Yi Lu, Gang Cheng, Bang Zhang

机构 * Tongyi Lab, Alibaba Group(通义实验室,阿里巴巴集团)

专题命中 规划推理 :planning(abstract)

AI总结 针对从音乐生成舞蹈视频的挑战,提出万舞者分层框架,解耦过程为全局关键帧规划和局部时间细化,利用音乐上下文确保连贯,通过动态帧率自适应等创新,突破时长限制,在多舞蹈类型上表现出色,达新的技术水平。

Comments project: https://humanaigc.github.io/wan-dancer-project/, code: https://github.com/Wan-Video/Wan-Dancer, modelscope: https://www.modelscope.cn/models/Wan-AI/Wan-Dancer-14B, huggingface: https://huggingface.co/Wan-AI/Wan2.2-Animate-14B

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13636 2026-07-20 cs.CV cs.RO 版本更新 50%

MindDrive: A Vision-Language-Action Model for Autonomous Driving via Online Reinforcement Learning

MindDrive: 一种通过在线强化学习实现自动驾驶的视觉-语言-动作模型

Haoyu Fu, Diankun Zhang, Zongchuang Zhao, Jianfeng Cui, Hongwei Xie, Bing Wang, Guang Chen, Hangjun Ye, Dingkang Liang, Xiang Bai

机构 * Huazhong University of Science and Technology(华中科技大学) Xiaomi EV(小米电动车)

专题命中 规划推理 :reasoning(abstract)

AI总结 MindDrive通过在线强化学习实现自动驾驶中的视觉-语言-动作模型,结合决策专家和动作专家,提升复杂场景下的驾驶决策与探索效率。

Comments Accepted by ECCV 2026; Project Page: https://xiaomi-mlab.github.io/MindDrive/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00333 2026-07-15 cs.CR 版本更新 50%

(A)I Sees What You Don't: Exploiting New Attack Surfaces in Third-Party Mobile Agents

(AI)看见你看不见的:利用第三方移动代理中的新攻击面

Zidong Zhang, Zhentao Xie, Wenrui Diao, Jianliang Wu

专题命中 规划推理 :reasoning(abstract)

AI总结 本文识别了第三方移动代理在屏幕感知和通道滥用方面的两种新攻击面,并设计了七种具体攻击,证明恶意应用可在无权限下劫持代理行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04280 2026-07-15 cs.MA cs.SY eess.SY 版本更新 50%

Resilient Decentralized Ergodic Coverage for Scalable Multi-Robot Systems in Unknown Time-Varying Environments

去中心化随机覆盖控制在未知时间变化环境中

Maria G. Mendoza, Victoria Marie Tuck, Chinmay Maheshwari, Shankar Sastry

专题命中 规划推理 :planning(abstract)

AI总结 本文提出一种去中心化多智能体覆盖框架,用于在未知且时间变化的环境中实现自适应覆盖。通过马尔可夫链转移模型和高斯过程,智能体根据动态重要性地图调整轨迹,提高环境适应性和探索效率。

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16726 2026-07-15 cs.MA 版本更新 50%

Bridging Individual and Collective Realism in LLM-Based Human Mobility Simulation via Mobility Scaling-Law Guidance

通过共享数据中的移动度量引导基于LLM的人群移动模拟

Hua Yan, Heng Tan, Yu Yang

专题命中 规划推理 :planning(abstract)

AI总结 M2LSimu通过共享数据中的移动度量引导多提示调整,有效提升基于LLM的人群移动模拟的群体协调与真实性

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09361 2026-07-14 cs.DB 版本更新 50%

Bespoke-Card: Why Tune When You Can Generate? Synthesizing Workload-Specific Cardinality Estimators

Bespoke-Card:为何调优而非生成?合成工作负载特定的基数估计器

Johannes Wehrstein, Anton Winter, Timo Eckmann, Carsten Binnig

专题命中 规划推理 :planning(abstract)

AI总结 提出Bespoke-Card系统,通过智能体驱动合成工作负载特定的基数估计器,利用结构化q-error反馈和课程学习等策略,在JOB上降低33%总运行时间和41%中位数q-error。

Comments Accepted for AIDB@VLDB'26 (Boston)

详情

展开后加载摘要…

URL PDF HTML 收藏