arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-13 至 2026-08-13 共收录 181 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 51 篇

2608.12047 2026-08-13 eess.SY cs.SY 新提交 78%

Network Topology Reconfiguration: Optimal Transition Planning

网络拓扑重构:最优过渡规划

Basel Morsy, Jochen Stiasny, Adolfo Anta, Jochen Cremer

专题命中 规划决策 :planning(title,abstract)

AI总结 该研究针对网络拓扑重构的过渡难题,提出最优过渡规划问题,采用后退时域框架求解,在1354节点系统上实现最高18.4%的运行成本降低。

Comments This work has been submitted to the IEEE for possible publication. Copyright may be transferred without notice, after which this version may no longer be accessible

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11174 2026-08-13 cs.RO 版本更新 78%

VIScore: Diagnosing Planning-Relevant Quality in Latent World Models

VIScore:诊断潜在世界模型中与规划相关的质量

Haiyu Wu, Randall Balestriero, Morgan Levine

机构 * Altos Labs(阿尔托斯实验室) Brown University(布朗大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 该研究针对潜在世界模型规划成功率与潜在空间属性脱节的问题,提出VIScore指标,覆盖编码器、预测器、规划器,在跨任务场景下斯皮尔曼相关性超0.75,可更好解释规划成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24235 2026-08-13 cs.RO cs.SY eess.SY 版本更新 78%

Towards Tighter Convex Relaxation of Mixed-Integer Programs: Leveraging Logic Network Flow for Task and Motion Planning

混合整数规划的更紧凸松弛:利用逻辑网络流进行任务与运动规划

Xuan Lin, Jiming Ren, Yandong Luo, Weijun Xie, Ye Zhao

机构 * George W. Woodruff School of Mechanical Engineering, Georgia Institute of Technology, USA(乔治亚理工学院机械工程学院) Milton Stewart School of Industrial and Systems Engineering, Georgia Institute of Technology, USA(乔治亚理工学院工业与系统工程学院)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出逻辑网络流框架,将时序逻辑集成到混合整数规划中,通过改进的傅里叶-莫茨金消元实现更紧的凸松弛,在多类机器人任务中大幅提升计算速度并降低内存消耗,硬件验证了实时重规划能力。

Comments 38 pages, 17 figures, 10 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11775 2026-08-13 cs.AI cs.CL 新提交 77%

The Sleeping Agent: What Gist-Based Context Compression Loses and Why

休眠智能体:基于主旨的上下文压缩会丢失什么以及为什么

Nicholas E. Kyrkewood

专题命中 规划决策 :agent(title,comments);分类 cs.AI、cs.CL

AI总结 本研究以SWC为工具,发现主旨压缩对多跳推理等任务表现优于截断,但会损害时间相关问题的性能,通过修改提示可提升时间问题的评判准确率。

Comments 7 pages, 5 tables, appendices. Code and results at https://github.com/kyrkewood/sleeping-agent

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12062 2026-08-13 cs.CL cs.AI 新提交 73%

Preference Tree Optimization: Enhancing Goal-Oriented Dialogue with Look-Ahead Simulations

偏好树优化:通过前瞻模拟增强面向目标的对话

Lior Baruch, Moshe Butman, Kfir Bar, Doron Friedman

机构 * Reichman University(赖希曼大学) School of Computer Science(计算机科学学院) School of Communications(传播学院)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.AI、cs.CL

AI总结 本研究提出偏好树优化(PTO)框架,结合带前瞻的偏好树与直接偏好优化(DPO),在动机访谈领域通过虚拟患者等模拟对话生成偏好数据,训练的对话智能体在关键指标上优于基线。

Comments 13 pages, 4 figures. Accepted at an ICLR 2025 workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10444 2026-08-13 cs.CL cs.AI 版本更新 73%

From Reasoning Depth to Reasoning Breadth: Evaluating Multi-Point Associative Reasoning in Large Language Models

从推理深度到推理广度:评估大型语言模型中的多点关联推理

Si'an Xie, Jiaxun Liu, Biao Yang, Wei Yuan, Fan Yang, Tingting Gao, Ming Wu

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Peking University(北京大学) Kuaishou Technology(快手科技)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 该研究构建了中英双语多点关联推理基准MPAR-Bench,发现大型语言模型的推理深度未自动带来稳健的推理广度,当前基准未充分覆盖推理广度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11477 2026-08-13 cs.CE 新提交 71%

Stochastic Corridor Time Network Capacity Planning for Low Altitude Airspace Systems

低空空域系统的随机走廊时间网络容量规划

Yipu Yao, Li Ding, Yanlu Zhao

专题命中 规划决策 :planning(title)

AI总结 针对低空空域的无人机物流容量规划问题,构建两阶段随机规划并通过带列生成子问题的Benders分解求解,经实验验证其在中等及更大网络上的有效性,深圳案例显示预留集中于核心走廊。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11357 2026-08-13 cs.MA 新提交 67%

When Do Institutions Beat Intelligence?

何时制度优于智能?

Zhengye Han

专题命中 规划决策 :agent(abstract);multi-agent(abstract)

AI总结 该研究通过构建受控人工生态,实验揭示制度在修复集体构建可用公共状态的失败时优于智能,反之则不然,为智能与制度的选择提供了诊断依据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04923 2026-08-13 cs.LG cs.AI cs.CL 版本更新 67%

Reproducing, Analyzing, and Detecting Reward Hacking in Rubric-Based Reinforcement Learning

基于评分标准的强化学习中的奖励黑客行为的复现、分析与检测

Xuekang Wang, Zhuoyuan Hao, Shuo Hou, Hao Peng, Juanzi Li, Xiaozhi Wang

机构 * Tsinghua University(清华大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Xi’an Jiaotong University(西安交通大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出可控黑客环境CHERRL,通过注入已知偏见复现奖励黑客行为,分析其可发现性与可利用性,并探索基于智能体的自动检测方法。

Comments 23 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20321 2026-08-13 cs.CL cs.AI cs.LG 67%

BiomedSQL: Text-to-SQL for Scientific Reasoning on Biomedical Knowledge Bases

BiomedSQL: 文本到SQL用于生物医学知识库上的科学推理

Mathew J. Koretsky, Maya Willey, Owen Bianchi, Chelsea X. Alvarado, Tanay Nayak, Nicole Kuznetsov, Sungwon Kim, Mike A. Nalls, Daniel Khashabi, Faraz Faghri

机构 * Center for Alzheimer’s and Related Dementias, NIA, NIH(阿尔茨海默病及相关痴呆症研究中心,国家老龄化研究所,国立卫生研究院) DataTecnica LLC(DataTecnica公司) Johns Hopkins University(约翰霍普金斯大学) Laboratory of Neurogenetics, NIA, NIH(神经遗传学实验室,国家老龄化研究所,国立卫生研究院)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 BiomedSQL通过评估文本到SQL生成中的科学推理能力,针对生物医学知识库设计了首个基准测试,展示了不同模型在复杂查询任务中的性能差异。

Comments Published as a conference paper at COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12078 2026-08-13 cs.CV cs.AI cs.LG 新提交 62%

Better Slots, Better Worlds: Representation Quality & Robustness in Object-Centric World Models

更好的槽,更好的世界:以对象为中心的世界模型中的表示质量与鲁棒性

Shukrullo Nazirjonov, Sai Prasanna, Anna Manasyan, Georg Martius

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 该研究通过受控实验分析以对象为中心的世界模型,发现槽质量与规划成功率正相关,槽绑定良好时可减少辅助输入,且在分布偏移下其鲁棒性优于LeWM,预训练特征是鲁棒性关键因素。

Comments Published at Model-Based RL in the Era of Generative World Models Workshop at RLC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12001 2026-08-13 cs.LG cs.AI cs.CV 新提交 62%

Remote Sensing and Machine Learning-Based Analysis of Land Use and Vegetation Change in Dhaka District, Bangladesh

基于遥感与机器学习的孟加拉国达卡区土地利用及植被变化分析

Muhammad Masud Tarek, Md. Alamgir Hossain, Md. Samiul Islam, Muntasir Hasan Kanchan

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本研究结合遥感与机器学习,分析孟加拉国达卡区2019-2024年土地利用与植被变化,发现建成区大幅扩张、植被与水体缩减,随机森林分类精度最高,为城市可持续发展提供数据支撑。

Comments 16 Pages, 8 Figures, 9 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11674 2026-08-13 cs.LG cs.AI 新提交 62%

GCPO: Diagnosing and Constraining Subspace Geometry in Rollout RL for LLMs

GCPO:针对大语言模型的rollout强化学习中子空间几何的诊断与约束

Kai Yang, Jingwei Xu, Wanyu Wang, Kai-Yuan Guo, Zhenbo Yu, Yi Wang, Yu Qiao

机构 * Shanghai AI Lab(上海人工智能实验室)

专题命中 规划决策 :tool-use(abstract);分类 cs.AI、cs.LG

AI总结 GCPO通过几何约束策略优化方法,诊断rollout强化学习的子空间几何问题,在大语言模型后训练中提升了多任务性能并解决了训练不稳定等问题

Comments 15 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11511 2026-08-13 cs.LG cs.AI 新提交 62%

Let it Cook: Learning to Wait in Sequential Decision Making

顺其自然:序贯决策中的等待学习

Christopher Watson, Arjun Krishna, Dinesh Jayaraman, Rajeev Alur

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 该研究针对序贯决策中智能体频繁感知决策的问题,提出采用带字典序目标的强化学习训练等待策略,在7类任务上实现了可观的等待时长,且不牺牲任务性能。

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11361 2026-08-13 cs.LG cs.CL cs.PF 新提交 62%

Lifecycle-Optimal Tokenization: Vocabulary Size as a Deployment-Regime-Dependent Infrastructure Parameter

生命周期最优分词:词汇表大小作为与部署 regime 相关的基础设施参数

Rima Mittal, Ankit Gubrani, Satyanarayana Kakollu

专题命中 规划决策 :planning(abstract);分类 cs.CL、cs.LG

AI总结 该研究发现 LLM 分词器的最优词汇表大小随部署 regime 变化,提出生命周期部署成本模型,经实验证实其与训练最优值差异最高达 16 倍,且最优范围内质量损失极小,为 LLM 部署提供词汇表容量规划指导。

Comments 6 pages, 3 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11242 2026-08-13 cs.CL cs.AI 新提交 62%

Lost in Compaction: Evaluating Side-Constraint Loss under Context Compaction

在压缩中迷失:评估上下文压缩下的侧约束损失

Zhiqi Wang, Yichi Zhang, Dongwon Lee, Yuchen Yang

机构 * The Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.CL

AI总结 本文针对长上下文场景下压缩器丢失会话约束(SCs)的问题,提出COMPINT评估套件量化损失,并开发即插即用的SCs感知提取器,使SCs保留率超90%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12236 2026-08-13 cs.RO cs.AI cs.LG 版本更新 62%

TMRL: Diffusion Timestep-Modulated Pretraining Enables Exploration for Efficient Policy Finetuning

TMRL: 差分时间步调节预训练实现高效策略微调的探索

Matthew M. Hong, Jesse Zhang, Anusha Nagabandi, Abhishek Gupta

机构 * University of Washington(华盛顿大学) Amazon FAR(亚马逊FAR)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出TMRL框架,通过结合行为克隆预训练与强化学习微调,解决预训练中动作分布狭窄的问题,提升机器人策略微调的样本效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.17468 2026-08-13 cs.LG cs.AI 版本更新 62%

Deep Activity Model: A Generative Approach for Human Mobility Pattern Synthesis

深度活动模型:一种用于人类移动模式合成的生成式方法

Xishun Liao, Qinhua Jiang, Brian Yueshuai He, Yifan Liu, Chenchen Kuai, Jiaqi Ma

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 针对现有人类移动模型的局限,提出生成式Transformer模型,结合社会人口统计与家庭属性合成活动链,经数据训练微调后,在多区域模拟中表现良好,为城市规划提供实用工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11223 2026-08-13 stat.AP cs.LG cs.SY eess.SY stat.ML 新提交 57%

Transit Destination Inference from Tap-In-Only Bus Smart-Card Data: A Hierarchical Bayesian Approach

仅刷卡进站的公交智能卡数据的出行目的地推断:一种分层贝叶斯方法

Gefei Zhao, Jiahe Ling, Yuelong Su

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 针对仅刷卡进站公交智能卡数据无法构建OD矩阵的问题,本研究提出分层贝叶斯潜在目的地(HBLD)模型,结合多类数据推断出行目的地,经评估其表现优于基线,可生成不确定性感知的OD矩阵用于公交相关管理工作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12274 2026-08-13 cs.CV cs.AI 新提交 57%

A Neighborhood Attention Transformer Network for Enhanced 3D Segmentation of the Left Anterior Descending Artery

用于增强左前降动脉三维分割的邻域注意力Transformer网络

Rafi Ibn Sultan, Chengyin Li, Yiannos Demetriou, Ahmed I. Ghanem, Joshua P. Kim, Justine Cunningham, Hassan Bagher-Ebadian, Dongxiao Zhu, Kundan S. Thind

机构 * Wayne State University(韦恩州立大学) Henry Ford Health(亨利福特医疗集团) Alexandria University(亚历山大大学) Michigan State University(密歇根州立大学) Oakland University(奥克兰大学) Institute for AI and Data Science, Wayne State University(韦恩州立大学人工智能与数据科学学院)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 该研究提出NA-UNETR模型,结合邻域注意力等模块,经预训练和LoRA微调,在低对比度CT中提升左前降动脉分割精度,为放疗规划提供高效心脏亚结构分割框架。

Comments Acceteed by Medical Physics 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12273 2026-08-13 cs.CR cs.AI 新提交 57%

Convergent Detour Hijacking: Task-Preserving Resource Amplification in Skill-Based LLM Agents

收敛式绕路劫持:基于技能的大语言模型智能体中的任务保留型资源放大

Junliang Liu, Ruoyu Li, Wenxin Tang, Jingyu Xiao, Zhenyu Liu, Jingheng Xu, Laizhong Cui

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 该研究提出收敛式绕路劫持攻击,耦合LLM智能体技能选择与规划阶段,可放大任务资源消耗,在DeepSeek-V4-Pro上80.02%的任务会被选中攻击者控制的协调器,任务完成率不变但成本显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12063 2026-08-13 cs.RO cs.AI 新提交 57%

Learning Loco-Manipulation From SMPC Demonstrations With Sparse Offline-to-Online RL

基于稀疏离线到在线强化学习从SMPC演示中学习移动操作

Martin Schuck, Maks Sorokin, Simone Manni, Duy Ta, Angela P. Schoellig, Marco Hutter, Simon Le Cleac'H, Jan Brüdigam

机构 * RAI Institute(RAI研究所) Technical University of Munich(慕尼黑工业大学) ETH Zurich(苏黎世联邦理工学院)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 本研究利用仿真中SMPC生成的离线数据,结合稀疏奖励训练离策略RL智能体,整合动态稳定性控制器,实现机器人移动操作技能的仿真到真实迁移,性能超越原最优控制方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11415 2026-08-13 cs.IR cs.AI 新提交 57%

TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs

TRACES:用于评估大型语言模型科学推理中认知可靠性的基准

Valentin Rodionov, Shamil Assylbekov

专题命中 规划决策 :agentic(abstract);分类 cs.AI

AI总结 该研究构建了名为TRACES的基准,发现30种大型语言模型在识别42篇不可靠科学论文的认知可靠性时表现不佳,仅少数模型能有效拒绝有缺陷前提,凸显科学部署需护栏。

Comments 16 pages + appendices. 4 figures in the main text

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11247 2026-08-13 cs.AI cs.MA 新提交 57%

Conformity Mitigations in Large Language Models Lie on a Single Resistance-Receptivity Frontier

大语言模型中的从众效应缓解措施存在于单一的抵抗-接受边界上

Zafar Hussain, Kristoffer Nielbo

机构 * Aarhus University(奥胡斯大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 该研究针对大语言模型的从众效应,提出抵抗-接受双维度评估,发现多数缓解措施存在此消彼长的边界,仅Reasoning可同时提升抵抗性与接受性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20781 2026-08-13 cs.AI cs.CY econ.GN q-fin.EC 版本更新 57%

The Human-AI Substitution Principle: When will you be replaced by AI in your organization?

人类-人工智能替代原则:在你的组织中,你何时会被人工智能取代?

Bonny Banerjee, Shreya Singh

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 研究人类员工何时被人工智能取代,提出HAT分析模型,编码人类技能与人工智能能力的经济不对称,推导多因素对人机替代的影响,得出替代原则,揭示其引发的组织变化及中层管理与高技能工人的脆弱性,统一相关理论。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21112 2026-08-13 cs.CV cs.AI cs.RO 版本更新 57%

LiDAR-based 3D Change Detection at City Scale

基于LiDAR的城市级三维变化检测

Hezam Albaqami, Haitian Wang, Xinyu Wang, Muhammad Ibrahim, Zainy M. Malakan, Abdullah M. Algamdi, Mohammed H. Alghamdi, Ajmal Mian

机构 * Department of Computer Science and Artificial Intelligence, University of Jeddah(计算机科学与人工智能系,朱德亚大学) Department of Computer Science and Software Engineering, University of Western Australia(计算机科学与软件工程系,西澳大学) Department of Data Science, Umm Al-Qura University(数据科学系,乌姆·阿勒·卡拉大学) Department of Information and Technology Systems, College of Computer Science and Engineering, University of Jeddah(信息与技术系统系,计算机科学与工程学院,朱德亚大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文提出了一种基于LiDAR的城市级三维变化检测方法,通过多分辨率NDT和ICP对齐数据,结合语义分割和双分匹配优化,实现了高精度的变化检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11866 2026-08-13 stat.AP 新提交 50%

Urban logistics dynamics: a user-centric approach to traffic modelling and kinetic parameter analysis

城市物流动力学:以用户为中心的交通建模与动力学参数分析方法

Emilienne Lardy, Eric Ballot, Mariam Lafkihi

专题命中 规划决策 :planning(abstract)

AI总结 本研究从用户视角出发,以城市物流交通动力学为研究对象,通过因子分析与广义线性模型,基于时间等外生因素预测车辆动力学行为,为城市物流交通建模提供了以用户为中心的方法。

Journal ref International Conference on Urban Traffic Congestion, Jul 2024, Paris, France

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12051 2026-08-13 cs.CV 新提交 50%

Do Not Forget the Obvious - RISC: A Risk-Informed Slice-Coverage Protocol for Safe Autonomous Driving

勿忽视显而易见的内容——RISC:一种用于安全自动驾驶的风险感知切片覆盖协议

Fabian Hüger

机构 * CARIAD SE

专题命中 规划决策 :planning(abstract)

AI总结 该研究提出RISC协议,将安全问题转化为风险切片,通过风险引导选择提升自动驾驶关键故障发现率,可应用于多类自动驾驶子系统,补充现有测试验证流程。

Comments 14 pages, 3 figures, 5 tables. Accepted at the ECCV 2026 Workshop on Safe and Defensive Autonomous Driving (SDAD). Non-archival workshop paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11870 2026-08-13 cs.RO 新提交 50%

Enhancing Visual Domain Robustness in Behaviour Cloning via Saliency-Guided Augmentation

通过显著性引导增强提升行为克隆中的视觉域鲁棒性

Zheyu Zhuang, Ruiyu Wang, Nils Ingelhag, Ville Kyrki, Danica Kragic

机构 * KTH Royal Institute of Technology(皇家理工学院) Aalto University(阿尔托大学)

专题命中 规划决策 :agent(abstract)

AI总结 该研究针对行为克隆中常规增强方法应对视觉域偏移效果差的问题,提出RoboSaGA显著性引导增强方法,提升了模型的视觉域鲁棒性且保留了域内性能。

Comments Accepted at the Conference on Robot Learning (CoRL) 2024

Journal ref CoRL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11641 2026-08-13 eess.SY cs.RO cs.SY 新提交 50%

Energy-Aware Wind-Resilient Routing for Truck-Assisted Multi-UAV Delivery under Wind Uncertainty

面向风况不确定性下卡车辅助多无人机配送的能量感知抗风路由算法

Tianshun Li, Yanggang Sheng, Hongliang Lu, Zhongzhen Wang, Haoang Li, Xinhu Zheng

专题命中 规划决策 :planning(abstract)

AI总结 针对卡车辅助多无人机配送的风况不确定性与能量安全问题,提出EWR在线规划框架,通过时变能量图优化路由,提升任务成功率并减少风致返回失败。

详情

展开后加载摘要…

URL PDF HTML 收藏