arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-15 至 2026-07-15 共收录 40 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 40 篇

2509.21842 2026-07-15 cs.AI 版本更新 90%

DeepTravel: An End-to-End Agentic Reinforcement Learning Framework for Autonomous Travel Planning Agents

深度旅行:用于自主旅行规划智能体的端到端智能强化学习框架

Yansong Ning, Rui Liu, Jun Wang, Kai Chen, Wei Li, Jun Fang, Kan Zheng, Naiqiang Tan, Hao Liu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Didichuxing Co. Ltd(滴滴出行有限公司)

专题命中 规划决策 :planning(title,abstract);agentic(title,abstract);agent(abstract);workflow(abstract)

AI总结 研究针对旅行规划智能体灵活性和自主性不足问题,提出深度旅行框架,通过构建旅行沙盒、开发分层奖励建模系统及回复增强强化学习方法,使训练后的智能体在行程生成准确率和性能上表现出色。

Comments KDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19186 2026-07-15 cs.RO cs.AI cs.FL 版本更新 85%

Real-Time Model Checking for Closed-Loop Robot Reactive Planning

闭环机器人反应式规划的实时模型检查

Christopher Chandler, Bernd Porr, Giulia Lafratta, Alice Miller

机构 * School of Computing Science University of Glasgow Glasgow Scotland UK(计算科学学院格拉斯哥大学格拉斯哥苏格兰英国) School of Biomedical Engineering University of Glasgow Glasgow Scotland UK(生物医学工程学院格拉斯哥大学格拉斯哥苏格兰英国) University of Glasgow(格拉斯哥大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract);autonomous agent(abstract);分类 cs.AI

AI总结 研究利用模型检查让自主机器人实现反应式多步规划与避障,特制算法基于生物知识实时原位生成规划,通过链式系统和临时快照减轻状态空间爆炸,实验证明方法有效且性能提升,为自动驾驶导航发展提供案例,适用于关键任务移动机器人。

Comments 41 pages excluding references, 21 figures, submitted to Formal Aspects of Computing

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12634 2026-07-15 cs.LG cs.AI cs.CL 版本更新 85%

Keep Policy Gradient in Charge: Sibling-Guided Credit Distillation for Long-Horizon Tool-Use Agents

保持策略梯度主导:面向长程工具使用智能体的兄弟引导信用蒸馏

Tianyu Ding, Jianhong Xin, Juan Pablo De la Cruz Weinstein

机构 * Amazon Web Services(亚马逊云服务)

专题命中 规划决策 :tool-use(title,abstract);tool use(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 针对长程工具使用强化学习中轨迹级优势信号稀疏的问题,提出兄弟引导信用蒸馏(SGCD),通过动态采样成功与失败轨迹、外部LLM对比生成逐步信用参考,实现密集信用分配,在AppWorld和τ³-airline任务上显著提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13034 2026-07-15 cs.AI cs.CL cs.SE cs.SY eess.SY 新提交 82%

Do AI Agents Know When a Task Is Simple? Toward Complexity-Aware Reasoning and Execution

人工智能代理知道任务何时简单吗?迈向复杂性感知推理与执行

Junjie Yin, Xinyu Feng

专题命中 规划决策 :AI agent(title);agent(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 研究探讨LLM代理缺乏任务感知执行范围估计能力,提出E3方法,在MSE-Bench基准测试及真实模型工具中验证,该方法能在保证成功率时大幅降低成本,推动迈向工程基础人工智能,还发布了框架和基准。

Comments 27 pages, 8 figures, 8 tables. Code and benchmark: https://github.com/eejyin/Do-AI-Agents-Know-When-a-Task-Is-Simple-Toward-Complexity-Aware-Reasoning-and-Execution

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09224 2026-07-15 cs.SE cs.AI cs.CL 版本更新 82%

Git-Assistant: Planning-Based Support for Updating Git Repositories

Git辅助工具:基于规划的Git仓库更新支持

Alfredo Garrachón Ruiz, Tomás de la Rosa, Daniel Borrajo

机构 * AI Research, JPMorganChase(人工智能研究,摩根大通)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 研究针对git工具对开发者有挑战的问题,提出结合大语言模型与自动规划的Git-Assistant,经合成和随机git环境评估,证明该方法能提升仓库管理可靠性、减少错误,展现混合人工智能方法在开发者辅助上的潜力。

Comments Pending permissions from the private company

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12177 2026-07-15 cs.AI cs.CV 新提交 79%

The Emerging Paradigm of Geospatial Foundation Models: From Pre-Training to Agentic Reasoning

地理空间基础模型的新兴范式:从预训练到智能推理

Shelley Cazares

机构 * Google Public Sector(谷歌公共部门)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 研究地理空间基础模型的新兴范式,通过职责分离实现预训练与特定任务微调,探讨不同类型模型能力及实现考虑因素,提出模型适应策略分类法和框架,展望智能地理空间推理推动领域从感知到认知的发展。

Comments 18 pages, 4 figures. To appear in Lecture Notes in Computer Science (LNCS)

Journal ref Lecture Notes in Computer Science, Vol. 16446 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12122 2026-07-15 cs.LG 新提交 79%

An Agentic AI Scientific Community for Automated Neural Operator Discovery

用于自动神经算子发现的智能体人工智能科学社区

Luis Loo, Ulisses Braga-Neto

机构 * Texas A&M University(德克萨斯农工大学)

专题命中 规划决策 :agentic(title,abstract);分类 cs.LG

AI总结 该研究基于人工智能科学社区提出智能体方法用于自动神经算子发现,通过虚拟实验室中三个智能体协作,共享通用词汇表,在五个问题上评估,能发现高精度低参数架构,揭示语言模型智能体对保持多样性的作用及神经算子无免费午餐定理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28583 2026-07-15 cs.CV cs.AI cs.MM 版本更新 79%

Navigating the Mirage: A Dual-Path Agentic Framework for Robust Misleading Chart Question Answering

穿越幻象:一种双路径代理框架用于鲁棒的误导图表问答

Yanjie Zhang, Yafei Li, Rui Sheng, Zixin Chen, Yanna Lin, Huamin Qu, Lei Chen, Yushi Sun

机构 * The Hong Kong University of Science and Technology(香港科技大学)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 本文提出ChartCynics双路径框架,通过分离感知与验证,利用诊断视觉路径和OCR驱动数据路径解决图表误导问题,提升模型鲁棒性。

Comments 10pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12764 2026-07-15 cs.CV 新提交 78%

EvoGraph-R1: Self-Evolving Multimodal Knowledge Hypergraphs for Agentic Retrieval

EvoGraph-R1:用于智能检索的自进化多模态知识超图

Jiashi Lin, Changhong Jiang, Xiangru Lin, Ruifei Zhang, Xinyi Zhu, Jiyao Liu, Cheng Tang, Ye Du, Shujian Gao, Junzhi Ning, Lihao Liu, Ziyan Huang, Tianbin Li, Jin Ye, Junjun He

机构 * Northwestern Polytechnical University(西北工业大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) The University of Hong Kong(香港大学) Monash University(莫纳什大学) The Chinese University of Hong Kong (Shenzhen)(香港中文大学(深圳))

专题命中 规划决策 :agentic(title);agent(abstract)

AI总结 研究针对现有GraphRAG方法将知识图视为静态数据结构的局限,提出EvoGraph-R1自进化框架,把检索建模为MDP,智能体通过多种操作使超图结构进化以支持多跳推理,实验证明该方法在多模态问答基准测试中大幅优于现有基线。

Comments 10 pages main paper, 6 figures. CVPR 2026 accepted paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12732 2026-07-15 cs.RO 新提交 78%

Globalized Constrained Stein Variational Inference for Diverse Feasible Robot Motion Planning

用于多样化可行机器人运动规划的全局约束斯坦变分推理

Jiayun Li, Georgia Chalvatzaki

机构 * PEARL Lab, Dept. of Computer Science, TU Darmstadt(珍珠实验室,达姆施塔特工业大学计算机科学系) Robotics Institute Germany (RIG)(德国机器人研究所)

专题命中 规划决策 :planning(title,abstract)

AI总结 研究机器人运动规划多模态问题,提出SteinSQP方法,通过约束斯坦变分推理演化粒子集合,用无矩阵原始对偶算法解决子问题,引入优点函数全局化方法,在多任务中表现良好,收敛快且可行性高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12423 2026-07-15 cs.RO 新提交 78%

Model-Based Diffusion Optimal Control for Multi-Robot Motion Planning

基于模型的扩散最优控制用于多机器人运动规划

Zhilin He, Yorai Shaoul, Jiaoyang Li

专题命中 规划决策 :planning(title,abstract)

AI总结 针对多机器人运动规划难题,介绍基于模型的扩散最优控制(MDOC),它不依赖数据,通过结合动力学模型与控制障碍函数约束投影,利用基于冲突搜索的安全机制,在模拟实验中展现出优于基线规划器的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12480 2026-07-15 cs.AI 新提交 74%

TRACE: An Operational Reasoning Schema for Auditable Agentic Commitments

TRACE:可审计的智能体承诺的操作推理模式

Edward Y. Chang, Emily J. Chang

机构 * Stanford University(斯坦福大学) Quadrivium AI(四元数人工智能)

专题命中 规划决策 :agentic(title);分类 cs.AI

AI总结 本文提出TRACE模式用于记录推理轨迹,通过字段和测试应对推理不在语言模型中的问题,给出参考程序和操作规范,借助记录-消费者契约形成操作接口,通过示例展示应用,贡献了模式及其契约。

Comments 46 pages, 18 tables, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12178 2026-07-15 eess.SY cs.SY 新提交 71%

Dynamically Feasible Planning and Control in Complex Environments: a Scalable Systematic Approach

复杂环境下的动态可行规划与控制:一种可扩展的系统方法

Miguel Castroviejo-Fernandez, Ilya Kolmanovsky

专题命中 规划决策 :planning(title)

AI总结 针对受非凸约束的线性离散时间系统,提出生成安全集的方法及参考调节器,能保证系统安全与参考命令收敛,在线计算开销低,特定情况下安全集计算高效,通过仿真验证了方法的适用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12130 2026-07-15 cs.RO 新提交 71%

More than a Manipulator: Planning Propellant-Free Attitude Maneuvers for Free-Floating Spacecraft

不仅仅是一个操纵器:为自由漂浮航天器规划无推进剂姿态机动

Harsh G. Bhundiya, Avi Soval, Keenan Albee

机构 * University of Southern California(南加州大学)

专题命中 规划决策 :planning(title)

AI总结 研究利用机器人操纵器运动进行自由漂浮航天器无推进剂姿态控制,通过制定带约束的轨迹优化问题求解,展示多种系统轨迹,经与反作用轮阵列比较,证明其可作冗余或主要姿态控制系统,为空间应用提供框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12113 2026-07-15 cs.DC cs.AI 新提交 70%

Toward Trustworthy Autonomous Science: A Two-Year Community Roadmap

迈向可信自主科学:两年社区路线图

Rafael Ferreira da Silva, Milad Abolhasani, Peter Beaucage, Laura Biven, Michael Bussmann, Kyle Chard, Ryan Coffee, Stephen DeWitt, Sagar Dolas, Carrie Eckert, David Elbert, Ian Foster, Tirthankar Ghosal, Anna Giannakou, Tom Gibbs, Leslie Hamilton, Glenn Lockwood, Theresa Mayer, Ben Mintz, Raffi Nazikian, Sal Nimer, Amanda Randles, Woong Shin, Sreenivas Rangan Sukumar, Frédéric Suter, Mitra Taheri, Michela Taufer, Draguna Vrabie

机构 * U.S. Department of Energy, Office of Science, Office of Advanced Scientific Computing Research(美国能源部科学办公室高级科学计算研究办公室)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 该研究针对自主科学领域发展现状及问题,更新路线图围绕七个维度,评估原有里程碑并新增四个,规划两年发展路径,第一年聚焦接口等搭建验证框架,第二年针对联盟等,强调基层网络的互操作性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23276 2026-07-15 cs.LG cs.MA 版本更新 70%

Auditable Context-Aware HFMD Forecasting with Structured LLM Agents

基于结构化大语言模型代理的可审计上下文感知手足口病预测

Joongwon Chae, Runming Wang, Chen Xiong, Gong Yunhan, Lian Zhang, Ji Jiansong, Dongmei Yu, Peiwu Qin

机构 * Institute of Biomedicine and Health Engineering, Tsinghua Shenzhen International Graduate School (SIGS), Tsinghua University, Shenzhen, China(清华大学深圳国际研究生院生物医学与健康工程学院) The Fifth Affiliated Hospital of Wenzhou Medical University, Lishui 323000, China(温州医科大学第五附属医院) Hengqin Laboratory, Zhuhai, China(横琴实验室) The First Hospital of Hebei Medical University, Shijiazhuang, China(河北医科大学第一医院)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.LG

AI总结 研究针对手足口病预测,提出双代理神经符号框架,由基于大语言模型的事件解释器和预测生成器组成,通过摄取异构信号并结合历史病例数进行预测,在两个数据集评估中实现有竞争力的点准确性、可靠区间及可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12497 2026-07-15 cs.CV 新提交 69%

TerraLogic: A Benchmark for Hierarchical Geospatial Reasoning in Earth Observation

TerraLogic:地球观测中分层地理空间推理的基准

Yuhang Yan, Linchao Mou, Bokang Yang, Qingyu Li

机构 * The Chinese University of Hong Kong (Shenzhen)(香港中文大学(深圳)) Technical University of Munich(慕尼黑工业大学)

专题命中 规划决策 :agent(abstract,comments);planning(abstract)

AI总结 针对遥感中认知地理空间推理研究不足的问题,引入TerraLogic基准及HieraPlan工具增强智能体,通过545个任务推动评估向认知级发展,实验显示HieraPlan在分层地理空间推理上表现出色,为相关研究提供强大基线。

Comments 8 pages, 3 figures, and 7 tables. Dataset and agent code are available at https://github.com/Ireliya/TerraLogic

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12680 2026-07-15 cs.CV 新提交 67%

ReflectVLN: Training Vision-Language Navigation Agents with Reflective Reasoning

ReflectVLN:通过反思推理训练视觉语言导航智能体

Jiahang Wang, Yirong Yang, Yanqing Zhu, Minghua Luo, Shichao Xie, Fei Liu, Mu Xu

机构 * Amap, Alibaba Group(高德软件有限公司,阿里巴巴集团) Beihang University(北京航空航天大学)

专题命中 规划决策 :agent(abstract);agentic(abstract)

AI总结 研究针对现有视觉语言导航方法缺乏闭环机制问题,提出ReflectVLN框架,通过双向交互智能体决策,引入行动思维链训练方案,实验证明该框架在有限数据下提升成功率和路径效率,且具良好训练成本与可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17253 2026-07-15 cs.AR 版本更新 67%

PDAGENT-BENCH: Characterizing, Grounding, and Architecting LLM/VLM Agents for VLSI Physical Design

PDAGENT-BENCH: 用于VLSI物理设计的LLM代理的特征化、基础化与架构化

Qiufeng Li, Rongqian Chen, Quan Cheng, Chengxuan Wang, Sizhe Tang, Chia-Tung Ho, David Z. Pan, Tian Lan, Weidong Cao

专题命中 规划决策 :workflow(abstract);agentic(abstract)

AI总结 提出PDAGENT-BENCH基准,用于评估LLM/VLM代理在VLSI物理设计中的能力,涵盖任务级和工作流级评估,揭示模型在工具执行和长程推理上的局限,并验证人类技能增强工作流的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16726 2026-07-15 cs.MA 版本更新 67%

Bridging Individual and Collective Realism in LLM-Based Human Mobility Simulation via Mobility Scaling-Law Guidance

通过共享数据中的移动度量引导基于LLM的人群移动模拟

Hua Yan, Heng Tan, Yu Yang

专题命中 规划决策 :agent(abstract);planning(abstract)

AI总结 M2LSimu通过共享数据中的移动度量引导多提示调整,有效提升基于LLM的人群移动模拟的群体协调与真实性

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12631 2026-07-15 cs.CL cs.AI 新提交 62%

Can Induced Emotion Bias LLM Behaviors in Sequential Decision Making?

诱导情绪会影响大语言模型在序列决策中的行为吗?

Minh Khoi Ho, Zihao Zhu, Runchuan Zhu, Levina Li, Zhiwen Fan, Zhangyang Wang, Junyuan Hong

机构 * MBZUAI(穆罕默德·本·扎耶德人工智能大学) Texas A&M University(德州农工大学) National University of Singapore(新加坡国立大学) UCLA(加州大学洛杉矶分校) University of Texas at Austin(德克萨斯大学奥斯汀分校) Mass General Hospital(麻省总医院) Harvard Medical School(哈佛医学院)

专题命中 规划决策 :autonomous agent(abstract);分类 cs.AI、cs.CL

AI总结 研究探讨诱导情绪对大语言模型在序列决策中行为的影响,采用爱荷华赌博任务结合情绪诱导程序,发现诱导情绪平均不显著影响其决策动态,但愤怒有条件地影响决策,揭示了与人类行为的差异,为相关研究提供工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12111 2026-07-15 cs.LG cs.AI cs.DC cs.MA cs.NI 新提交 62%

PFAdapter: Hierarchical LoRA Decomposition for Personalized Federated MLLMs

PFAdapter:用于个性化联邦多模态大语言模型的分层LoRA分解

Jing Liu, Kun Yang, Yan Wang, Dingkang Yang, Xiaoshuai Hao, Wei Zhang, Yang Liu, Wei Zhou

机构 * College of Future Information Technology, Fudan University(复旦大学未来信息技术学院) Division of Natural and Applied Sciences, Duke Kunshan University(昆山杜克大学自然科学与应用科学部) Department of Electrical and Computer Engineering, The University of British Columbia(英属哥伦比亚大学电气与计算机工程系) Ant Group(蚂蚁集团) College of Information Science and Electronic Engineering, Zhejiang University(浙江大学信息科学与电子工程学院) School of Data Science and Engineering, East China Normal University(华东师范大学数据科学与工程学院) College of Intelligent Robotics and Advanced Manufacturing, Fudan University & Fysics AI(复旦大学智能机器人与先进制造学院及复肆智能科技(上海)有限公司) Xiaomi EV, Xiaomi Campus(小米汽车、小米园区) Information and Communications Technology Cluster, Singapore Institute of Technology (SIT)(新加坡理工学院信息通信技术集群) College of Electronic and Information Engineering, Tongji University(同济大学电子与信息工程学院) School of Computer Science and Informatics, Cardiff University(卡迪夫大学计算机科学与信息学院)

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.LG

AI总结 针对分布式网络中联邦微调平衡全局知识与局部适应的挑战,提出PFAdapter框架,用分层LoRA分解将适配器参数分离,通过正交正则化和选择性聚合协议减少通信成本,实验证明该框架在多数据集上性能优于基线,为智能AI部署提供有效方案。

Comments submitted to IEEE TCCN

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05995 2026-07-15 cs.RO cs.AI cs.LG 版本更新 62%

TADPO: Reinforcement Learning Goes Off-road

TADPO:强化学习走向越野

Zhouchonghao Wu, Raymond Song, Vedant Mundheda, Luis E. Navarro-Serment, Christof Schoenborn, Jeff Schneider

机构 * Robotics Institute, School of Computer Science, Carnegie Mellon University(机器人研究所,计算机科学学院,卡内基梅隆大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 TADPO通过改进的策略梯度方法,首次在全规模越野平台上实现了基于强化学习的自动驾驶解决方案,能够应对复杂地形和低信号奖励环境。

Comments Accepted for Oral Presentation at ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16727 2026-07-15 cs.AI cs.LG 版本更新 62%

Mobility-Aware Cache Framework for Scalable LLM-Based Human Mobility Simulation

面向可扩展性的LLM基人类移动模拟移动感知缓存框架

Hua Yan, Heng Tan, Yingxue Zhang, Yu Yang

机构 * Lehigh University(莱维大学) State University of New York at Binghamton(纽约州立大学布法罗分校)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 MobCache通过移动感知缓存框架提升大规模LLM基人类移动模拟的效率和保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11949 2026-07-15 eess.IV cs.AI 新提交 57%

BAT-RM: A Boundary-Aware Transformer with Region-Aware Multi-Directional Mamba for Clinically Deployed Cervical Cancer Radiotherapy Auto-Contouring

BAT-RM:一种用于临床部署的宫颈癌放疗自动轮廓勾画的具有区域感知多向曼巴的边界感知变换器

Istiak Ahmed, Kazi Shahriar Sanjid, Galib Ahmed, Md. Tanzim Hossain, Md. Anwarul Islam, Shahrukh Khan, Md. Ashrif Rahman Arian, Md. Nishan Khan, Md. Misbah Khan, S M Hasibul Hoque, Rahnuma Shahrin Rista, Md. Jobairul Islam, Sheikh Anisul Haque, Md Arifur Rahman, Syed Md. Akram Hussain, Syeda Nashra, Sayeed Shafayet Chowdhury, Md. Mostafa Kamal Sarker, M. Monir Uddin

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 研究针对宫颈癌放疗自动轮廓勾画问题,提出BAT-RM混合架构,集成多种技术。该架构在多机构数据实验中性能卓越,提升了初级肿瘤学家的交并比并减少轮廓勾画时间,临床部署后缩短患者等待时间,体现了严格研究流程对患者的益处。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12856 2026-07-15 cs.LG 新提交 57%

Verifier-Based Reinforcement Fine-Tuning of Reasoning Models for Thermal Energy Storage Control

基于验证器的热能存储控制推理模型强化微调

Takumi Shioda, Kohei Terashima, Tatsuo Nagai

机构 * The University of Tokyo(东京大学) Tokyo University of Science(东京理科大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 研究针对建筑物热能存储控制中模型难以扩展的问题,采用基于可验证奖励的强化学习,通过强化微调训练开放权重推理模型,在简单办公楼TES基准测试中取得较好效果,明确了规划模式转移情况,推动了相关测试与验证器发展。

Comments 29 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12590 2026-07-15 eess.SY cs.LG cs.SY 新提交 57%

Environment Parameter Gradient Theorem for Policy-Environment Co-Design in Reinforcement Learning

强化学习中用于策略-环境协同设计的环境参数梯度定理

Amber Srivastava

机构 * Faculty of Mechanical Engineering, Indian Institute of Technology Delhi(机械工程系,印度理工学院德里)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 研究在环境可变的强化学习中联合优化策略与环境设计参数的问题,通过建立环境参数梯度定理及广义动作值函数,开发无模型算法,在无人机网络设计中证明可联合学习最优放置与路由以降低通信成本。

Comments 6 pages, 1 figure, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12775 2026-07-15 math.OC cs.LG cs.SY eess.SY 新提交 57%

Learning-enabled Acceleration of Scenario-based Model Predictive Control

基于学习的场景模型预测控制加速

Trinh Tran, Binh Nguyen, Truong X. Nghiem

机构 * Department of Electrical and Computer Engineering, University of Central Florida(电气与计算机工程系,中央佛罗里达大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 针对场景模型预测控制计算复杂的问题,提出学习加速的交替方向乘子法,通过重新表述问题、利用并行计算和莫罗包络学习加速求解,在微电网能量管理问题上评估,相比其他求解器有显著计算加速且保持控制性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04669 2026-07-15 cs.CR cs.SE 版本更新 57%

SoK: Post-Quantum Cryptography Implementation in Software: Approaches, Challenges and the PQC-HOT Framework

SoK:软件系统中的后量子密码学(PQC)实现

R. D. N. Shakya, C. P. Wijesiriwardana, S. M. Vidanagamachchi, Nalin A. G. Arachchilage

专题命中 规划决策 :planning(abstract);分类 cs.SE

AI总结 本文通过人类、组织和技术(HOT)维度系统综述后量子密码学在软件系统中的实现方法、挑战及相互关联的社会技术约束,并提出PQC-HOT概念模型以支持系统化决策和组织转型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12414 2026-07-15 econ.GN q-fin.EC 新提交 50%

Beyond Consistent Scenarios: Deriving Indirect Influence, Transition Resistance, and Adjustment Dynamics

超越一致情景:推导间接影响、转型阻力和调整动态

Andrew G. Ross, Julia Gershenzon, Andreas Kleefeld

专题命中 规划决策 :agent(abstract)

AI总结 研究能源转型等结构变化与经济转型动态评估问题,通过线性响应理论扩展交叉影响平衡(CIB),得出四个分析对象,应用于能源转型交叉影响矩阵得出相关结果,可转移至相关领域。

详情

展开后加载摘要…

URL PDF HTML 收藏