Learning to Plan, Planning to Learn: Adaptive Hierarchical RL-MPC for Sample-Efficient Decision Making
学习与规划:自适应分层RL-MPC用于样本高效决策
Toshiaki Hori, Jonathan DeCastro, Deepak Gopinath, Avinash Balachandran, Guy Rosman
机构
*
Toyota Research Institute(丰田研究院)
;
Learning to Plan, Planning to Learn: Adaptive Hierarchical RL-MPC for Sample-Efficient Decision Making(学习规划,规划学习:自适应分层RL-MPC用于样本高效决策)
Benchmarking Classical Coverage Path Planning Heuristics on Irregular Hexagonal Grids for Maritime Coverage Scenarios
在不规则六边形网格上评估经典覆盖路径规划启发式方法的基准测试:用于海洋覆盖场景
Carlos S. Sepúlveda, Gonzalo A. Ruz
机构
*
Facultad de Ingeniería y Ciencias, Universidad Adolfo Ibáñez(工程与科学学院,阿道弗·伊巴涅斯大学)
;
Dirección de Programas, Investigación y Desarrollo, Armada de Chile(智利海军计划、研究与开发 Directorate)
;
Millennium Nucleus for Social Data Science (SODAS)(社会科学数据科学千年核基金(SODAS))
;
Millennium Nucleus in Data Science for Plant Resilience (PhytoLearning)(植物韧性数据科学千年核基金(PhytoLearning))
机构
*
ISI Laboratory, National School of Applied Sciences (ENSA), Abdelmalek Essaadi University(阿德莱尔梅萨迪大学应用科学学院智能研究所)
;
EsieaLab LDR, Higher School of Computer Science, Electronics and Automation (ESIEA)(高等计算机科学、电子与自动化学校)
Trajectory Planning for a Multi-UAV Rigid-Payload Cascaded Transportation System Based on Enhanced Tube-RRT*
基于增强型管状RRT*的多无人机刚性载荷级联运输系统轨迹规划
Jianqiao Yu, Jia Li, Tianhua Gao
机构
*
School of Aerospace Science and Technology, Beijing Institute of Technology(航天科学与技术学院,北京理工大学)
;
Graduate School of Systems and Information Engineering, University of Tsukuba(系统与信息工程研究生院,筑波大学)
Comments15 pages, 7 figures. Under review at IEEE Transactions on Aerospace and Electronic Systems (TAES). This work has been submitted to the IEEE for possible publication
AI4S-SDS: A Neuro-Symbolic Solvent Design System via Sparse MCTS and Differentiable Physics Alignment
AI4S-SDS: 一种基于稀疏MCTS和可微物理对齐的神经符号溶剂设计系统
Jiangyu Chen
机构
*
State Key Laboratory for Novel Software Technology at Nanjing University(南京大学新型软件技术国家重点实验室)
;
School of Computer Science, Nanjing University(南京大学计算机科学学院)
;
Suzhou Laboratory(苏州实验室)
Foresight Optimization for Strategic Reasoning in Large Language Models
为大语言模型中的战略推理进行前瞻性优化
Jiashuo Wang, Jiawen Duan, Jian Wang, Kaitao Song, Chunpu Xu, Johnny K. W. Ho, Fenggang Yu, Wenjie Li, Johan F. Hoorn
机构
*
Department of Computing, Hong Kong Polytechnic University(香港理工大学计算机系)
;
Department of Language Science and Technology, Hong Kong Polytechnic University(香港理工大学语言科学与技术系)
;
Apple(苹果公司)
;
School of Design, Hong Kong Polytechnic University(香港理工大学设计学院)
;
Research Institute for Quantum Technology, Hong Kong Polytechnic University(香港理工大学量子技术研究所)
;
Department of Communication Science, Vrije Universiteit Amsterdam(阿姆斯特丹自由大学传播科学系)
In Context Learning and Reasoning for Symbolic Regression with Large Language Models
在大型语言模型中进行上下文学习和推理以实现符号回归
Samiha Sharlin, Tyler R. Josephson
机构
*
Department of Chemical, Biochemical, and Environmental Engineering, University of Maryland Baltimore County(化学、生物化学与环境工程系,马里兰大学巴尔的摩县分校)
;
Department of Computer Science and Electrical Engineering, University of Maryland Baltimore County(计算机科学与电气工程系,马里兰大学巴尔的摩县分校)
机构
*
National University of Singapore(新加坡国立大学)
;
Nankai University(南开大学)
;
Sichuan University(四川大学)
;
School of Artificial Intelligence, Beihang University(北航人工智能学院)
;
Beijing Advanced Innovation Center for Future Blockchain and Privacy Computing(北京未来区块链与隐私计算高级创新中心)
;
Key Laboratory of Mathematics, Informatics and Behavioral Semantics (LMIB)(数学、信息学与行为语义学重点实验室(LMIB))
;
Engineering Research Center of Machine Learning and Industry Intelligence, Ministry of Education, China(教育部机器学习与工业智能工程研究中心,中国)
专题命中
规划决策
:planning(abstract);分类 cs.AI、cs.CL
AI总结
METRO 通过大规模语言模型从原始 transcripts 自动诱导策略动作和规划逻辑,提出策略森林结构,实验显示其在两个基准上性能优越,具有跨任务迁移能力。
Blue Data Intelligence Layer: Streaming Data and Agents for Multi-source Multi-modal Data-Centric Applications
蓝色数据智能层:面向多源多模态数据导向应用的流数据与智能体
Moin Aminnaseri, Farima Fatahi Bayat, Nikita Bhutani, Jean-Flavien Bussotti, Kevin Chan, Rafael Li Chen, Yanlin Feng, Jackson Hassell, Estevam Hruschka, Eser Kandogan, Hannah Kim, James Levine, Seiji Maekawa, Jalal Mahmud, Kushan Mitra, Naoki Otani, Pouya Pezeshkpour, Nima Shahbazi, Chen Shen, Dan Zhang
BarrierBench: Evaluating Large Language Models for Safety Verification in Dynamical Systems
BarrierBench: 评估大型语言模型在动态系统安全验证中的性能
Ali Taheri, Alireza Taban, Sadegh Soudjani, Ashutosh Trivedi
机构
*
Isfahan University of Technology(伊斯法罕技术大学)
;
Max Planck Institute for Software Systems(马克斯·普朗克软件系统研究所)
;
University of Colorado Boulder(科罗拉多大学博尔德分校)
TrigReason: Trigger-Based Collaboration between Small and Large Reasoning Models
TrigReason:基于触发的大小推理模型协作
Yi Zhao, Yajuan Peng, Cam-Tu Nguyen, Zuchao Li, Xiaoliang Wang, Xiaoming Fu, Hai Zhao
机构
*
AGI Institute, School of Computer Science, Shanghai Jiao Tong University, Shanghai, China(AGI研究院,计算机科学学院,上海交通大学,上海,中国)
;
Key Laboratory of Shanghai Education Commission for Intelligent Interaction and Cognitive Engineering, Shanghai Jiao Tong University, Shanghai, China(上海市教育委员会智能交互与认知工程重点实验室,上海交通大学,上海,中国)
;
Shanghai Key Laboratory for Intelligent Information Processing, Fudan University(上海市智能信息处理重点实验室,复旦大学)
;
State Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学)
;
School of Artificial Intelligence, Wuhan University(人工智能学院,武汉大学)
;
Institute of Computer Science, University of Göttingen, Göttingen, Germany(计算机科学研究所,哥廷根大学,哥廷根,德国)