Hierarchical Reinforcement Learning for Air Combat at DARPA's AlphaDogfight Trials
在DARPA的AlphaDogfight试验中用于空战的分层强化学习
Adrian P. Pope, Jaime S. Ide, Daria Micovic, Henry Diaz, David Rosenbluth, Lee Ritholtz, Jason C. Twedt, Thayne T. Walker, Kevin Alcedo, Daniel Javorsek
机构
*
Primordial Labs
;
Lockheed Martin Artificial Intelligence Center, Applied AI Team(洛克希德·马丁人工智能中心,应用人工智能团队)
;
United States Air Force(美国空军)
Comments15 pages (main text) + 4 pages (supplementary material), 13 figures. This work has been accepted for publication in IEEE Transactions on Artificial Intelligence (IEEE-TAI). This replaces the previous conference-version presented at the 2021 International Conference on Unmanned Aircraft System (ICUAS 21), June 15-18, 2021, Athens, Greece
Journal refIEEE Transactions on Artificial Intelligence (IEEE-TAI), vol. 4, no. 6, pp. 1371-1385, 2023
SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems
SafeOR-Gym:用于实际运筹学问题的安全强化学习算法的基准套件
Asha Ramanujam, Adam Elyoumi, Hao Chen, Sai Madhukiran Kompalli, Akshdeep Singh Ahluwalia, Shraman Pal, Dimitri J. Papageorgiou, Can Li
机构
*
Davidson School of Chemical Engineering, Purdue University(普渡大学化学工程学院)
;
Energy Sciences, ExxonMobil Technology and Engineering Company(埃克森美孚技术与工程公司能源科学部)
机构
*
Department of Information and Computer Sciences, Saitama University(Saitama大学信息与计算机科学系)
;
Department of Electrical Engineering, Tokyo University of Science(东京科学大学电气工程系)
;
Department of Information Physics and Computing, The University of Tokyo(东京大学信息物理与计算系)
CoRL-MPPI: Enhancing MPPI With Learnable Behaviours For Efficient And Provably-Safe Multi-Robot Collision Avoidance
CoRL-MPPI: 通过可学习行为增强MPPI以实现高效且可证明安全的多机器人避障
Stepan Dergachev, Artem Pshenitsyn, Aleksandr Panov, Alexey Skrynnik, Konstantin Yakovlev
专题命中
模仿学习与强化学习
:navigation(abstract);分类 cs.RO
AI总结
CoRL-MPPI通过结合协同强化学习与MPPI,提升多机器人避障的效率与安全性。
CommentsComments: 8 pages, 6 figures. Substantially revised version. The manuscript, algorithm description, and figures have been extensively updated. The experimental evaluation has been redesigned with new scenarios, ablation study and an additional car-like motion model
Reinforcement Learning in the Real World: A Survey of Statistical Challenges and Future Directions
现实世界中的强化学习:统计挑战与未来方向综述
Asim H. Gazi, Yongyi Guo, Daiqi Gao, Ziping Xu, Kelly W. Zhang, Susan A. Murphy
机构
*
Department of Computer Science, Harvard University(哈佛大学计算机科学系)
;
Department of Statistics, University of Wisconsin–Madison(威斯康星大学麦迪逊分校统计学系)
;
Department of Statistics, Harvard University(哈佛大学统计学系)
;
School of Data Science and Society, University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校数据科学与社会学院)
;
Department of Mathematics, Imperial College London(伦敦帝国理工学院数学系)
Active Sensing with Meta-Reinforcement Learning for Emitter Localization from RF Observations
基于元强化学习的主动感知用于从射频观测定位发射源
M. Shamail J. Khan, Nisha L. Raichur, Lucas Heublein, Christian Wielenberg, Alexander Mattick, Tobias Feigl, Christopher Mutschler, Felix Ott
机构
*
Fraunhofer Institute for Integrated Circuits IIS(弗劳恩霍夫集成电路研究所)
;
Positioning Systems Lab, University of Technology Nürnberg (UTN)(定位系统实验室,图恩大学)
;
Center for Artificial Intelligence, Technical University of Applied Sciences Würzburg-Schweinfurt(人工智能中心,应用技术大学魏玛-施魏尔堡)
GrowthHacker: Automated Off-Policy Evaluation Optimization Using Code-Modifying LLM Agents
GrowthHacker: 使用代码修改型LLM代理的自动离线策略评估优化
Jie JW Wu, Ayanda Patrick Herlihy, Ahmad Saleem Mirza, Ali Afoud, Fatemeh Fard
机构
*
Michigan Technological University, Houghton(密歇根技术大学)
;
Birmingham City University(伯明翰城市大学)
;
University of British Columbia, Kelowna(不列颠哥伦比亚大学, 肯洛纳)
A Human-Sensitive Controller: Adapting to Human Musculoskeletal Disorder-Related Constraints via Reinforcement Learning
一种人类敏感控制器:通过强化学习适应人类肌肉骨骼疾病相关约束
Vitor Martins, Sara M. Cerqueira, Mercedes Balcells, Elazer R Edelman, Cristina P. Santos
机构
*
Fundação para a Ciência e Tecnologia(葡萄牙科学与技术基金会)
;
Centro de Microssistemas Eletromecânicos da Universidade do Minho(University of Minho微机电系统中心)
;
Massachusetts Institute of Technology(麻省理工学院)
;
Brigham and Women’s Hospital, Harvard Medical School(哈佛医学院布莱尔妇女医院)
;
GEVAB, IQS School of Engineering(GEVAB,IQS工程学院)
;
LABBELS-Associate Laboratory, University of Minho(University of Minho关联实验室)
GraphWalker: Agentic Knowledge Graph Question Answering via Synthetic Trajectory Curriculum
GraphWalker: 通过合成轨迹课程实现基于知识图谱的代理问答
Shuwen Xu, Yao Xu, Jiaxiang Liu, Chenhao Yuan, Wenshuo Peng, Jun Zhao, Kang Liu
机构
*
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
The Key Laboratory of Cognition and Decision Intelligence for Complex Systems, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所复杂系统认知与决策智能重点实验室)
;
Department of Electronic Engineering, Tsinghua University(清华大学电子工程系)