机构
*
Cybersecurity & Blockchain Research Group, i2CAT Foundation(网络安全与区块链研究组,i2CAT基金会)
;
Department of Information and Communication Technologies, Universitat Pompeu Fabra(信息与通信技术系,庞培法华大学)
Relational Multi-Agent Reinforcement Learning for Dynamic Pricing in High-Speed Railway Markets
面向高速铁路市场动态定价的关系型多智能体强化学习
Enrique Adrian Villarrubia-Martin, David Muñoz-Valero, Luis Rodriguez-Benitez, Giovanni Montana, Luis Jimenez-Linares
机构
*
Department of Technologies and Information Systems, Universidad de Castilla-La Mancha(卡斯蒂利亚-拉曼恰大学技术与信息系统系)
;
Warwick Manufacturing Group, University of Warwick(华威大学华威制造集团)
Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking
用于车联网资源分配的多智能体强化学习:通过基准测试解开多智能体强化学习挑战
Siyuan Wang, Lei Lei, Pranav Maheshwari, Sam Bellefeuille, Kan Zheng
机构
*
College of Engineering, University of Guelph(圭尔夫大学工程学院)
;
College of Electrical Engineering and Computer Sciences, Ningbo University(宁波大学电气与电子工程学院)
JaxMARL: Multi-Agent RL Environments and Algorithms in JAX
JaxMARL: JAX中的多智能体强化学习环境与算法
Alexander Rutherford, Benjamin Ellis, Matteo Gallici, Jonathan Cook, Andrei Lupu, Gardar Ingvarsson, Timon Willi, Ravi Hammond, Akbir Khan, Christian Schroeder de Witt, Alexandra Souly, Saptarashmi Bandyopadhyay, Mikayel Samvelyan, Minqi Jiang, Robert Tjarko Lange, Shimon Whiteson, Bruno Lacerda, Nick Hawes, Tim Rocktaschel, Chris Lu, Jakob Nicolaus Foerster
机构
*
University of Oxford(牛津大学)
;
Universitat Politècnica de Catalunya(巴塞罗那理工大学)
;
University College London(伦敦大学学院)
;
University of Maryland(马里兰大学)
;
Technical University Berlin(柏林技术大学)
CommentsPreprint. 4 figures, 1 algorithm, 5 tables. Systems paper with a preliminary six-session case study on four deployed applications; full benchmark protocol proposed, corpus run to appear in a later revision
Haejoon Lee, Vincent-Daniel Yun, Dimitra Panagou, Sai Praneeth Karimireddy
机构
*
Department of Robotics, University of Michigan, Ann Arbor, USA(密歇根大学机器人系,安娜堡,美国)
;
Thomas Lord Department of Computer Science, University of Southern California, USA(南加州大学计算机科学托马斯·劳德系,美国)
Multi-Agent Goal Recognition with Team- and Goal-Conditioned Reinforcement Learning and Factorized Branch-and-Bound
基于团队与目标条件强化学习和因子化分支定界的多智能体目标识别
Thiago Thomas, Gabriel de Oliveira Ramos, Felipe Meneguzzi
机构
*
Pontifícia Universidade Católica do Rio Grande do Sul (PUCRS)(里约格兰德杜斯阿伦斯天主教大学)
;
Universidade do Vale do Rio dos Sinos (Unisinos)(里约斯inos大学)
;
University of Aberdeen(阿伯丁大学)