When Does Deep RL Beat Calibrated Baselines? A Benchmark Study on Adaptive Resource Control
深度强化学习何时超越校准基线?自适应资源控制的基准研究
机构 * University of California, Berkeley(加州大学伯克利分校) ; Stanford University(斯坦福大学) ; University of Toronto(多伦多大学)
AI总结 通过RLScale-Bench基准测试,发现校准的基于规则的自动缩放器在所有工作负载上成本均低于六种主流深度强化学习算法,并揭示了算法选择、基线校准和评估协议的关键瓶颈。