arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

EPFL(洛桑联邦理工学院)

2026-07-16 至 2026-07-16 共收录 2
2607.14008 2026-07-16 cs.LG cs.AR 新提交

Lighthouse RL: Sample-Efficient Circuit Optimization via Strategic Reset Points

灯塔强化学习:通过策略性重置点实现样本高效的电路优化

Mustafa Emre Gürsoy, Stefan Uhlich, Ryoga Matsuo, Yağız Gençer, Arun Venkitaraman, Chia-Yu Hsieh, Andrea Bonetti, Eisaku Ohbuchi, Lorenzo Servadei

机构 * Sony Group Corporation(索尼集团公司) EPFL(洛桑联邦理工学院) Sony Semiconductor Solutions(索尼半导体解决方案公司) TU Munich(慕尼黑工业大学)

AI总结 研究针对模拟电路规模确定问题,提出灯塔强化学习方法,通过策略性重置策略,从高性能配置初始化情节引导探索,相比其他方法在样本效率、优化性能、通用性等方面显著提升,可增强基于强化学习的优化方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12363 2026-07-16 cs.RO cs.LG 版本更新

Pretraining in Actor-Critic Reinforcement Learning for Locomotion

在机器人运动强化学习中预训练Actor-Critic算法

Jiale Fan, Andrei Cramariuc, Tifanny Portela, Marco Hutter

机构 * Robotic Systems Lab, ETH Zürich(苏黎世联邦理工学院机器人系统实验室) Section of Microengineering, EPFL(日内瓦联邦理工学院微工程系) ETH AI Center(苏黎世联邦理工学院人工智能中心)

AI总结 本研究提出了一种在机器人运动强化学习中预训练Actor-Critic算法的方法,通过预训练模型提升样本效率和任务性能。

Comments Published in IEEE Robotics and Automation Letters (RA-L)

详情

展开后加载摘要…

URL PDF HTML 收藏