arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Harvard University(哈佛大学)

2026-07-31 至 2026-07-31 共收录 3
2607.26434 2026-07-31 cs.RO cs.AI 版本更新

Reinforcement Learning on Cost-Constrained Quadrupedal Hardware

成本受限四足硬件上的强化学习

Javier C. Weddington, Bence P. Ölveczky, Stephen A. Baccus

机构 * Stanford University(斯坦福大学) Harvard University(哈佛大学) Stanford University School of Medicine(斯坦福大学医学院)

AI总结 该研究针对低成本四足硬件的仿真-现实差距,采用生物启发方法,结合延迟前向模型与时间感知神经网络,学习到鲁棒CPG,实现了成本受限硬件上的强化学习控制。

Comments Sim-to-real transfer, locomotion, reinforcement learning, central pattern generator

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10600 2026-07-31 cs.MA cs.AI cs.GT cs.LG 版本更新

Procedural Fairness in Multi-Agent Bandits

多智能体老虎机中的程序公平性

Joshua Caiata, Carter Blair, Kate Larson

机构 * University of Waterloo(滑铁卢大学) Harvard University(哈佛大学)

AI总结 本文提出程序公平性作为多智能体老虎机中的公平性目标,强调平等决策权和结果比例性,证明不同公平性观念优先不同价值观,主张加强程序公平性研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05254 2026-07-31 cs.LG 版本更新

When unlearning is free: leveraging low influence points to reduce computational costs

当删除变得免费:利用低影响点以减少计算成本

Anat Kleiman, Robert Fisher, Ben Deaner, Udi Wieder

机构 * Harvard University(哈佛大学) Kempner Institute(凯普纳研究所) University College London(伦敦大学学院) Apple(苹果公司)

AI总结 本文提出了一种高效删除框架,通过识别低影响点减少计算成本,提升删除效率。

详情

展开后加载摘要…

URL PDF HTML 收藏