arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

University of California, Berkeley(加州大学伯克利分校)

2026-03-12 至 2026-03-12 共收录 3
2603.10230 2026-03-12 math.OC cs.LG cs.NA math.NA stat.ML

A Trust-Region Interior-Point Stochastic Sequential Quadratic Programming Method

一种基于信任区域内点的随机序列二次规划方法

Yuchen Fang, Jihun Kim, Sen Na, James Demmel, Javad Lavaei

机构 * Department of Mathematics, University of California, Berkeley(加州大学伯克利分校数学系) Department of IEOR, University of California, Berkeley(加州大学伯克利分校工业工程与运营研究系) School of Industrial and Systems Engineering, Georgia Tech(佐治亚理工学院工业与系统工程学院) Department of EECS, University of California, Berkeley(加州大学伯克利分校电子工程与计算机科学系)

AI总结 本文提出了一种针对随机目标函数和确定性非线性约束的优化方法,结合信任区域内点和随机序列二次规划技术,实现全局收敛性保证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00915 2026-03-12 cs.LG cs.RO

Partially Equivariant Reinforcement Learning in Symmetry-Breaking Environments

部分等价强化学习在对称破坏环境中

Junwoo Chang, Minwoo Park, Joohwan Seo, Roberto Horowitz, Jongmin Lee, Jongeun Choi

机构 * School of Mechanical Engineering, Yonsei University, Seoul, South Korea(延世大学机械工程学院,首尔,韩国) Department of Artificial Intelligence, Yonsei University, Seoul, South Korea(延世大学人工智能系,首尔,韩国) Department of Mechanical Engineering, University of California, Berkeley, United States(加州大学伯克利分校机械工程系,美国)

AI总结 本文提出部分等价强化学习框架,通过选择性应用群不变或标准贝尔曼备份,提升样本效率和泛化能力,适用于对称破坏环境的离散和连续控制任务。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14255 2026-03-12 cs.RO

A Chain-Driven, Sandwich-Legged Quadruped Robot: Design and Experimental Analysis

链驱动、夹层腿四足机器人:设计与实验分析

Aman Singh, Bhavya Giri Goswami, Ketan Nehete, Shishir N. Y. Kolathaya

机构 * Department of Cyber Physical Systems, Indian Institute of Science(印度科学研究院计算机物理系统系) University of Waterloo(滑铁卢大学) UC Berkeley(伯克利大学)

AI总结 本文提出了一种低成本、高性能的四足机器人,通过夹层腿结构和双电机配置实现敏捷运动,同时采用低成本制造方法和开源设计,为四足机器人研究提供了一个经济且实用的平台。

Comments 6 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏